← Back to search
allmodels-io/hermes-speech|音声認識と音声合成を追加するプラグイン|GitHub
Kana & Mari's SoundRepos (Japanese) · 2026-09-19 · 2 min
Show full episode description
Hermes AgentにAllModels経由の音声合成TTSと音声認識STTを追加するプラグインです。音声ストリーミング、音声検索とプレビュー、モデルや音声の設定、アカウント登録、残高確認、チャージなどをHermesのCLIやTUI、デスクトップアプリから利用できます。 関連: allmodels-io/hermes-speech/音声認識と音声合成を追加するプラグイン/GitHub
✨ Episode Outline — click any point to jump to it in the episode
Problem solved
Hermes AgentにAll Models経由のTTSとSTTを追加依存なしで組み込み、音声選択から利用管理まで一箇所で扱えるようにする。
Benefits
- TTSとSTTを一つのプラグインでHermes Agentに追加
- CLI・TUI・デスクトップアプリから音声機能を利用可能
- 音声ストリーミングと声の検索・プレビューに対応
- アカウント登録・残高確認・チャージまで同じ場所で管理
- 追加のPythonパッケージ不要(同梱OpenAI+HTTPXで連携)
Use cases
- 声を検索してプレビュー試聴してから選ぶワークフロー
- Hermes同梱のOpenAIクライアントとHTTPXでAll Models APIと連携
- 音声利用状況の確認とチャージをHermes内で完結
- PyTestとRuffで開発時の検証を実施
KPIs / results
- GitHubスター約190
- Hermes Agent 0.2.0.0以降で動作
- 追加Pythonパッケージ0個
みんな音声合成と音声認識をHermes Agentに加えるプラグインKana & Maris SoundReposです。 All Models経由で声を使う方法を見ていきます。 取り上げるのはAll Models-ioのHermes Speechです。 All Modelsの音声モデルと声を使い、Hermes AgentにTTSとSTTを追加します。 文字を声にするだけでなく、話した内容を認識する入り口も同じ拡張で用意されるのですね。 どこから使えるのでしょうか? HermesのCLI、TUI、デスクトップアプリから利用できます。 音声ストリーミングと音声の検索やプレビューにも対応します。 検索して試しに聞いてから選べる流れですね。 モデルや声の設定も利用者が選べるのでしょうか? はい、モデルと音声を設定できます。 アカウント登録、残高確認、チャージも扱い、音声利用の管理までつながります。 声を探すところから利用状況の確認まで同じ場所で進められるのですね。 導入時の追加パッケージは必要ですか? 追加のPythonパッケージは不要です。 Hermes同梱のOpenAIとHTTPXでAll Models APIと連携し、Hermes Agent 0.2.0.0以降で動作します。 依存関係を増やさず音声機能を試せる構成ですね。 開発時の確認には何を使いますか? 開発時はPyTestとRafを使います。 実装言語はPythonで、ライセンスはMITライセンスです。 CLIに偏らず操作画面が異なる利用者にも届くのですね。 プレビューで声を先に確かめられるのも分かりやすいです。 GitHubのスターはおよそ190です。 音声入出力だけでなく、設定とアカウント管理まで扱う構成だと分かります。 認識と合成が別々の道具ではなく、Hermesの入り口から扱えるのですね。 対応条件を確認して試せそうです。 本日の確信を一文で、Hermes SpeechはHermes Agent 0.2.0.0以降に All Models経由のTTSとSTT、音声選択、利用管理を加えるPython製プラグインです。