pocket-tts
Pocket TTSは、GPUや音声生成Web APIを使わず、CPU上でテキストから音声を作る軽量なPython音声合成ツールです。Python APIまたはCLIから利用できます。
Xで共有ライセンス: MIT
概要
Pocket TTSは、GPUや音声生成Web APIに頼らず、CPUでテキストを音声に変換する軽量なPythonアプリケーションです。pipで導入し、Python APIまたはコマンドラインから文章を渡して音声を生成します。音声のストリーミング、声のクローン、英語・フランス語・ドイツ語・ポルトガル語・イタリア語・スペイン語・オランダ語に対応し、長いテキストも扱えます。
主な特長
- GPUや音声生成Web APIなしでCPU上で音声を生成
- Python APIまたはコマンドラインから利用
- 音声のストリーミングと長文の処理
- 声のクローンと7言語での音声生成
こんな人・用途に
CPU上でローカルに音声を生成したいPython開発者や利用者に向いています。GPUや音声生成Web APIを使いたくない場合に便利です。
- アップストリーム
- kyutai-labs/pocket-tts
- GitHubのフォーク
- Guo-astro/pocket-tts
- アップストリームのスター数
- 9.8k
- カテゴリ
- ドキュメント・メディア・コンテンツ
- 言語
- Python
- ライセンス
- MIT
- フォーク日
- 2026-10-09
- 同期状態
- 同期済み最終同期 2026-10-10
同じカテゴリ: ドキュメント・メディア・コンテンツ
動画や音声をローカルで編集・確認できるFFmpegツールキットです。コーディングエージェントからも直接利用でき、メディアのアップロードやAPIキーは不要です。
フォーク日 2026-10-04最終同期 2026-10-10ライセンス: MITドキュメント・メディア・コンテンツGitHub
深層学習の教科書を中国語で読むための資料で、読者の修正提案を集めて正確さを高めます。
フォーク日 2026-10-04最終同期 2026-10-10ライセンス表記なしドキュメント・メディア・コンテンツGitHub
Markdownを拡張し、論文、スライド、Webサイト、書籍、ナレッジベースを作れる組版システムです。
フォーク日 2026-09-28最終同期 2026-10-10ライセンス: GPL-3.0ドキュメント・メディア・コンテンツGitHub
Word、PowerPoint、Excel、PDFなど各種文書をきれいなMarkdownに変換する高速ライブラリです。Node.jsとPythonから使えます。
フォーク日 2026-09-28最終同期 2026-10-10ライセンス: MITドキュメント・メディア・コンテンツGitHub