GoogleのWaveNetテクノロジーを活用し、人間に迫る自然な音声を生成します。

AIで音楽、ナレーション、オーディオコンテンツを生成
GoogleのWaveNetテクノロジーを活用し、人間に迫る自然な音声を生成します。
AIでオリジナル音楽を作成:テキストプロンプトから曲、ビート、ボーカルを生成。
わずか5秒の音声サンプルから声をクローンし、リアルタイムで音声を生成します。
AIボイスクローニングを備えた、無料のオープンソーステキスト読み上げツール。
音声カスタマイズが可能な、無料で高品質なEdge TTSソリューション。
音声を英語テキストに文字起こし・翻訳する無料のAI音声ツール。
クリエイター向けの無料かつオープンソースなAIテキストから音声生成ツール。
クリエイター向けの無料でカスタマイズ可能なテキストから音声を生成するAIジェネレーター。
少数の音声データから声をクローン可能な、オープンソースの高品質なTTS(テキスト音声合成)ツール。
音声クローン機能を備えた無料でカスタマイズ可能なAIテキスト読み上げツール。
カスタム音声生成のためのオープンソーステキスト読み上げツール。
Hugging Faceで利用できる無料のテキストからHiFi 48kHz音声を生成するAIジェネレーター。
Webブラウザ上で直接、無料かつ瞬時にテキストから音声へ変換できます。
人間レベルの自然さを実現したエンドツーエンドのテキスト読み上げシステム。
Whisperを逆転させることで構築されたオープンソースのテキスト読み上げシステム
OpenAIのWhisperモデルをオフラインで利用するための、高性能なC/C++ポート。
独自の2つの音声ミックス機能を備えた、無料のオープンソースTTSツール。
無料のオープンソースリアルタイム音声テキスト変換ディクテーションアプリ。
無料のオープンソースTTSおよび音声認識モデル。
自然なTTS音声合成を実現するGoogleのエンドツーエンドニューラルネットワーク。
高品質なText-to-Speech(テキスト読み上げ)のためのオープンソースディープラーニングツールキット。
無料、オープンソース、プライバシー重視のオンデバイス音声認識(音声からテキスト変換)ツール。
プライベートかつCPUのみで推論可能な、純粋なC言語による音声認識(Speech-to-Text)ツール。
有名人やキャラクターのニューラルテキスト読み上げ(AI音声合成)を使って、楽しい音声を生成しましょう。
AI音声クローンおよびTTSテスト用のDockerized Coqui Barkツール。
セルフホスト可能な音声合成(TTS)および音声認識(STT)のための、オープンソースの統合API。
Hugging Face Spacesでホストされている、無料のオープンソーステキスト読み上げツール。
トップクラスのオープンソース音声認識モデルを比較・評価します。
高速な文字起こしを実現する、オープンソースのセルフホスト型音声認識API。
テキストの自動クレンジング機能を備えた、無料のウェブベースAI音声クローンツール。
ElevenLabs is an AI-powered audio and voice synthesis platform.
カスタムボイスクローン機能を備えた無料のAIテキスト読み上げジェネレーター。
Hugging FaceのオープンソースS2Sで、安全なローカルボイスエージェントを構築しましょう。
オーディオファイルから無音部分を自動的にカットできる無料のオンラインツール。