オーディオ駆動のオープンソースAIモデル。シネマティックな動画を生成します。
Open SourceaiVideo Generationaudio-drivencinematic
AI搭載ツールの包括的なコレクションを探索
オーディオ駆動のオープンソースAIモデル。シネマティックな動画を生成します。
Hugging Faceで利用できる無料のAIコード生成プレイグラウンド。
VRAMの使用量を大幅に削減しながら、LLMのファインチューニングを最大2倍高速化します。
Whisperを逆転させることで構築されたオープンソースのテキスト読み上げシステム
BuilderIOによる、エージェントネイティブなアプリケーションを構築するためのTypeScriptフレームワーク。
ブラウザ上で無料でコミュニティ学習済みのStable Diffusionコンセプトをテストできます。
OpenAIのWhisperモデルをオフラインで利用するための、高性能なC/C++ポート。
ファインチューニングされた拡散モデルを使用し、WebブラウザからAIアートを生成。
自然なTTS音声合成を実現するGoogleのエンドツーエンドニューラルネットワーク。
独自の2つの音声ミックス機能を備えた、無料のオープンソースTTSツール。
無料のオープンソースリアルタイム音声テキスト変換ディクテーションアプリ。
無料のオープンソースTTSおよび音声認識モデル。