Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
GitHubの音楽・音声AIリポジトリを毎日1本、約2分で紹介。TTS(音声合成)、MIDI、オーディオ処理など、「音」にまつわるオープンソースの注目プロジェクトをKanaとMariが声でナビゲートします。※この番組は日本語でお届けします。Kana と Mari のプロフィールはこちら:Kana – Newbie Esports Caster: https://y... more
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.
July 08, 2026journey-ad/CosyVoice2-ExCosyVoice2-Ex は、CosyVoice2 を拡張した音声合成(TTS)向けの WebUI/API リポジトリです。事前学習音色の利用、3秒程度の高速音色クローン、自然言語による発話制御、自動音声認識、音色保存、API 提供を行い、Windows / Linux / macOS での利用を想定しています。...more3minPlay
July 08, 2026Aratako/MioTTS-InferenceMioTTSという軽量・高速なTTSモデルの推論用リポジトリで、OpenAI互換APIを持つLLM推論基盤(llama.cpp、Ollama、vLLMなど)をバックエンドとして音声合成を行います。REST APIと簡易WebUIを提供し、参照音声プリセットの登録やBest-of-Nによる品質選択にも対応しています。...more3minPlay
July 06, 2026sfortis/openai_ttsHome Assistant向けのカスタムTTS統合で、OpenAIの音声合成APIおよびOpenAI互換バックエンドを使ってテキストを音声再生します。複数のTTSプロファイル、音声・モデル・音声形式の選択、ジングル追加、音量正規化、再生前後の音量復元や一時停止/再開など、アナウンス用途の機能が中心です。...more2minPlay
July 05, 2026yerfor/SyntaSpeechSyntaSpeechは、IJCAI 2022論文の公式PyTorch実装で、語法情報を取り入れた非自回帰Text-to-Speech(TTS)システムです。句法グラフの構築・エンコードと、多長度の敵対的学習を用いて、韻律や音質を改善しつつ推論を高速化することを目的としています。LJSpeech、Biaobei、LibriTTSに対応し、学習・推論・データ前処理の一連のパイプラインを提供します。...more2minPlay
July 04, 2026soobinseo/Tacotron-pytorchTacotronのPyTorch実装で、テキストから音声波形を生成するTTS(Text-to-Speech)モデルを学習・推論するためのリポジトリです。LJSpeechデータセットを前提に、テキスト前処理、メル/線形スペクトログラム生成、Tacotron本体の学習、チェックポイント保存、音声合成までを一通り提供しています。...more2minPlay
July 03, 2026dramaclaw/dramaclawDramaClaw は、脚本の取り込みからキャラクター抽出、エピソード設計、台本生成、絵コンテ・初稿画像生成、音声合成、動画編集・書き出しまでを一気通貫で行う、短編ドラマ制作向けのソース公開型パイプラインです。個人クリエイターや小規模スタジオが、自前の環境で“ドラマ工場”を運用できることを目的としており、Freezone(無限キャンバス)やディレクター支援AI、スタイルテンプレート、タスク管理なども備えています。...more3minPlay
July 02, 2026karim23657/Persian-tts-coquiこのリポジトリは、Coqui TTSを使ってペルシア語(Farsi)のテキスト読み上げモデルを学習・微調整・テストするためのサンプルコード集です。GlowTTS、VITS、マルチスピーカーVITSの学習ノートブックや推論例、事前学習済みモデルへのリンクが含まれています。...more3minPlay
July 01, 2026lucoiso/UEAzSpeechUnreal Engine向けのプラグイン「AzSpeech」で、Microsoft Azure Speech Cognitive Services を統合し、音声認識(Speech-to-Text)と音声合成(Text-to-Speech/SSML)を非同期タスクとして利用できるようにします。さらに、エディタ上で音声データをUSoundWaveとして生成・保存するツールや、認識/合成タスクの管理機能も提供します。...more3minPlay
June 30, 2026Deepest-Project/MelNetMelNetという、音声を周波数領域のメルスペクトログラムとして生成する深層生成モデルの実装です。学習用のトレーナーと、チェックポイントから音声をサンプリングしてスペクトログラム・波形・WAVを出力する推論スクリプトが含まれています。KSSやBlizzard、VoxCeleb2向けの設定が用意されており、条件付きTTS生成にも対応しています。...more3minPlay
June 29, 2026pkozul/ha-tts-bluetooth-speakerHome Assistant向けのカスタムコンポーネント集で、BluetoothスピーカーへTTS(音声合成)を再生するメディアプレーヤーを提供します。さらに、Bluetooth存在検知(device_tracker)と音声再生が同時にBluetoothを奪い合って音切れする問題を避けるため、Bluetoothトラッカーを一時停止・再開できる仕組みも含まれています。...more2minPlay
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.