Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
GitHubの音楽・音声AIリポジトリを毎日1本、約2分で紹介。TTS(音声合成)、MIDI、オーディオ処理など、「音」にまつわるオープンソースの注目プロジェクトをKanaとMariが声でナビゲートします。※この番組は日本語でお届けします。Kana と Mari のプロフィールはこちら:Kana – Newbie Esports Caster: https://y... more
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 412 episodes available.
August 22, 2026djdevil/AlertTicker-CardHome AssistantのLovelaceダッシュボード向けカスタム通知カード「AlertTicker Card」です。エンティティ状態・属性・テンプレート・デバイスクラスなどを条件に複数のアラートを表示し、豊富なテーマ、アニメーション、TTS、プッシュ通知、グローバルオーバーレイ、カメラ表示、音楽プレーヤー、天気予報、履歴・スヌーズ機能を提供します。YAML設定に加えて、GUIによるビジュアルエディタにも対応しています。...more3minPlay
August 21, 2026streamcoreai/streamcore-serverStreamCoreは、AI音声エージェント向けのリアルタイムメディア基盤です。WebRTC/WHIPによる音声通信、NAT traversal、VAD、ターンテイキング、割り込み(barge-in)、セッション管理、ストリーミングSTT・LLM・TTS連携を提供し、エージェントのプロンプトや業務ロジックは外部アプリケーションに委ねます。ブラウザ、モバイル、バックエンド、SIP電話、組み込みデバイスから利用できます。...more4minPlay
August 20, 2026kk43994/kkclawKKClawは、OpenClawおよびHermes Agentに対応したElectron製のデスクトップAIペットアプリです。流体ガラス球体のアバター、14種類の感情表現、音声合成・音声クローン、字幕、Gateway監視、モデル切り替え、セットアップウィザードなどを提供し、AIに視覚・聴覚的なデスクトップ上の身体性を与えます。...more4minPlay
August 19, 2026Floe-Labs/floe-guardfloe-guardは、AIエージェントのLLM、音声処理、ツール呼び出しなどの支出をローカルで計測し、設定したUSD予算を超える次の呼び出しを事前にブロックする予算ゲートライブラリです。PythonとTypeScriptに対応し、OpenAI、Anthropic、Gemini、LangChain、LangGraph、CrewAI、LiteLLM、Vercel AI SDK、Pipecat、LiveKit、Vapi、Retellなどのアダプター、コストマップ、並行実行向け予約、支出ログ、音声通話コスト計測を提供します。デフォルトではネットワーク通信やテレメトリを行わず、ホスト型予算参照や台帳同期は明示的なオプトイン時のみ実行します。...more3minPlay
August 18, 2026QuantiusBenignus/BlahSTBlahSTは、Linux上の任意の編集可能なテキストフィールドへ、キーボードショートカットで音声入力できる軽量な音声認識ツールです。whisper.cppまたはwhisperfileによるオフライン・ネットワーク音声認識に加え、多言語翻訳、連続ディクテーション、ローカルLLMとの音声チャット、校正・翻訳、Piperによる音声出力などを提供します。...more3minPlay
August 17, 2026makerjackie/zhttsZhTTSは、中国語テキストをCPU上でリアルタイムに音声合成するTTSデモです。BakerProcessorによる中国語テキスト正規化・ピンイン変換の後、FastSpeech2またはTacotron2でメルスペクトログラムを生成し、MB-MelGANで24kHzのWAV音声へ変換します。Python APIに加えて、FlaskによるWeb画面とHTTP音声合成APIも提供します。...more4minPlay
August 16, 2026ishandutta2007/Awesome-Text-to-SpeechAI音声生成・Text-to-Speech(TTS)に関するリソースを体系的にまとめたAwesome Listです。商用クラウドAPI、オープンソースTTSモデル、音声クローニング、研究論文、サンプル、チュートリアルなどを紹介し、用途や特徴、関連リンクを整理しています。実行可能なTTSアプリケーション本体ではなく、情報収集・比較のためのカタログです。...more3minPlay
August 15, 2026msrbuilds/voice-studioVoice Studio by MSRは、複数のオープンソースTTSモデルをローカルで切り替えて利用できるオフラインWebアプリケーションです。ポッドキャスト編集、テキスト読み上げ、Whisperによる音声文字起こし・字幕出力、音声の吹き替え、翻訳、音声クローン、キャッシュ管理などを提供します。...more4minPlay
August 14, 2026xenova/kokoro-webKokoro Webは、ブラウザ上でKokoro音声合成モデルを実行し、入力したテキストを自然な音声へ変換するWebアプリケーションです。音声の選択、再生速度の調整、ストリーミング生成、チャンク単位の再生、一時停止、生成音声のWAVダウンロードに対応しています。WebGPUまたはWASMを利用して推論をクライアント側で実行します。...more3minPlay
August 13, 2026sgl-project/sglang-omniSGLang-Omniは、マルチモーダル、音声、音声合成(TTS)モデル向けのマルチステージ推論・サービングランタイムです。前処理、エンコーダ、自己回帰生成、デコーダ、ボコーダなどを分離して管理し、共有メモリ・NCCL・NIXL・Mooncakeによるステージ間通信と、OpenAI互換APIを提供します。音声生成・ストリーミング・音声認識・話者分離・画像や動画理解に加え、性能および精度評価用のベンチマーク機能も含みます。...more3minPlay
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 412 episodes available.