Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
GitHubの音楽・音声AIリポジトリを毎日1本、約2分で紹介。TTS(音声合成)、MIDI、オーディオ処理など、「音」にまつわるオープンソースの注目プロジェクトをKanaとMariが声でナビゲートします。※この番組は日本語でお届けします。Kana と Mari のプロフィールはこちら:Kana – Newbie Esports Caster: https://y... more
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.
August 26, 2026Aivis-Project/AivisSpeech-EngineAivisSpeech Engineは、VOICEVOX ENGINEをベースに開発された日本語音声合成エンジンです。AIVMX形式のStyle-Bert-VITS2系モデルをONNX Runtimeで推論し、VOICEVOX互換のHTTP APIを通じて感情豊かな音声を生成します。...more3minPlay
August 25, 2026JollyToday/GhostCut-auto_video_translationGhostCut(国際版ブランド名:Weydub)は、AIを活用した動画・画像のローカライズおよび編集サービスです。OCRによる動画内文字・字幕の除去と翻訳、ASR/TTSによる音声翻訳・吹き替え、動画のリメイク・重複回避、画像翻訳などを提供し、これらの機能をAPI経由で組み合わせて利用できます。リポジトリには主にAPI呼び出し用のPythonサンプルコードと製品説明が含まれています。...more4minPlay
August 24, 2026dengxibo/sumatrapdf-plusSumatraPDFをベースにした非公式のWindows向け文書ビューア「Sumatra PDF Plus」です。PDF、EPUB、MOBI、DjVu、CBZ/CBRなどを閲覧でき、中国語電子書籍向けの表示改善、オフライン辞書、テーマ切り替え、スマートPDFダークモード、ローカルOCR、TTS朗読などを追加しています。...more3minPlay
August 23, 2026ChenShuo2004/cs-boardSRT字幕と参考音声をもとに、暖色系の紙背景を使った白板手描きアニメーション動画を制作するためのツールです。字幕解析、分鏡・配图策略の作成、画像領域の注釈編集、流れる筆跡によるMP4レンダリング、複数シーンの結合に対応しています。また、実際のナレーション時間に同期する動的インフォグラフィック制作機能も備えています。...more3minPlay
August 22, 2026djdevil/AlertTicker-CardHome AssistantのLovelaceダッシュボード向けカスタム通知カード「AlertTicker Card」です。エンティティ状態・属性・テンプレート・デバイスクラスなどを条件に複数のアラートを表示し、豊富なテーマ、アニメーション、TTS、プッシュ通知、グローバルオーバーレイ、カメラ表示、音楽プレーヤー、天気予報、履歴・スヌーズ機能を提供します。YAML設定に加えて、GUIによるビジュアルエディタにも対応しています。...more3minPlay
August 21, 2026streamcoreai/streamcore-serverStreamCoreは、AI音声エージェント向けのリアルタイムメディア基盤です。WebRTC/WHIPによる音声通信、NAT traversal、VAD、ターンテイキング、割り込み(barge-in)、セッション管理、ストリーミングSTT・LLM・TTS連携を提供し、エージェントのプロンプトや業務ロジックは外部アプリケーションに委ねます。ブラウザ、モバイル、バックエンド、SIP電話、組み込みデバイスから利用できます。...more4minPlay
August 20, 2026kk43994/kkclawKKClawは、OpenClawおよびHermes Agentに対応したElectron製のデスクトップAIペットアプリです。流体ガラス球体のアバター、14種類の感情表現、音声合成・音声クローン、字幕、Gateway監視、モデル切り替え、セットアップウィザードなどを提供し、AIに視覚・聴覚的なデスクトップ上の身体性を与えます。...more4minPlay
August 19, 2026Floe-Labs/floe-guardfloe-guardは、AIエージェントのLLM、音声処理、ツール呼び出しなどの支出をローカルで計測し、設定したUSD予算を超える次の呼び出しを事前にブロックする予算ゲートライブラリです。PythonとTypeScriptに対応し、OpenAI、Anthropic、Gemini、LangChain、LangGraph、CrewAI、LiteLLM、Vercel AI SDK、Pipecat、LiveKit、Vapi、Retellなどのアダプター、コストマップ、並行実行向け予約、支出ログ、音声通話コスト計測を提供します。デフォルトではネットワーク通信やテレメトリを行わず、ホスト型予算参照や台帳同期は明示的なオプトイン時のみ実行します。...more3minPlay
August 18, 2026QuantiusBenignus/BlahSTBlahSTは、Linux上の任意の編集可能なテキストフィールドへ、キーボードショートカットで音声入力できる軽量な音声認識ツールです。whisper.cppまたはwhisperfileによるオフライン・ネットワーク音声認識に加え、多言語翻訳、連続ディクテーション、ローカルLLMとの音声チャット、校正・翻訳、Piperによる音声出力などを提供します。...more3minPlay
August 17, 2026makerjackie/zhttsZhTTSは、中国語テキストをCPU上でリアルタイムに音声合成するTTSデモです。BakerProcessorによる中国語テキスト正規化・ピンイン変換の後、FastSpeech2またはTacotron2でメルスペクトログラムを生成し、MB-MelGANで24kHzのWAV音声へ変換します。Python APIに加えて、FlaskによるWeb画面とHTTP音声合成APIも提供します。...more4minPlay
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.