Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
GitHubの音楽・音声AIリポジトリを毎日1本、約2分で紹介。TTS(音声合成)、MIDI、オーディオ処理など、「音」にまつわるオープンソースの注目プロジェクトをKanaとMariが声でナビゲートします。※この番組は日本語でお届けします。Kana と Mari のプロフィールはこちら:Kana – Newbie Esports Caster: https://y... more
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.
September 05, 2026hhguo/MSMC-TTS|高品質な音声合成AI|GitHubMSMC-TTSは、マルチステージ・マルチコードブックVQによる高品質なニューラル音声合成システムの実装です。MSMC-VQ-GANベースのオートエンコーダーで音声表現を学習し、マルチステージ予測器でテキストから音声を合成できます。CSMSCなどの中国語データセットを用いた学習、マルチGPU学習、推論に対応しています。関連: hhguo/MSMC-TTS/高品質な音声合成AI/GitHub...more3minPlay
September 04, 2026adelacvg/ttts|ゼロショット音声合成AI|GitHubDetailTTSは、テキストと参照音声から話者性を保った音声を生成するゼロショット音声合成システムです。VITS系のVQVAEと音声トークナイザーを組み合わせ、英語・中国語・日本語・韓国語に対応し、学習・推論・ファインチューニングを提供します。関連: adelacvg/ttts/ゼロショット音声合成AI/GitHub...more3minPlay
September 03, 2026declare-lab/jamifyJAMは、歌詞から楽曲を生成する530MパラメータのRectified Flowベース音楽生成モデルです。単語・音素レベルのタイミングや発音 duration、全体の曲長、音声またはテキストによるスタイルを細かく制御でき、推論だけでなく事前学習、教師ありファインチューニング、DPOによる学習にも対応しています。...more3minPlay
September 02, 2026zcbacxc/movie-narratorMovie Narratorは、映画情報や映像素材を入力として、LLMで映画 recap(あらすじ紹介)台本を生成し、音声ナレーション、字幕、BGM、映像編集を組み合わせた完成動画を自動生成するPython製ツールキットです。CLIを中心に、16段階のパイプライン、複数候補の比較、参照動画のスタイル模倣、多言語字幕、QA、非同期タスク処理、REST API、プラグイン拡張などを提供します。...more3minPlay
September 01, 2026mo-tunn/OpenGuiderOpenGuiderは、ユーザーのPC上で実際のUI操作を支援するElectron製のデスクトップAIアシスタントです。チャット、タスク計画・再計画、スクリーンショット解析、座標付きポインター案内、音声入出力、セッション履歴、プラグインおよびブラウザ自動化機能を提供します。複数のLLMプロバイダーやローカルモデルにも対応しています。...more3minPlay
August 31, 2026vecartier/cc-beeperCC-Beeperは、Claude Codeの実行状況をデスクトップ上に表示するネイティブmacOS向けフローティングページャーです。ローカルHTTPフックで複数セッションを監視し、完了・エラー・権限要求・入力待ちなどの状態表示、権限の自動承認モード、グローバルホットキー、音声入力・読み上げを提供します。...more3minPlay
August 30, 2026p-groarke/wsaywsayは、macOSの「say」に相当するWindows向けのコマンドライン音声合成ツールです。Windows Speech APIを利用してテキストを音声再生し、WAVファイル出力、音声・再生デバイス選択、クリップボード・ファイル・パイプ入力、Speech XML、音量・速度・音程調整、ラジオ風エフェクトなどを提供します。音声合成機能を利用できるC++ライブラリも含まれています。...more4minPlay
August 29, 2026petercunha/ttsAmazon PollyおよびGoogle Cloud WaveNetを利用して、入力したテキストをTwitchなどの配信用音声として読み上げるWebアプリケーションです。React/Gatsby製のフロントエンドで音声・テーマを選択でき、Node.js/Express製のバックエンドがTTS生成、レート制限、ボット対策、利用統計、アクセスログを提供します。...more3minPlay
August 28, 20260xShug0/audio.cppaudio.cppは、ggmlを基盤とした高性能なネイティブC++音声推論フレームワークです。TTS、音声クローニング、音声変換、ASR、話者 diarization、VAD、音源分離、音楽生成など多数の音声モデルを、CLI・HTTPサーバー・組み込みWebUI・JSONパイプラインからローカル実行できます。複数モデルに共通のランタイムを提供し、CUDAを中心にCPU、Vulkan、Metal、HIP/ROCmでの移植性と高速推論を目指しています。...more3minPlay
August 27, 2026tsensei/OpenReelsOpenReelsは、入力したトピックから、リサーチ、台本作成、音声合成、AI画像・動画・音楽生成、字幕付与、シーン遷移、品質評価までを自動実行し、YouTube Shorts・TikTok・Instagram向けの縦型MP4動画を生成するオープンソースAIパイプラインです。CLIに加えて、リアルタイム進捗表示付きのWeb UI、REST API、Docker実行環境を提供しています。...more3minPlay
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.