Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
GitHubの音楽・音声AIリポジトリを毎日1本、約2分で紹介。TTS(音声合成)、MIDI、オーディオ処理など、「音」にまつわるオープンソースの注目プロジェクトをKanaとMariが声でナビゲートします。※この番組は日本語でお届けします。Kana と Mari のプロフィールはこちら:Kana – Newbie Esports Caster: https://y... more
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.
July 17, 2026divyaprakash0426/autoshortsAutoShortsは、長尺のゲームプレイ動画からAIで見どころシーンを抽出し、縦型のショート動画として自動生成するツールです。字幕生成、AI音声ナレーション、GPU加速レンダリング、複数のAIプロバイダ(OpenAI/Gemini/ローカル)対応を備え、TikTok/YouTube Shorts/Reels向けの投稿用クリップを作成します。...more3minPlay
July 16, 2026sdsds222/Unitaleこのリポジトリは、LLMとTTSを組み合わせて有声書・有声ストーリーをブラウザ上で制作するためのWebツールです。脚本の自動分解、感情推定、多角色音声合成、SFX/BGMの自動編成、音声フィルタの挿入、さらに背景画像付きMP4動画の生成までを一括で行えることを目的としています。...more3minPlay
July 14, 2026keonlee9420/Parallel-Tacotron2Googleの論文「Parallel Tacotron 2」をPyTorchで実装した音声合成(TTS)リポジトリです。テキストからメルスペクトログラムを生成する非自己回帰モデルの学習・評価・推論、データ前処理、TensorBoardログ出力、HiFi-GANなどのボコーダ連携を提供しています。...more3minPlay
July 13, 2026roryeckel/wyoming_openaiWyomingプロトコル向けのOpenAI互換プロキシミドルウェアです。Home AssistantなどのWyomingクライアントから、OpenAI互換の音声認識(STT/ASR)と音声合成(TTS)サービスを利用できるようにし、OpenAI公式APIだけでなくSpeaches、LocalAI、Kokoro、Mistral Voxtral、Edge TTS、Groqなど複数のバックエンドに対応します。TTSのストリーミングではpySBDによる文境界分割と並列プリフェッチで低遅延配信を行います。...more3minPlay
July 12, 2026Orkas-AI/Orkas-VideoStudioOrkasVideoStudio は、coding agent から自然言語で動画の合成・編集・生成を指示できる、エージェント向け動画制作ツールキットです。可読で差分可能な `plan.json` を中核に、Compose / Edit / Generate / Auto の4つの制作ラインを CLI と MCP で提供し、ffmpeg・whisper.cpp・HyperFrames などを薄くラップして決定的に実行します。...more3minPlay
July 11, 2026mateogon/pdf-narratorPDFやEPUB、TXT、HTMLファイルを読み込み、テキスト抽出・整形を行ったうえで、Kokoro TTSを使ってオーディオブック化するGUIアプリです。PDFはTOCやヒューリスティック、スキャンPDFのOCRにも対応し、EPUBは内部構造やTOCを解析して章単位で抽出できます。...more3minPlay
July 10, 2026yl365/MoneyPrinterTurboEasyこのリポジトリは、ユーザーが入力したテーマからAIで口述文案を生成し、Pexels/Pixabayの動画素材や音声と組み合わせて短尺の音声付き動画を作成するためのデスクトップアプリです。READMEでは「一句話で专业爆款短视频を生成」と説明されており、設定ファイルを編集して実行する形の動画生成ツールとして提供されています。...more3minPlay
July 09, 2026balisujohn/tortoise.cppGGMLベースでTortoise-TTSをC++へ移植した音声合成(TTS)プロジェクトです。CPU/CUDA/一部Metalで動作し、モデルファイルと話者ボイスファイルを読み込んで、コマンドラインから音声を生成します。README上では、音声プロンプトの文字種制限やボイス追加方法も案内されています。...more3minPlay
July 08, 2026keonlee9420/Cross-Speaker-Emotion-TransferPyTorchで実装された、話者条件付きLayer Normalizationと半教師あり学習を用いるクロススピーカー感情転送TTS(Text-to-Speech)モデルのリポジトリです。学習・推論・評価・前処理の一連の処理に対応しており、RAVDESSなどの感情音声データセットを使って、話者と感情を制御した音声合成を行います。...more3minPlay
FAQs about Kana & Mari's SoundRepos (Japanese):How many episodes does Kana & Mari's SoundRepos (Japanese) have?The podcast currently has 426 episodes available.