一份文稿變一支影片!MDR Radio 0.1.5 正式發布

2026-06-21 · 0 次瀏覽 AI

摘要

MDR Radio 是為 Agent 設計的影片製作工作流,可將 Markdown 或文字稿自動轉換為帶中文解說的投影片影片。流水線分六個階段,涵蓋投影片生成、TTS 配音、影片合成、封面繪製與 Bilibili 上傳。0.1.5 版本首次打通從寫稿到發布的完整流程,每階段皆可獨立審核後再繼續。用戶只需克隆 GitHub 倉庫,準備文稿交給 Agent 並選擇對應 Prompt,即可逐步產出影片。

完整逐字稿
大家好,我叫 MDR Radio,用一句話介紹我自己:你給我一份文稿,我還你一支會說話的影片。今天正好是 0.1.5 版本發布,就借這個機會正式做個自我介紹。

先說說我是誰。我本質上是一個為 Agent 設計的小工作流,你丟給我一份 Markdown 檔,或者隨便一段文字想法,我就把它一步變成帶中文解說的投影片影片。我的做事風格是一個決斷、一個 Prompt,每做完一步都停下來讓你審核,滿意了再繼續,所有產物都收在同一個工作區資料夾裡。

到 0.1.5 為止,這個工具歷經了數十個小時的打磨。我有六個流水線階段,發過六個版本,已經產出了 17 個影片作品。

那具體是怎麼幹活的呢?就是這六步:第一步,做投影片,導出 PDF 和解說稿;第二步,逐頁配音,每頁生成一個 MP3;第三步,把 PDF 和音訊合成影片,這是主鏈路。後面三步是可選的:寫簡介、畫封面,最後發布到 Bilibili。每一步都對應 Prompt 資料夾裡的一個獨立 Prompt,想走到哪一步,由你決定。

支撐這六步的,是倉庫裡的兩類東西。Prompt 資料夾放的是給 Agent 的階段指令,比如 Slide Prompt 負責生成簡報和解說稿,TTS Prompt 負責配音。Script 資料夾放的是可以獨立運行的 Python 工具,配音、合成影片、生成封面、上傳 B 站,都有對應的腳本。

還有一點要說明:生成的作品不放在主倉庫裡,Output 目錄是掛在 AI Video 倉庫的 Git 子模組,作品的歷史都記在那邊。

說回這次的 0.1.5,最大的新東西就是 Bilibili 上傳階段。上傳腳本直接讀取本地瀏覽器的登入 Cookie,標題和簡介取自 intro.txt,封面取自 thumbnail.png,而且發布前一定先做一次 dry run 預覽,不會貿然發出去。另外,流水線看板的卡片上現在能直接預覽封面圖,intro.txt 新增了一行公開產出連結,Changelog 也為重寫後的歷史重新生成了一遍。

這些能力不是一天長出來的:0.1.0 跑通了從投影片到影片的主鏈路;0.1.1 加上了字幕和 OpenAI TTS;0.1.2 開始連續產出中文成片;0.1.3 有了封面生成和即時看板;0.1.4 把產出拆成了獨立的子模組;到這次 0.1.5,流水線第一次從寫稿一路通到了發布,算是補上了最後一塊拼圖。

最後說說怎麼開始用我,很簡單:從 GitHub 上把 Isomos Video 下的 MDR Video 倉庫克隆下來,準備一份文稿或者一段想法,交給你的 Agent,然後按階段挑 Prompt,先出片子,審核滿意了再配音、合成、發布。

送你一句我的座右銘:我不替你創作內容,我只負責讓內容開口說話。期待和你一起做出下一支影片。