为什么做一套“读书播客”Skills
一直想把地铁上的时间用来听书。
想听的并非一份可以代替原书的浓缩摘要。一本真正值得读的书,重要的不只是几个结论,还有作者提出问题、辨析概念和展开论证的过程。设想很简单:正式读一本书之前,先为它生成一套导读播客。通勤时可以先熟悉全书的问题、结构和主要内容,等到真正翻开原书,心里已经有了一张初步的地图。
这套播客的定位始终是“导读”。它负责领人进门,降低阅读门槛;最后,仍要回到原书。
从 NotebookLM 得到启发
这个项目受 Google NotebookLM 启发。它能把材料变成双人对谈音频,这种形式也很适合在通勤路上收听。
但 NotebookLM 有一点不能满足需要:无论书有多厚,它都只生成一段音频。面对一本篇幅很长、结构复杂的书,一段音频很难同时照顾全书轮廓和章节细节。
所以,读书播客被设计成了一个系列。
第一集是全书导读,先介绍这本书在讨论什么、为什么值得读,以及后面的内容将怎样展开。中间各集按照原书章节依次推进,详细讲解每一部分的核心问题和思路。最后一集再回到全书,对已经讲过的问题作一次总结和回顾。
这样的结构既保留全局视角,也给章节内容留下展开的空间。先有入口,中间逐步深入,最后再收束。听完整个系列后,可以对这本书有较完整的认识,也更容易带着问题去读原书。
两个 Skill,各自解决一半问题
这个项目包含两个可以配合工作的 Skill:book-podcast-content-director 和 book-podcast-tts-producer。
book-podcast-content-director 是内容导演。它面向完整的非虚构书籍,先理解全书的结构和核心问题,再规划导读集、章节精讲和总结集。写每一集之前,它会从原文中整理证据,确认重要说法有出处;写完后还要审核和定向修订。它并非把章节压缩成要点,而是让听众跟上作者怎样提出问题、区分概念并推进思考。最终产出中文男女双主播脚本。
book-podcast-tts-producer 是配音制作器。它接过已经验收的双主播脚本,把女声和男声分别转换成语音,再合成为每一集的 MP3。它还负责批量生成、失败重试、断点续跑和结果检查。内容没有通过审核,就不会进入批量配音清单;到了配音阶段,也不再擅自改动台词。
一个 Skill 管内容,确保导读忠于原书、结构完整、对话真正帮助理解;另一个 Skill 管音频,把确认过的脚本稳定地做成可以在地铁上收听的节目。两者分开,各自守住边界,又能接成一条完整的制作过程。
一集实际生成的内容
下面是《正义论》导读系列的第五集《无知之幕:怎样公平地选择正义原则》。点击播放器即可收听。
这里选取一集作为试听。完整示例见 GitHub 仓库。
为阅读做一次预习
做这个项目,归根到底是想为阅读多准备一个入口。
地铁上的时间有限,播客可以先帮人认识一本书:它关心什么,怎样展开,哪些地方值得在阅读时特别留意。等到真正开始读原书,这些内容就成了预习留下的线索。
导读播客不会替人读完一本书。它的价值,是让一本想读的书更容易开始,也让人知道该带着哪些问题回到书中。
项目源码与完整示例:tunggian/book-podcast-skills