这是什么
白板声画工坊(cs-board)是一个本地运行的开源 AI 视频制作工作台,它能把你的参考声音和中文文案自动转成一支带手绘动画的白板讲解视频。你只需上传一段 10–30 秒的参考音频、粘贴至少 10 个字的中文文案,系统就会自动完成音色克隆、内容拆解、统一插画、手绘动画渲染、字幕与音画合成,最终导出 MP4 成片。
项目采用 MIT 协议开源,目前获得 569 Stars、99 Forks,最新发布版本为 v1.0.0。所有素材、密钥、任务历史和成片默认都保存在本机,同一局域网内的团队还可以共用一条制作队列,非常适合注重数据隐私的创作者。
适合谁
- 知识类视频创作者:需要快速制作白板讲解、课程宣传或故事口播,但不想花费大量时间手绘动画。
- 品牌与内容团队:需要固定画风和角色形象,生成系列化视频。
- 一人公司或独立创作者:希望用低成本工具产出专业感视频,同时掌握全部数据。
能做什么
工具提供了三种制作模式:
- 标准制作:适合知识讲解、故事口播、课程宣传。自动拆分分镜,生成插画并绘制白板动画。
- 自定义参考:适合固定 IP、品牌视频。上传风格参考图和人物参考图(最多 5 个角色,每个 1–3 张),让画风与角色贯穿全片。
- 动态信息图:适合观点表达、商业分析。系统先依据真实旁白时间生成短语时间表,再动态呈现知识卡片,内容随讲解同步出现。
核心能力亮点:
- 本地音色克隆:可接入自己的 IndexTTS Gradio 或 FastAPI 服务,参考音频不离开本机。
- 12 个视觉模板:从极简白板、国风、手账到赛博霓虹,每个模板都有对应画面特征和内容建议。
- 自定义人物与画风:支持 1 张风格参考图和最多 5 个角色,每人 1–3 张参考图。
- 中文重点词:可本地叠加 4–10 字重点短语,避免图片模型生成中文乱码的问题,可一键关闭。
- 可控成片节奏:支持字幕开关、笔身账号名、4 档线条绘制量,每张图承载 1–4 个分镜。
- 任务复用与恢复:配音、分镜、图片、分段视频均有检查点,调整渲染设置时无需重复调用模型。
- 局域网协作:多台电脑可共享队列、进度和历史,个人偏好保存在各自浏览器。











使用前准备
运行环境需要满足以下条件:
- Windows 10/11 或 macOS 15+(Intel 与 Apple Silicon)
- Python 3.11+、Node.js 22.13+
- FFmpeg 与 FFprobe,且已加入系统 PATH
- 可访问的 IndexTTS 2.5 服务(Gradio 或 FastAPI)
- OpenLux API Key,并具有文本模型与图片模型的调用权限
首次使用前,请先确认音视频依赖可用:
ffmpeg -version
ffprobe -version
安装方法
项目提供了 Windows 和 macOS 两种安装方式。
Windows 安装
在项目根目录执行一次安装(PowerShell):
python scripts/prepare_env.py
.\venv\Scripts\python.exe -m pip install -r webapp\requirements.txt
Push-Location web
npm ci
Pop-Location
然后启动工作台:
.\start-webapp.ps1
脚本会启动前后端并打开 http://127.0.0.1:13000/,同一局域网设备可通过输出地址访问。
macOS 安装
使用 Homebrew 安装依赖:
brew install python@3.13 node ffmpeg
然后在项目根目录执行安装:
python3.13 scripts/prepare_env.py
.venv/bin/python -m pip install -r webapp/requirements.txt
(cd web && npm ci)
若国内网络较慢,可临时使用清华 PyPI 镜像:
PIP_INDEX_URL=https://pypi.tuna.tsinghua.edu.cn/simple python3.13 scripts/prepare_env.py
PIP_INDEX_URL=https://pypi.tuna.tsinghua.edu.cn/simple .venv/bin/python -m pip install -r webapp/requirements.txt
然后启动工作台:
./start-webapp.sh
启动后同样会打开 http://127.0.0.1:13000/。macOS 14 及更低版本可启动界面和 API,但 Remotion 视频渲染可能不保证成功。
使用示例
启动工作台后,打开右上角的「API 设置」完成配置:
- 填写 OpenLux API Key(只保存在本机
.webapp/config.json,页面不回显完整密钥)。 - 选择文本模型(默认
gpt-5)和图片模型(默认gpt-image-2)。 - 填写 IndexTTS 地址和接口类型(Gradio 通常为
http://127.0.0.1:7860,FastAPI 通常为8000端口)。 - 测试连接成功后,上传 10–30 秒、单人且噪声较少的参考音频,粘贴至少 10 字的中文文案,选择制作模式和视觉模板,即可开始生成。
风险与注意事项
- 密钥安全:OpenLux API Key 只保存在本机,请勿在 Issue、日志、截图或提交记录中公开。
- 数据隐私:参考音频、任务文件、成片均保存在
.webapp/目录,注意备份和清理。 - 渲染依赖:macOS 15+ 才能完全支持 Remotion 视频渲染;Windows 需要安装好 FFmpeg 并加入 PATH。
- 模板与版权:视觉模板的预览图片来自 GitHub Raw 地址,使用时注意素材的合规性。
- API 费用:生成视频需要调用 OpenLux 等外部模型,会消耗 API 额度,建议先测试小批量。
该项目遵循 MIT 许可证,你可以自由使用、修改和分发,但需保留原作者版权声明。