用 Opus 5.5 做60秒知识讲解视频:从资料、分镜到成片验收
通过一个可复算的分类指标案例,学习怎样约束 Opus 5.5 视频任务,核对资料、分镜和旁白,并下载真实 MP4、可编辑代码与字幕。
用 Opus 5.5 做知识讲解视频,交付物应包括可编辑项目,以及内容能核对的真实成片。先限定一个问题,为每句事实找到依据,再把主张安排进分镜,最后同时验收知识和 MP4。动画再流畅,也不能弥补分母讲错。
本文用十张虚构客服工单,在六十秒内解释精确率与召回率,提供英文样片、源代码、旁白和字幕。样片是为教程编写并实际本地渲染的参考项目,本次没有调用 Opus 5.5 生成它。下面的提示词供你交给 Opus 修改项目,不代表模型能力测评,也不保证一次成功。
下载可编辑项目,或直接查看60秒 MP4。案例足够小,你可以逐一核对所有对象,再把方法迁移到复杂知识。
一、先写清观众看完要会什么
目标观众是看过分类分数、却分不清分母的客服运营。看完后,他应该能解释:同一批预测,为什么精确率是五分之三,召回率却是四分之三。模型架构、阈值选择和其他指标不属于这一分钟的任务。
固定真实标签:工单一、二、三、四需要紧急处理,其余六张正常。虚构分类器标出一、二、三、五、六,因此正确找出三张,误报两张,漏掉一张,正确排除四张。这是教学标签,不是客户记录或任何模型的实测成绩。
定义参考 Google 的分类指标课程:精确率看所有预测为正的对象里有多少确实为正;召回率看所有实际为正的对象里找到了多少。工单编号、颜色、时长和讲解措辞均为本教程自行设计,不要把教学算例改写成基准测试。
“理解人工智能评估”太宽泛;“指出精确率分母中的五张卡片”才可验收。脚本作者、动画作者和审稿者有了共同目标,就不容易在最后十秒塞入第二个主题。
二、把来源、句子和镜头逐项对应
先做主张清单,再做动画。外部定义需要出处,本地计算需要能复算,视觉设计则明确是编辑选择,三者不要混在一起。
| 时间 | 讲解任务 | 依据 | 画面验收 |
|---|---|---|---|
| 0—10秒 | 提出问题 | 自编十张工单 | 十个编号都可见且不重复 |
| 10—20秒 | 展示真实标签 | 一至四为紧急 | 这四张为橙色 |
| 20—30秒 | 展示预测 | 标出一、二、三、五、六 | 蓝框恰好圈住五张 |
| 30—40秒 | 解释精确率 | 官方定义+本地五分之三 | 蓝框中三张橙色、两张正常 |
| 40—50秒 | 解释召回率 | 官方定义+本地四分之三 | 选中全部四张紧急工单 |
| 50—60秒 | 对照两个问题 | 分子相同、分母不同 | 两个分数与卡片一致 |
最重要的不变量是对象身份:转场时,四号不能悄悄变成五号。橙色只表达真实标签,蓝框只表达当前讨论的集合,文字标签再重复类别,避免完全依赖颜色辨认。
不要在分镜确定之后让模型“找点数据充实一下”。先提供来源和定义,再审新增句子;无法对应出处或明确计算的句子,删除或标为待核验,不能借漂亮画面混过去。
三、给 Opus 明确的修改范围
解压项目,在能读取文件和运行命令的环境中使用以下模板,并通过账号已有的模型选项选择 Opus 5.5。本文不假定某个 API 端点,也不包含付费请求。基础工作流可参考Opus 视频提示词与 MP4 指南。
请修改这个60秒知识讲解项目。
观众:没有统计学基础的客服运营。
目标:能解释精确率=3/5、召回率=3/4。
先阅读 render.py 和 README.md。
真实紧急集合={1,2,3,4};预测紧急集合={1,2,3,5,6}。
定义来源:
https://developers.google.com/machine-learning/crash-course/classification/accuracy-precision-recall
保留十个对象编号和六段各10秒的结构。
橙色始终表示真实紧急,保留类别文字;蓝框仅选中当前解释集合。
只有改善理解时才改旁白、间距和转场,不修改样本。
不虚构研究、API测试或Opus效果,不安装付费服务,不索要密钥。
交付差异、真实MP4、字幕、抽帧和ffprobe结果,运行样本测试。
列出实际执行命令、失败检查和缺少工具,不能把预览当成MP4。
遇到来源解释不确定,暂停该主张并说明原因。
让模型先列分镜和拟修改点,再接受大幅重写。格式正确不代表内容正确;“更有吸引力”也没有说明哪个集合被选中。要求它解释视觉修改的目的,并返回具体代码差异。
Remotion 官方的编码代理指南提供另一种项目式制作路径。本例用 Pillow 与 FFmpeg,方便检查每个对象;迁移到 Remotion 后,语义验收仍保留,但不要混用两套项目的运行命令。
四、先把参考项目完整跑通
完整复现需要 Python 3.10 及以上、Pillow、包含 ffprobe 的 FFmpeg,以及 macOS 的 say 工具和英文语音。本例使用 Samantha;先通过常用包管理器安装依赖,再检查命令可用。渲染不需要模型密钥,另开 Opus 编辑会话按你的账号权限和计费执行。
cd opus-explainer-20261008
python3 -m venv .venv
source .venv/bin/activate
python3 -m pip install -r requirements.txt
ffmpeg -version
ffprobe -version
say -v '?'
python3 render.py --voice Samantha
脚本输出一千四百四十帧,每秒二十四帧,画面为一千二百八十乘七百二十。六个镜头各十秒,旁白分别合成;单段超过九点七秒就报错,较短段落补静音到边界,再拼接。最终包含 H.264 视频、AAC 旁白及可选英文字幕轨;旁白文字同时绘入画面,播放器关闭字幕轨仍可阅读。
其他系统可运行 python3 render.py --silent,生成 output/silent.mp4。这只是无声版;要复现旁白,请提供有权使用的六段录音并调整拼接部分。不能用静音音轨替代缺失的语音工具,然后宣称旁白通过。
主要产物为 output/explainer.mp4、output/captions.srt、六张抽帧和 output/narration-durations.json。脚本查找常见系统字体,找不到时把 FONT_PATH 指向可读的 TrueType 字体;换字体可能改变换行,应重新检查抽帧。

这是本地渲染的英文参考成片,不是 Opus 生成过程截图;完整旁白、转场和结尾请打开 MP4 检查。
五、分别验收知识和媒体文件
先独立复算:真实与预测集合的交集是一、二、三;误报是五、六;漏报是四;正确排除为七至十。对照视频第二十五、三十五、四十五秒核对编号。只看百分比不够,画面可能写着百分之六十,却圈错对象。
再检查导出的文件,不只检查代码中的时长常量:
python3 test_project.py
ffprobe -v error -show_entries \
format=duration:stream=codec_type,codec_name,width,height,r_frame_rate \
-of json output/explainer.mp4
ffmpeg -v error -i output/explainer.mp4 -f null -
应得到六十秒容器、指定画幅和帧率的视频、旁白及字幕流。成功解码只说明工具能读文件,不能证明发音自然或内容易懂。闭眼听一遍,再静音看一遍,两种条件都应能理解核心区别。
本例每条字幕覆盖整个十秒镜头。以后改成更口语化的旁白,可能需要逐句切分,详见旁白与字幕同步教程。不能缩短字幕显示时间,却让对应声音跨进下一幕。
还要用小屏检查卡片编号和长字幕。把横屏缩进竖屏画布不能解决阅读问题;另做手机版本时,参考横屏转竖屏教程,重新安排文字与对象。
六、下一次修改也要能验证
把首版当基线,每次只改一个教学决定。例如暂停在第四十五秒,请同事指出召回率的分母,先记录答案,再解释概念。如果对方还在数上一幕的五个蓝框,就加强转场或补一句“现在改看实际紧急集合”。这是建议的理解度检查,本教程没有开展用户实验。
换成文档检索等题材时,对象名称、标签、旁白、主张表和测试预期必须一起改。新样本算不出原来的比例,就不能沿用百分之六十与七十五;真实客户资料也不能未经许可直接放进公开项目。
本次交付范围是英文横屏参考片,不是多语配音包、竖屏广告或模型对比测评。可复用的是让证据与解释一致的方法;即使交给 Opus 修订,发布者仍要验收具体主张和实际文件。
七、只修失败点,保留已经核对的内容
| 问题 | 优先排查 | 修改方式 |
|---|---|---|
| 旁白越过镜头边界 | 文案加长或语速变化 | 缩短对应段,再测时长 |
| 分数正确、圈选错误 | 动画状态脱离样本 | 先恢复对象集合 |
| 字符变方块 | 字体缺失 | 指定字体并重看抽帧 |
| 成片没有声音 | 无声模式或音轨映射错误 | 查媒体流,重跑旁白流程 |
| 画面好看但难理解 | 同一颜色承担多个含义 | 恢复固定颜色和文字标签 |
| 修改后运行报错 | 语法或依赖变化 | 保存错误,检查最小差异 |
修订提示可以直接写:“第四十五秒应选中一至四号。只恢复这个集合,不改旁白、时长和样本;重新导出并提供对应抽帧。”这比“把整片做好一点”更容易复核,也减少已验证镜头被顺手改坏的机会。
每次接受修改前,保留原项目和成片,记录来源版本、变化的主张、渲染命令与文件哈希。换知识点时,先换样本和主张表,再同步改旁白与视觉。来源、计算、声音、画面和最终文件一致,才算完成这篇知识视频。
常见问题
- 本文样片是 Opus 5.5 生成的吗?
- 不是。样片是为教程编写的参考项目,使用 Python、Pillow、macOS 语音合成和 FFmpeg 在本地渲染。文中的 Opus 提示词是任务模板,不是模型实测结果。
- 没有模型 API Key 能复现吗?
- 可以。参考项目不调用模型。完整旁白复现依赖 macOS say;其他系统可以先输出无声视频,再接入自己有权使用的旁白。
- MP4 能播放就说明知识讲对了吗?
- 不能。还要分别核对来源定义、对象身份、计算结果,以及旁白与画面的对应关系。媒体文件检查不能代替内容检查。


