FFmpeg 技能更新 🎬
Ver.0.9.2→Ver.0.12.0
「把这个视频改成9:16」「剪掉无声部分」「添加字幕」
除此之外,现在还能处理这样的指令。
「只把这个部分按像素单位裁剪」
「把这张照片边缩放边剪辑成视频」(Ken Burns 风格)
「旋转/翻转视频」
「把这个视频和logo视频合成」「抠掉绿幕」
「把这个视频倒放」
「修正手抖」
「从连番图像制作视频」
「制作单色/渐变背景剪辑」
「无损直接导出」
「字幕保持画质不变,以可后续切换的形式添加」
「高光部分按长度而非音量选择」
「为 AI 解析导出低分辨率预览」
能做的事从 21 项增加到了 28 项工具。
🔍 AI 在「理解基础上」进行处理
・执行前预先检查「当前环境下这个工具是否实际可用」
・掌握 GPU 编码器/字体替代的可用性
・对于拥有多个音轨的文件(配音・其他语言版等),几乎所有工具都能指定使用的音轨
・能读取字幕音轨的语言等详细信息
・字幕时机也能以时间码(hh:mm:ss:ff)形式指定
・9:16 化等裁剪中,也能指定裁剪位置(左对齐/右对齐等)
・是否对音频重新编码,每个工具都会诚实申报
✅ 彻底贯彻「不坏・不说谎」
・每次确认导出真正成功后才报告「完成」,失败时不留下垃圾文件
・防止意外覆盖・损坏原始视频文件的安全措施
・失败时,AI 判断原因和是否可重试
・颜色转换需要重新编码时,也会尽可能保留字幕和附加音轨
・检测到同步偏差时,若置信度低则 AI 发出警告
・在最新 FFmpeg / Windows 环境下也稳定运行(包括 Windows 路径相关的 bug 修复)
🛠️ 开发・维护机制也得到强化
・明确规定「AI 能做的事/不该判断的事」(设计上防止 AI 擅自判断「视觉美观」)
・添加测试以堵住逃向原始 FFmpeg 命令的后门
・若文档与实际代码行为不符,则通过自动测试检测
・作为 OSS 完善 Contributing 流程,添加打版本标签时自动生成 GitHub Release 的机制
・关于 GPU 支持,诚实注明「声称支持但不保证运行」
Claude Code / Cursor / Codex 对应、MCP 有、纯本地处理无需云端这一点不变。
当前:v0.12.0
http://t.cn/AX0mutTi…
#FFmpeg #AIVideo #AI #MCP #ClaudeCode #OpenSource
http://t.cn/AX0mutTX
