每场活动结束都要出一个回顾视频:开场标题、数据展示、照片墙、获奖名单、结尾感谢。用剪映套模板要手动调,用 AE 太重,用 AI 效果又不可控。花两天时间,作者做了一个一键出片的离线视频生成工具——燃剪 IgniteClip。
工具已部署在魔搭创空间,免费开放使用:https://modelscope.cn/studios/benben2paopao/activity-video-generator

不需要会 AE、不需要懂关键帧、不需要调曲线。填文案、传图片,一键出 MP4。11 种场景覆盖了活动视频的完整流程。

支持 1080p 和 720p 两种分辨率,制作过程不需要调用大模型,纯本地渲染。

技术选型
开发时明确了几个原则:
- 前端不上 React:本质是拼接 HTML,每个场景结构固定,原生 JS 直接操作 DOM 更快
- 后端轻量:Node.js + Express,REST API,数据存本地 JSON
- 动画用 GSAP 时间轴:入场、转场、数字滚动、进度条填充都在一条 timeline 上精确控制
- 外部工具可配置:HyperFrames、FFmpeg、Edge-TTS 路径在设置页面配置,配完自动验证
UI 方面给 Agent 安装了设计类 skill,从深色科技风迭代到浅色 Soft UI。

开发工具与模型
开发工具使用阿里开源的 Qwenpaw,主流 Agent 功能都有,自带免费大模型。模型选择字节的 doubao-seed-evolving——专为 Agent 场景设计,遇到报错会自己读错误信息、定位问题、提修复方案。模型名称没有数字版本号,后台更新名称不变,不用焦虑。
最大体会是:AI 编程最大的风险不是 AI 写不出代码,而是人不假思索地接受 AI 写的代码。你得懂你要做的东西,得能判断它写得对不对,得愿意上手测。AI 是执行力极强的实习生,方向和质量把关还是你的事。
三步出片
第一步:选模板加场景。从 11 种模板里挑,支持多个同类场景,拖拽排序、复制、删除。

第二步:填文案传图片。选中场景后右侧面板显示所有参数,图片自动压缩到 1920px,竖图不变形。

第三步:一键导出 MP4。选分辨率后,后端自动跑 TTS → 时长计算 → HTML 生成 → HyperFrames 无头渲染 → FFmpeg 合成 → 截封面。90 秒视频约 5-10 分钟。

写在最后
两天时间,从一个念头到能跑出片的工具。中间修了十几个 bug,UI 改了三轮,照片布局重写了两次。
AI 不是一句话生成 APP 的魔法,更像是雇了一个执行力极强、记性极好、但偶尔会犯蠢的实习生——你得给他清晰的需求,review 他的代码,在他跑偏时拉回来。他干得比你快,但你得知道什么是对的。
工具不会取代人。但会用工具的人,会取代不会用工具的人。
体验地址:https://modelscope.cn/studios/benben2paopao/activity-video-generator