一个人,一台 Windows 电脑,一台手机,怎么做一集能发出去的 AI 短剧?这是我踩了两部片总结出的完整流水线,零基础可复制。
一、剧本先行(别急着出图)
先写出"12镜/60秒"的紧凑剧本:每镜写清【画面动作 + 台词/旁白 + 情绪要求】。两个原则:每15秒一个小爽点;最后一镜必须留钩子。这才是后面所有环节的地基。
二、分镜表交给 WorkBuddy
把剧本丢给 WorkBuddy,让它整理成 Excel 分镜表:每镜含画面内容、台词、可直接粘贴的 AI 绘图提示词。为什么用表格?因为出图、配音、装配全部要按镜号对齐,表格是最不容易乱的容器。
三、人物一致性是最痛的坎(重点)
AI 出图最怕"同一个角色每张脸都不一样"。我的做法:
- 开工前先出角色【三视图】(正面/侧面/背面,含完整衣着),锁定形象;
- 之后的每张图都带这张参考图;双人同框开 input_fidelity=high 防串脸。
这一步省下来的返工,比后面所有优化都值钱。
四、本地配音补短板
WorkBuddy 支持生成图片和分镜,但中文 TTS 不内置。我用微软 edge-tts 本地批量生成分角色台词 mp3(Python 脚本 + 按镜号命名),装配时直接对位。免费、不限量、效果接近真人朗读。
五、装配与发布
分镜图→图生视频→按镜号把视频、配音、字幕卡拼起来。成片规格按平台走:抖音用 1080×1440 竖版,时长控制在 60~120 秒。片头片尾用静态黑底字幕卡即可,不需要额外会员功能。
【贴士:提示词模板(可直接用)】
通用画风前缀:
"怀旧治愈系手绘漫画,老照片质感,4:3竖版电影构图,柔和光影,电影级打光"
→ 换成写实风格则是:
"3D写实CG,皮克斯质感渲染,真实皮肤,布料褶皱,8K细节,电影级柔光"
教训(避坑):
- 形象不锁就批量出图 = 返工积分黑洞;
- 话术要写死动作幅度,别让 AI 自由发挥,否则"站桩"废片率极高;
- 一版能看就收,只返工"车祸级"问题,追求完美是最贵的行为。
以上就是我一个人用 WorkBuddy 做 AI 短剧的全部经验,欢迎交流。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。