大家好!我是专注分享AI编程的瓜哥!
大家有没有试过用AI生成视频?就是那种钱不少花,但每次还只能生成5-10秒的视频,基本没法直接拿来用,让人非常郁闷~ 我自己快速体验了下,就直接放弃了...
最近,为了给正在开发小程序填充内容,我尝试用多个AI工具组合成一套视频输出的工作流。花了1周时间,反复测试后,终于跑通了这套工作流。最关键的是,为了方便使用,我还把整套工作流封装成了一个应用,现在用起来那是相当的舒爽啊!

这个工作流,可以生成科普知识、产品介绍、情感表达、生活记录、公益宣传等。比如:一分钟讲清楚一个动物特征,几张图加语音把一款新产品介绍明白。
Demo 1
这是一个科普类视频,讲述印度尼西亚的科莫多巨蜥是如何捕猎野牛的。
###
Demo 2
这是一个科普类视频,讲述海豚如何利用回声定位鱼群。
也就是说,现在已经能从0-1,一口气生成整个动画视频。全程使用AI工具辅助,包括创意、文案、图片、音频、视频合成等。今天,把思路分享给大家,让有需要的朋友们能发挥出更大的效应来。
如果你也想让AI帮你高效产出内容,那点个 ‘关注’ ,不然你可能还得跟剪辑软件死磕。
一、我是咋想的?
起初,我是为了给我的科普小程序(奇妙动植星球)填充内容。我试了H5动画、Vne3/即梦(短视频生成AI)等等单一工具,碰到下列问题:
- H5开发:周期长,输出结果不可控
- Ven3/即梦:风格不稳定,视频时间较太短
想用单一工具来生成视频行不通,必须尝试构建一个“工作流”,把AI的能力组合起来。于是我跟AI开始讨论设计流程(脚本->图片->音频->合成),并用《AI讲解员视频生成器》工具组合进行实践。
经过很长时间的调优,这个流程变得很丝滑,生成视频也比较符合的我的需求,于是我干脆让AI写了个Web应用,把所有经验固化下来。
于是有了下面这个应用:

二、我是咋做的?
2.1 实现思路
通过多种AI工具组合使用,从而实现快速、批量、稳定的生成的图片视频。
- 第 1 步:让AI生成主题故事脚本
- 第 2 步:让AI生成故事所需的图片提示词和音频生成提示词
- 第 3 步:分别生成图片和音频
- 第 4 步:一键视频合成输出
2.2 工具组合
工具不唯一,以下工具是我测试效果比较好的,其中脚本讨论、图片生成、音频合生成都可以选择你顺手的。
- 脚本讨论:Gemini 2.5 Pro(写故事思路)
- 图片生成:Gemini 2.5 Flash Image(文字生成图片)
- 音频生成:Gemini 2.5 Pro Preview TTS(文字转语音)
- 视频合成:本地Web网站(素材合成视频)
三、制作的流程
3.1 脚本讨论
跟AI讨论主题、内容结构、具体描述等。
3.2 图片生成
用谷歌最新的纳米香蕉(当前最强AI生图工具),输入提示词批量生成图片。
3.3 音频生成
在线文字转音频,将生成好的文本给到Gemini,选择你喜欢的人声,点击转换,大概10几秒就搞定了。
3.4 视频生成
点击【生成视频】按钮,可在 Cursor 的终端/Web网站查看视频生成进度~


##
四、工具产品化
刚开始,我是在Cursor里跑这个工作流,但每次都需要将文字、图片、音频上传到指定文件夹,再让Cursor执行合并任务。后来一想,工作流都跑通了,不如直接做一个Web网站,使用起来更方便些。
说干就干,通过Vibe Coding(氛围编程)方式,很快就基于Python和CSS跑出一个前后端分离的Web网站来,长下面这个样子。
自从有了这个小应用,可以进行视频的批量生产,效率原地起飞!
五、总结
很显然,当前单一的AI工具都有局限,但如果能将多个AI结合起来使用时,往往能创造意想不到的惊喜。在经历了各种尝试后,终于跑出来这条能稳定生产动画的AI工作流。
在跑通流程后,将工作流封装成一个产品。我自己能提效,也希望将思路和方法分享出来,让更多的内容创作者、运营人员、产品经理,能够大幅降低创作门槛。
目前这个工作流虽然能稳定运行,但在画面的衔接、字幕的同步等方面,还有很大的优化空间。接下来,我会继续探索...
提交反馈
图文这条 “图->文->声->影” 流水线!我把它封装成了一个人人都能用小产品!
评论区
暂无公开评论还没有公开评论。