从相册到成片:不用学剪辑,也能做出专业的视频(完整教程,附免费工具包)
上周朋友问我:你发的那个视频是怎么做的?用 AI 了吗? 用了。从 3 月到现在,我发的 100 多条视频,都没打开过剪辑软件。我没学过专业剪辑。我告诉电脑上的 AI 助手(Claude Code 或 Codex)我想要什么,它用我自己的素材把视频做出来,我再提意见,直到满意。 这不是让 AI...
Published: 2026-10-01

上周朋友问我:你发的那个视频是怎么做的?用 AI 了吗?
用了。从 3 月到现在,我发的 100 多条视频,都没打开过剪辑软件。我没学过专业剪辑。我告诉电脑上的 AI 助手(Claude Code 或 Codex)我想要什么,它用我自己的素材把视频做出来,我再提意见,直到满意。
这不是让 AI 凭一句话直接生成视频,而是让 AI 把视频写成代码,代码用的是我自己的照片、视频和录音,原样不动。因为是代码,我可以指着任何一刻,只改那一处。代码我不用写,也不用看。
发了申请 Stripe 工作的那支短片以后,好多人问我是怎么做的。这篇文章和这个网站就是我的回答:完整的做法,公开分享,真实的每一稿和修改意见都在里面。
这些都不是炫技的样片,是我真的需要的视频:给朋友的生日片、为朋友婚礼做的庆祝短片、求职短片、我的 App Joe Speaking 的发布片、剪自己的演讲、每个 App 版本的更新预告、AI Candidate 面试系列、安省移民故事、头一回去 BlizzCon 的 vlog。都是一边开发 Joe Speaking 一边做的。手机里有素材,心里有想做的视频,就够了。
这就是和视频生成工具的区别:生成工具是重新画画面,改一句就整段重画;代码用的是你手里已有的素材,一条意见只改你指的地方。但照样要一轮轮改:BlizzCon 那支改了 16 版,求职短片一天多改了 19 版。每支用的什么工具和模型,写在后面的时间线里。
更好的模型能让你更早拿到一版好的初稿,但它不替你决定视频要表达什么,也不替你对结果负责,这些还是你自己的事。所以要有耐心:看,提意见,一次改一段。
今天(10 月 1 日)我录了一期播客聊这件事,录之前先把整个方法写了下来,没用上的版本也在里面。指南免费,工具包开源,这支预告片也是这么做的。
做视频的 4 条路

- 自己用剪辑软件剪(Premiere Pro、剪映、DaVinci Resolve)。软件里的 AI 功能能帮你加字幕这类杂活,但剪还是你自己剪:完全可控,但得先学会软件,每处改动都靠手。
- 视频模型直接生成(Veo、可灵、Seedance、Runway)。适合拍不到的镜头。但它是画出来的,不是剪出来的:真人的脸、文字和 logo 会走样,改一句就得整段重画。
- AI 编程工具把视频写成代码(Claude Code 或 Codex 配 Remotion、Python 和 FFmpeg)。因为是代码,控制很精准:一条意见只改你指的地方,你的真素材原样保留。代码不用你碰。需要一点设置。
- AI 操作你的剪辑软件(MCP 连接器或 computer use)。得到的是 Premiere、达芬奇或 Final Cut 里的普通工程,之后还能自己接着剪。但软件得装好、付费、开着,而且只能做软件开放给脚本的操作。用 MCP 连接器会稳一些,让 AI 直接点屏幕仍然很慢,也更费 token。
第 2、3、4 条路都可以把做成的方法存成 Skill:写给 AI 的做法说明,下次照着做。我走第三条路。下面讲怎么做。
5 步

- 知道自己要什么,再把素材找齐。
- 先让它出一整版,看完再提意见。
- 指出问题,一次只改一段。
- 拼起来,每个衔接处都听一遍。
- 发前看效果。这类视频以后还要做,就把做法存成 Skill。
一条好的修改意见有四个部分:哪里、哪里不对、你想要什么、什么要保留。
每一稿都是一次抽卡
用 AI 做视频很像抽卡。每一稿都是一次抽卡,大多数是普通卡(N 和 R),稀有卡(SSR)才是你要发的那一版。
更好的模型出好卡的概率更高。但抽卡和挑卡,还得你自己来。

越做越快
- 3 到 4 月:Joe Speaking 发布片,约 2 周,Claude Code
- 7 月:安省移民故事,5 天,Codex,后来换 Kiro CLI
- 9 月:求职短片,一天多,Codex 配 GPT-6 Astra
- 9 月:头一回去 BlizzCon,半天,Claude Code 配 Opus 5.5
- 9 月 23 日到 28 日:6 天 12 支,用 Opus 5.5

方法每次都一样,是模型变好了。
相隔四个月
5 月我用 Codex 和 GPT-5.5 剪了自己的一场演讲。9 月用 Claude Code 和 Opus 5.5 剪了下一场。同一个系列,开场白都是 "Hello everyone, this is Joe."。放在一起看看。

之后交给 Skill
同一类视频,头一条总是慢的。4 到 5 月,我的 AI Candidate 系列,前几集每集都换了新开头,第 3 集改了 3 版。
然后我让 AI 把我每条意见背后的规则都写下来。这个文件就是 Skill。

第 4 到第 11 集:7 天 8 集,每集第一次渲染就通过,每集 4 种语言。
比工具更重要的 4 件事
- 想清楚视频是干什么用的。 谁来看,看完要做什么?AI 负责做,结果由你负责。
- 要有耐心。 哪怕用最好的模型,好东西也几乎没有一次出来的。说清楚哪里不对,再抽一次。
- 一次渲染一段。 整片渲染很慢。改一段,只渲染那一段,看过再往下走。
- 你的眼光才是核心。 AI 能做出一百个版本,分得清哪个好的是你。多看最好的作品来练眼光。
我用哪个模型
Opus 5.5,它出好稿的概率高得多。思考力度默认是 Medium,想要更好可以往上调。
拿走工具包
里面有写成 Skill 的 5 步、指南里的全部提示词,以及我从自己视频里存下的 6 个 Skill。你需要在电脑上装好 Claude Code 或 Codex。装好工具包只要一步,打开放照片的文件夹,说你想要什么就行。
变了什么,没变什么
不用再学怎么操作剪辑软件了,操作交给 AI。没变的是其他部分:想清楚视频为什么做,判断每一稿好不好,向最好的作品学习。这些还是你的,而且都学得会。
这只是我个人的做法和分享,不是唯一的方法,欢迎反馈和讨论,也想听听你是怎么做的。如果这份教程帮到了你,也欢迎到网站上请我喝杯咖啡。
谢谢 @bcherny 和 Claude Code 团队!也谢谢 @lydiahallie:上周她送的额度重置,让我有足够的额度去试验,也才有了这份完整的教程。