用 AI 学 AI — 12 分钟一镜到底学会 GPT image2
你刷到的大部分 AI 博主在做「新闻式视频」——工具又出了/谁丢工作了/模型多炸——他们自己都没用过。看完只更慌。
- 用 AI 学 AI 才是最快的路——这一年最该练的方法
- 一镜到底跑通 Claude Code + GPT image2 → Seedance 2.0 → 30 秒科幻短片
- 不是「给指令」是「沟通需求」——AI 反问就修正「故事书 vs 故事板」
- API key 安全:D 盘建 txt 拖进窗口,不要粘对话框
- 承认 AI 偷懒了——但用它学新 AI 工具的可能性已经存在
「用最好的模型,用 AI 学 AI。」
周末第一天,讲点能直接动手的。
最近跟很多在大厂做管理的朋友聊天,压力都很大——每次跟老板汇报,老板都在挑战「你有没有降本增效?你有没有用 AI 赋能业务?」一个一个问下来,谁都不轻松。
我自己学 AI 也走过弯路。所以今天这期,我换个方法分享。
一、市面博主的「AI 新闻」在浪费你的时间
你刷到的大部分 AI 博主,做的都是新闻式视频——「这个工具又出了」「谁谁谁丢工作了」「这个模型有多炸」。
可这些博主自己甚至都没用过那些工具。
他们直接开始渲染好处、制造焦虑。看完你只会更慌,工具一个都没学会。
我觉得完全没必要。这种视频就是在浪费时间。
二、用 AI 学 AI 才是最快的路
我帮很多同事装过 Claude Code,他们用完和我有一个共同体验——「AI 这件事,真的得用 AI 来学 AI」。
最近大家都说 OpenAI 的 GPT image2 模型做故事板拼短视频效果特别好。我也一直没时间学。
今天就一镜到底,全程演示我怎么用 Claude Code 学一个完全没碰过的 AI 新工具。
三、不是「给指令」,是「沟通需求」
打开 Claude Code,我没直接让它出图。我先讲清楚我要什么——
「我想系统学 GPT image2 做故事板拼短视频。你要建一个多智能体团队深度调研最佳实践,再带我一步一步真实操作,最后把视频生成出来。」
然后它开始反问。问的第一件事就让我修正了它的理解——它以为我要「故事书(绘本)」,我说不是,是影视行业的 storyboard,导演的分镜头。
一个好的智能体,一定是交互式的。不是搜索引擎那种「我给一句你给结果」。充分沟通了解需求之后给的结果,才是好结果。
四、API key 怎么安全地交给 Claude Code
调研做完了,要真出图。OpenAI API key 怎么处理?
千万别直接粘到对话窗口里——会泄露。
我的做法:在 D 盘随便建个 txt 文件,把 key 粘进去,把文件拖到 Claude Code 窗口。Claude Code 自动读进环境变量,之后跟它说「用这个 key」就行。
录完节目我会把这个 key 注销掉。大家都看到了,还是有泄露风险。
五、看结果,看反思,不看过程
跑完出来一个网页:完整的故事构思、主角设定、视觉参考、三幕结构、调用接口的全过程,加一段 30 秒拼接的科幻短片。
镜头连续性和场景一致性差点意思,但作为一次「从零调研到成片」的全流程演示已经很完整了。
我承认它大概率偷懒了——我电脑上有大量做 AI 短剧的记忆,它复用了我之前积累的文档。
但这恰恰是核心:你不必每次都一气呵成跑成功。用 Claude Code 调研 + 学习 AI 新工具的可能性已经存在了。一次失败的过程也是探索更新更好实现方式的过程。
收尾
拿到 Claude Code 之后,一定要用最好的模型,用 AI 学 AI。
剩下的,开动起来就行。
来源:EP0010_audio.mp3 · ASR 模型 gemini-2.5-pro · 12 分钟原片完整文字版
[00:00] 回来了啊朋友们,欢迎回到拼拼的 AI 频道。那今天是周末的第一天,讲点什么好呢,我们来讲一下怎么用 AI 学习吧。跟很多原来在大厂的同事聊天啊,他们都是做到了管理层的位置啊,年薪也比较的丰厚,几十万、上百万甚至几百万的都有。但是压力真的很大,就是每次跟老板汇报的时候,老板都会不断地去挑战说:你有没有做到降本增效啊?你有没有用到 AI 去赋能现有的一些业务?这一个一个讲起来,都是觉得下一秒可能就要领大礼包走人了。
[00:31] 包括我自己学 AI 的时候也走了很多的弯路。那现在市面上这些大家能刷到的博主啊,他们很多都是新闻式的视频,就是告诉你这个工具又出了,然后它怎么哇塞了、怎么厉害了,谁谁谁又丢工作了对吧。那这些博主他自己甚至都没有用过这些工具,他就直接开始给你去渲染这些工具的好,去制造这些焦虑。我觉得完全没必要。那这些视频看起来也是完全在浪费时间。所以这也就是为什么我要用这样的一种一镜到底的方式,去给大家分享我是怎么样去用 AI 的。
[00:59] 我也帮很多同事去装这个 Claude Code 嘛,他们在用了之后,我们其实有一个共同的一个体验,就是 AI 这件事情,真的去用 AI 学 AI 是一个最好的方式。那最近呢网上有很多人就说这个 GPT 的 image2 这个模型做故事书去做这个短视频是非常好的。那我也一直没有时间去学。那我今天就带着大家一步一步地,把我如何用 AI 去学习 AI 新技术的这方式分享给大家。那视频还是很长啊,点赞收藏回去慢慢看。
[01:28] 那我们同样也是先打开 Claude Code 的这样的一个页面,那我们把我们的目的去告诉他。我最近听说有很多人使用 GPT image2 的模型去制作故事书,然后把故事书变成短视频,生成出来的效果是非常好的。那我想系统性地去学习这样的一个 AI 生成的方式。那我不只需要你建立一个多智能体的团队去深度的调研别人做这件事情的最佳实践,那我还需要你带着我一步一步地去真实的操作,最终把这个视频生成出来。
[02:01] 那你看我们其实跟 AI 说的是我们要去做一件什么样的事情。那我也明确了需求说除了要去学习这件事情,我还需要他一步一步地带着我把这个视频生成出来。因为昨天前两天的视频非常的火啊,就很多人留言说,你其实我没有讲得很细,包括一些 API 的申请啊、怎么样的调用啊,这些东西有的没讲对吧。那我们今天就把这个过程全面的展示出来。那同样啊这个 AI 思考的这个过程我会加速,这样节省一下大家的时间。
[02:31] 好这个时候他其实就跟我沟通嘛,一个好的智能体一定是交互式地进行的,而不是说我们就像对待搜索引擎那样,就给他一句话他就直接给结果,其实这样的结果反而是不好的。反而是充分沟通了解了我们的需求之后,他给到的结果是更好的。
[02:46] 那他问我是哪个方向的故事书。那这个时候就其实我就发现是说他的理解是有错误的,并不是一本故事书,而是影视行业里面那个叫 storyboard。我说的并不是一个绘本,而是影视制作当中的那个故事板,或者是导演的分镜头。而且我需要用到的模型是 GPT 最新的 image 2,而不是之前的老版本的模型,这一点一定要区分清楚。那我们可以去做一些……我们可以把我们今天的学习的过程做出一个信息版来,然后也可以去把这个过程做成一个小 15 秒的一个短片。
[03:28] OK,那他又问我说这个目标平台和市场。那这样,这个我只是想去做一个学习,所以我们只需要用一张故事板,生成 15 秒的 Seedance 2.0 的视频就可以了。他问我说故事的素材在哪里。就像我刚才说的,我们把我们今天的学习过程做成一个小的故事。我们优先使用官方的付费 API,你可以教我如何去申请 API。那同时我们这是一个学习的过程,先不用考虑预算。OK,发现这个 Seedance,Seedance 它其实识别错了,我们把它修改一下:使用字节跳动的 Seedance 2.0 的模型。
[04:14] 好,它现在做完了,我们来看一下啊。OK,它已经收到了说我们是做故事板,不是故事书。然后 Seedance 它也把我的语音输入法识别错误的转换过来了。四个调研都已经回来了。第一个是说模型已经确认了,然后都有 API,业界是有 SOP 的。好,那它现在有些问题给到我啊。
[04:43] 对,虽然我已经有了 OpenAI 的 API,但是这是一个教学的演示,那也请你一步一步的带着我们来申请 API,包括网页的地址啊什么都要给到我们。然后题材方向:OK,它还是觉得我们要做一个视频啊。那这样吧,我们去做一个科幻题材,就是宇宙探索的题材的一个影片的开场吧。我们今天就先申请 OpenAI 的 API,那火山引擎的 API 我已经有了,但是因为今天时间有限,所以我们就不展示火山引擎的过程了。
[05:35] OK,回来了,这个调研的任务,然后又有些问题问到我们。他问这个剧本和角色的设定是否需要调整。那他给了我们一个简单的剧本,因为我们是学习嘛,那我们就说全部保留直接出图。但是你需要告诉我出图的提示词是什么。出图方式,我自己跑脚本,不用。OK,你带我调用 API 出图,但是把整个过程你的操作详细的步骤告诉我。好出图的规格,官方的规格。
[06:10] 因为现在确实 GPT image 2 的质量特别的高现在,因为我之前用它有做过海报,海报嘛但是没有做过故事书。所以它这个里面推荐的是 GPT image 2 目前应该是最高的一个分辨率的话,就是 2K 九宫格的这样一种方式。但是有点奇怪,变成正方形的比例了。没所谓先继续吧。我觉得这先不继续,是这样我先问他一下对:我们的这个故事,我想生成 16:9 的横屏的样式,请你再确认一下网上其他人生成功故事板的方案是否是 1:1 的比例还是要 16:9 的比例。
[06:46] 而且这个故事板的方案跟之前 Sora 九宫格出图的方案是不一样的,它应该除了分镜之外,还会要有一些额外的解释和说明。千万要去确认你拿到的方案是最新的最佳实践。好它识别正确,我们让它再去进行一轮的研究。
[07:15] 好它现在又反馈给我一些需要我决策的地方。第一个是说,角色板和故事板的提示词我计划怎么动。OK,直接出图吧我们做演示嘛。API key 怎么提供给它调用?我存到一个文件里面然后给你文件的路径。出图策略:OK 继续。
[07:44] 好我们这个 API 申请的这个教程出来了,我们看一下。来它做了一个网页版的,一个 OpenAI API 申请的完整教学。那这里面其实从申请的注意事项、到准备工作、到怎么样去注册账号和申请 API 全部都是全的。但是因为某些原因,我们有些内容不能分享,所以我们直接从——我看看——创建 API 开始吧。
[08:13] OK,那它这里面会直接把链接给到我们,我们直接点击之后就可以进到这个 OpenAI 的管理页面。那这个页面是我已经注册账号、登录好的一个状态啊,这里也是配置好了它的支付的方式。但我们进到这个界面设置的界面之后呢,其实可以进到 API keys,在这里面大家可以看到这里面已经有三个我正在使用的 key 了。那我这里可以去创建一个新的 key,那这个名字为比如说叫分享吧。那选择一个项目,那它的这个许可是所有的都可以的。我们直接点击创建这个密钥,创建完了之后就可以把这个密钥直接拷贝下来。
[08:54] 拷贝下来之后我们接下来怎么做呢?我们把它在 D 盘随便创建一个文本文件,只需要把这个 key 粘进去,就可以保存它。并且把这个文件拖到这个窗口里面来。比如说我把 API key 放到这个文档里了,请把它妥善的保存,不要在任何记录的明文当中出现。
[09:19] 好那我们把这个 key 做了一个应用,它会把它自动的存到 Claude Code 的环境量里面去。之后只要跟它提及说我们要使用这个 key,它就可以自动的去应用了。大家千万不要把这个 API key 直接粘到这个对话窗口里面去,因为确实它是有泄露的风险。那刚才的那个 key,我在今天录完视频之后我也会把它注销掉,因为还是会有这个毕竟大家都看到了嘛对吧,还是会有泄露的风险。
[09:49] 好的你继续做吧,然后做完了之后,把所有的过程的提示词然后图片包括最终生成的视频放在一个网页里面,进行一个分享式的展示。我们看最后的结果。
[10:03] 好我们看到这个结果回来了,我们打开网页看一下。它已经生成了这一段 30 秒的视频,三段拼接的我们先看一下效果。
[10:29] 效果感觉还不错啊,但是镜头与镜头之间的连续性还是差一点。然后它的场景的一致性还是差一点。那我们可以看到说,但是已经是一个很不错的一个状态了,它一次性帮我做到了这样的一个水准。那我们看到它从这个故事的构思、它的主角的设定,以及它的视觉参考、它的三幕结构的设计,和它整个过程当中采用过的坑它做的反复的尝试,最终是怎样去完成这个项目的,它是怎样调用接口的,它是一步一步如何去写提示词的。它的提示词的英文版以及中文版的一个解释。它生成的角色三视图的参考图。
[11:02] 那很显然它应该也是遇到了这个 Seedance 2.0 的真人的一个限制,它是没有办法直接用真人形象生成视频的。所以它又把这个图片又转换成了铅笔稿的一个样式,这个故事板,然后包括它的角色也转换成了铅笔稿的样子。然后它生成视频之后,又把视频进行了一个 FFmpeg 的一个拼接。它整个过程包括它踩过的所有的坑,包括所有的复现你要怎么怎么去做,然后怎么去看到它完整的一个 prompt、它的提示词。这已经是一个很完整的一个自学的一个教程了。
[11:32] 那我们当你们自己在做这个过程的时候,可能没有这么顺利啊。因为看过我前几期视频的朋友们都知道,我做了一个 AI 去做短剧的一个平台,所以在我的 Claude Code 里面它有大量的记忆关于视频生成、包括它的接口该怎么调用啊、包括它如何去避坑啊。这些其实它我觉得它大概率偷懒了,它应该是用到了我之前记忆当中的一些这个文档去生成的这样的一个教程。
[11:54] 但是没关系,我们可以看到说,现在用 Claude Code 用 AI 去调研、去学习 AI 的它的一个可能性。我们即便不能一次性生成这样的一个教程,那其实也可以在一次一次它失败的过程当中去探索更新的、甚至是说探索更好的一种实现的方式。这都是有可能的。并不是说我记忆里的这样的一个完成方式就一定是最好的。
[12:14] 所以真的开动起来吧,就是拿到 Claude Code 之后,我们一定要用最好的模型,用 AI 去学习 AI。那有什么问题呢可以在评论区@我,那我们下期再见,拜拜。