30秒视频一帧没"生成"、一分钟只花2美元:冲Opus 5.5"一句话直出"这波前,先把两本账算清楚
这两天你的首页大概率被同一类东西刷屏了:一句话丢给 Opus 5.5,几分钟到几小时后,一支一镜到底、字幕不糊、音效卡点的成片直接躺在那里。有人看完直言自己被刷屏画面的反应是"瘫坐在椅子上"。 也有人冷笑:这不就是会自动播放的 PPT 吗?小红书
更热闹的是,连 Anthropic 自己 9 月 22 日发 Opus 5.5 的那个官方页面,压根没打算讲"视频"这件事。 一场全网刷屏的视频狂欢,主角却对视频只字不提——这事本身就不对劲。先别急着开会员,把这波拆开看。知乎专栏

先把最大的误会拆掉:那些刷屏片子,一帧都不是"生成"的
这是整件事里最反常识、也最少被讲清楚的一点。
Anthropic 官方文档里把边界划得很死,原话的意思是 Claude 可以看图,但不能生成、制作、编辑或创建图像。 那视频哪来的?答案是:写程序画出来的。知乎
完整链路是模型先写出包含 HTML 或 React 的网页代码、配上 GSAP 这类动画库,再由无头浏览器、Playwright、FFmpeg 以及 Remotion、HeyGen 开源的 HyperFrames 这类框架逐帧截图合成视频。知乎
Hacker News 上有条评论说得直白:用过渡动画创建 HTML 演示从 Opus 4.6 开始就有了,用 playwright/ffmpeg 录下来算不上模型的新本事。知乎
但"只是录屏"不等于"做得不好",恰恰相反,这条路线的几个"不崩",全是白送的:
每一帧只由时间参数决定:同一份代码每次渲染结果完全一致,不存在抽卡抽歪;
字幕和中文不会糊:那是真的字体渲染,不是扩散模型硬猜的笔画;
音画同步是算出来的,不是对出来的:有创作者实测,模型把每个音频尖峰的时间先导出来,照着时间表合成音效,心跳声、放电的咔哒声全卡在点上。
一支 30 秒的脑机接口科普片实测下来:模型写了七百多行代码把每一帧画出来、再用代码合成配乐,1080p 一镜到底,中间自己抽帧检查,发现标签重叠自己改完重渲,全程没让人开口。 用的是 Pro 订阅,5 小时额度只烧了 5%。知乎
成本的四五个真实样本,比"0 成本"口号诚实得多
我这两天把能找到的公开实测都翻了一遍,成本长这样:
30 秒讲解视频:Pro 额度 5 小时窗口消耗约 5%;
1 分钟创业产品发布片:约 2 美元。另有作者自报一支讲解片的生成过程约 4 分钟、模型费约 0.66 美元,还不含渲染和重试的成本。知乎
B 站有人用一句话让 Opus 5.5 参考音频做 60-70 秒动效,晒出的用量是一串数字。 输入 Token 249 万、输出 Token 33 万、请求 323 次——额度大户走的是这种打法。哔哩哔哩
国内跟进的 MiniMax M3.1 Flash 实测:25.7 分钟后出一部 88 秒实验短片,画面、旁白、雨声全是代码生成。
被马斯克称为"神作"的那支 5 分钟 MV,口径是模型连续自主工作了约 12 小时。
注意最后两条:这类路线的真实成本大头不是模型账单,是渲染等待、自主检查重试、以及长任务占用的额度窗口。"模型费 0.66 美元"和"一晚上占着一台机器跑 12 小时"是两本账,卖课的通常只给你看第一本。
反方叙事也得摆上桌:"一句话"仨字,省略了大概一万字
海外有做动态设计的创作者写长文把这些刷屏作品逐个拆开,结论很扎心:一次生成,不等于一句没准备的文字。

那些看起来随手一句话就出片的案例,幕后往往有上万字的导演说明打底。知乎
原文还给了几条"幕后规矩",比"做得高级一点"具体得多:每一帧由时间参数 t 决定、禁用依赖上一帧状态的临时计时器、随机纹理使用固定种子,每轮导出联系表并检查开头、手机尺寸和循环接缝。知乎
更麻烦的是同质化:相同任务描述会把作品推向相近的文字、渐变、卡片和转场,一句话验证的是工具,不是创意。 真要用它做品牌片,得把产品网址、logo、颜色、字体、真实截图喂进去,先让模型拆出镜头表;画面里的价格和界面数据必须来自产品本身,不能为了动画顺滑瞎编。知乎
所以这波真正被压缩的,是"手工搭动画"的那部分劳动量。审美、分镜、取舍,一样没消失,只是从你手里挪到了你写给模型的那一万字里。
三类镜头三种去处:对号入座再决定要不要跟
把上面两本账合起来,答案其实很干脆——这不是"Opus 5.5 替代 Seedance"的问题,是两种物理规律不同的工具:
该立刻换过去的:科普动画、产品演示、技术讲解、数据可视化、UI 动效。这类片子要的就是"不糊、不错、可改",代码渲染路线全占。改个颜色?视频模型得重抽卡、人物可能整个变掉;这边改个数字,两分钟后重渲完事。
别硬换的:真人质感镜头、氛围片、角色短剧。实拍类画面仍然是 Seedance、即梦、可灵们的主场,让代码去画"肉眼看世界的样子",是走错了赛道。接过历史人物商单的创作者就碰过这堵墙:正面人像 AI 根本不给你生成。知乎
接下来半年大多数人的形态:两条路线混着用。生成模型出画面素材和角色,代码渲染管字幕、图表、包装和音画对齐;或者反过来,用 Agent 把整个"生成—渲染—审片—修改"的闭环串起来。
要不要自己上手跟这波,取决于一个很现实的门槛:你得有终端,能备好 Node.js 22 或更新版本、ffmpeg 和无头浏览器,让 Agent 自己渲染、自己看回放。 只有聊天框、没有执行环境的,先用各家现成的 Agent 产品试水,别硬搭。知乎

国庆前这波,值得盯的三个信号
假期临近,正是小批量试产的时间窗。跟进之前,建议盯三件事:
国产工具会不会把这条链子产品化。OpenRouter 上那只在 Opus 5.5 刷屏同期上线的匿名模型"Space Bunny",9 月 27 日 MiniMax 正式上线了推理强度六档可调的新 Flash 模型,参数与兔子如出一辙。 GitHub 热榜第一的 OpenMontage 也走"一句话进、成片出"的路线。工具方补齐渲染链产品化的速度,决定这波是阶层固化还是又一次洗牌。知乎
生成模型的定价会不会被打。快手可灵 AI 4.0 已放话 10 月上线,将支持 4K HDR 与 30 秒视频生成。 即梦积分账、Seedance 折扣这些"按秒收费"体系,正在被一个"按额度算"的对手背刺。谁降价,谁就替你决定该把产能放哪边。知乎
同质化反噬什么时候到。今天刷十条"一句话直出"还觉得震撼,两周后观众对渐变卡片转场免疫的那天,就是纯提示词玩家退场的那天。能留下来的差异化,都在那一万字的导演说明里。
一句话收尾:这波"直出"确实真,但它直出来的不是画面,是一段可以被你反复改的代码。想清楚你要的是抽卡的运气还是工程的确定性,再决定国庆这几天,是把额度烧在提示词上,还是烧在渲染循环里。