Opus,掀了AIGC的桌子

Opus,掀了AIGC的桌子

2026-09-29 22:08:34 0点赞 2收藏 1评论
Opus,掀了AIGC的桌子

2026年9月末,Anthropic发布了Claude Opus 5.5。

最初,人们以为这又是一次常规的旗舰迭代。但真正让整个科技圈陷入疯狂的,发生在发布后的几天里。X的时间线上,突然被一种前所未有的视频内容淹没:有人用纯代码搓出了一支完整的音乐MV,有人让模型连续工作12小时,从零生成一部动画短片。

这些视频的共同点是:Opus 5.5没有输出任何一帧视频画面。它做的是另一件事——写代码,让代码去画画面,电脑把画面一帧帧存下来,拼成视频。

当一个“会写代码”的模型,交出来的不是代码,是视频时,AI视频的叙事就被彻底改写了。

——

不是生成,是“导演”

要理解Opus 5.5的视频能力,需要先理解它和Sora、Seedance这类视频生成模型的本质区别。

视频生成模型的逻辑是“像素级生成”。它从海量视频数据中学习画面规律,然后“画”出新的像素。这种方式的优势是能生成写实画面,但劣势同样明显:画面不可控、细节容易闪烁、无法精确编辑。

Opus 5.5走的是另一条路。它不生成像素,它生成渲染代码。常见的工具链包括HTML Canvas、p5.js、Three.js、Remotion、Manim和GSAP。Opus 5.5写出这些代码,然后通过无头浏览器逐帧渲染,再用FFmpeg合成MP4文件。

这个流程的关键在于“确定性渲染”。每一帧都是代码计算出来的结果,不是概率生成的。这意味着画面精确可控、可复现、没有生成式闪烁。对于动画、动态图形、科普讲解、产品发布片这类需要精确控制画面元素和运动轨迹的场景,代码渲染的优势是决定性的。

一位开发者用Opus 5.5生成了一个93秒的动画视频,全程无渲染依赖,一次性成功运行。这在视频生成模型上几乎不可能做到。

——

“出片潮”:从MV到科普,从商单到游戏

Opus 5.5的视频能力,在发布后一周内引发了一场全网范围的“出片潮”。

最先炸场的是音乐MV。博主donald对着电脑口述了大约5分钟的需求,然后去睡觉。12个小时后,一支2分21秒的翻拍MV已经躺在电脑里。他在提示词中写明了调用Seedance 2.5生成画面、ElevenLabs生成声音、fal跑视频生成,而Opus 5.5自己干的是导演加剪辑——决定每个镜头找谁要素材、怎么接、哪里不对要重来。这条帖子在X上被看了144万次,马斯克连发两条评论,将其推到超过660万播放。

宣传片和广告领域同样被冲击。Deedy给一家推理初创公司做了一支发布视频,用时约1分钟,成本约2美元,播放量达到32万。Pivi给产品Dictus做了一支32.5秒的手绘风宣传片,只给了一句话:“这是参考视频,分析它,然后给Dictus做一支同样风格的。”剩下的它全包了——拆帧分析风格、去代码仓库里找logo和配色、写场景、自己检查画面、自己作曲。

科普讲解是另一个被打开的场景。Deedy丢进去一篇研究论文,出来一段8分钟的3Blue1Brown风格讲解视频,25万播放。Addy Osmani用它做了40秒的“浏览器是怎么工作的”科普短片。这些视频的制作者们普遍反馈:以前需要专业动画师和剪辑师协作数周的工作,现在一个人、一句话、几个小时的等待,就能完成。

更极端的案例来自游戏开发。游戏设计师Danny Limanseta的孩子说想玩《旷野之息》那样的开放世界,他把需求丢给Opus 5.5,最多同时开6个代理,边玩边改,迭代出一款叫Wildbrush的浏览器游戏。武器是一支巨型画笔,四色对应四种效果:红色喷火、蓝色释冰、黄色弹跳、绿色长藤。2个生物群系,3个解谜地牢,30多个敌人,还有一座巨型Boss。Danny在帖子里写道:“the future is all about Imagination”。

还有开发者用一条提示词,从逻辑门开始造了一台完整的计算机,跑了约30个小时。有人让Opus 5.5用JavaScript画了一个儿童绘本+剪纸拼贴+蜡笔手绘混搭风的定格动画,分镜、节奏、转场都像模像样。

这些案例的共同特征是:Opus 5.5在写代码时练出的那套能力——拆解任务、自己改错、连续运行数小时不跑偏——被原样搬进了视频、动态设计和游戏开发。它不是一个“视频工具”,它是一个能完成复杂长程任务的Agent,视频只是它众多输出形态中的一种。

——

“一行代码没写”

Opus 5.5视频能力中最具颠覆性的部分,是它把“制作视频”的门槛降到了接近于零。

Vox Media的创意团队做了一个29秒的短片《小字》。内容是:Claude每天收到一大堆请求,它从里面圈出藏着的“人的部分”,比如一句“单手打字,宝宝睡着了”,轻轻放进罐子;到了夜里,这些字变成星星,连成星座。作者在帖子中特意强调:自己一行代码没写。

一位日本网友用Opus 5.5给自家小店做了30秒宣传片,全程只需要一句提示词。还有人用它做了Dunkin' Donuts的广告片。

这种“零门槛”不是靠简化操作流程实现的,而是靠把整个制作链条都交给模型。从分析参考视频的风格、到提取品牌素材、到编写渲染代码、到逐帧检查画面、到最终合成输出——每一个环节,Opus 5.5都能独立完成。

更值得注意的是“过夜任务”模式。donald口述5分钟需求后去睡觉,醒来MV就做好了。用户anabology照着donald公开的提示词,配上Midjourney和moodboard,同样睡一觉,醒来又一支5分多钟的MV。这意味着,视频制作从“人坐在电脑前操作”变成了“人下达指令、模型自主完成”。这是一个根本性的工作流转变。

——

“裁剪工程”:从内容创作到后期制作的渗透

Opus 5.5的视频能力不止于从零生成。它在后期制作环节的渗透同样值得关注。

有用户发现,Opus 5.5可以将自己剪辑好的视频,直接生成一个剪映工程文件——画面、字幕、配音、音效、配乐都分好轨。打开就能手动调整每一处修改。这位用户称其为“这么多公司心心念念的剪辑Agent”。

这意味着Opus 5.5正在进入一个比“生成”更广阔的市场:视频编辑和后期流程的自动化。对于短视频创作者、广告制作团队、企业宣传部门来说,繁琐的素材整理、字幕对齐、音画同步、多轨道管理,都是耗时巨大的重复劳动。如果模型能自动生成一个结构完整的工程文件,创作者只需要做最后的精修和审核,效率提升是数量级的。

另一个值得关注的方向是“调用外部模型”模式。Opus 5.5不生成写实画面,但它可以指挥Seedance、Kling、Veo这类视频生成模型去生成画面,自己负责编排和剪辑。在这种模式下,Opus 5.5扮演的是“导演”角色:它知道每个镜头需要什么,知道调用哪个模型最合适,知道怎么把不同来源的素材拼接成完整的故事。这比单纯“生成视频”更接近真实影视制作的协作逻辑。

——

桌子被掀翻之后

Opus 5.5的视频能力,掀翻的是“视频制作必须依赖视频生成模型”这个默认假设。

过去两年,AI视频的叙事一直被Sora、Runway、Kling这类模型主导。它们的进步肉眼可见,但始终受限于一个根本问题:不可控。你无法精确指定画面中每一个元素的位置和运动轨迹,无法保证两次生成的结果一致,无法在后期流程中无缝编辑。

Opus 5.5提供了另一种解法:用代码的确定性,取代生成的随机性。渲染代码是确定的,每一帧都是精确计算的结果。这种确定性让视频从“看起来像”变成了“确实是这样”。对于需要精确控制画面的场景——科普动画、产品演示、品牌宣传片、教育视频——确定性比写实性更重要。

更深层的变化在于,Opus 5.5证明了编程能力可以泛化为视频制作能力。当模型能写出复杂的渲染代码、能连续运行12小时不偏离目标、能自主拆解“做一支MV”这样的模糊指令时,它就不再只是一个“写代码的工具”,而是一个能完成复杂创意项目的Agent。视频只是这种能力的第一个出圈场景。音乐、3D建模、UI设计、游戏开发——这些都在以同样的方式被渗透。

GPU编程教育者Elliot Arledge放出了一首约3分10秒的歌《Chasing the Roofline》,歌词由Opus 5.5写,曲子用开源音乐模型ACE-Step 1.5在一张3090上跑出来。有人用它做了AI简史动画,从“Attention Is All You Need”讲到AGI,带配音带配乐。

当视频、音乐、动画、游戏都能由同一个模型用同一种方式——写代码——来完成时,“AI视频模型”这个品类本身,可能就会消失。它被一个更大的品类取代了:能自主完成复杂创意任务的通用Agent。

Opus 5.5掀了桌子。桌上的东西——视频生成模型、动画工具、剪辑软件、游戏引擎——都还在,但坐在这张桌子前的人变了。他们不再需要掌握这些工具,他们只需要告诉Opus 5.5:我想做什么。

作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

展开 收起
1评论

  • 精彩
  • 最新
  • 这次不一样

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
2
扫一下,分享更方便,购买更轻松