效果进步太大了!
除了我自己的配音,画面、音效、配乐都是它写代码做出来的,没调用任何视频生成模型。
下面是对比视频,左边 GPT-6 Astra,右边 Opus 5.5。
放在一起看,Opus5.5 在分镜、动画、音乐制作上,都有很大的提升。
而且不只是我。这几天 X 上有不少人拿 Opus 5.5 做视频。
用户 @shneural 给两个模型同一个提示词,前半段是 Opus 5.5,后半段是 GPT-6 Astra。
另一组对比。 用户 @AniSri016 让两边做 15 秒动态图形,讲各自公司的模型演进。
GitHub 万星视频 Skill 的作者 @VincentWei93 说这条 Anthropic 发展史是 Opus 5.5 一句话做出来的,画面、背景音乐、音效全部由代码生成。
下面一个环节一个环节看,Opus 5.5 到底提升在哪里!
01 · 分镜:一台电脑,演完整条片分镜就是每个画面里的逻辑:口播说到的东西,放在画面哪里、怎么摆。
讲 Tibo 做判断这一段,左边原版放的是推文截图,十几秒一直是这一张;右边是 Opus 5.5 做的同一段:
这样对比下来,Opus 的分镜设计,内容更加丰富,更能抓住眼球。
放到整条视频看,Opus 是怎么组织画面的:
视频里有两处,我觉得设计得特别好:
- 电脑发烫:机身变红、冒热气,风扇猛转,内存条一路往上涨,“扛不住”一眼就能看出来。
- 云端任务:Grok Bot 的云里放着一台电脑,本地的任务一个个搬进去,“交给云端”就这样被画出来了。
分镜决定画面里放什么,动画决定它们怎么动:口播说到一个动作,画面要把它从头演到尾,有起点、有过程、有结果。
Opus 5.5 的很多动画做得很好,挑几段看看:
好在哪:动得有重量、有衔接,东西从一个样子自然变成另一个样子,而不是跳过去。
03 · 节奏:先憋住,再炸开节奏就是情绪怎么推进:先铺垫,一点点往上推,推到高点爆一下,再停下来喘口气。画面和声音都跟着这条情绪线走。
挑两段看:
好在哪:情绪有起有落。先憋住,炸开才有力;一点点往上推,高点才够高。
04 · 音效:每一声,都是代码造的动画让画面动起来,音效让动作有声音:东西弹出来“啵”一声,飞走“嗖”一声,砸下来“咚”一声。
这些声音,全是 Opus 5.5 写代码“造”出来的。没有素材库,也没有用 AI 音效工具,每一个“啵”、每一声“嗖”,都是它用代码从最基本的声波合成的。
挑两段看:
好在哪:声音是它自己造的,也是它自己对上的,画面和声音严丝合缝。
05 · 配乐:不找歌,自己写配乐是垫在整条视频底下的音乐。前面说的情绪线,很大一部分靠它撑起来。
这段配乐也是 Opus 5.5 写代码做的:没有找现成的歌,也没有用 AI 音乐模型。
Opus 5.5 指明了未来的一个方向:一个 Agent,把一条视频从分镜做到配乐,全都完成了。
code is all you need!