发展趋势量子位5/10

视频后期,危!MiniMax H3手绘即特效,多模态的「Coding时刻」来了

By Jay

视频后期,危!MiniMax H3手绘即特效,多模态的「Coding时刻」来了
图源:量子位

AI 摘要

尽显AGI黄金时代的奢华

原文正文

视频后期,危!MiniMax H3手绘即特效,多模态的「Coding时刻」来了

尽显AGI黄金时代的奢华

Jay 发自 凹非寺

量子位 | 公众号 QbitAI

视频后期,危。

就在刚刚,MiniMax正式发布了全新一代视频模型——MiniMax H3。

也是他们的首个开源视频模型。

坦率地讲,这是今年继Seedance之后,第二个让我感到「后背发凉」的时刻。

现在,你可以直出这类「手绘」视频特效,宛如魔法一样。

无论是添加灵动的花体字,还是渲染复杂的字幕动画,它都能直接端到端生成。

并且清晰度默认2K。

如果你也是名AI视频玩家,应该知道我想说什么。

过去一年,视频模型因Scaling红利已获得了突飞猛进,但至今有一项定位未曾变化:它们只负责为你提供「一段素材」。

素材生成后呢?你还得把它拖进PR里,加字幕、调色、做转场、配音乐、套模板……反正后面还有「一万件」事在等着你。

但H3彻底打破了这个范式。

它将剪辑逻辑、字体排版、转场设计、节奏把控、背景音乐以及视觉特效,全部「端到端」地集成到了模型之中。

输入一段文本,它直接还你一个可以一键发布的成品。

X上也是玩疯了,海外开发者们已经玩疯了,社区公认其为全新的SOTA视频模型。

在新鲜出炉的Artificial Analysis榜单上,H3也是毫无疑问地斩获了视频编辑的第一。

也是很神奇,唯一开放权重的竟然也是第一名。

说实话,我曾一直固执地认为,「后期」会是人类创作者最后的护城河。

AI或许能生成精美的素材,但如何运用剪辑技巧、光影调度与特效来「讲故事」,这些必然需要人类独有的主观审美与情感共鸣。

现在我收回这句话。

MiniMax H3新鲜出炉

看到消息后,我立马打开官网,开始实测。

正式开始测试,我决定先跑一个简单的男团「出道花絮」热热身,看看这个模型的基础能力怎么样。

我把如今硅谷AI圈最嚣张的三个男人放在了一起。Sam Altman、Dario Amodei、马斯克。

我管这个新男团叫「AGI Boys」(doge)。

生成完第一遍我就觉得有点离谱了。

说实话,之前看到官方demo里那些手绘视觉特效、动态片头、混剪预告,说实话心里是有点怀疑的。

抽了几次卡之后,我服了……

这个模型,对用户意图的嗅觉真的异常灵敏,只用给文本,就马上能理解我想要什么视觉和剪辑风格。

就比如下面这个模型宣传片,我就只在prompt里加了一个tag,苹果发布会风格,然后H3就直出了一个平行宇宙中的「苹果版MiniMax」。

说实话,这个玻璃特效、这个渐变,太对味了……

然后我决定上强度。

这次的年度大戏主题名为「AGI复仇者联盟」,Dario和马斯克联手,准备找Sam Altman一雪前耻。

我写了一版非常长的prompt,大概描述了一个六分镜的预告片。每个分镜我都写了不同的情绪方向、表演逻辑,并且节奏相当快。

结果,我给的每个分镜,H3都完美遵守了。

尤其是后面蒙太奇Dario崩溃捶桌子那段,你要知道,我这周刚看完《痴迷》,这视频直接给我干PTSD了……

对了,你别说,掉小珍珠的Dario竟然也别有一番风味。

阅读原文
视频后期,危!MiniMax H3手绘即特效,多模态的「Coding时刻」来了 · AI Daily