和旗舰模型同题交卷,国产新模型在前端创作上不落下风

中秋刚过,国庆又到。

AI 圈却没跟着放假。

新模型还是一个接一个上线。

旗舰忙着刷新上限。

速度档的模型,则盯着日常工作。

后者的能力越涨。

两者的分工就越模糊。

过去要请出旗舰才能做的任务,如今交给名字里带 Flash 的模型。

能做到什么程度,值得先看看。

前端创作是个很直观的窗口。

把作品摆在一起。

配色和排版的高低,一眼就能看出来。

对做 AI工具 的人来说,这也是现成的参照。

上个月,一家海外厂商推出了新旗舰。

在 X 上,有人拿它做动态作品集。

也有人让它画水墨动画。

这些用代码做出来的作品,已经有了各自的风格。

最近,一款国产模型成了 X 网友的新宠。

它上线不久,代号 M3.1。

MiniMax 产品界面截图

这个模型此前以「太空兔」的名义,在开发者圈里流传。

后来有人把它对上了 M 系列。

还有人提议,用测试旗舰的那套题目来试试它。

X 用户推荐帖截图

名字里带着 Flash,通常先让人想到速度和便宜。

但我们更想验证另一件事。

它在前端创作上,能不能和旗舰掰一掰手腕。

MiniMax Code 界面截图

做法很简单。

沿用旗舰优质案例的公开提示词。

比视觉风格,也比动效编排和整体完成度。

再换更多题材,看它的多维度能力。

第一题是一段 15 秒的动态设计作品集。

最后要交付一个成片文件。

这类活计,其实就是典型的 AI编程 场景。

没有指定配色和字体,也没写分镜。

除了时长和用途,怎么设计基本交给模型自己定。

它给出的成片里,米白色大字铺满黑色背景。

荧光绿从字母背后亮起。

文字退场。

圆环和三角形沿轨道运动。

接着浮出波形和跳动的数字。

末尾补上一份能力列表。

短短 15 秒,字体和几何图形轮番登场。

数据动效也穿插其中。

始终沿用黑底配荧光绿。

M3.1 Flash 动态设计作品集

同题不同解。

设计上难分高下。

这个创意来自 X 上的一支旗舰作品集。

我们沿用了作者公开的提示词。

只追加了成片交付这一条要求。

旗舰作品与 M3.1 Flash 成片对比

左边是原作者标注的旗舰作品。

右边是 M3.1 做出的成片。

这类 AI视频 作品,拼的不只是画面好看。

左边那版把大字排版和缓动曲线轮番摆出来。

像在展示一组动效练习。

右边这版把圆环和波形收进黑底荧光绿的体系里。

它更像一支有主题的科技短片。

两版路子不同。

如果让我给一个科技项目选方向,我会更偏向 M3.1 这版。

大字和细线的大小与疏密都在变。

配色始终统一。

段落之间也看得出联系。

整体感更强。

至少在这一题上,它已经能和旗舰同台比较。

风格更统一。

作品的组织也更完整。

选择它,不需要先说服自己接受一个明显逊色的设计。

MiniMax 界面需求截图

对多模态的理解,藏在场景细节里。

一支科技短片做得漂亮,还不足以说明问题。

换个题材,才看得出它会不会一直沿用同一套视觉习惯。

这一题更考验人。

「人生的意义」是另一个来自 X 的创意。

交给 M3.1 之后,它变成了一支手绘短片。

米色纸张上铺着绿色山丘。

一个小人开始追问这一切是为了什么。

场景随后换成方格纸。

沿路立起「更多」「更快」「完美」的路牌。

走完一圈,画面里的问号反而更大。

答案落在了小处。

手绘短片《人生的意义》画面

问号逐渐分解。

故事落到几件小事上。

有人准备了食物,一个笑话逗乐了朋友,种下的植物长了出来。

还有雨天,有猫,也有自己做的一件小作品。

模型把这些片段排成一面纸片墙。

前面还在找一个大答案。

后面已经开始看一顿饭、一株植物。

我觉得这里最合适的设计,是它选了手账的形式。

纸片和铅笔线贯穿前后。

小插画也是。

它既接得住开场的追问,也装得下后面那些不起眼的日常。

接着我们复刻了网友用旗舰做过的一支水墨动画。

水墨动画画面

浅色纸面上,荷叶的叶脉清晰可见。

蝌蚪拖着细尾巴游过池塘。

一路遇见鱼和鸭子,还有乌龟和螃蟹。

最后它来到青蛙身边。

字幕伴着故事出现。

水墨和纸张撑起全片底色。

沿用同样的创作要求,M3.1 也交出了完整的作品。

它没有停在复刻某一帧。

纸张质感和角色运动,被它一路贯穿到底。

完成度不低。

第三题,我把画面的变化交给了一条时间轴。

这题要的是交互。

纽约天际线交互作品

起初是橙红色的天空映在水面上。

桥和楼群挡住部分夕阳。

拖动底部的时间轴,天空渐暗。

楼里的窗灯一盏盏亮起。

河面也从暖色反光,变成细碎的夜景倒影。

我更喜欢这一版对水面的处理。

白天是大块暖色。

入夜后,亮起的窗户在水上留下点点碎光。

层次很清楚。

桥和楼群随同一条时间轴变化。

天空和倒影也一样。

停在哪个时刻,就得到哪一幅画面。

短片由模型安排观看顺序。

交互作品则把一部分控制权交给用户。

时间轴拖到哪,场景就得给出对应状态。

到了游戏里,画面还要跟着玩家的操作持续变化。

我们把要求又推进到一款街机卡丁车游戏。

蓝天和绿地组成赛道。

红白路肩划出弯道。

从选车到竞速再到结算,一场比赛被串成了完整流程。

街机卡丁车游戏原型

水下探索换了一种节奏。

潜艇缓缓驶过被海水吞没的植物园。

青绿色雾气交代出远近层次。

探照灯又补上一层。

它转向时保留了惯性。

靠近地标,又会慢慢浮出扫描提示。

探索因此沉静下来。

也给玩家留出发现细节的空间。

水下探索游戏画面

小幽灵的叙事游戏,则把场景藏进深秋农庄的夜色。

篝火照亮附近的玉米和木栅栏。

屋内的暖光与绿色门光,引导着调查方向。

我喜欢它留下的大片黑色空间。

有限的光照,让几件遗物和灯更显眼。

每一次靠近和互动,都带上了故事感。

氛围做得足。

小幽灵叙事游戏画面

前端作品的难,正是在这些细节里堆出来的。

画面和动画逻辑决定体验。

用户操作也占一大块。

单把某一块做好,还不足以完成整个作品。

从动态作品集到手绘,再到交互场景和游戏原型,两边各有取舍。

这个速度档的定位,没有成为完成度上的明显短板。

与其每次都请出最强的旗舰,不如按任务难度挑一档。

改稿界面记录

从智能的高度,到使用的广度。

当它在这些任务上交出了能和旗舰掰手腕的结果,选择它的理由也就多了一条。

除了速度和成本,作品本身的设计与完成度,同样算数。

前端表现的背后,是设计理解、审美和代码能力的共同作用。

据介绍,这个系列从预训练起点就做多模态混合训练。

视觉与代码的协同,是理解它前端能力的一个观察方向。

创作者可以把更多具体设计交给它。

自己只负责定方向和判效果。

分工很清楚。

对多数日常任务来说,用户已经没必要时刻调用最强的旗舰。

智能体开始连续搜索和整理。

它还要调用工具,来生成内容。

单次回答的聪明程度,已经决定不了整体体验。

一个任务可能连着调用模型几十次。

等待时间和调用成本,会在完整流程里不断累积。

账要算总账。

前面那些前端案例,其实也对应真实需求。

动态作品集可以展示设计能力。

手绘短片能当创意样稿。

小游戏则用来验证活动玩法。

都能落到用处。

把想法变成能看、能操作的作品,团队讨论方案会快很多。

配色和动效每改一次,都可能带来新一轮模型调用。

如果它能持续交付符合需求的效果,速度和成本的优势就能帮上忙。

创作者的预算有限。

多试几套方案也更从容。

要速度,要质量,还要压低价格,这依旧是不可能三角。

但这个速度档的模型,正在改变三者之间的交换比例。

过去只有旗舰才能处理的编程任务,如今用更低的成本和更快的速度也能完成。

能力上限仍然重要。

与其盯着参数表上的数字,不如先看它能不能稳定交货。

能稳定走进开发流程的能力,才更容易变成实际生产力。

速度、质量与价格取舍示意

从这个角度看,速度档模型之于旗舰,有点像当年的个人电脑之于大型机。

大型机曾把昂贵的算力集中在少数机构手里。

个人电脑靠标准化和规模生产,把算力带进办公室和普通家庭。

当智能也成为随时可调用的标准组件,一个更庞大的应用市场才会出现。

个人电脑普及之后,产业价值逐渐流向操作系统和芯片。

软件生态也是受益者。

速度档模型普及之后,AI 的价值可能更多流向智能体。

工作流和专有数据的入口,也会占到大头。

价值会搬家。

旗舰继续去探智能的边界。

这类模型则把已经验证的能力,带进高频的开发场景。

而未来更丰厚的利润,也许属于那些真正知道怎么用好这些智能的产品。