GPT-6 Astra实测剪视频:三个机位访谈素材丢给AI,字幕错字它自己改了几十处

GPT-6 Astra 上线那两天,我正琢磨视频剪辑这行会不会变天,就刷到一条实测视频。视频里的人是个做访谈节目的主理人,他拿新模型干的第一件事,是把一期访谈的剪辑整个外包给 AI,干完得出结论,初级剪辑暂时不用招了。我一开始当标题党看,耐着性子看完,觉得这事值得记一笔。

他手上压着的那期访谈,是三个机位拍的,嘉宾一个特写,他自己一个特写,外加一台全景。素材从相机里导出来,三段画面的色调没调齐,一暖一冷,摆在一起看着就别扭。这活放在以前,得找个剪辑师,先手动把色温拉到差不多,再对着镜头一帧帧切,碰上字幕还要人工校对,一期下来够呛。他说他本来也在想要不要招个初级剪辑,试完这个模型,不想了。

三机位访谈素材自动剪辑场景

他的做法不复杂,把三段素材丢给 Astra,把要求说清楚:色调统一,出一个完整版,左上角加栏目 logo,谁开口镜头切谁,字幕要淡一点,别用那种压画面的粗体字。头一版字幕确实是粗体,他让模型去参考网上高级访谈的字幕样式,第二版就换成了细体,搁在画面底下不抢戏。镜头切换这种最吃经验的部分,模型自己按说话的人切了,特写全景轮着来,节奏居然顺。

真正让他意外的不是切镜头,是校对字幕。访谈里嘉宾说“第一性原理”,语音转出来成了“定性原理”,“生成式 AI”被听成“生生 AI”,这类错在自动字幕里太常见,以前都得人盯着一条条改。他把这两处指给模型,模型把整段字幕从头扫了一遍,自己改了几十处,全是靠上下文猜出来的,剩下几处拿不准的,才列出来交给他定。这个流程我熟,以前剪辑师交片之前干的就是这个,先让人过一遍错别字,再自己核一遍。具体语音怎么转成文字、又怎么跟画面卡上拍的,视频里没细讲,我反正没研究过那层。

AI字幕自动校对工作台

他下的判断也不玄。初级剪辑师干的这些活,被模型接住了,但要说剪辑师这个行当没了,他摇头。他提的那些要求,他自己也承认基础,就是把三台机器的画面按时间轴接顺。真正值钱的地方他反复讲,观众爱看什么、镜头什么时候切才不闷、节奏怎么压,他说模型现在还替不了人,这些还得靠有经验的人拿主意。

他顺带提了一句,这一版不是一次成的,中间来来回回改了好几轮,因为他自己没剪过片子,全凭一脑子想法在跟模型提要求,想到哪说到哪。头几轮给的版本确实糙,字幕加得生硬,转场也愣,是他一轮轮把要求掰细了,比如特写镜头怎么用能丰富画面、字幕该参考网上哪种高级样式,才慢慢顺起来的。他说整个过程他基本就是在等,等它跑完导出,中间没动过手。

这话我信一半。以前我说哪家 AI 能干活,多半是它嘴上答得漂亮,这回它是真坐在工作台前面,把成片导出来给我看了。可一个岗位就这么没了,我觉着也说早,真到那一步,大概是用得转这些工具的人,把初级那摊重复活接过去,自己腾出手来做判断。

这段实测我留着了。视频里那人说得实在,机器好不好用,得拿手头真实的活去试,试的时候连要求都说不利索,它也能给你办到八九分。他末了补一句,招剪辑的事已经从待办里划掉了,先让模型顶一阵,顶不住再说。初级剪辑这个岗还剩多少活要人干,我反正说不准,等着看吧。