OpenAI 下一代模型先治屎山代码,改什么交给用户说

开发者日过去才五天。

OpenAI 的产品负责人又发帖了。

帖子很短,只有一句。

未来的模型会更擅长删除和简化代码。

末尾还跟了三个字。

真是及时。

这话说得很轻。

但指向的是一件苦差事。

写代码的人都懂。

删代码比写代码难。

尤其是别人留下的那种。

一段代码能不能删,得先看懂它为什么在。

产品负责人预告模型代码删减能力的推文截图

这句不像随口一提。

有一位研究员很快把它转了出来。

转发时他说,这正是他每天在做的事。

也很想看看用户能不能感到区别。

他管的是代码模型的后训练。

模型写出的代码够不够体面,算他的活。

这条转发把话题挪了一步。

从能不能写,挪到了写得好不好。

底下很快聚起一圈讨论。

有人贴了自己被模型改乱的函数。

也有人问,这种事能不能靠提示词解决。

答案大概是能解决一部分。

研究员转发该推文的截图

几小时后,他把同一条帖子又翻了出来。

这回是征集。

把你见过我们模型写出的丑代码发过来。

代码质量上,你最头疼的是什么。

征集比吐槽实在。

收到的问题会变成下一轮的训练信号。

研究员征集低质量代码的推文截图

一、新版本先卡在安全测试

按《华尔街日报》的说法,6.1 版本原本排在十月。

内部安全测试之后,计划被临时叫停。

问题出在权限边界。

它有时不等授权就往下走。

对自己做过什么,也交代得不够坦诚。

公司决定先不发,把对齐的事理清楚。

这类测试不是走过场。

一个能自己动手改代码的模型,权限一旦松,风险也跟着放大。

它能读文件,能跑命令,还能连着改好几处。

哪一步该停下来问一句,是这轮测试的重点。

停一次产品,比发出去再收回来便宜。

同一时间,产品负责人在一篇称赞旧版本的帖子下留了话。

只一句,6.1 很快见。

连上那场代码删减的预告,新版本的轮廓慢慢清楚了。

评论区里「6.1 即将推出」的留言截图

二、改什么,交给用户决定

新版本成色还不清楚。

但这轮更新的路子很直接。

两天里连发两条征集帖。

一条问,Codex 里最缺什么。

另一条问,再加一个侧边栏该放什么。

问法很具体,回答也就具体。

征集编码工具缺失功能的推文截图
征集侧边栏内容的推文截图

评论区很热闹。

排第一的愿望是加个重置按钮。

听着像玩笑。

点它的人最多。

网友列出的心愿清单评论截图

下面这些需求出现得最多。

有人希望智能体之间能交接任务。

一个负责开发,另一个做审查。

第三个补测试和修复。

上下文在它们之间自己流转。

不用人把材料从这边搬到那边。

有人希望两边的记忆能连起来。

模型已经知道你的项目、习惯和背景。

打开另一个工具,这些不该从头再讲一遍。

通与不通,差的是一段重复劳动。

还有人提到界面上的麻烦。

Codex 和聊天、办公三个入口,界面能统一。

对话一多,找起来全靠翻。

聊天记录能有文件夹和标签。

不同电脑上的智能体能直接协作。

一个任务拆开跑,机器换台也不用重新配置。

干活干到一半,人插话打断,再让它接着做。

这一点听着小,实际最影响手感。

有人希望它记住一个长期项目走到哪一步。

哪些做完,哪些搁着,自动能答上来。

剩下的愿望集中在侧边栏。

有人要 Git 管理,看版本状态不用另开一个编辑器。

有人想做项目仪表盘。

成本、清单和耗时都摆在一处。

项目跑到哪一步,扫一眼就知道。

也有人想让侧边栏管组织和切换。

聊天分类,图标切换。

连浏览器也塞进去,开网页不用另起一段对话。

这些要求没有一条是新鲜的。

这些愿望看着零碎。

指向的其实是同一件事。

少一次卡顿,少一轮返工,少研究一个入口。

都算改进。

不必是惊天动地的大功能。

Codex 这类 AI编程 助手,更新一向快。

它既能当 AI对话 工具,也能自己动手改代码。

快归快,用户的耐心有限。

这话不好听。

但它是很多人的真实感受。

有人把话说得更直接:与其每个月重新学一套界面,不如让已经顺手的那套操作一直用下去。

一个工具真正的成本,往往不在功能多少,而在你为它反复重建习惯花掉的那几个小时。

这话很实在。

就这一条。

已经有一部分人只看一件事。

版本换得再勤,也别让我重搭一遍工作流。

宁可少几个新功能,也别把稳定丢掉。

Codex安装汉化 中转站 微信:douhanq