8 月 14 日晚上,我打开千问办公首页,前沿模型那个档位里多出两个名字,GLM-5.3 和 DeepSeek V4 Pro,加上之前就有的 Qwen3.8-Max,阿里、智谱和 DeepSeek 三家模型算是凑齐了,同一页面上头一回见到三家厂子的名字并排摆着。挺意外。

DeepSeek V4[……]
6 月 30 日上线的 Claude Sonnet 5,Anthropic 的公告、安全评估和合作伙伴的反馈我翻了一遍,翻完的结论是,这个模型把能干完一整条任务的本事下放到了中端价位。定计划、使唤浏览器和终端,自主跑任务,这些事几个月前还得靠更大更贵的模型撑,现在这个价位的也有了。

7月24日,Anthropic 把 Claude Opus 5 放了出来,我看完第一眼记住的不是分数,是价格:编程和知识工作这块它拿了当前最优,定价只有 Fable 5 的一半,花更少的钱拿接近顶级的智力,这句话在模型圈喊了半年,这次算是真兑现了。

官方放[……]
以前:新课开班,要从头查资料,搭大纲,写讲义,做课件,备课花掉大半天。
● 现在:打开WorkBuddy说:“根据桌面上「服装公司资料文件夹」“针对新员工入职培训,搭一份包含公司文化,岗位技能,常见问题的课程大纲。”大纲框架直接出来,逐模块补充细节,备课时间砍掉一半。


[……]
[……]
[……] 以前:主编一句“下午3点前给我一篇稿,搜资料一小时,组织语言一小时,排版半小时,交上去还被说”不够网感”。
● 现在:打开WorkBuddy输入:“根据这个主题,搜集网上最新的相关资料,生成一篇800字的推文初稿。” 一句指令,初稿直接出来,你只管润色。从催命到交差,15分钟。
