智谱 GLM 开始自己优化自己:两周把推理吞吐拉到 3 倍

智谱把一件挺微妙的事摆到了台面上。GLM-5.3 这次做的事,不只是写几段代码。它亲手把自己跑起来的那套推理系统,从零搭了出来。

唐杰是清华大学计算机系教授,也是智谱创始人。他分享了团队内部观察到的这个早期案例。集群上有超过 10 万张国产芯片。GLM-5.3 驱动的 Infra Agent 从零参[……]

继续阅读

云知声发布 U2-Flash,266B 参数只激活 10B,代码分直接翻倍

云知声发布了 U2-Flash,一款主打「智能密度」的模型。它的后训练闭环里,模型已经开始深度参与自身演进,从生成训练数据、分析执行轨迹,到巡检和修复训练系统,这些环节都交了出来。按行业惯例,Flash 这个后缀一般默认是旗舰平替,更快更便宜,能力相应打折。U2-Flash 的答卷不太一样。

云知声 U2-Flash 模型发布信息

[……]

继续阅读