科研 AI 工作台开放内测:单细胞组学评测 0.86 分,高于人类专家参考解

一个给科研用的工作台开始内测

9 月 16 日,无界进化开放了 Karl Workbench 的内测。

它是一款面向科研的AI智能体工作台。研究意图和科学假说,数据与文献,还有分析工具和研究证据,都被放进同一个工作空间。任务怎么执行的,每一步都记下来。可以复现的产物也一样留存。

内测开放之前,它先跑[……]

继续阅读

AI三巨头集体踩刹车,真正的原因是模型开始自己改自己

这两天 AI 圈最扎眼的不是又发了什么新模型,是几家头部公司一块儿踩了刹车。OpenAI 的奥尔特曼、Anthropic 的达里奥,还有马斯克,先后出来讲话。意思都差不多,AI 的研发节奏,得管一管了。我正琢磨这事的时候刷到一条视频,晓辉博士讲的,十几分钟,把来龙去脉捋了一遍。我把它拆成几件事,一件[……]

继续阅读

视觉智能体自己出题练手:创意任务解决率做到 95%

AI 完成任务之后,还能留下什么。

多数系统的答案是「什么都没留下」。下一次遇到相似需求,它还得从头试一遍。

研究团队来自北京航空航天大学和香港中文大学,联合新加坡国立大学,给出了另一条路径。他们发布的 OmniHarness 让视觉智能体主动练习,主动检查结果,再把有效的流程留下来。

面对下一个需[……]

继续阅读

网易叭哥说实测:说错能改口,口头禅自动清掉,官方称效率是键盘 5 倍

语音输入这条赛道,今年挤进来不少大厂。

字节在做豆包输入法。腾讯在做微信输入法。讯飞和网易也都在往里挤。

大家比的东西换了。

前些年比词库大小,比皮肤好不好看,比联想词准不准。

现在比的是另一件事,能不能听懂人到底想说什么。

网易有道最近上线了一款语音输入产品,叫网易叭哥说。

官方给它的定位是 AI[……]

继续阅读

苹果把数字签名做进相机传感器:AI 生成的图片,冒充不了真实拍摄

AI 画的图越来越真,这件事早就没什么争议。

2023 年那会儿,模型画手还会多长一根手指,画招牌上的字会糊成一团。

三年过去,光影和质感都追了上来,构图也一样。

一张来源不明的照片传到聊天框里,多数人已经分不出真假。

想分辨也没有趁手的 AI工具,判断基本靠直觉。

真实照片被局部改一改,成本低到可[……]

继续阅读

LimiX-2拿下三项结构化数据第一:400M参数,Elo比谷歌TabFM高143分

这两年,大模型赛道卷得厉害。

大家的目光几乎都盯着那些能直接上手的AI工具

可另一条做结构化数据的路线,最近突然挤满了巨头。

谷歌下场了。亚马逊也下场了。德国软件公司SAP动作更大,干脆把TabPFN背后的团队买了下来。

就在巨头们刚进场的时候,榜首的位置已经被人坐稳。

9月15日,SAP抢先发布[……]

继续阅读

Claude 用四周优化 30 个生物模型:AI 写出的科学代码,还能再快 3 倍

四周时间,超过 30 个开源生物分子模型被重新优化了一遍。

名单里有结构预测模型,也有分子设计工具。都是科研人员天天要用的东西。

做这件事的是一个通用 AI工具,不是性能工程师。它背后只有两名 Anthropic 技术人员,负责监督。

这两个人懂生物建模。但他们没做过推理优化,也没写过显卡内核。

结[……]

继续阅读