Codex 额度怎么算?Token、上下文和缓存一次讲透

同样一句”我今天用了多少”,在 ChatGPT 里的 Codex 任务上和在 API 接口上,答案不是一回事。产品侧按计划额度和 credits 结算,API 侧按 token 算钱,走第三方中转的又是另一张账单。三套口径混在一起估,算出来的数字往往偏得离谱。

token 这一侧最容易算错的地方有两[……]

继续阅读

WorkBuddy文件处理实战:批量重命名、会议纪要、视频翻译

有些文件夹打开就是乱的。图片和合同,票据和资料堆在一起,文件名乱到找不到东西。文件处理这一类活 WorkBuddy 能接,核心就三步,读文件、提取内容、按你的规则重新整理,最后输出一个结果。

先说批量重命名。场景是文件夹里一堆命名混乱的文件,想按统一规则改名。目标是按文件内容或时间信息,自动生成统一[……]

继续阅读

AI 智能体设计模式:21 种架构怎么选,配哪些、什么时候用

把一个智能体写成一段超长的提示词,短期能跑,长期一定不稳。任务一多,它会漏要求,会忘上下文,工具一开始报错,整条流程就卡死在那里。

真正能长期运行的智能体,靠的是一组可复用的设计模式。这些模式解决的是同一类麻烦:怎么把活拆开,怎么调工具,怎么记住东西。还有怎么检查输出,怎么兜住失败,哪些环节必须让人[……]

继续阅读

不装记忆模块,把 126 秒画面塞进上下文:机器人揭盖成功率提升 17 个百分点

机器人干活时,最容易出问题的不是没看清眼前,而是忘了刚才。

积木被黑盖扣住,盖子底下是什么颜色,当前画面里已经找不到答案。它只能靠几十秒前那一眼。

面壁智能牵头做了一套方案,名字叫 SimpleMemVLA。华中科技大学、中国人民大学参与其中,清华大学和北京大学也在合作名单里。北京智源人工智能研究院[……]

继续阅读

页面只改 0.1%,答案就找不到了:ProSA 把文档解析错误定位到内容块

企业里的技术手册和设计资料,很少是纯文字。表格和示意图混在文字里,机器读起来容易出错。

读错了,后面交给 AI工具 的活儿就会跑偏。麻烦的是,错在哪一块,影响有多大,过去很难说清。

中山大学和混沌摆实验室牵头,拉上南洋理工大学的研究人员,做了个专门查这件事的框架,叫 ProSA。相关论文被 EMNL[……]

继续阅读

Claude Code 项目功能重构:说一个目标,云端一群智能体分头写码并提合并请求

多人同时在线写代码的时代,来了。

Claude Code 刚刚对项目功能做了大重构。这次它原生支持多智能体玩法。

你只要下一个目标,它就在云端派生出多条代码分支干活。活干完,代码直接提交。合并请求也一并开好。

它还加了共享记忆。多个智能体之间,上下文能一直对齐。

项目功能不再是那个只放提示词和文档的[……]

继续阅读

Manus 独立运营 17 天:新融资瞄准 40 亿美元,半年收入涨到 4 倍

Manus 恢复自由身还不到一个月。身价先翻了一倍。

彭博社消息,这家公司正在推进新一轮约 5 亿美元融资,目标估值约 40 亿美元。

这是它和 Meta 完成拆分、恢复独立运营之后的第一轮融资。

知情人士说,这轮谈判已经接近收尾。但金额和条款仍有变数。

新投资方的身份还没披露。腾讯、HSG[……]

继续阅读

谷歌让 AI 学会「做梦」:不改权重,靠回放历史自己进化

9 月 18 日,谷歌和 Google DeepMind 联合马里兰大学与弗吉尼亚大学挂出一篇论文。正文里反复出现同一个词。做梦。

论文给的结论很硬。人工智能的递归自我改进,不一定非得从改权重开始。

它的做法是让智能体把走过的每一步存成一棵树。然后在树里做梦,试出更优的探索策略,再回到现实接着干[……]

继续阅读