9月16日,网易有道在北京办了一场 AI Open Day,主题是「NEXT,AGENT」。现场摆出的是覆盖办公、学习、营销几条线的 AI Agent 产品矩阵,场外还搭了个「有道 AI Agent 未来市集」,让到场的人直接上手试。

网易有道 CEO 周枫在现场给了一个判断,过去一年 AI 真正的变化,是它不再是一个需要用户主动去找、主动去调的工具,而是能嵌进原有的工作流程里解决问题的助手。他甚至认为,应该围绕 AI 智能体重新设计一套更科学也更高效的工作方式。
顺着这个判断往下推,决定 AI 能力高低的核心因素,正在从单一的模型能力,变成由模型、智能体和工作流一起组成的系统能力。周枫拆得很直白,模型体现的是「聪明」,它决定能力上限。Agent 让 AI 变得「能干」,把模型能力转成实际行动。工作流代表「靠谱」,保证 AI 在真实业务里能稳定交付。
底层模型和中间层 Agent,搭的是三层结构
围绕这套逻辑,网易有道搭的是「模型矩阵 × Agent 矩阵 × 真实场景」的结构。底层是「子曰」模型矩阵,提供多模态推理和实时语音交互这些基础能力。中间层是 Agent 产品矩阵,把模型能力包装成可执行的智能服务。上层扎进办公、学习、营销这些具体场景。
营销是个能看清效果的样本。有道围绕广告业务的全链路做了创意生成、达人筛选和投放优化三块 Agent 能力,其中 iMagicBox 用一张图加一句指令就能生成数字人视频和本地化素材,官方给出的数据是素材制作成本下降 80%,广告点击率提升 30%。平台上的 AI 素材占比两年翻了 12 倍,达到 25%。另外两个产品里,YODA 基于 2000 多个真实项目的数据做达人洞察和营销决策,小智 2.0 把跨账户查询和数据同步自动化。
模型这块由首席科学家段亦涛负责讲。今年 5 月「子曰」大模型升级到 4.0,一起发布的有多模态推理、跨语种零样本、翻译升级三款模型,前两款已经开源。这次他宣布发布子曰 Live 同传模型,同时开源子曰流式 ASR 模型,提供面向语音 Agent 级别的流式语音识别能力。相比过去「你说一句我说一句」的交互,新模型支持实时流式输入输出和全双工交互。
他还介绍了一个人机协作 Agent「有道有据」,平台沉淀了论文、专利、法条这些权威数据,每个论点都附可核查的依据,能自己执行写论文、生成 PPT 这类任务。段亦涛的说法是,它既是模型的 Harness,也是人脑的 Harness,未来有价值的 AI 产品不应该只是个替人完成任务的 Chat,而应该是一个「工作台加活的助手」。
LobsterAI 2.0 兼容 OpenClaw 生态
办公 Agent 由 LobsterAI 负责人王宁来讲。会上 LobsterAI 正式发布 2.0 版本,全面兼容 OpenClaw 2.0 生态,新增 Sites 和 Teams 两个功能,任务产物可以一键生成公网地址并设置分享码,计费改成按实际用量付费,不再按席位收费。
王宁提了三个关键词,组织、交付、信任。他的判断是办公 Agent 不只是个人工具,更应该成为整个团队效率的放大器,而且光「做出来」不够,还得方便「发出去」,竞争的核心也从「谁更能干」变成「谁更值得托付」。团队最近发布了国内第一份《办公 Agent 用户行为报告》,手机端产品也快上线。
声音这条线上,智能应用事业部负责人张艺提到,有道 AI 同传已经累计服务超过 2500 万用户,使用次数同比接近翻倍。网易叭哥说是网易第一个 AI 原生语音 Agent,目标是把人的自然口语直接转成结构化、能复用的文本。做口语私教的 Hi Echo 累计用户超过 1000 万,用的是端到端全双工语音对话技术,加上自研的目标驱动型自进化学习系统 Echo HELIX。
硬件那边,智能硬件事业部负责人高慧湍介绍了 AI 耳机 OpenPods,它把录音、转写、总结、翻译串成一条链路,覆盖会议里「听、记、办」三个环节。产品支持二十多种语言的音视频实时翻译,还能用音色克隆保留发言者的音色,耳机舱本身就能独立完成录音、翻译和外放,不依赖手机。
会议记录方面,它能自动区分不同发言人,把口语里的重复和改口整理掉,把录音转成纪要和待办。用户还能针对笔记内容提问,系统作答时会给出出处。更往前一步的是,纪要里的待办可以直接转成可执行的任务清单,从辅助记录走到主动代办。
如果关心的是 AI 怎么真正嵌进日常办公流程,这次发布会给出的答案是把模型、智能体和场景三层摞在一起看,而不是只盯着跑分。想按用途挑工具的话,可以先从 AI办公软件 这条线翻起,或者直接在 AI工具 列表里按场景筛选。
