Anthropic 发布 Claude Sonnet 5,把高阶 Agent 能力下放到默认 Sonnet 档位
Anthropic 在官方渠道发布 Claude Sonnet 5,强调其在规划、多步执行、浏览器与终端工具调用上的代理能力,定位是“最具 Agent 能力的 Sonnet”。它最值得关注的地方不只是模型升级,而是 Anthropic 正在把原本需要更高价位模型才能完成的自主执行能力,压到更普及的默认生产力入口。
Google 同步推进图像与视频生成,Nano Banana 2 Lite 和 Gemini Omni Flash 抢占低时延多媒体入口
Google DeepMind 本周推出 Nano Banana 2 Lite 图像模型和 Gemini Omni Flash 视频生成与编辑能力,主打更快生成速度与更低成本。这个组合值得关注,因为 Google 正在把多媒体生成从“偶发创作”推向可批量调用的实时基础设施,直接争夺开发者和企业工作流中的默认媒体引擎位置。
Meta 推出 Brain2Qwerty v2,非侵入式脑机接口首次逼近实时句级解码实用门槛
Meta 发布 Brain2Qwerty v2,展示了从非侵入式神经信号中实时解码词语与语义的能力,并把语言模型与神经信号建模进一步结合。它的重要性不在消费级产品立即落地,而在于脑机接口与生成模型的结合已经开始从字符级实验,迈向可做句级交互的系统级研究。
Cognition 推出 Devin Security Swarm,把漏洞发现与可利用性验证打包成专用 Agent 工作流
Cognition 发布 Devin Security Swarm,用 Agentic MapReduce 思路把代码库扫描、结果聚合和漏洞可利用性验证整合成多智能体安全流程,并给出大型企业试点数据。它说明 Agent 产品竞争正在从通用 coding assistant,进一步走向围绕高价值垂类流程的专用自动化系统。
Z.ai 发布 ZCode,GLM-5.2 开始从强模型扩展为完整 AI 编程产品面
Z.ai 推出官方开发环境 ZCode,围绕 GLM-5.2 补齐跨平台 IDE、BYOK 和订阅配额等产品能力,继续强化其在 AI 编程场景中的入口地位。它值得跟踪,因为开放权重模型一旦配套上完整产品面和开发者体验,就不再只是“可替代模型”,而会成为独立生态。
NVIDIA 公布 Nemotron-Labs-TwoTower,用并行写词路线冲击自回归生成速度瓶颈
NVIDIA 发布 Nemotron-Labs-TwoTower,把 30B 语言模型改造成双塔并行生成结构,给出约 2.42 倍生成加速且接近原模型质量的结果。它的价值在于,前沿模型性能竞争开始重新触及推理架构本身,谁能在不明显牺牲质量的前提下突破生成吞吐,将直接影响推理成本与产品体验。
华为开源 openPangu-2.0-Flash,国产大模型底座继续向 Agent 时代加码
华为宣布开源 openPangu-2.0-Flash,开放 920 亿参数模型、基础推理代码和训推算子,强调基于昇腾原生体系为 Agent 应用提供底座。它值得关注,因为国内大厂正在把“开源一个模型”升级为“开源一整套软硬件协同栈”,争夺未来国产智能体生态的基础设施位置。
支付宝 AI 助手结束内测并开放公测,超级 App 的生活服务入口开始原生 AI 化
支付宝宣布 AI 助手开放公测,用户无需邀请码即可体验,首批覆盖账单分析、社保查询、出行订票、保洁等多项生活服务技能。它的重要性在于,AI 正从独立聊天入口转向高频超级 App 内的原生服务界面,真正的竞争点开始变成谁能把任务直接完成而不是只给答案。
LangChain 推出 OpenWiki,把代码库文档维护做成可持续供 Agent 消费的知识层
LangChain 发布 OpenWiki,用于初始化并持续维护可供 Agent 读取的代码库 Wiki 文档,把记忆与上下文沉淀从聊天记录迁移到结构化知识层。它值得关注,因为长期任务里的上下文丢失已成为 Agent 落地瓶颈,谁先把“可维护记忆层”产品化,谁就更接近真正可持续的自治工作流。