Google 推出 Gemini 3.5 全家桶,模型竞争全面转向 Agent 执行层
Google 在 I/O 2026 集中发布 Gemini 3.5 Flash、Gemini Omni、Antigravity 2.0 和 Spark,把模型、开发栈与长期在线代理打包推进。核心信号不是单一模型升级,而是 Google 正试图同时占住消费入口、开发者平台和多步骤任务执行层。
OpenAI 用通用推理模型推翻 80 年离散几何猜想,长链路科学推理再上台阶
OpenAI 披露内部通用推理模型在平面单位距离问题上给出新的反例构造,挑战了自 1946 年以来的经典认知。它的意义不在数学题本身,而在于这类结果开始证明通用模型也能在没有专用证明系统的前提下推进严肃科研推理。
DeepSeek 将 V4 Pro 永久降价 75%,前沿模型价格战再次改写成本曲线
DeepSeek 宣布把 V4 Pro 的大幅降价转为永久政策,直接把高能力模型的调用成本压到更低区间。对开发者和平台方来说,这不仅是一次促销,而是又一次把“性能够强且足够便宜”的门槛向下推,迫使闭源前沿模型重新解释自己的溢价。
Codex 加上 Appshots、插件共享和锁屏远程操控,编程 Agent 更像持续在线操作员
OpenAI Devs 本周继续更新 Codex,新增 Appshots、团队插件共享、组织分析与锁屏后远程使用 Mac 应用等能力。编程 Agent 从代码补全转向跨设备、长任务、可审计的持续执行体验。
Anthropic 称 Glasswing 一个月发现上万高危漏洞,AI 安全进入产线重构阶段
Anthropic 表示 Project Glasswing 与合作伙伴在一个月内发现了超过一万条高危或严重漏洞,并提醒行业必须适应模型带来的漏洞发现洪峰。AI 在安全领域的影响正从辅助分析迈向直接改变发现、验证与修复流程。
阿里发布 Qwen3.7-Max,把智能体时代的旗舰模型押注到长任务和工具调用
通义千问推出新一代旗舰模型 Qwen3.7-Max,重点强调编程、办公自动化和长周期自主执行表现,并给出超长任务与上千次工具调用的实测案例。模型卖点已经从通用聊天能力,明确迁移到 Agent 场景下的稳定性和持续执行能力。
MCP 发布新 RC 并改成无状态协议,Agent 基础设施开始向可横向扩展重构
MCP 新的 release candidate 把协议改成无握手、无 session ID 的 stateless 设计,并加入 Apps、Tasks 等一等扩展。对于基础设施团队,这意味着更容易做负载均衡、弹性扩缩和多实例部署,协议本身也更接近真正的生产级平台接口。
智谱推出 GLM-5.1 高速版 API,400 tokens/s 让国产模型开始卷实时性
智谱开放平台发布 GLM-5.1-highspeed,主打 400 tokens/s 的输出速度,面向编程、实时交互和语音等低延迟场景。国内模型竞争正在从榜单分数扩展到速度、成本和可直接落地的实时体验。