OpenAI 发布 GPT-5.3-Codex 并同步推出 Codex App,编程 Agent 正式进入规模化产品阶段
OpenAI 同步发布新一代编程模型 GPT-5.3-Codex 与 Codex App,在 SWE-Bench Pro、Terminal-Bench 2.0 等基准取得 SOTA 成绩,显著领先同类模型。这标志着 AI 编程 Agent 从模型能力展示迈入成熟产品化阶段,对开发者工具链和企业软件工程流程产生深远影响。
Anthropic 发布 Claude Opus 4.6:百万级上下文与多 Agent 协作验证工程级突破
Claude Opus 4.6 提供 100 万 token 上下文窗口与自适应思考能力,并通过多 Agent 实验完成可编译、可启动 Linux 的 C 编译器构建,展示其在复杂工程与安全研究任务中的领先能力,进一步巩固其在高端模型市场的地位。
Alphabet 财报确认 Gemini 3 成为史上采用最快模型,AI 正式成为谷歌核心业务引擎
Alphabet 在财报中披露 Gemini 3 的用户规模与产品集成速度刷新公司历史纪录,并在真实生产环境中达到每分钟 100 亿 token 推理、7.5 亿 MAU,显示大模型已进入基础设施级规模,对全球 AI 商业化具有风向标意义。
VS Code 推出 Agent Sessions,并行子代理正式进入主流 IDE 工具链
Microsoft 在 VS Code 中原生引入 Agent Sessions,支持并行子代理与 Claude、Codex 等多模型协作,标志着 IDE 从“智能补全”演进为“多 Agent 工程平台”,对软件开发范式产生直接影响。
GitHub Copilot Pro+ 与 Enterprise 接入 Claude 与 Codex,企业开发进入多模型时代
GitHub 宣布在 Copilot 高阶版本中同时支持 Claude 与 Codex,显示企业级开发工具正在从单模型绑定转向多模型并存策略,为成本、性能与合规性提供更大灵活度。
通义千问开源 Qwen3-Coder-Next,小参数 MoE 编程 Agent 实现高性价比突破
阿里通义千问开源 Qwen3-Coder-Next,采用 80B MoE 架构、单次仅激活 3B 参数,在 SWE-Bench Verified 上解决率超过 70%,以显著更低算力成本逼近大模型性能,为开源编程 Agent 提供重要选择。
阶跃星辰开源 Step 3.5 Flash,专为 Agent 场景设计的超大 MoE 基座模型
阶跃星辰发布并开源 Step 3.5 Flash,1960 亿参数 MoE 架构、256K 上下文,推理速度最高达 350 TPS,并通过 MTP-3 技术显著提升效率,显示国产开源模型在 Agent 与推理场景的工程化进展。
Waymo 披露基于 Genie 3 的世界模型,用生成式仿真推进自动驾驶安全
Waymo 公布其 World Model 架构,利用 Genie 3 生成极端与罕见场景进行自动驾驶训练与验证,显示自动驾驶正在从数据回放迈向生成式世界建模阶段,具备长期商业与安全价值。
昆仑天工发布 Skywork 桌面版,本地运行的多模型 AI 办公 Agent
昆仑万维推出支持 Windows 本地运行的 Skywork 桌面版,支持跨格式文件理解、多任务并行和多模型(Claude、Gemini)调用,强调隐私与本地化,为个人与企业 AI 办公提供新形态。
Vidu Q3 推出 16 秒音视频直出模型,AI 视频迈向“一键成片”
Vidu Q3 支持 16 秒音视频同步直出、多镜头切换与多语言对白,面向漫剧与短剧创作,推动 AI 视频从实验生成走向工业化内容生产。