字节 Seedance 2.0 视频生成:最多 12 路多模态参考 + 可局部修改,瞄准“可控运镜与废片率”
字节跳动推出 Seedance 2.0 AI 视频生成模型,支持同时上传图片/视频/音频等最多 12 个参考文件以复刻运镜与动作细节,并提供对生成结果不满意部分的直接修改能力,强调生成与后期编辑融合。
字节 Seedream 5.0 家族上新:主打高分辨率与“检索增强/推理”两条路线并行推进
Seedream 5.0 上线并在剪映、CapCut、小云雀等平台开放体验,支持 2K/4K 输出并提升提示词理解与细节纹理渲染;随后 Seedream 5.0 Lite 强化“思考/推理”与精准图片编辑,并引入实时检索增强能力。
MiniMax M2.5 发布:强调低成本“真实世界工作”能力与 SWE-Bench Verified 提速
MiniMax 发布 M2.5,主打编程、搜索工具调用与办公等生产力场景能力;并宣称在 SWE-Bench Verified 上完成任务速度较上一代提升 37%。
谷歌 Gemini 3 Deep Think 升级:竞赛级编程与推理基准刷新纪录,直接抬高行业 SOTA 天花板
谷歌宣布 Gemini 3 Deep Think 重大升级,在多项顶尖基准测试中刷新纪录,并在竞技编程平台 Codeforces 获得 3455 Elo 评级;同时在 ARC-AGI-2 推理基准及多项学术竞赛类测试中取得领先成绩。
OpenAI × Cerebras 推出 GPT-5.3-Codex-Spark:面向“实时编程”,推理速度突破 1000 token/s
OpenAI 联合 Cerebras 发布主打实时编程的新模型,可实现超过每秒 1000 个 token 的推理速度,用于降低长时间自主编程场景中的等待与反馈延迟。
腾讯发布 WorkBuddy 桌面工作台:从“聊天”走向“代执行”,强调本地文件与办公任务交付
腾讯推出面向职场的 AI 智能体桌面工作台 WorkBuddy,支持自然语言交互并可在本地执行文件操作,覆盖 PPT 生成、数据整理、知识库构建等复杂任务,当前开放内测申请。
腾讯混元推出 HY-1.8B-2Bit 端侧模型:2Bit 量化把内存压到约 600MB,推理提速 2–3 倍
腾讯混元发布产业级 2Bit 量化端侧模型 HY-1.8B-2Bit,等效参数量约 0.3B、内存占用约 600MB,并通过量化感知训练在保持原模型能力的同时将生成速度提升 2–3 倍,面向手机与边缘设备部署。
阿里发布 Qwen-Image-2.0:生成+编辑统一,强调中文文字渲染与复杂指令理解
阿里云发布 Qwen-Image-2.0 图像生成及编辑模型,支持 1K token 长文本输入与 2K 高分辨率输出,并将图像生成与编辑能力统一;官方披露其在 AI Arena 评测中取得较高排名与编辑得分。
阿里云通义 CoPaw 发布:对标 OpenClaw 的“个人智能体工作台”,支持本地与云端一键部署
AgentScope 团队发布 CoPaw,定位为协同个人智能体工作台,支持 macOS/Windows/Linux 本地快速部署,也支持在“魔搭创空间”一键云端部署,强调极简安装与统一体验。
美团 LongCat 上线“深度研究”智能体:基于本地生活交易数据做个性化攻略,支持长上下文与多工具调用
美团旗下 LongCat 上线“深度研究”智能体功能,依托本地生活真实交易数据与行业洞察生成吃喝玩乐攻略,并支持长程任务规划与多工具调用及高轮次交互能力。
科大讯飞发布星火 X2 并开放 API:强调国产算力训练与 MoE 架构升级
科大讯飞发布星火 X2 大模型并同步上线 API,采用 293B MoE 稀疏架构并进行工程优化,官方披露推理性能较上一代提升,并强调可在国产昇腾服务器上部署。
智谱开源 GLM-5:744B(激活 40B)规模,主打 Coding 与 Agent 能力的开源 SOTA 竞争
智谱开源旗舰模型 GLM-5,参数规模扩展至 744B(激活 40B)、预训练数据 28.5T,并在编程与智能体相关基准(如 SWE-bench、Terminal Bench)上给出领先开源模型的官方表述。
智谱 AI 开源 GLM-OCR 视觉识别模型并展示 OCR 性能优势
智谱 AI(Zhipu)在 Hugging Face 发布 GLM-OCR 模型,在 OCR 测试中击败 Gemini 3 Flash。该模型被定位为高性价比的视觉/OCR 解决方案,适用于文档理解和图像文本提取任务,并已开源供社区使用,支持商业应用。
月之暗面 Kimi 推出支持百级子代理的 Agent Swarm 系统
Moonshot AI 的 Kimi 推出 Agent Swarm 概念,支持最多 100 个子代理并行执行,单次任务可进行 1500 次工具调用,声称比顺序执行快 4.5 倍。该系统适用于并行研究和创作任务,展示了强大的多代理协作和任务分解能力。
吴恩达推出 Agent2Agent 协议标准在线课程
吴恩达通过 DeepLearning.AI 推出关于 Agent2Agent (A2A) 协议的新课程,将其定位为跨 Agent 框架的发现与通信标准。课程提及 IBM 的 ACP 与 A2A 的整合,以及在不同企业系统中的集成模式,推动智能体互操作性标准发展。
Dagger 推出 container-use 实现 Agent 沙盒隔离
DSPy 社区讨论将 Agent 隔离提升为实用的安全原语,维护者推广 Dagger 的 container-use 作为隔离层,强制 Agent 在 Docker 容器中运行。该方法通过容器化技术限制 Agent 的系统访问权限,提高安全性。
开发者发布无需 API 密钥的 Google 搜索 MCP 工具
LM Studio 用户分享 noapi-google-search-mcp 工具,通过无头 Chromium 添加 Google 搜索功能而无需 API 密钥。该工具功能异常广泛,支持 MCP 协议集成,为本地 Agent 提供无需付费的搜索能力。
分析总结 DeepSeek 创新对当前开源 LLM 的广泛影响
广泛分享的总结称 DeepSeek 的创新塑造了“几乎当今每个前沿开源 LLM”——包括细粒度稀疏 MoE、共享专家、MLA、生产环境稀疏注意力、开放推理(R1)、GRPO 作为基础算法等,展示中国实验室对全球开源生态的深远影响。
Karpathy 演示使用 DeepWiki MCP 和 GitHub CLI 构建软件
Andrej Karpathy 展示使用 DeepWiki MCP 加 GitHub CLI 查询代码库(torchao fp8),让 Agent“提取”所需实现到独立文件并附带测试的具体示例,展示 LLM 如何改变软件组合方式和代码重构流程。