开源项目Clawdbot爆火带动Mac mini关注:主打自部署“对话式个人助理”,接入多模型+日历/邮件/自动化技能
报道称Clawdbot在GitHub短期内Star暴涨,定位为可自部署的AI助手网关,连接WhatsApp/Telegram等聊天入口并集成日历、邮件与自动化技能。对个人Agent生态而言,这是“把工具塞回聊天框”的典型路径。
OpenAI宣布2月13日下线GPT-4o等旧模型:资源集中到主流模型,用户担忧“对话风格”不可替代
OpenAI宣布将于2月13日下线部分旧模型(报道提及GPT-4o等),并称将集中资源优化主流模型、在GPT-5.2改进个性与创造力;同时引发用户对“温暖对话风格”迁移成本的讨论。
Anthropic推进 MCP Apps 开放标准:让工具调用返回可交互UI,瞄准“应用互操作”与订阅整合
简报称MCP Apps与多方合作推进开放标准,使工具调用不仅返回JSON,还能返回可在聊天中渲染的交互式UI组件,并推动生态互操作,可能改变“AI应用碎片化+重复订阅”的现状。
xAI Grok Imagine API被指冲上视频生成榜首:原生带音频、15秒视频、定价$4.20/分钟
简报称Grok Imagine在多个榜单靠前,并以“原生音频+多模式(文生视频/图生视频/编辑)+较低单价”形成压迫式性价比;若可稳定规模化,将加速视频生成赛道的价格战与平台整合。
阿里发布Qwen3-Max-Thinking:超万亿参数推理模型+36T Tokens训练,主打更“经济”的测试时扩展
阿里云发布其规模最大推理模型Qwen3-Max-Thinking,强调测试时扩展机制在提升推理能力同时降低成本,并宣称在多项国际基准刷新成绩。对企业侧推理成本/性能比是直接变量。
阿里开源Qwen3-ASR:1.7B/0.6B+强制对齐模型,覆盖52种语言与方言,强调嘈杂/歌唱场景稳定性
千问团队开源语音识别模型Qwen3-ASR系列,覆盖多语言与多口音,并强调在复杂噪声、歌唱等场景的稳定表现。对语音入口类产品(客服、会议、创作)是直接可用的工程组件。
月之暗面开源Kimi K2.5:原生图像/视频理解+“Agent集群”并行到100个分身,宣称开源SOTA
Kimi发布并开源K2.5,强调多模态(图像/视频)、代码与Agent任务综合能力,并推出可并行创建多达100个子代理的“Agent集群”来提速复杂任务。对开发者意味着更强的开源替代与更成熟的多代理范式。
DeepSeek开源DeepSeek-OCR 2:用新架构改“阅读顺序”,在OmniDocBench拿到91.09综合分
DeepSeek发布并开源新一代文档识别模型,强调通过动态重排视觉Token让模型更像“按逻辑顺序阅读”复杂文档(表格/多栏排版),并宣称在OmniDocBench刷新记录、阅读顺序误差降低33%。
苹果被曝以近20亿美元收购以色列AI公司Q.ai:押注“无声语音”输入,或将落地AirPods/iPhone/AI眼镜
报道称苹果以近20亿美元收购Q.ai,其技术通过面部微表情与肌肉运动识别“无声语音”,可能用于更私密的交互入口(如AirPods与未来AI眼镜)。大额并购信号明确:苹果在端侧AI交互上加速补齐关键能力。
英伟达追加20亿美元投资CoreWeave:持股升至超11%,目标2030年前冲刺5GW算力
英伟达加码云算力服务商CoreWeave,持股比例升至超11%并深化合作,规划到2030年前建设超5GW AI算力项目;同时出现向其供应Vera CPU的信号,可能牵动数据中心CPU竞争格局。
宇树开源UnifoLM-VLA-0:基于Qwen2.5-VL-7B,用340小时真机数据训练通用人形机器人操作
宇树开源视觉-语言-动作大模型UnifoLM-VLA-0,强调2D/3D空间感知与动力学预测融合,并用340小时真机数据训练。对机器人公司而言,这类VLA开源化会显著加速“从理解到执行”的落地迭代。
商汤开源SenseNova-MARS(8B/32B):主打“多模态搜索+推理”一体化,宣称基准超越Gemini-3-Pro与GPT-5.2
商汤开源多模态自主推理模型SenseNova-MARS,强调动态图文搜索与推理融合能力,并给出在MMSearch等评测的领先分数。若指标可复现,将提升开源Agentic VLM在检索/搜索场景的可用性。
昆仑万维开源SkyReels-V3:把图生视频/视频延长/音频驱动虚拟形象三合一,瞄准创作全流程
昆仑万维旗下Skywork AI开源SkyReels-V3,强调在统一架构内整合三大视频生成能力,并给出对标主流产品的指标优势。若工具链更完整,将推动视频生成从“单点模型”转向“端到端创作流水线”。
Vidu Q2全球上线“万物可参考”:支持6类参考输入,一键复刻特效/迁移表情/替换场景
Vidu推出支持“参考生视频”的能力,覆盖特效、表情、纹理、动作、人物、场景等六类参考,强调精细化增删改编辑。对商业化视频生产而言,这类“参考一致性”是提高可控性与交付效率的关键指标。
MiniMax发布Music 2.5:把整曲结构做成可控标签(前奏/副歌/桥段等14种),瞄准专业编曲工作流
MiniMax推出音乐生成模型Music 2.5,强调可用标签化方式精确控制段落结构与情绪曲线,让创作者更像在“编曲”而非随机生成。对内容平台与商业配乐需求,这是可交付性提升的信号。
昆仑天工发布Mureka V8:提出“AI音乐是新品类”,主打可直接发布的旋律/人声/混音质量
昆仑万维旗下昆仑天工发布Mureka V8,强调基于MusiCoT体系提升旋律完整性、人声表现与混音质感,并提出“AI音乐是新的音乐品类”的定位。对平台侧意味着更清晰的商品形态与分发逻辑。