AI Hotlist

2026 | 08.02 - 08.08 Vol. 34

AI一周资讯 精华

@Luhui Dev 出品,精选 AI 领域技术发展与产品动态,提供一份连续阅读的周度观察。
OpenAI Developers 2026-08-07

OpenAI 发布 Agent Plugins 标准并推出 Codex Security Review 研究预览

OpenAI Developers 宣布 Agent Plugins 开放标准,与 AWS、Cursor、GitHub、Vercel 等合作定义 Agent Skills 与 MCP 服务器配置的共享格式,并同步推出面向 GitHub PR 的 Codex Security Review 研究预览。它值得关注,因为 Agent 工具分发和仓库级安全审查正在同时产品化,开发者生态会从单点集成转向跨平台兼容和内建审计。

Read Source
Anthropic 2026-08-08

Anthropic 为 Claude Code 增加跨会话消息并将 Auto Mode 设为默认路径

Anthropic 通过 ClaudeDevs 公布 Claude Code 新增跨会话消息传递、会话预算、自动加载仓库技能和可中途调用的 advisor 模型,并将 Pro、Max、Team 用户的默认权限模式切换为由独立分类器审核操作的 Auto Mode。它值得关注,因为编码 Agent 的竞争点正在从单次补全扩展到长任务协作、权限治理和默认执行体验。

Read Source
千问大模型 2026-08-03

阿里发布 Qwen3.8-Max 并预告下周开源模型权重

阿里推出新一代旗舰模型 Qwen3.8-Max,总参数规模 2.4 万亿、激活参数 95B,支持 100 万上下文 Tokens,并表示将在下周开源模型权重。它值得关注,因为超大规模开源权重继续向旗舰能力推进,长上下文、编程和研究场景的成本与可部署性会受到直接影响。

Read Source
MiniMax 稀宇科技 2026-08-03

MiniMax 开源通用视频模型 MiniMax H3

MiniMax 开源新一代通用视频模型 MiniMax H3,支持文本、图像、视频、音频多模态输入,可生成最高 2K 分辨率、15 秒时长并带 32kHz 立体声音频的视频,同时开放 H3-Base 并支持 SGLang、vLLM 本地部署。它值得关注,因为高质量视频生成正从封闭产品转向可落地的开源基础模型,开发者可以直接围绕推理栈和工作流做二次构建。

Read Source
阿里云 2026-08-07

阿里云启动 Wan3.0 公测并加入文档到视频输入能力

阿里云开启 Wan3.0 公测,模型单次可生成 30 秒视频,支持连续运镜与一镜到底叙事,并新增 doc、xls、ppt、pdf、md 等文档输入以直接生成教学课件和产品演示视频。它值得关注,因为视频生成开始接入办公素材和知识文档,企业内容生产将更接近自动化流水线而非单次创作工具。

Read Source
Prime Intellect 2026-08-07

Prime Intellect 开源编码与研究 Agent 框架 Prime Agent

Prime Intellect 在 GitHub 开源 Prime Agent,提供程序化工具调用、多 Agent 消息传递、持久执行、可修改的 harness 状态与“context as a variable”等能力。它值得关注,因为开源社区开始把编码 Agent 的能力竞争从模型选择扩展到执行框架本身,harness 设计正在成为影响效果和成本的核心变量。

Read Source
llama.cpp 2026-08-07

llama.cpp 主线合入 Qwen3-TTS 语音克隆支持

ggml-org 在 llama.cpp 主线合入 Qwen3-TTS-12Hz-1.7B-Base GGUF 支持,使本地多语言语音克隆可基于 WAV 或 MP3 说话人参考运行。它值得关注,因为主流本地推理栈对 TTS 模型的原生支持正在完善,语音 Agent 和端侧多模态应用的部署门槛会继续下降。

Read Source
京东黑板报 2026-08-05

京东开源实时流式视频编辑模型 JoyAI-Video-Edit

京东开源 JoyAI-Video-Edit,支持视频边播边改,在 720P 分辨率下实现每秒 30 帧推理,并可处理任意时长视频。它值得关注,因为实时视频编辑把生成式视频从离线渲染推进到交互式生产流程,直播、电商和创作工具会更快出现新的产品形态。

Read Source
腾讯混元 2026-08-04

腾讯混元联合推出智能体评测基准 E-Bench

腾讯混元联合清华 AIR 与东南大学推出 E-Bench,以王者荣耀、QQ 音乐和腾讯会议为原型构建 323 个改状态任务与 7.6 万余条数据,11 个前沿模型平均成功率为 54.56%。它值得关注,因为 Agent 评测开始从问答类 benchmark 转向带工具与状态变化的任务环境,模型真实执行能力会更容易被量化比较。

Read Source
商汤科技 2026-08-04

商汤开源统一多模态模型 SenseNova U1.5-Lite-Preview

商汤科技开源 SenseNova U1.5-Lite-Preview,基于 NEO-Unify 架构以 8B-MoT 参数贯通视觉理解、推理、生成与编辑,并原生支持 4K 图像生成。它值得关注,因为轻量统一多模态模型正在向更完整的视觉生成和编辑能力靠拢,产品团队可以用更小模型覆盖更多图像工作流。

Read Source
阿里云 2026-08-06

阿里云上线 One Key MCP 统一接入多家 MCP 服务

阿里云上线 One Key MCP,允许开发者通过统一 API Key 调用多家生态伙伴 MCP 服务,并兼容主流 Coding Agent 的接入、鉴权和计费管理流程。它值得关注,因为 MCP 正在从协议讨论进入平台化分发阶段,企业 Agent 集成会更依赖统一身份、计费和服务发现能力。

Read Source

@Luhui Dev 出品,精选 AI 领域技术发展与产品动态,提供一份连续阅读的周度观察。

llama.cpp 主线合入 Qwen3-TTS 语音克隆支持

ggml-org 在 llama.cpp 主线合入 Qwen3-TTS-12Hz-1.7B-Base GGUF 支持,使本地多语言语音克隆可基于 WAV 或 MP3 说话人参考运行。它值得关注,因为主流本地推理栈对 TT…

京东开源实时流式视频编辑模型 JoyAI-Video-Edit

京东开源 JoyAI-Video-Edit,支持视频边播边改,在 720P 分辨率下实现每秒 30 帧推理,并可处理任意时长视频。它值得关注,因为实时视频编辑把生成式视频从离线渲染推进到交互式生产流程,直播、电商和创作工…

腾讯混元联合推出智能体评测基准 E-Bench

腾讯混元联合清华 AIR 与东南大学推出 E-Bench,以王者荣耀、QQ 音乐和腾讯会议为原型构建 323 个改状态任务与 7.6 万余条数据,11 个前沿模型平均成功率为 54.56%。它值得关注,因为 Agent …

商汤开源统一多模态模型 SenseNova U1.5-Lite-Preview

商汤科技开源 SenseNova U1.5-Lite-Preview,基于 NEO-Unify 架构以 8B-MoT 参数贯通视觉理解、推理、生成与编辑,并原生支持 4K 图像生成。它值得关注,因为轻量统一多模态模型正在…

阿里云上线 One Key MCP 统一接入多家 MCP 服务

阿里云上线 One Key MCP,允许开发者通过统一 API Key 调用多家生态伙伴 MCP 服务,并兼容主流 Coding Agent 的接入、鉴权和计费管理流程。它值得关注,因为 MCP 正在从协议讨论进入平台化…

@Luhui Dev 出品,精选 AI 领域技术发展与产品动态,提供一份连续阅读的周度观察。

OpenAI 发布 Agent Plugins 标准并推出 Codex Security Review 研究预览

OpenAI Developers 宣布 Agent Plugins 开放标准,与 AWS、Cursor、GitHub、Vercel 等合作定义 Agent Skills 与 MCP 服务器配置的共享格式,并同步推出面向 GitHub PR 的 Codex Security Review 研究预览。它值得关注,因为 Agent 工具分发和仓库级安全审查正在同时产品化,开发者生态会从单点集成转向跨平台兼容和内建审计。

01

Anthropic 为 Claude Code 增加跨会话消息并将 Auto Mode 设为默认路径

Anthropic 通过 ClaudeDevs 公布 Claude Code 新增跨会话消息传递、会话预算、自动加载仓库技能和可中途调用的 advisor 模型,并将 Pro、Max、Team 用户的默认权限模式切换为由独立分类器审核操作的 Auto Mode。它值得关注,因为编码 Agent 的竞争点正在从单次补全扩展到长任务协作、权限治理和默认执行体验。

02

阿里发布 Qwen3.8-Max 并预告下周开源模型权重

阿里推出新一代旗舰模型 Qwen3.8-Max,总参数规模 2.4 万亿、激活参数 95B,支持 100 万上下文 Tokens,并表示将在下周开源模型权重。它值得关注,因为超大规模开源权重继续向旗舰能力推进,长上下文、编程和研究场景的成本与可部署性会受到直接影响。

03

MiniMax 开源通用视频模型 MiniMax H3

MiniMax 开源新一代通用视频模型 MiniMax H3,支持文本、图像、视频、音频多模态输入,可生成最高 2K 分辨率、15 秒时长并带 32kHz 立体声音频的视频,同时开放 H3-Base 并支持 SGLang、vLLM 本地部署。它值得关注,因为高质量视频生成正从封闭产品转向可落地的开源基础模型,开发者可以直接围绕推理栈和工作流做二次构建。

04

阿里云启动 Wan3.0 公测并加入文档到视频输入能力

阿里云开启 Wan3.0 公测,模型单次可生成 30 秒视频,支持连续运镜与一镜到底叙事,并新增 doc、xls、ppt、pdf、md 等文档输入以直接生成教学课件和产品演示视频。它值得关注,因为视频生成开始接入办公素材和知识文档,企业内容生产将更接近自动化流水线而非单次创作工具。

05

Prime Intellect 开源编码与研究 Agent 框架 Prime Agent

Prime Intellect 在 GitHub 开源 Prime Agent,提供程序化工具调用、多 Agent 消息传递、持久执行、可修改的 harness 状态与“context as a variable”等能力。它值得关注,因为开源社区开始把编码 Agent 的能力竞争从模型选择扩展到执行框架本身,harness 设计正在成为影响效果和成本的核心变量。

06

llama.cpp 主线合入 Qwen3-TTS 语音克隆支持

ggml-org 在 llama.cpp 主线合入 Qwen3-TTS-12Hz-1.7B-Base GGUF 支持,使本地多语言语音克隆可基于 WAV 或 MP3 说话人参考运行。它值得关注,因为主流本地推理栈对 TTS 模型的原生支持正在完善,语音 Agent 和端侧多模态应用的部署门槛会继续下降。

07

京东开源实时流式视频编辑模型 JoyAI-Video-Edit

京东开源 JoyAI-Video-Edit,支持视频边播边改,在 720P 分辨率下实现每秒 30 帧推理,并可处理任意时长视频。它值得关注,因为实时视频编辑把生成式视频从离线渲染推进到交互式生产流程,直播、电商和创作工具会更快出现新的产品形态。

08

腾讯混元联合推出智能体评测基准 E-Bench

腾讯混元联合清华 AIR 与东南大学推出 E-Bench,以王者荣耀、QQ 音乐和腾讯会议为原型构建 323 个改状态任务与 7.6 万余条数据,11 个前沿模型平均成功率为 54.56%。它值得关注,因为 Agent 评测开始从问答类 benchmark 转向带工具与状态变化的任务环境,模型真实执行能力会更容易被量化比较。

09

商汤开源统一多模态模型 SenseNova U1.5-Lite-Preview

商汤科技开源 SenseNova U1.5-Lite-Preview,基于 NEO-Unify 架构以 8B-MoT 参数贯通视觉理解、推理、生成与编辑,并原生支持 4K 图像生成。它值得关注,因为轻量统一多模态模型正在向更完整的视觉生成和编辑能力靠拢,产品团队可以用更小模型覆盖更多图像工作流。

10

阿里云上线 One Key MCP 统一接入多家 MCP 服务

阿里云上线 One Key MCP,允许开发者通过统一 API Key 调用多家生态伙伴 MCP 服务,并兼容主流 Coding Agent 的接入、鉴权和计费管理流程。它值得关注,因为 MCP 正在从协议讨论进入平台化分发阶段,企业 Agent 集成会更依赖统一身份、计费和服务发现能力。

11

End of Brief

See you next week