Qwen Code v0.25.1 发布
千问 Qwen Code 发布 v0.25.1,新增实验性 Kubernetes CSI 运行时与持久化 worker ACK,并引入 managed-agent 的 H3 后台 Shell 与 Monitor 运行时。
千问 Qwen Code 发布 v0.25.1,新增实验性 Kubernetes CSI 运行时与持久化 worker ACK,并引入 managed-agent 的 H3 后台 Shell 与 Monitor 运行时。
Amp 现在支持使用 Claude Pro/Max 订阅,功能免费并向所有人开放。新建 thread 时选择 Mode > Claude Code 即可,未关联订阅会提示先关联;该模式底层改用 Claude Agent SDK 而非 Amp 自有 Agent,同时保留了 orbs 与 runners、thread 分享、portals、多人协作、thread 间消息与编排等能力。
推荐理由:原文说明了 Amp 接入 Claude 订阅的具体入口与底层实现,读者可据此判断订阅复用对现有工作流的影响。
Asana 的 StackAI CTO Frank Hidalgo 用 Codex 中的 GPT-6 Astra 做实验,把浏览器 Agent 工作流优化到在 GPT-6.1 Sol 上运行成本降低 76 倍、速度提升 5 倍,单次运行平均约 0.47 美元、约 4 分钟。
Sophos 通过 OpenAI Daybreak 将 OpenAI 模型与其威胁情报、响应手册和安全专业知识结合,使使用 AI 智能体的案件平均响应时间从约 38 分钟降至 89 秒,调查时间缩短 96%。目前 52% 的 MDR 案件由 AI 端到端解决,Sophos 通过 Notify、Collaborate、Authorise 三种模式保留人工监督。
Mistral 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、520 亿激活参数的原生多模态模型,权重将于本月底开放。
推荐理由:Mistral 官方给出 ML4 的完整能力清单与开源权重时间表,可据此判断欧洲开源模型在编码与智能体任务上的位置。
OpenHands 发布 v1.25.0,新增 Model Router 直连提示词设置、会话开始时运行开关,以及按连接批量添加 LLM profiles。Canvas Apps 支持 Update 操作,聊天输入框加入可选语音听写,Agent profiles 可自定义 persona 或额外指令并固定 SDK 1.53.0。
GitHub 发布 ReviewBench,一个面向 AI 代码审查的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含 219 个 pull request、覆盖 19 种语言。
推荐理由:GitHub 公开了代码审查基准的构建方法与评分口径,读者可据此判断自家审查 Agent 的强弱项。
Anthropic 推出 Claude Frontier Academy,投入 1 亿美元,计划到 2027 年底培养 1 万名前沿部署工程师(FDE)。
GitHub Copilot app 的 canvases 是一种可自定义界面,用户只需在 Agent 会话中输入 /create-canvas 技能并用自然语言描述需求,Agent 就会生成界面并在右侧面板打开。
推荐理由:原文给出 /create-canvas 的提示词写法与双向协作机制,读者可据此把日常流程做成可复用画布。
OpenHands 发布 v1.24.0,新增从 Conversations 头部一键折叠全部工作区文件夹、按后端隔离 OpenAI 订阅缓存,并支持在云端以只读方式打开共享自动化会话。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需传入 GitHub owner/repo,Agent 就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM Agent,读者可据此判断自动化安全测试的边界。
Cursor 发布 Rollouts 和 Security Review 两个机器人,用于代码上线的最后环节,今日起在 Teams 和 Enterprise 套餐提供。
推荐理由:Cursor 把部署健康监控与安全审查做成两个 PR 机器人,读者可据此判断上线环节的自动化边界。
Anthropic 成立生命科学研究组与实验室,让 Claude 自主挖掘 DNA 数据。约 950 个 agent 用 210 million tokens 搜索 21 小时。
Amp 的 runner 现在可以创建 Git worktree:在目录选择器里选中仓库按 Tab 并命名分支,线程就会在新建的独立 checkout 中启动,主 checkout 不受影响,未提交的改动仍留在原处。
推荐理由:原文给出 runner 创建 Git worktree 与读取 Secrets 的具体操作路径,可据此判断多分支并行开发流程的变化。
GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是可读的打包经验,后者是连接工具与数据的标准接口,二者可组合使用。
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方称对话默认不保存在 Mozilla 服务器上,Mistral 同意零数据保留,并按地区语言和方言微调模型。
Google 在 Gemini API 和 Google AI Studio 发布 Gemini 3.8 Live、3.8 Live Extended Thinking 与 Gemini 3.5 Transcribe。
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups(GDG)在 115 个国家举办 800 多场活动,预计近百万开发者参与。
Cursor 推出 Projects,用于承接功能开发、迁移或完整应用等更大规模的工作,可跨数月维持上下文、把任务分派给大量子 Agent,并在无需提示的情况下执行周期性工作。
推荐理由:官方说明 Projects 如何用协调者 Agent 与云端并行子 Agent 承接跨月的大型开发任务,可据此判断长周期工作流的组织方式。
Google 发布 8 月 AI 更新汇总,推出面向编码与 Agent 的 Gemini 3.7 Flash,每百万 token 价格为首发 3.6 Flash 的一半,距 3.6 Flash 发布仅三周。
Zed 认为 Ted Nelson 的 Xanadu 超文本构想之所以长期无法落地,是因为缺少能耐心追踪每一层引用的用户,而 AI 智能体正好补上这一环。DeltaDB 用 Lamport 时间戳、Merkle 树、CRDT、廉价存储、常连网络和 Firecracker 级微虚拟机等六十年积累的组件,实现"永不复制、只引用,永不覆盖、只版本化"的 xanalogical 计算。
智谱开放平台上线 GLM-5.3 与 GLM-5.3-Flash。GLM-5.3 编程能力在内部 Z.ai Code Bench 上较 GLM-5.2 提升 50%,在包括 Terminal Bench 3.0 等公开基准中达到开源模型 SOTA,并联合多个中国安全团队累计发现 2436 个漏洞(1097 个中高危)。
推荐理由:智谱一次性放出 GLM-5.3 与 GLM-5.3-Flash 等多项更新,可对照参数与基准变化判断其编程与多模态能力定位。
Model Context Protocol 官方发布更新版路线图,覆盖下一次规范发布及之后的方向,由 Core Maintainers 与社区维护者、Working Groups 共同制定。
推荐理由:MCP 官方给出五个优先方向与 SEP 评审优先级,读者可据此判断协议下一步演进重点。
Cursor 推出代码托管服务 Origin,今日起在所有付费计划上以早期 beta 形式逐步开放,企业组织管理员可选择退出。首批功能包括仓库、pull request、代码浏览和 GitHub 同步,Origin 托管的仓库以 Origin 为唯一来源,同步的 GitHub 仓库仍以 GitHub 为准、双向同步 PR 评论。
推荐理由:Cursor 把代码托管、PR 与 Agent 放进同一入口,读者可据此判断它与 GitHub 的分工边界。
NVIDIA Nemotron 3.5 Lightning 已在 Ollama 上线,可完全在本地设备运行。
推荐理由:NVIDIA 开源 30B 总参数、3B 激活的本地 Agent 模型,可对照其吞吐与上下文规格判断本地部署取舍。
Meta Superintelligence Labs 的首个开源模型 Muse Glimmer 已在 Ollama 上线,这是一个 30B 多模态模型,面向本地运行的 Agent 工作负载,上下文长度 128K+,采用 Apache 2.0 许可。
推荐理由:Meta Superintelligence Labs 首个开源模型在 Ollama 上线,可了解其本地编码 Agent 接入方式与 Apple Silicon 加速表现。
JetBrains 在 7 月 8 日开放 Central CLI 早期访问,把第三方终端 Agent 的请求统一接入其 AI 路由层,用 AI credits 对个人、团队和部门设置用量与预算限制。
推荐理由:JetBrains 公开了内部 AI 成本治理的完整路径,从失控到自建 CLI 与预算机制,可供多工具团队参考。
MCP 官方发布 2026-07-28 规范,协议核心从双向有状态转为请求/响应无状态,取消 initialize 握手与 Mcp-Session-Id,任何请求都可落在普通轮询负载均衡后的任意实例上。
推荐理由:官方给出无状态协议核心的完整变更清单与迁移说明,可据此评估现有 MCP 服务的改造量。
MCP 官方发布 2026-07-28 规范候选版对应的四个 Tier 1 SDK beta,由 Python v2 和 TypeScript v2 领衔,Go 与 C# 也提供 beta。
推荐理由:官方给出四个 Tier 1 SDK 的 beta 入口与无状态协议改动清单,可据此提前评估现有 MCP 服务的迁移成本。
Zed 正在开发名为 DeltaDB 的新型版本控制系统,将每次操作而非提交记录为细粒度 delta,并把与 Agent 的对话和代码编辑并排存储,使二者不再分离。DeltaDB 内嵌无冲突复制工作树,支持多人和多个 Agent 跨机器同时编辑同一文件,引用锚定在 delta 上而非行号,因此代码变动后仍可追溯。该产品将于几周内推出 beta 版,现已开放 waitlist。
MCP 发布 2026-07-28 规范候选版本,这是协议发布以来最大的一次修订,核心变化是协议层改为无状态,移除 initialize/initialized 握手与 Mcp-Session-Id 会话,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。
推荐理由:MCP 协议最大一次改版,无状态核心与扩展机制的具体变化,可据此评估现有部署与 SDK 的迁移成本。