Qwen Code v0.25.1 发布
千问 Qwen Code 发布 v0.25.1,新增实验性 Kubernetes CSI 运行时与持久化 worker ACK,并引入 managed-agent 的 H3 后台 Shell 与 Monitor 运行时。
千问 Qwen Code 发布 v0.25.1,新增实验性 Kubernetes CSI 运行时与持久化 worker ACK,并引入 managed-agent 的 H3 后台 Shell 与 Monitor 运行时。
OpenCode 发布 v1.19.0,用户可通过 `opencode upgrade --major` 升级到 OpenCode 2。TUI 新增 /update 命令用于安装更新或升级到 OpenCode 2,更新不再自动安装。此版本还允许使用 OpenAI ultrafast 服务层级,并在检查 PTY 是否存在前校验 PTY 连接来源与 ticket。
GitHub Copilot for JetBrains 更新,企业管理员可通过托管设置将任意可用的 Copilot agent 模型设为新会话默认模型,同时保留显式模型选择。
Amp 现在支持使用 Claude Pro/Max 订阅,功能免费并向所有人开放。新建 thread 时选择 Mode > Claude Code 即可,未关联订阅会提示先关联;该模式底层改用 Claude Agent SDK 而非 Amp 自有 Agent,同时保留了 orbs 与 runners、thread 分享、portals、多人协作、thread 间消息与编排等能力。
推荐理由:原文说明了 Amp 接入 Claude 订阅的具体入口与底层实现,读者可据此判断订阅复用对现有工作流的影响。
GitHub Copilot 本周更新中,Claude Haiku 5.5 已向 Copilot Pro、Pro+、Max、Business 和 Enterprise 用户开放。
推荐理由:汇总了 Copilot 本周在账号分离、本地沙箱和本地模型接入上的多项更新,可据此判断现有工作流的调整空间。
Claude Code 2.1.296 为 Claude apps gateway 的 managed.policies[] 新增 code 键,与 cli 配置相同并应用于 Claude Desktop 的 Code 标签页,同时开启 Desktop 的 gateway 模式。
Asana 的 StackAI CTO Frank Hidalgo 用 Codex 中的 GPT-6 Astra 做实验,把浏览器 Agent 工作流优化到在 GPT-6.1 Sol 上运行成本降低 76 倍、速度提升 5 倍,单次运行平均约 0.47 美元、约 4 分钟。
Sophos 通过 OpenAI Daybreak 将 OpenAI 模型与其威胁情报、响应手册和安全专业知识结合,使使用 AI 智能体的案件平均响应时间从约 38 分钟降至 89 秒,调查时间缩短 96%。目前 52% 的 MDR 案件由 AI 端到端解决,Sophos 通过 Notify、Collaborate、Authorise 三种模式保留人工监督。
OpenHands 发布 v1.26.0,新增 verify-openhands 技能及配套 control-openhands CLI 与完整功能图谱,并支持每日验证。该版本还加入后端认证视图辅助、企业后端 Super Admin 设置引导,以及大量可访问性与错误提示修复。
opencode 发布 v2.0.26。该版本于 10 月 8 日打上标签,发布页仅提供 2 个资源文件,未附具体更新说明。
GitHub 为 Copilot 代码审查新增组织级计费与权限控制:组织所有者可将持 Copilot 许可证成员的审查请求计入组织成本中心,而非消耗成员自身配额,该选项需启用 AI Credits 付费用量并可设预算。同时可开启设置,仅允许由本组织或企业提供许可证的用户触发代码审查,组织级开启后仓库管理员无法关闭。
Oracle 超过 13 万名员工正在使用 ChatGPT Work 和 Codex,其中 Codex 活跃用户超 9.5 万。其招聘团队用 ChatGPT Work 搭建的人才市场情报工具,把原本需要 2–4 天的调研压缩到 15–20 分钟准备,招聘调研耗时下降 98%;应用实验室团队则用 Codex 把自然语言业务问题转成 SQL 查询,简单故障处理从 1 小时缩短到几分钟。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是按任务匹配 Astra、Sol 和 Luna 模型,并对预算进行策略性管理。
JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版本,架构未变,仍为 2.5B 激活参数、Apache 2.0 许可。
推荐理由:JetBrains 开源 12B MoE 编码模型,读者可了解其强化学习后训练路线与本地部署的取舍。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5 打造 Pollo Agent,为创作者提供从创意到成片的完整视频生成流程,目前服务超 2600 万用户。其模型组合让用户挑选或切换模型的时间减少 50% 以上,30% 的创作者会话从视频模板或热门格式工作流开始。Photo to Video Ads 工具可将单张产品图转为约 15 秒短视频广告。
opencode 发布 v2.0.25。该版本于 10 月 8 日打上标签,发布资源共 2 项。
OpenAI 在 Codex 和 ChatGPT Work 中推出 GPT-6.1 Sol Ultrafast,Ultrafast 模式可加速 token 生成。该模式面向 Pro $500 及符合条件的 Enterprise 和 Edu 套餐,Enterprise 默认关闭,需由工作区管理员开启,并支持在美国和欧洲(EEA + 瑞士)的推理驻留。
推荐理由:官方更新日志给出 Ultrafast 模式的可用套餐、默认开关与推理驻留区域,便于团队评估接入条件。
OpenAI 捣毁了两起借助 AI 开展的影响力行动,这些行动利用假记者身份和一家智库散布地缘政治信息。
Anthropic 最新的轻量模型 Claude Haiku 5.5 已在 GitHub Copilot 正式可用,面向 Copilot Pro、Pro+、Max。
推荐理由:官方说明 Haiku 5.5 在 Copilot 中的可用范围与计费方式,便于团队评估是否切换轻量模型。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别数据库密码等非结构化密钥,候选批次评估耗时低于 2 毫秒,可将可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度的数据说明密钥泄露与代码量同步增长,并给出把检测前移到 push 环节的模型方案。
GitHub 发布用于密钥检测的微调模型,可读取上下文代码识别无固定格式的密码等凭据,且不生成代码或文本。已有 AI 检测密码告警的客户自动升级到新模型,AI 检测密钥的推送保护进入 private preview,Copilot CLI 和 Copilot App 的 /security-review 命令中的 AI 密钥扫描也将很快进入 private preview。
推荐理由:GitHub 把微调后的密钥检测模型接入推送保护与 Copilot 安全审查,读者可据此判断其计费与启用方式。
Anthropic 发布新版 Usage Policy,将于 11 月 12 日生效,多数改动是澄清现有规则,并针对 Claude 承担更长、更独立任务的新能力补充示例。
Anthropic 宣布三年投入 1.5 亿美元支持美国联邦"Genesis Mission"计划,向 NASA、NIH、NSF 等 15 个以上参与机构开放 Claude。
Anthropic 发起长期安全计划 Anthropic Cyber Mission,首批聚焦关键基础设施与开源软件两大方向。
GitHub Copilot 的本地沙箱功能正式可用,覆盖 Copilot CLI、Copilot 应用和使用 Agent Host 的 VS Code 会话。
推荐理由:官方说明了本地沙箱在三个入口的正式可用状态与策略边界,可据此判断智能体工作流的权限控制方式。
GitHub Copilot CLI 从 1.0.94-0 版本起,可用 /model 发现正在运行的本地 Ollama 实例中的受支持模型,与已配置模型和 GitHub Copilot 云端模型并列展示。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能。OpenAI 还宣布成立青少年 AI 委员会(teen AI council),让青少年参与塑造 AI 的未来。
GitHub 发现部分 IDE 将 Copilot Agent 会话迁移到 Copilot SDK 后未标识来源,导致用量指标中 Agent 活动和代码行数被少计、部分被算作 Copilot CLI 活动。
Gemini CLI 发布 v0.63.0,修复连接恢复时显示重试进度指示器、区分 MCP 启用配置缺失与 JSON 格式错误、恢复能力检测后暂停的 stdin 等问题。核心侧限制工具输出大小并优化长时间运行 Agent 循环的内存生命周期,同时在非交互模式下启用自主计划执行。
Google 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可将文本、图像、音频和视频映射到统一嵌入空间。
推荐理由:Google 发布 740M 参数端侧多模态嵌入模型,给出量化内存与向量截断等可核对的部署数据。
Mistral 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、520 亿激活参数的原生多模态模型,权重将于本月底开放。
推荐理由:Mistral 官方给出 ML4 的完整能力清单与开源权重时间表,可据此判断欧洲开源模型在编码与智能体任务上的位置。
OpenHands 发布 v1.25.0,新增 Model Router 直连提示词设置、会话开始时运行开关,以及按连接批量添加 LLM profiles。Canvas Apps 支持 Update 操作,聊天输入框加入可选语音听写,Agent profiles 可自定义 persona 或额外指令并固定 SDK 1.53.0。
Cursor 上线 Remote Control,可在 Cursor iOS app 中查看并回复运行在本地电脑上的 Agent。
推荐理由:官方说明了本地 Agent 远程查看与回复的开启方式和运行前提,便于判断是否适合远程办公场景。
Amp 的 Puck 现已支持开启多个独立会话,每个会话拥有各自的 Puck,点 + 即可新建,点击顶部会话名可切换。三天未使用的会话会被移入 Inactive,以保持列表简洁。
Anthropic 推出扩展版 Cyber Verification Program(CVP),将原 Project Glasswing 与 CVP 合并为三级访问体系。
GitHub 发布 ReviewBench,一个面向 AI 代码审查的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含 219 个 pull request、覆盖 19 种语言。
推荐理由:GitHub 公开了代码审查基准的构建方法与评分口径,读者可据此判断自家审查 Agent 的强弱项。
千问 Qwen Code 发布 v0.25.0,新增本地 workspace-agent 协作、workspace agent 的 A2A 访问与共享,并将 Mem0 打包进主 CLI。该版本还引入 managed-agent 的私有 Hosted MCP 运行时、托管文件历史与撤销、持久化 Hosted Hooks,以及 IMAP/SMTP 邮件渠道。无已知破坏性变更。
GitHub 博客提出 AI 时代开发者应加强的三项技能:学会指挥 AI 而非只是使用它、不要轻信 AI 的第一个答案、用 AI 省下的时间解决更大的问题。文中提到 GitHub Copilot 内置的 Rubber Duck agent 会用第二个模型审查计划、代码和测试,以发现首个模型遗漏的问题。
Anthropic 推出 Claude Frontier Academy,投入 1 亿美元,计划到 2027 年底培养 1 万名前沿部署工程师(FDE)。
JetBrains 在 IDE 中开放 Air 的 Early Access Program,以插件形式上线 JetBrains Marketplace,也内置于 2026.3 EAP 版本。
推荐理由:JetBrains 官方说明 Air 如何把多 Agent 并行会话、临时 worktree 与本地云端运行整合进 IDE,可据此判断现有工作流会怎样变化。