Barclays 扩大与 Anthropic 合作,将 Claude 推广至全行
Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,用于加速软件开发、现代化遗留系统并提升运营效率。Barclays 预计到 2026 年底 Claude Code 覆盖 50% 开发者,2027 年覆盖多数软件工程师。
Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,用于加速软件开发、现代化遗留系统并提升运营效率。Barclays 预计到 2026 年底 Claude Code 覆盖 50% 开发者,2027 年覆盖多数软件工程师。
Windsurf 发布 Wave 13,为 Windsurf 带来并行多 Agent 会话的一等支持,并加入 Git worktrees、并排 Cascade 面板和专用终端配置。
推荐理由:更新日志列出多智能体并行会话、Git worktree 与专用终端等改动,可据此判断 Windsurf 的 Agent 工作流变化。
Amp 为使用 GPT-6 Astra 的模式新增 Plaid 速度档,采用 OpenAI 的超高速推理层级,请求速度最高提升 6 倍,同时每 token 成本也是 6 倍。
推荐理由:原文说明了 Plaid 速度档的开启方式、6 倍加速与 6 倍单价,以及仅限 Amp 自有推理的限制。
Ollama 0.35 通过新的 /v1/systemone 端点支持基于 TypeSafe Jev API 的决策模型,可一次性提交文本状态和一组命名问题并本地作答。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并直接服务企业合作伙伴。该中心将推进与 BMW 的碰撞仿真、与 Siemens Energy 的工业 AI 应用合作,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。Mistral 计划到 2030 年建成 1 吉瓦欧洲算力,其开放权重模型可在客户自有基础设施上运行。
Amp 宣布 medium 模式默认模型由 GPT-5.6 Sol 换成 Claude Opus 5.5,使用 ChatGPT 订阅的 ChatGPT Only 预设时 medium 仍固定为 GPT-5.6 Sol。
推荐理由:Amp 官方给出 Opus 5.5 在 medium 模式的任务解决率与成本对比,以及可迁移的提示与验证习惯。
GitHub Copilot app 的 canvases 是一种可自定义界面,用户只需在 Agent 会话中输入 /create-canvas 技能并用自然语言描述需求,Agent 就会生成界面并在右侧面板打开。
推荐理由:原文给出 /create-canvas 的提示词写法与双向协作机制,读者可据此把日常流程做成可复用画布。
OpenHands 发布 v1.24.0,新增从 Conversations 头部一键折叠全部工作区文件夹、按后端隔离 OpenAI 订阅缓存,并支持在云端以只读方式打开共享自动化会话。
Amp 现在会把 Agent 的逐步执行过程折叠得更彻底,因为用户关心的是 Agent 做了什么,而非它如何做到,需要时仍可展开步骤。Amp 认为,如今用户同时运行大量 Agent,应给它们更难、更深的工作和验证要求,让它们更长时间自主运行,而不是近距离盯着每一步。
GitHub 认为 chat 是大多数场景下错误的 AI 交互界面,主张用 GitHub Copilot app 中的 canvas 替代。canvas 是运行在 Copilot app 内的全栈应用,可与 agent 双向通信、调用第三方 API 并在本地执行代码,例如做出 Connect 4 游戏、Winget 包管理界面和 SQLite 操作界面。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需传入 GitHub owner/repo,Agent 就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM Agent,读者可据此判断自动化安全测试的边界。
Amp 上线共享 Runner 功能,用 --share 启动后,工作区内所有成员都能在 ampcode.com 上在这台机器上开启线程,带 GPU 的机器、用于构建和签名 iOS 应用的 Mac 或特定网络中的开发机都可以这样接入,并在选择器中以 Shared Runners 显示。
推荐理由:原文说明了共享 runner 的启动方式、权限边界与安全前提,便于团队评估是否把带 GPU 或签名环境的机器接入 Agent 工作流。
Amp 的 macOS 应用现在会自动为你在本机启动 runner,不再需要在终端里保持 amp --no-tui 打开才能运行线程。在 App Settings(⌘⇧,)的 Runner 里点 + 添加文件夹或项目后,启动线程时选择器里会出现标记为 This Mac 的本机选项,从 ampcode.com、手机或 Puck 发起线程时同样可选。
GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超百万行改动和 400 多条行内评论的开源 PR 做压力测试。代码行高度可预先精确计算,但评论高度依赖 markdown 换行、折叠区、回复框和图片加载,只能在渲染时确定,因此把文档高度拆成确定性的代码几何与动态块几何两套体系,动态块按文件、行号和侧别锚定并惰性测量。
Cursor 发布 Rollouts 和 Security Review 两个机器人,用于代码上线的最后环节,今日起在 Teams 和 Enterprise 套餐提供。
推荐理由:Cursor 把部署健康监控与安全审查做成两个 PR 机器人,读者可据此判断上线环节的自动化边界。
Anthropic 成立生命科学研究组与实验室,让 Claude 自主挖掘 DNA 数据。约 950 个 agent 用 210 million tokens 搜索 21 小时。
Kimi CLI 发布 1.52.0 版本,由贡献者 sailist 提交,commit 9ab1286 带有 GitHub 验证签名。该仓库已于 2026 年 9 月 23 日被所有者归档,现为只读状态。
Amp 的 runner 现在可以创建 Git worktree:在目录选择器里选中仓库按 Tab 并命名分支,线程就会在新建的独立 checkout 中启动,主 checkout 不受影响,未提交的改动仍留在原处。
推荐理由:原文给出 runner 创建 Git worktree 与读取 Secrets 的具体操作路径,可据此判断多分支并行开发流程的变化。
Kimi CLI 发布 1.51.0,将 kimi-cli 归档并引导用户迁移到 Kimi Code CLI。该版本由 @RealKai42 提交,包含归档 kimi-cli 和版本号升至 1.51.0 两项改动,完整变更记录为 1.50.0...1.51.0。
GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是可读的打包经验,后者是连接工具与数据的标准接口,二者可组合使用。
Anthropic 与 Accenture 达成合作,由 Accenture 旗下 AI 业务 Faculty 牵头,对 Anthropic 的前沿模型开展独立评估,包括模型评估与红队测试、对齐评估和安全防护测试。
JetBrains 撰文介绍其语义代码搜索平台 Air Context 的 RAG 流水线,首篇聚焦解析、分块与向量化。Air Context 目前支持 Kotlin、Java、Python、JavaScript、TypeScript、C#、PHP、Go、Rust 九种语言的结构感知分块,其余语言回退到按行切分。
推荐理由:JetBrains 公开了语义代码搜索 RAG 流水线的解析、分块与向量化细节,含二进制量化取舍。
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,率先面向法国和北美用户,英国和德国预计今年晚些时候跟进。双方称对话默认不保存在 Mozilla 服务器上,Mistral 同意零数据保留,并按地区语言和方言微调模型。
Zed 团队发布 Delta 公测版,这是一个与 Agent 协作编码并审查其产出的多人环境,支持 macOS、Linux、Windows 和网页端,移动浏览器也可跟进线程。
推荐理由:Zed 团队把 PR 换成 Delta 线程,并公开了自用数据,可据此判断协作式 Agent 编码的另一种组织方式。
Google 在 Gemini API 和 Google AI Studio 发布 Gemini 3.8 Live、3.8 Live Extended Thinking 与 Gemini 3.5 Transcribe。
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups(GDG)在 115 个国家举办 800 多场活动,预计近百万开发者参与。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,数据与由此产生的智能均归企业所有。Cloudera 平台承载 30 exabytes 客户自管数据,双方称此举面向对主权 AI 日益增长的需求。
Cursor 推出 Projects,用于承接功能开发、迁移或完整应用等更大规模的工作,可跨数月维持上下文、把任务分派给大量子 Agent,并在无需提示的情况下执行周期性工作。
推荐理由:官方说明 Projects 如何用协调者 Agent 与云端并行子 Agent 承接跨月的大型开发任务,可据此判断长周期工作流的组织方式。
Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 的油藏模拟器迁移到 C++,该代码库没有测试套件也没有集中文档。团队先搭建数值对等测试框架,用自定义解析器生成调用树并借助 Vibe CLI 启动上百个 Agent 补文档,最终采用人工把关的 coder、tester、reviewer 结构化工作流逐模块迁移。
推荐理由:Mistral 用 4 万行 Fortran 迁移案例,给出对等测试框架、文档化和人机协作工作流的具体做法。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。这是欧洲科技公司完成的最大股权融资,资金将用于扩展前沿研究、算力、基础设施和商业增长。Mistral 目前业务覆盖 20 个国家,服务 125 家以上全球企业,包括 Airbus、ASML 和 HSBC。
推荐理由:Mistral 完成欧洲科技公司最大股权融资,读者可了解其主权开源 AI 全栈定位与投资方阵容。
Cursor 支持自托管机器,让工具执行完全留在自有网络内,代码库、构建产物和密钥都保留在内部基础设施上,由 Agent 在本地处理工具调用。My Machines 可将单台笔记本或 VM 接入账号,Team pools 则是团队或企业的命名工作队列,容量随请求到达增长、随 worker 断开收缩,并支持空闲机器休眠后在重连窗口内恢复。
推荐理由:Cursor 把工具执行放进企业自有网络,并给出池化调度与第三方沙箱接入方式,便于评估落地边界。
Google 发布 8 月 AI 更新汇总,推出面向编码与 Agent 的 Gemini 3.7 Flash,每百万 token 价格为首发 3.6 Flash 的一半,距 3.6 Flash 发布仅三周。
Kimi CLI 发布 1.50.0,新增弃用感知的更新流程,支持一键迁移到 Kimi Code。该版本修复了 kosong 在未声明 beta 功能时仍发送空 anthropic-beta 请求头的问题,并将 kosong 升级至 0.56.0。
Zed 认为 Ted Nelson 的 Xanadu 超文本构想之所以长期无法落地,是因为缺少能耐心追踪每一层引用的用户,而 AI 智能体正好补上这一环。DeltaDB 用 Lamport 时间戳、Merkle 树、CRDT、廉价存储、常连网络和 Firecracker 级微虚拟机等六十年积累的组件,实现"永不复制、只引用,永不覆盖、只版本化"的 xanalogical 计算。
Google Antigravity 为 Teamwork 框架推出多项更新,该框架让自主 AI 智能体团队协作、互评并迭代数小时至数天,以解决复杂长周期任务。
推荐理由:原文列出多智能体协作在数学与系统工程上的具体产出,可据此判断长周期自主团队框架的实际能力边界。
Ollama 将 Pro、Max、Team 计划改为按 token 计费,每档包含每月用量额度:Pro 每月 20 美元含 60 美元用量,Max 每月 100 美元含 300 美元用量,Team 每月 500 美元含 1000 美元共享用量且不限用户数。
Google DeepMind 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供,新增场景延展、首尾帧插值、4K 升采样等生成视频控制能力。
Cursor 更新 Cloud Agents,不再要求先连接 GitHub 或其他第三方 SCM 提供商,在 repo picker 中选择 Start from scratch 即可直接向智能体下达提示词,Cursor 会在后台创建 Origin 仓库。
推荐理由:Cursor Cloud Agents 不再依赖第三方代码托管即可起步,读者可据此判断无仓库场景下的智能体工作流变化。
智谱开放平台上线 GLM-5.3 与 GLM-5.3-Flash。GLM-5.3 编程能力在内部 Z.ai Code Bench 上较 GLM-5.2 提升 50%,在包括 Terminal Bench 3.0 等公开基准中达到开源模型 SOTA,并联合多个中国安全团队累计发现 2436 个漏洞(1097 个中高危)。
推荐理由:智谱一次性放出 GLM-5.3 与 GLM-5.3-Flash 等多项更新,可对照参数与基准变化判断其编程与多模态能力定位。
Ollama 新增 Claude Desktop 支持,开发者可在 Ollama 中开启 Claude,由其自动配置第三方网关,从而在 Claude 里使用 Ollama 的本地或云端模型,并可随时切回原有 Claude 配置。