跳到正文
9月21日周一
9月19日周六
9月18日周五
9月17日周四
  1. JetBrains AI Blog62

    JetBrains 详解语义代码搜索 RAG 流水线:解析、分块与向量化

    JetBrains 撰文介绍其语义代码搜索平台 Air Context 的 RAG 流水线,首篇聚焦解析、分块与向量化。Air Context 目前支持 Kotlin、Java、Python、JavaScript、TypeScript、C#、PHP、Go、Rust 九种语言的结构感知分块,其余语言回退到按行切分。

    推荐理由:JetBrains 公开了语义代码搜索 RAG 流水线的解析、分块与向量化细节,含二进制量化取舍。

9月16日周三
9月14日周一
9月10日周四
  1. Cursor 更新日志88

    Cursor 发布 Projects:协调者 Agent 调度云端子 Agent 承接长期任务

    Cursor 推出 Projects,用于承接功能开发、迁移或完整应用等更大规模的工作,可跨数月维持上下文、把任务分派给大量子 Agent,并在无需提示的情况下执行周期性工作。

    推荐理由:官方说明 Projects 如何用协调者 Agent 与云端并行子 Agent 承接跨月的大型开发任务,可据此判断长周期工作流的组织方式。

9月9日周三
  1. Mistral AI62

    Mistral 如何用 AI Agent 迁移 4 万行 Fortran 77 遗留代码

    Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 的油藏模拟器迁移到 C++,该代码库没有测试套件也没有集中文档。团队先搭建数值对等测试框架,用自定义解析器生成调用树并借助 Vibe CLI 启动上百个 Agent 补文档,最终采用人工把关的 coder、tester、reviewer 结构化工作流逐模块迁移。

    推荐理由:Mistral 用 4 万行 Fortran 迁移案例,给出对等测试框架、文档化和人机协作工作流的具体做法。

9月7日周一
9月5日周六
9月2日周三
  1. 宝玉的分享62

    Anthropic 博客:高效电商 AI 智能体的架构、延迟成本优化与评估实践

    Anthropic 发布电商 AI 智能体解剖指南,基于与零售、电商平台、旅游、娱乐和电信团队的 Claude 生产部署经验,提出把 Claude 放进标准智能体循环、用技能覆盖长尾需求、用工具调用现有系统的单一智能体架构,并称该架构在对比测试中质量优于全塞进提示词或子智能体方案。

9月1日周二
  1. Zed Blog36

    Zed 谈 Xanadu 为何在等待 AI 智能体

    Zed 认为 Ted Nelson 的 Xanadu 超文本构想之所以长期无法落地,是因为缺少能耐心追踪每一层引用的用户,而 AI 智能体正好补上这一环。DeltaDB 用 Lamport 时间戳、Merkle 树、CRDT、廉价存储、常连网络和 Firecracker 级微虚拟机等六十年积累的组件,实现"永不复制、只引用,永不覆盖、只版本化"的 xanalogical 计算。

8月31日周一
  1. 宝玉的分享22

    宝玉谈 AI 原生思维:像训练大模型一样训练自己

    宝玉在腾讯内部以自研字幕翻译 App 为主线,分享 AI 产品从找需求、判边界、最小验证到重设计的完整过程。他提出需求要盯模型能力边界,并用 AutoGPT 与 Manus 对比说明同一想法在能力边界两侧的两种命运。成本优化中,他把调用从 33 次降到 12 次,单集处理从 31 分钟降到 18 分钟。

8月28日周五
  1. 宝玉的分享62

    Warp 如何让 Agent 自我进化:用人类反馈改进代码审查 Skill

    Claude 发布博文介绍 Warp 如何在 Claude 上构建自我改进的 Agent,解决 Skill 的进化问题。Warp 内部用 AI 做代码审查时发现 Agent 不了解项目、团队规范和历史经验,于是设置两个 Skill:一个负责代码审查,另一个定期收集人类工程师在 PR 中的评论并据此更新审查 Skill,让反馈收集自动发生。

8月27日周四
8月25日周二
8月24日周一
8月21日周五
8月20日周四
  1. Mistral AI62

    Mistral 发布 Agentic Search 检索层,FinanceBench 正确率从 26.7% 升至 86%

    Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查并核实信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries。

    推荐理由:原文给出多步检索循环的工具设计与两组基准数据,可据此判断它相对一次性 RAG 的取舍。

8月19日周三
  1. Cursor 更新日志78

    Cursor 更新云 Agent 与 Harness:支持事件订阅、子 Agent 独立虚拟机与 /goal

    Cursor 发布云 Agent 与 Harness 更新,云 Agent 可订阅 PR、Slack 线程或定时任务等事件源,被触发后自动唤醒并持续推进目标。新增 Custom Modes 可把技能固定在对话中,子 Agent 可运行在各自独立的虚拟机与干净上下文中,用于测试父 Agent 改动或并行修复。还加入 /goal 设定长期目标,以及不打断 Agent 的转向消息机制。

    推荐理由:官方更新日志列出云 Agent 订阅事件、子 Agent 独立虚拟机与 /goal 等能力,可据此判断常驻 Agent 的编排方式。

8月17日周一
8月14日周五
8月12日周三
  1. Zed Blog60

    Zed 团队推出多人协作编码环境 Delta 并开启私测

    Zed 团队发布 Delta,一个面向与 Agent 协作编码和评审的多人环境,首批用户已进入私测。Delta 基于自研 DeltaDB,把对话与 worktree 一起实时复制,兼容现有 git 仓库,未使用 Delta 的同事看到的仍是普通 repo。Delta 还支持把线程分享为链接在浏览器打开,并已接入第三方 Agent 运行框架,首个是 Claude Code。

    推荐理由:Zed 团队把 DeltaDB 的实时协作能力做成独立应用,读者可据此判断多人加 Agent 的代码评审会怎么变。

8月8日周六
  1. Addy Osmani50

    Addy Osmani:Agentic Code Quality——用约束与质量门禁替代逐行代码审查

    Addy Osmani 提出,Agent 每天产生数十万乃至上百万次代码变更,逐行代码审查已不可行,软件质量转而取决于围绕 Agent 设置的约束,即质量门禁。这些门禁包括单元测试、属性测试、验收测试、变异测试,以及圈复杂度和行长等代码质量指标,并贯穿 Agent 从解释器到控制器再到生产的全流程。人类注意力应只投向自动化护栏失效时的复杂问题,否则会拖慢机器速度的流程。

7月28日周二
  1. 宝玉的分享22

    关于 Agent 的几个判断:通用 Agent 通吃、插件生态与模型护城河

    针对 @cellier_ 提出的通用 Agent 吃掉垂直 Agent、开放吃掉封闭、下沉吃掉傲慢三个判断,宝玉补充了自己的六点看法:通用 Agent 赛道本身也会是少数赢家通吃,小通用 Agent 同样没有生存空间;开放与封闭的差别不在开源或模型切换,而在插件生态,Skill 加 MCP 是关键。

7月21日周二
7月20日周一
  1. Addy Osmani38

    Addy Osmani:软件工厂的明与暗——从循环、Harness 到无人审查的暗工厂

    Addy Osmani 提出软件工厂由循环、Harness、工厂三层构成:循环是单个 Agent 重复执行任务的最小单元,Harness 是沙箱、工具、记忆与完成判定,工厂则是多个 Harness 化循环共用一个审查门。明工厂保留人类判断,暗工厂让 Agent 自行定范围、构建并发布代码,无人阅读细节。他指出图中生成、测试、扫描几乎零成本,唯一难以扩展的是审查门这一"判断"环节。

7月15日周三
7月12日周日
6月23日周二