跳到正文
8月31日周一
  1. 宝玉的分享22

    宝玉谈 AI 原生思维:像训练大模型一样训练自己

    宝玉在腾讯内部以自研字幕翻译 App 为主线,分享 AI 产品从找需求、判边界、最小验证到重设计的完整过程。他提出需求要盯模型能力边界,并用 AutoGPT 与 Manus 对比说明同一想法在能力边界两侧的两种命运。成本优化中,他把调用从 33 次降到 12 次,单集处理从 31 分钟降到 18 分钟。

8月28日周五
  1. 宝玉的分享62

    Warp 如何让 Agent 自我进化:用人类反馈改进代码审查 Skill

    Claude 发布博文介绍 Warp 如何在 Claude 上构建自我改进的 Agent,解决 Skill 的进化问题。Warp 内部用 AI 做代码审查时发现 Agent 不了解项目、团队规范和历史经验,于是设置两个 Skill:一个负责代码审查,另一个定期收集人类工程师在 PR 中的评论并据此更新审查 Skill,让反馈收集自动发生。

8月26日周三
  1. 智谱开放平台更新70

    智谱上线 GLM-5.3 与 GLM-5.3-Flash 原生多模态模型

    智谱开放平台上线 GLM-5.3 与 GLM-5.3-Flash。GLM-5.3 编程能力在内部 Z.ai Code Bench 上较 GLM-5.2 提升 50%,在包括 Terminal Bench 3.0 等公开基准中达到开源模型 SOTA,并联合多个中国安全团队累计发现 2436 个漏洞(1097 个中高危)。

    推荐理由:智谱一次性放出 GLM-5.3 与 GLM-5.3-Flash 等多项更新,可对照参数与基准变化判断其编程与多模态能力定位。

8月25日周二
8月24日周一
  1. Armin Ronacher17

    Armin Ronacher:面对 AI,与其愤怒不如保持好奇与焦虑

    Armin Ronacher 撰文回应"在当下科技行业怎么可能不愤怒"的提问,认为面对 AI 更合理的情绪是迷茫与焦虑而非愤怒,因为愤怒需要一个可归咎的对象,而 AI 带来的冲击让每个人都难以看清未来。他建议用不确定感取代愤怒,因为它能通向好奇心,进而带来实验与行动的自由;许多公开表现自信的从业者私下同样充满不确定,只是在用信心为自己争取筹码。

8月22日周六
8月21日周五
8月17日周一
  1. Cursor 更新日志74

    Cursor 推出 Origin 代码托管,早期 beta 面向所有付费计划开放

    Cursor 推出代码托管服务 Origin,今日起在所有付费计划上以早期 beta 形式逐步开放,企业组织管理员可选择退出。首批功能包括仓库、pull request、代码浏览和 GitHub 同步,Origin 托管的仓库以 Origin 为唯一来源,同步的 GitHub 仓库仍以 GitHub 为准、双向同步 PR 评论。

    推荐理由:Cursor 把代码托管、PR 与 Agent 放进同一入口,读者可据此判断它与 GitHub 的分工边界。

8月14日周五
8月11日周二
8月10日周一
  1. Ollama Blog62

    Meta Superintelligence Labs 的 Muse Glimmer 上线 Ollama

    Meta Superintelligence Labs 的首个开源模型 Muse Glimmer 已在 Ollama 上线,这是一个 30B 多模态模型,面向本地运行的 Agent 工作负载,上下文长度 128K+,采用 Apache 2.0 许可。

    推荐理由:Meta Superintelligence Labs 首个开源模型在 Ollama 上线,可了解其本地编码 Agent 接入方式与 Apple Silicon 加速表现。

8月8日周六
  1. Addy Osmani50

    Addy Osmani:Agentic Code Quality——用约束与质量门禁替代逐行代码审查

    Addy Osmani 提出,Agent 每天产生数十万乃至上百万次代码变更,逐行代码审查已不可行,软件质量转而取决于围绕 Agent 设置的约束,即质量门禁。这些门禁包括单元测试、属性测试、验收测试、变异测试,以及圈复杂度和行长等代码质量指标,并贯穿 Agent 从解释器到控制器再到生产的全流程。人类注意力应只投向自动化护栏失效时的复杂问题,否则会拖慢机器速度的流程。

8月3日周一
7月29日周三
7月28日周二
  1. Model Context Protocol Blog88

    MCP 发布 2026-07-28 规范,协议核心转为无状态

    MCP 官方发布 2026-07-28 规范,协议核心从双向有状态转为请求/响应无状态,取消 initialize 握手与 Mcp-Session-Id,任何请求都可落在普通轮询负载均衡后的任意实例上。

    推荐理由:官方给出无状态协议核心的完整变更清单与迁移说明,可据此评估现有 MCP 服务的改造量。

  2. 宝玉的分享22

    关于 Agent 的几个判断:通用 Agent 通吃、插件生态与模型护城河

    针对 @cellier_ 提出的通用 Agent 吃掉垂直 Agent、开放吃掉封闭、下沉吃掉傲慢三个判断,宝玉补充了自己的六点看法:通用 Agent 赛道本身也会是少数赢家通吃,小通用 Agent 同样没有生存空间;开放与封闭的差别不在开源或模型切换,而在插件生态,Skill 加 MCP 是关键。

7月20日周一
  1. Addy Osmani38

    Addy Osmani:软件工厂的明与暗——从循环、Harness 到无人审查的暗工厂

    Addy Osmani 提出软件工厂由循环、Harness、工厂三层构成:循环是单个 Agent 重复执行任务的最小单元,Harness 是沙箱、工具、记忆与完成判定,工厂则是多个 Harness 化循环共用一个审查门。明工厂保留人类判断,暗工厂让 Agent 自行定范围、构建并发布代码,无人阅读细节。他指出图中生成、测试、扫描几乎零成本,唯一难以扩展的是审查门这一"判断"环节。

7月15日周三
6月29日周一
6月19日周五
  1. Steve Yegge32

    Steve Yegge:AI 模型能力曲线为何对大多数人"变平"

    Steve Yegge 提出"平坦曲线社会":模型智能仍在指数增长,但最强大的模型将被各国政府像核武器一样管制,多数企业和开发者只能用到 Fable 级模型。他指出开源模型落后前沿约七个月,且难以突破 Fable 级,因为算力供应链正被锁定。他还提出"辨识地平线"概念,认为用户因缺乏足够难的问题而无法区分更强模型。

6月11日周四
  1. Zed Blog38

    Zed 发布 DeltaDB:为 Agent 协作打造的新型版本控制

    Zed 正在开发名为 DeltaDB 的新型版本控制系统,将每次操作而非提交记录为细粒度 delta,并把与 Agent 的对话和代码编辑并排存储,使二者不再分离。DeltaDB 内嵌无冲突复制工作树,支持多人和多个 Agent 跨机器同时编辑同一文件,引用锚定在 delta 上而非行号,因此代码变动后仍可追溯。该产品将于几周内推出 beta 版,现已开放 waitlist。

5月21日周四
  1. Model Context Protocol Blog82

    MCP 发布 2026-07-28 规范候选版本,协议改为无状态核心

    MCP 发布 2026-07-28 规范候选版本,这是协议发布以来最大的一次修订,核心变化是协议层改为无状态,移除 initialize/initialized 握手与 Mcp-Session-Id 会话,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。

    推荐理由:MCP 协议最大一次改版,无状态核心与扩展机制的具体变化,可据此评估现有部署与 SDK 的迁移成本。

4月24日周五
4月3日周五
3月31日周二
3月4日周三