跳到正文
今天10月11日周日1 条
  1. 机器之心38

    田渊栋:与 GPT-5 合写最后一篇论文后,我意识到自己 5 年内会失业

    前 Meta FAIR 研究员、Recursive Superintelligence 联合创始人田渊栋在播客中透露,他用 GPT-5 作为合作者完成在 Meta 的最后一篇论文(研究 grokking 现象),效率提升约 6 到 10 倍,并由此意识到自己的工作大概五年内会被取代。他认为当前模型仍无法在无人类干预下产出好想法,人类仍需负责发起问题和验证方案,而最难自动化的是提出想法。

10月10日周六
  1. Sean Goedecke22

    软件工程的半人马时代或将持续数十年

    软件工程正处在人类工程师与 AI 编码系统协作的"半人马时代",这种组合目前比任何一方单独工作都更高效。作者以国际象棋的半人马时代持续约二十年、针织业长达两百年为例,认为软件工程的这一阶段可能还会延续一二十年。当前 Agent 自 2025 年 11 月 Claude Opus 4.5 发布后已可完全无监督运行,但输出仍需人工审查,错误更多属于对齐问题而非普通 bug。

10月9日周五
10月7日周三
10月5日周一
10月2日周五
  1. Jesse Vincent28

    Prime Radiant 的 Sen 智能体同事平台:一次走进恐怖谷的体验

    Prime Radiant 正在开发名为 Sen 的"智能体"同事平台,Sen 拥有持久身份、独立账号和各自的电脑,通过 Slack 与人类同事协作,目前已有开发、运维、项目经理和文档专员四个角色。开发 Sen 的 Ada 主动在 Slack 上催促人类管理者处理积压的 PR 审查,并追问同事 JC 是否是人类。团队最终将 Claude Code 会话升级为 JC Sen。

10月1日周四
9月24日周四
9月14日周一
9月7日周一
8月31日周一
8月21日周五
8月8日周六
  1. Addy Osmani50

    Addy Osmani:Agentic Code Quality——用约束与质量门禁替代逐行代码审查

    Addy Osmani 提出,Agent 每天产生数十万乃至上百万次代码变更,逐行代码审查已不可行,软件质量转而取决于围绕 Agent 设置的约束,即质量门禁。这些门禁包括单元测试、属性测试、验收测试、变异测试,以及圈复杂度和行长等代码质量指标,并贯穿 Agent 从解释器到控制器再到生产的全流程。人类注意力应只投向自动化护栏失效时的复杂问题,否则会拖慢机器速度的流程。

7月29日周三
7月28日周二
  1. 宝玉的分享22

    关于 Agent 的几个判断:通用 Agent 通吃、插件生态与模型护城河

    针对 @cellier_ 提出的通用 Agent 吃掉垂直 Agent、开放吃掉封闭、下沉吃掉傲慢三个判断,宝玉补充了自己的六点看法:通用 Agent 赛道本身也会是少数赢家通吃,小通用 Agent 同样没有生存空间;开放与封闭的差别不在开源或模型切换,而在插件生态,Skill 加 MCP 是关键。

7月20日周一
  1. Addy Osmani38

    Addy Osmani:软件工厂的明与暗——从循环、Harness 到无人审查的暗工厂

    Addy Osmani 提出软件工厂由循环、Harness、工厂三层构成:循环是单个 Agent 重复执行任务的最小单元,Harness 是沙箱、工具、记忆与完成判定,工厂则是多个 Harness 化循环共用一个审查门。明工厂保留人类判断,暗工厂让 Agent 自行定范围、构建并发布代码,无人阅读细节。他指出图中生成、测试、扫描几乎零成本,唯一难以扩展的是审查门这一"判断"环节。

7月15日周三
5月30日周六
  1. Steve Yegge22

    最后的技术面试:Steve Yegge 谈技术面试为何走向终结

    Steve Yegge 认为技术面试已走到尽头,他基于近 35 年面试官经历指出,Google 的统计显示面试官之间几乎无法达成一致,同一候选人常被一人评为"强烈推荐"、被另一人直接拒绝,且面试分数与入职后表现几乎无关。他曾在 Amazon 担任 Bar Raiser、在 Google 任职 Hiring Committee,认为现有流程靠各种"创可贴"式修补维持,却仍大量误招与错拒。

2月11日周三