跳到正文
今天10月11日周日2 条
  1. 机器之心38

    田渊栋:与 GPT-5 合写最后一篇论文后,我意识到自己 5 年内会失业

    前 Meta FAIR 研究员、Recursive Superintelligence 联合创始人田渊栋在播客中透露,他用 GPT-5 作为合作者完成在 Meta 的最后一篇论文(研究 grokking 现象),效率提升约 6 到 10 倍,并由此意识到自己的工作大概五年内会被取代。他认为当前模型仍无法在无人类干预下产出好想法,人类仍需负责发起问题和验证方案,而最难自动化的是提出想法。

10月10日周六
  1. Sean Goedecke22

    软件工程的半人马时代或将持续数十年

    软件工程正处在人类工程师与 AI 编码系统协作的"半人马时代",这种组合目前比任何一方单独工作都更高效。作者以国际象棋的半人马时代持续约二十年、针织业长达两百年为例,认为软件工程的这一阶段可能还会延续一二十年。当前 Agent 自 2025 年 11 月 Claude Opus 4.5 发布后已可完全无监督运行,但输出仍需人工审查,错误更多属于对齐问题而非普通 bug。

  2. Amp News60

    Amp 支持在编辑器内使用 Claude Pro/Max 订阅

    Amp 现在支持使用 Claude Pro/Max 订阅,功能免费并向所有人开放。新建 thread 时选择 Mode > Claude Code 即可,未关联订阅会提示先关联;该模式底层改用 Claude Agent SDK 而非 Amp 自有 Agent,同时保留了 orbs 与 runners、thread 分享、portals、多人协作、thread 间消息与编排等能力。

    推荐理由:原文说明了 Amp 接入 Claude 订阅的具体入口与底层实现,读者可据此判断订阅复用对现有工作流的影响。

10月9日周五
  1. OpenHands Releases12

    OpenHands v1.26.0 发布

    OpenHands 发布 v1.26.0,新增 verify-openhands 技能及配套 control-openhands CLI 与完整功能图谱,并支持每日验证。该版本还加入后端认证视图辅助、企业后端 Super Admin 设置引导,以及大量可访问性与错误提示修复。

  2. Tessl34

    AI Agent 评估需要可执行规格(Executable Specs)

    Tessl 在 AI Native DevCon London 提出,AI 编码 Agent 让 PR 变多却卡在代码审查,根因是缺乏验证层。其方案是把规格转成可执行检查:一个 Agent 做规划拆解需求与边界情况,多个验证 Agent 并行逐条核对预览环境,再由编排器汇总报告。审查需同时基于规格与代码,并优先对照 base branch 而非仅看 diff。

  3. OpenAI News22

    Oracle 如何用 ChatGPT 和 Codex 把数天工作压缩到几分钟

    Oracle 超过 13 万名员工正在使用 ChatGPT Work 和 Codex,其中 Codex 活跃用户超 9.5 万。其招聘团队用 ChatGPT Work 搭建的人才市场情报工具,把原本需要 2–4 天的调研压缩到 15–20 分钟准备,招聘调研耗时下降 98%;应用实验室团队则用 Codex 把自然语言业务问题转成 SQL 查询,简单故障处理从 1 小时缩短到几分钟。

10月8日周四
  1. Codex 更新日志66

    OpenAI 在 Codex 和 ChatGPT Work 中上线 GPT-6.1 Sol Ultrafast

    OpenAI 在 Codex 和 ChatGPT Work 中推出 GPT-6.1 Sol Ultrafast,Ultrafast 模式可加速 token 生成。该模式面向 Pro $500 及符合条件的 Enterprise 和 Edu 套餐,Enterprise 默认关闭,需由工作区管理员开启,并支持在美国和欧洲(EEA + 瑞士)的推理驻留。

    推荐理由:官方更新日志给出 Ultrafast 模式的可用套餐、默认开关与推理驻留区域,便于团队评估接入条件。

  2. GitHub Blog · AI & ML62

    GitHub 推出基于 ModernBERT 的密钥检测模型,将 push 保护扩展到非结构化密钥

    GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别数据库密码等非结构化密钥,候选批次评估耗时低于 2 毫秒,可将可拦截的密钥数量提升一倍以上。

    推荐理由:GitHub 用九个季度的数据说明密钥泄露与代码量同步增长,并给出把检测前移到 push 环节的模型方案。

  3. GitHub Changelog · Copilot60

    GitHub 推出专用模型检测泄露密钥,覆盖推送保护与 Copilot 安全审查

    GitHub 发布用于密钥检测的微调模型,可读取上下文代码识别无固定格式的密码等凭据,且不生成代码或文本。已有 AI 检测密码告警的客户自动升级到新模型,AI 检测密钥的推送保护进入 private preview,Copilot CLI 和 Copilot App 的 /security-review 命令中的 AI 密钥扫描也将很快进入 private preview。

    推荐理由:GitHub 把微调后的密钥检测模型接入推送保护与 Copilot 安全审查,读者可据此判断其计费与启用方式。

10月7日周三
  1. GitHub Changelog · Copilot78

    GitHub Copilot 本地沙箱正式可用

    GitHub Copilot 的本地沙箱功能正式可用,覆盖 Copilot CLI、Copilot 应用和使用 Agent Host 的 VS Code 会话。

    推荐理由:官方说明了本地沙箱在三个入口的正式可用状态与策略边界,可据此判断智能体工作流的权限控制方式。

  2. Gemini CLI Releases12

    Gemini CLI v0.63.0 发布

    Gemini CLI 发布 v0.63.0,修复连接恢复时显示重试进度指示器、区分 MCP 启用配置缺失与 JSON 格式错误、恢复能力检测后暂停的 stdin 等问题。核心侧限制工具输出大小并优化长时间运行 Agent 循环的内存生命周期,同时在非交互模式下启用自主计划执行。

10月6日周二
10月5日周一