跳到正文
今天10月11日周日7 条
  1. 机器之心38

    田渊栋:与 GPT-5 合写最后一篇论文后,我意识到自己 5 年内会失业

    前 Meta FAIR 研究员、Recursive Superintelligence 联合创始人田渊栋在播客中透露,他用 GPT-5 作为合作者完成在 Meta 的最后一篇论文(研究 grokking 现象),效率提升约 6 到 10 倍,并由此意识到自己的工作大概五年内会被取代。他认为当前模型仍无法在无人类干预下产出好想法,人类仍需负责发起问题和验证方案,而最难自动化的是提出想法。

  2. BestBlogs · AI 高分28

    和 ColaOS 橘子聊个人 Agent 这半年:时代追上了他,他却打了转向灯

    ColaOS 创始人橘子复盘个人 Agent 半年变化:云端部署加 flash 级模型(如 DeepSeek Flash、Haiku 5.5)把单用户月成本从几百美元压到约十美元,补贴 token 已低于获客成本,免费打法回归,6 到 18 个月前因成本砸掉的产品值得重做。他放弃卷办公场景,转向「996 之外」的副业与技能变现,今年目标先做到盈亏平衡。

10月10日周六
  1. Sean Goedecke22

    软件工程的半人马时代或将持续数十年

    软件工程正处在人类工程师与 AI 编码系统协作的"半人马时代",这种组合目前比任何一方单独工作都更高效。作者以国际象棋的半人马时代持续约二十年、针织业长达两百年为例,认为软件工程的这一阶段可能还会延续一二十年。当前 Agent 自 2025 年 11 月 Claude Opus 4.5 发布后已可完全无监督运行,但输出仍需人工审查,错误更多属于对齐问题而非普通 bug。

  2. Amp News60

    Amp 支持在编辑器内使用 Claude Pro/Max 订阅

    Amp 现在支持使用 Claude Pro/Max 订阅,功能免费并向所有人开放。新建 thread 时选择 Mode > Claude Code 即可,未关联订阅会提示先关联;该模式底层改用 Claude Agent SDK 而非 Amp 自有 Agent,同时保留了 orbs 与 runners、thread 分享、portals、多人协作、thread 间消息与编排等能力。

    推荐理由:原文说明了 Amp 接入 Claude 订阅的具体入口与底层实现,读者可据此判断订阅复用对现有工作流的影响。

  3. BestBlogs · AI 高分42

    宝玉分享 baocut 开源项目开发流程:从技术方案、UI 原型到 AI 辅助编码与测试

    宝玉分享了开源项目 baocut 的完整开发流程:先由 Agent 分析调研并撰写技术方案文档,反复沟通定稿后生成高保真 UI 原型,再基于文档进入编码。在 baocut 完善字幕样式功能时,他用 AI Agent 快速迭代 UI 设计,并由 Agent 运行自动化测试用例,防止新功能破坏现有系统,最后人工检查自动化无法覆盖的边缘情况。

10月9日周五
  1. InfoQ · AI/ML22

    Netflix 如何用本体驱动可观测性构建端到端知识图谱

    Netflix 可观测性团队分享了如何用本体(ontology)驱动的方式构建端到端知识图谱,把传统被动监控改造成主动洞察引擎,目标是在整个技术栈中自动检测、按用户影响排序、自动分派并定位根因,甚至提前预测问题。其规模背景是峰值 6500 万并发流、每日超 20 亿请求、每秒超 3800 万条实时日志事件。

  2. BestBlogs · AI 高分62

    TRAE 将 TraeCode 与 TraeWork 合并为统一平台

    TRAE 将 TraeCode 和 TraeWork 双端融合,升级为支持 Agent 模式和 IDE 模式的新平台,可在同一窗口内把不同任务分配给多个 Agent,也能保留传统代码编辑体验。平台还支持自动化测试、跨平台同步(如飞书、微信),并提供模板库以加速文档和设计工作。

  3. 卡尔的AI沃茨12

    用游点灵搭出超级英雄盖楼小游戏,我去了腾讯AI游戏训练营看大学生们的作品

    作者用游点灵几句话搭出一个跳跃盖楼策略小游戏:玩家用9格泥土为不会飞的超级英雄造楼,让他从沙漠荡回城市,游戏已公开可玩。在腾讯游戏游点灵·湖南马栏山集团AI游戏训练营现场,大学生们做出海鸥偷薯条、海岛生存等机制完善的作品,AI纯度100%,自带4万多个游戏资产,支持可视化调参和自由二创。

  4. BestBlogs · AI 高分20

    Aether AI 发布 CRIS-0:给具身智能换上「因果」内核

    Aether AI 发布机器人系统 CRIS-0,采用因果驱动架构,将高层任务规划与低层物理预测分离,并引入因果世界模型推演动作后果。系统用任务图组织执行流程,每个节点对应可验证阶段,某步失败时可退回上一成功节点重新评估并尝试替代方案。实验显示 CRIS-0 在灯光变化、物体移动等突发干扰下能迅速调整策略,长程模糊指令执行中的错误恢复能力显著提升。

  5. AI寒武纪22

    不用剪辑软件,用豆包工作加 Remotion 跑通代码驱动动效视频工作流

    豆包工作配合 Remotion 技能,可在云端自动写代码渲染动态视频,无需本地剪辑软件和 Node.js 环境。实测中它通读 Transformer 论文生成 10 个分镜、自动修复 TypeScript 引号错误并重渲,还从飞书文档解析 26 张图片,产出 120 秒 1080P 30 帧成片。该流程可沉淀为「SR动态视频」技能复用,新用户登录电脑端可领 30 天会员。

  6. Tessl36

    Mozilla.ai 的 cq 项目:为 AI 智能体建一个共享知识库

    Mozilla.ai 在 AI Native DevCon London 上介绍了 cq 项目,目标是解决智能体反复重新发现同一缺失知识的问题。cq 以"知识单元"为基本单位,记录智能体遇到非显而易见问题后找到的解决方案,包含领域、洞察、采取的行动及可选元数据,供其他智能体按需查询。cq 默认本地运行,使用本地 SQLite 数据库,数据无需离开本机,之后可连接远程服务器构建带审查的团队级知识库。

  7. Tessl34

    AI Agent 评估需要可执行规格(Executable Specs)

    Tessl 在 AI Native DevCon London 提出,AI 编码 Agent 让 PR 变多却卡在代码审查,根因是缺乏验证层。其方案是把规格转成可执行检查:一个 Agent 做规划拆解需求与边界情况,多个验证 Agent 并行逐条核对预览环境,再由编排器汇总报告。审查需同时基于规格与代码,并优先对照 base branch 而非仅看 diff。

  8. Latent Space22

    Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 谈“合成超级智能”:从半导体到超导体

    Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 在播客中提出“合成超级智能”,主张 AI 科学发现应靠扎根物理实验的强化学习,而非只训练更多互联网数据。他们讨论材料发现闭环中的预测、合成与表征,DFT 与仿真,以及让每台实验仪器具备“140 IQ”的高通量自主实验室。两人认为失败实验可能是最有价值的训练数据,自主实验有望把数十年的试错压缩到数月。

10月8日周四
  1. 卡尔的AI沃茨36

    腾讯WorkBuddy上线独立文件浏览器:右键打开文件,AI对话就在旁边

    腾讯WorkBuddy新增独立文件浏览器,在本地文件上右键选择用WorkBuddy打开,即可弹出左文件、右AI对话的独立窗口,并支持把文件上传到知识库。它支持多标签页且每个文件的AI对话上下文独立,Office文件改完可直接存回原文件、不产生新副本,Markdown实时渲染并自动保存,HTML也能看能改。小程序版同样可打开.md和.html文件,查看和编辑文件不消耗积分,仅与AI对话才扣。

10月7日周三