跳到正文
10月9日周五
  1. BestBlogs · AI 高分20

    Aether AI 发布 CRIS-0:给具身智能换上「因果」内核

    Aether AI 发布机器人系统 CRIS-0,采用因果驱动架构,将高层任务规划与低层物理预测分离,并引入因果世界模型推演动作后果。系统用任务图组织执行流程,每个节点对应可验证阶段,某步失败时可退回上一成功节点重新评估并尝试替代方案。实验显示 CRIS-0 在灯光变化、物体移动等突发干扰下能迅速调整策略,长程模糊指令执行中的错误恢复能力显著提升。

  2. AI寒武纪22

    不用剪辑软件,用豆包工作加 Remotion 跑通代码驱动动效视频工作流

    豆包工作配合 Remotion 技能,可在云端自动写代码渲染动态视频,无需本地剪辑软件和 Node.js 环境。实测中它通读 Transformer 论文生成 10 个分镜、自动修复 TypeScript 引号错误并重渲,还从飞书文档解析 26 张图片,产出 120 秒 1080P 30 帧成片。该流程可沉淀为「SR动态视频」技能复用,新用户登录电脑端可领 30 天会员。

  3. OpenHands Releases12

    OpenHands v1.26.0 发布

    OpenHands 发布 v1.26.0,新增 verify-openhands 技能及配套 control-openhands CLI 与完整功能图谱,并支持每日验证。该版本还加入后端认证视图辅助、企业后端 Super Admin 设置引导,以及大量可访问性与错误提示修复。

  4. Anthropic(@AnthropicAI)22

    天体物理学家用 Claude Science 绘制首张完整紫外天图

    天体物理学家 Brice Ménard 借助 Claude Science 绘制出首张完整紫外天图,Claude 负责寻找已有数据集、将其合并,并用统计推断填补观测空白。这项工作原本需要人类数周,实际只用了几天,Ménard 期间还在处理其他项目。该图可作为教学工具,也说明这类缓慢、低优先级的科研工作如今借助 AI 变得可行。

  5. GitHub Changelog · Copilot22

    GitHub Copilot 代码审查新增组织计费选项与权限控制

    GitHub 为 Copilot 代码审查新增组织级计费与权限控制:组织所有者可将持 Copilot 许可证成员的审查请求计入组织成本中心,而非消耗成员自身配额,该选项需启用 AI Credits 付费用量并可设预算。同时可开启设置,仅允许由本组织或企业提供许可证的用户触发代码审查,组织级开启后仓库管理员无法关闭。

  6. Tessl36

    Mozilla.ai 的 cq 项目:为 AI 智能体建一个共享知识库

    Mozilla.ai 在 AI Native DevCon London 上介绍了 cq 项目,目标是解决智能体反复重新发现同一缺失知识的问题。cq 以"知识单元"为基本单位,记录智能体遇到非显而易见问题后找到的解决方案,包含领域、洞察、采取的行动及可选元数据,供其他智能体按需查询。cq 默认本地运行,使用本地 SQLite 数据库,数据无需离开本机,之后可连接远程服务器构建带审查的团队级知识库。

  7. Tessl34

    AI Agent 评估需要可执行规格(Executable Specs)

    Tessl 在 AI Native DevCon London 提出,AI 编码 Agent 让 PR 变多却卡在代码审查,根因是缺乏验证层。其方案是把规格转成可执行检查:一个 Agent 做规划拆解需求与边界情况,多个验证 Agent 并行逐条核对预览环境,再由编排器汇总报告。审查需同时基于规格与代码,并优先对照 base branch 而非仅看 diff。

  8. Latent Space22

    Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 谈“合成超级智能”:从半导体到超导体

    Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 在播客中提出“合成超级智能”,主张 AI 科学发现应靠扎根物理实验的强化学习,而非只训练更多互联网数据。他们讨论材料发现闭环中的预测、合成与表征,DFT 与仿真,以及让每台实验仪器具备“140 IQ”的高通量自主实验室。两人认为失败实验可能是最有价值的训练数据,自主实验有望把数十年的试错压缩到数月。

  9. OpenAI News22

    Oracle 如何用 ChatGPT 和 Codex 把数天工作压缩到几分钟

    Oracle 超过 13 万名员工正在使用 ChatGPT Work 和 Codex,其中 Codex 活跃用户超 9.5 万。其招聘团队用 ChatGPT Work 搭建的人才市场情报工具,把原本需要 2–4 天的调研压缩到 15–20 分钟准备,招聘调研耗时下降 98%;应用实验室团队则用 Codex 把自然语言业务问题转成 SQL 查询,简单故障处理从 1 小时缩短到几分钟。

10月8日周四
  1. BestBlogs · AI 高分22

    大模型 Token 分词机制科普综述:BPE 的代价与替代方案

    一篇科普综述剖析了大模型底层的分词机制:模型读到的不是字母,而是分词器生成的数字编号字块,因此无法准确数清字母 r。文章指出 BPE 算法靠反复合并高频字符对来压缩文本,代价是算术与字符分析能力缺陷、低资源语言成本上升,以及冷门字块带来的安全漏洞。学界正探索直接读字节、动态切分和视觉化文字等替代方案,但替换现有分词地基的训练与评测成本很高。

  2. 卡尔的AI沃茨36

    腾讯WorkBuddy上线独立文件浏览器:右键打开文件,AI对话就在旁边

    腾讯WorkBuddy新增独立文件浏览器,在本地文件上右键选择用WorkBuddy打开,即可弹出左文件、右AI对话的独立窗口,并支持把文件上传到知识库。它支持多标签页且每个文件的AI对话上下文独立,Office文件改完可直接存回原文件、不产生新副本,Markdown实时渲染并自动保存,HTML也能看能改。小程序版同样可打开.md和.html文件,查看和编辑文件不消耗积分,仅与AI对话才扣。

  3. OpenAI News10

    Pollo AI 用 OpenAI 模型把创意变成营销活动

    Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5 打造 Pollo Agent,为创作者提供从创意到成片的完整视频生成流程,目前服务超 2600 万用户。其模型组合让用户挑选或切换模型的时间减少 50% 以上,30% 的创作者会话从视频模板或热门格式工作流开始。Photo to Video Ads 工具可将单张产品图转为约 15 秒短视频广告。