被 OpenAI 解雇的三名安全研究员发公开信披露内幕
被 OpenAI 解雇的三名安全与对齐研究员 Tomek Korbak、Jasmine Wang 和 Mikita Balesni 联名发表致 OpenAI 安全与安保委员会等机构的公开信,称解雇原因是他们与外部安全评估机构的合作以及提出模型可监测性担忧。
被 OpenAI 解雇的三名安全与对齐研究员 Tomek Korbak、Jasmine Wang 和 Mikita Balesni 联名发表致 OpenAI 安全与安保委员会等机构的公开信,称解雇原因是他们与外部安全评估机构的合作以及提出模型可监测性担忧。
Aether AI 发布因果驱动的机器人智能系统 CRIS-0,由因果驱动机器人 Agent 与因果世界模型两大组件构成,在真实机器人演示中面对人为干扰的反应速度达 0.1s 级。
Aether AI 发布机器人系统 CRIS-0,采用因果驱动架构,将高层任务规划与低层物理预测分离,并引入因果世界模型推演动作后果。系统用任务图组织执行流程,每个节点对应可验证阶段,某步失败时可退回上一成功节点重新评估并尝试替代方案。实验显示 CRIS-0 在灯光变化、物体移动等突发干扰下能迅速调整策略,长程模糊指令执行中的错误恢复能力显著提升。
Anthropic 因申请量远超预期,暂停 Claude Startups 项目中的 Claude Team 套餐和 1000 美元 API 额度两项福利,并重新审核已提交和已获批的申请,部分已获批账号将无法获得该福利。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 改为 GPT-5/GPT-6 系列。
Superpowers 在首次公开发布一周年之际推出 7.0,最大变化是完全重建的头脑风暴体验,更擅长帮用户理清和表达想做的产品,也更愿意在用户目标明确时让编码 Agent 直接干活。
Simon Willison 的 token 计数 CLI 工具 ttok 更新至 0.4,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,已两年未更新,可通过 uvx 直接运行,如 `cat file.txt | uvx ttok`。
OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表公开信称因"将安全置于公司短期利益之上"被辞退,OpenAI 则称其不当处理机密信息。
豆包工作配合 Remotion 技能,可在云端自动写代码渲染动态视频,无需本地剪辑软件和 Node.js 环境。实测中它通读 Transformer 论文生成 10 个分镜、自动修复 TypeScript 引号错误并重渲,还从飞书文档解析 26 张图片,产出 120 秒 1080P 30 帧成片。该流程可沉淀为「SR动态视频」技能复用,新用户登录电脑端可领 30 天会员。
Anthropic 推出 OSS Scanner,将用其前沿模型定期扫描已选择加入的开源项目,查找漏洞且不收取费用。报告会提供 proof-of-concept、说明和修复建议。
Anthropic 宣布启动 Anthropic Cyber Mission 计划,目标是让各方依赖的系统更安全、更具韧性。该计划将随实践反馈持续扩展和调整,并与公共及私营部门合作伙伴共同推进,Anthropic 表示这项工作需要时间。
Anthropic 启动名为 Anthropic Cyber Mission 的新计划,目标是保护关键基础设施与开源软件。该消息由 Anthropic 官方账号发布,详情见 anthropic.com/news/anthropic。
OpenHands 发布 v1.26.0,新增 verify-openhands 技能及配套 control-openhands CLI 与完整功能图谱,并支持每日验证。该版本还加入后端认证视图辅助、企业后端 Super Admin 设置引导,以及大量可访问性与错误提示修复。
天体物理学家 Brice Ménard 借助 Claude Science 绘制出首张完整紫外天图,Claude 负责寻找已有数据集、将其合并,并用统计推断填补观测空白。这项工作原本需要人类数周,实际只用了几天,Ménard 期间还在处理其他项目。该图可作为教学工具,也说明这类缓慢、低优先级的科研工作如今借助 AI 变得可行。
opencode 发布 v2.0.26。该版本于 10 月 8 日打上标签,发布页仅提供 2 个资源文件,未附具体更新说明。
GitHub 为 Copilot 代码审查新增组织级计费与权限控制:组织所有者可将持 Copilot 许可证成员的审查请求计入组织成本中心,而非消耗成员自身配额,该选项需启用 AI Credits 付费用量并可设预算。同时可开启设置,仅允许由本组织或企业提供许可证的用户触发代码审查,组织级开启后仓库管理员无法关闭。
Claude Docs、Slides 和 Design 结束 beta,现已面向包括 Free 在内的所有套餐开放。团队可与 Claude 在同一份文档、演示文稿或设计中协同编辑。
Claude 现可将仪表盘发送到分析工具做深度分析,动画则可导入视频编辑器完成收尾。官方公布了完整的支持工具清单,详见 claude.com/resources/arti…。
Claude 推出 Claude Dashboards,可连接数据平台或 CRM 工具并用自然语言提问,Claude 会编写查询并生成随数据变化自动更新的仪表盘,每张图表都会展示对应的查询语句。该功能目前面向付费计划开放 beta。
Claude Motion 能把报告、图表或产品演示转成短视频动画,由 Claude 以代码方式生成,不涉及视频模型,因此每个词、数字或时间点都可修改,并可导出 MP4。该功能目前处于 beta 阶段,面向 Team 和 Enterprise 套餐开放。
Tessl 把一场 AI Native DevCon 演讲变成 Agent 可调用的技能上下文。演讲者用 OpenClaw、GitHub 仓库、Obsidian 和 Telegram 搭建"组织大脑",通过 cron job 每天推送 agentic engineering 相关研究更新,研究库约 1200 个文件,并另设客户信息库供自然语言查询。
Liran Tal 在 AI Native DevCon London 的演讲中指出,Agent Skills 不只是给人类看的 markdown,一旦被 Agent 信任就能影响其读取内容、调用工具和访问工作区,因此应被视为供应链组件。
Mozilla.ai 在 AI Native DevCon London 上介绍了 cq 项目,目标是解决智能体反复重新发现同一缺失知识的问题。cq 以"知识单元"为基本单位,记录智能体遇到非显而易见问题后找到的解决方案,包含领域、洞察、采取的行动及可选元数据,供其他智能体按需查询。cq 默认本地运行,使用本地 SQLite 数据库,数据无需离开本机,之后可连接远程服务器构建带审查的团队级知识库。
Cisco 工程师 John Groetzinger 在 AI Native DevCon 演讲中提出,把技能散落到各仓库只会带来上下文漂移和重复劳动,真正需要的是把上下文打包、评测、同步并分发的流水线。
Tessl 在 AI Native DevCon London 提出,AI 编码 Agent 让 PR 变多却卡在代码审查,根因是缺乏验证层。其方案是把规格转成可执行检查:一个 Agent 做规划拆解需求与边界情况,多个验证 Agent 并行逐条核对预览环境,再由编排器汇总报告。审查需同时基于规格与代码,并优先对照 base branch 而非仅看 diff。
GitHub Next 的 Don Syme 提出在 CI 和 CD 之外增加第三根支柱 Continuous AI,即由仓库事件或定时触发的自动化 AI 工作流,用于持续文档、代码改进、问题分诊和故障分析。
Ramp 和 Stripe 为不会写代码的员工搭建了内部平台,让他们用 Vibe Coding 自行构建内部网站和工具,这些平台在两家公司内部正快速普及。The Pragmatic Engineer 的 The Pulse 专栏将这一现象称为中型科技公司的新趋势,并预计会有更多公司跟进。
Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 在播客中提出“合成超级智能”,主张 AI 科学发现应靠扎根物理实验的强化学习,而非只训练更多互联网数据。他们讨论材料发现闭环中的预测、合成与表征,DFT 与仿真,以及让每台实验仪器具备“140 IQ”的高通量自主实验室。两人认为失败实验可能是最有价值的训练数据,自主实验有望把数十年的试错压缩到数月。
Oracle 超过 13 万名员工正在使用 ChatGPT Work 和 Codex,其中 Codex 活跃用户超 9.5 万。其招聘团队用 ChatGPT Work 搭建的人才市场情报工具,把原本需要 2–4 天的调研压缩到 15–20 分钟准备,招聘调研耗时下降 98%;应用实验室团队则用 Codex 把自然语言业务问题转成 SQL 查询,简单故障处理从 1 小时缩短到几分钟。
VarOps 的 Ran Aroussi 复盘了为跨组织 Agent 构建记忆系统的经验,认为把记忆当作存储的 retrieve、stuff、hope 做法在生产中会以四种方式失效。
一篇科普综述剖析了大模型底层的分词机制:模型读到的不是字母,而是分词器生成的数字编号字块,因此无法准确数清字母 r。文章指出 BPE 算法靠反复合并高频字符对来压缩文本,代价是算术与字符分析能力缺陷、低资源语言成本上升,以及冷门字块带来的安全漏洞。学界正探索直接读字节、动态切分和视觉化文字等替代方案,但替换现有分词地基的训练与评测成本很高。
腾讯WorkBuddy新增独立文件浏览器,在本地文件上右键选择用WorkBuddy打开,即可弹出左文件、右AI对话的独立窗口,并支持把文件上传到知识库。它支持多标签页且每个文件的AI对话上下文独立,Office文件改完可直接存回原文件、不产生新副本,Markdown实时渲染并自动保存,HTML也能看能改。小程序版同样可打开.md和.html文件,查看和编辑文件不消耗积分,仅与AI对话才扣。
生数科技推出视频生成模型 Vidu Q4 Preview,将生成成本压至 0.09 元/秒,图生视频速度达同类模型的 2 倍。该预览版支持最多 15 张参考图、参考音色输入与 2K/4K 画质输出,并提升了人物演绎、镜头调度和复杂特效表现。
斯坦福大学李飞飞、吴佳俊、Ehsan Adeli 团队提出开放世界动作建模框架 OpenWAM,基于 Wan2.2-5B 视频模型做因果化预训练,并用共享 MoT 架构组合 5B 视频专家与 2B 动作专家,定义 VTA、ATV、Joint、Decoupled 四种交互程序。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是按任务匹配 Astra、Sol 和 Luna 模型,并对预算进行策略性管理。
JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版本,架构未变,仍为 2.5B 激活参数、Apache 2.0 许可。
推荐理由:JetBrains 开源 12B MoE 编码模型,读者可了解其强化学习后训练路线与本地部署的取舍。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5 打造 Pollo Agent,为创作者提供从创意到成片的完整视频生成流程,目前服务超 2600 万用户。其模型组合让用户挑选或切换模型的时间减少 50% 以上,30% 的创作者会话从视频模板或热门格式工作流开始。Photo to Video Ads 工具可将单张产品图转为约 15 秒短视频广告。
Spotify Ads 高级工程师 Pratik Rasam 在 QCon AI 分享了 Spotify Ads Manager 内部多 Agent 平台 Ads AI 的生产实践:上线以来超 70% 的广告使用 AI 工具,为 7000 多家广告主生成约 2 万个创意。
opencode 发布 v2.0.25。该版本于 10 月 8 日打上标签,发布资源共 2 项。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日还下调了 Sonnet 5.5 与订阅计划价格。
推荐理由:汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗数据,便于判断小模型在 Agent 工作流中的成本取舍。