TypeSafe/Jev 上线三周 ARR 超 1 亿美元、估值 75 亿美元
TypeSafe 宣布其 Series AI 融资,Sequoia 透露 Jev 上线首周 ARR 突破 1 亿美元,公司估值达 75 亿美元。AINews 汇总的当日动态显示,多家厂商同日发布返回概率、选项或分数的决策模型,OpenAI 推出 Decisions API,Perplexity、Cloudflare、Liquid 等也跟进。
TypeSafe 宣布其 Series AI 融资,Sequoia 透露 Jev 上线首周 ARR 突破 1 亿美元,公司估值达 75 亿美元。AINews 汇总的当日动态显示,多家厂商同日发布返回概率、选项或分数的决策模型,OpenAI 推出 Decisions API,Perplexity、Cloudflare、Liquid 等也跟进。
Sophos 通过 OpenAI Daybreak 将 OpenAI 模型与其威胁情报、响应手册和安全专业知识结合,使使用 AI 智能体的案件平均响应时间从约 38 分钟降至 89 秒,调查时间缩短 96%。目前 52% 的 MDR 案件由 AI 端到端解决,Sophos 通过 Notify、Collaborate、Authorise 三种模式保留人工监督。
被 OpenAI 解雇的三名安全与对齐研究员 Tomek Korbak、Jasmine Wang 和 Mikita Balesni 联名发表致 OpenAI 安全与安保委员会等机构的公开信,称解雇原因是他们与外部安全评估机构的合作以及提出模型可监测性担忧。
OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表公开信称因"将安全置于公司短期利益之上"被辞退,OpenAI 则称其不当处理机密信息。
Oracle 超过 13 万名员工正在使用 ChatGPT Work 和 Codex,其中 Codex 活跃用户超 9.5 万。其招聘团队用 ChatGPT Work 搭建的人才市场情报工具,把原本需要 2–4 天的调研压缩到 15–20 分钟准备,招聘调研耗时下降 98%;应用实验室团队则用 Codex 把自然语言业务问题转成 SQL 查询,简单故障处理从 1 小时缩短到几分钟。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是按任务匹配 Astra、Sol 和 Luna 模型,并对预算进行策略性管理。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5 打造 Pollo Agent,为创作者提供从创意到成片的完整视频生成流程,目前服务超 2600 万用户。其模型组合让用户挑选或切换模型的时间减少 50% 以上,30% 的创作者会话从视频模板或热门格式工作流开始。Photo to Video Ads 工具可将单张产品图转为约 15 秒短视频广告。
OpenAI 捣毁了两起借助 AI 开展的影响力行动,这些行动利用假记者身份和一家智库散布地缘政治信息。
OpenAI在28天挑战中为GPT-6 Astra和Sol提速50%至50 tokens/s,并上线免费auto-review与ChatGPT Meetings插件;Gemini 4 Argon发布,主打长步骤编码与网络防御,输出达100万token。Mistral Large 4发布,总参数1万亿、激活490亿,月底开放权重,现可在OpenRouter试用。
OpenAI 公开了一个尚未发布的内部前沿模型产出的 722 篇数学手稿,归入 372 个成果族,覆盖 17 个方向,其中 235 族附带 Lean 形式化证明。
OpenAI 发布 722 篇由 AI 撰写的数学论文并打包上传至 GitHub,平均每个难题解法消耗 ChatGPT Pro 深度思考约三小时算力,同步给出大量 Lean 代码供机器核验,技术细节与模型推理过程全部开源。
Firebase iOS SDK 因后端变更崩溃,导致所有使用 Firebase 分析的应用宕机 2-6 小时,Google 未更新状态页也未提供事后复盘。OpenAI 正效仿 AWS 打造平台,允许将 ChatGPT 预算分配给 16 家合作伙伴的开放模型与 AI 服务。
本期 AI 编程周报实测了 GPT-6.1 Sol、Sonnet 5.5、Opus 5.5 与 GPT-6-Astra 等多款新模型,并对比了 Opus 5.5 与 GPT-6-Astra 作为代码审查者的表现。
Martin Fowler 在 Fragments 中汇总:OpenAI 此前对 RubyGems 的智能体攻击未主动告知 RubyGems 团队,Simon Willison 认为这与其在 Hugging Face、Wiki 攻击中的表现同样糟糕。
AI Coding Daily 本周发布 SWE-2 与 DeepSeek v4.1-Flash 在 24 个编码提示词上的实测视频,并重新测试了 Muse Spark 1.3 在 Muse Code MAX 级别的表现。