Python 3.15.0 加入 actions/python-versions
Python 3.15.0 已被加入 actions/python-versions,现在可以在 GitHub Actions 测试矩阵中填入 "3.15" 来针对这个新版本运行测试。Simon Willison 称自己为此等了好几天,甚至让 ChatGPT 每小时 clone 并 git pull 一次,直到稳定版 3.15 被添加后通知他。
Python 3.15.0 已被加入 actions/python-versions,现在可以在 GitHub Actions 测试矩阵中填入 "3.15" 来针对这个新版本运行测试。Simon Willison 称自己为此等了好几天,甚至让 ChatGPT 每小时 clone 并 git pull 一次,直到稳定版 3.15 被添加后通知他。
GitHub Copilot for JetBrains 更新,企业管理员可通过托管设置将任意可用的 Copilot agent 模型设为新会话默认模型,同时保留显式模型选择。
GitHub Copilot 本周更新中,Claude Haiku 5.5 已向 Copilot Pro、Pro+、Max、Business 和 Enterprise 用户开放。
推荐理由:汇总了 Copilot 本周在账号分离、本地沙箱和本地模型接入上的多项更新,可据此判断现有工作流的调整空间。
GitHub 将 GitHub Copilot CLI、Copilot 应用和 Copilot SDK 背后的运行时从 TypeScript 和 Node.js 迁移到 Rust,通过 AI 辅助重写替换了超过 80 万行生产代码。
GitHub 为 Copilot 代码审查新增组织级计费与权限控制:组织所有者可将持 Copilot 许可证成员的审查请求计入组织成本中心,而非消耗成员自身配额,该选项需启用 AI Credits 付费用量并可设预算。同时可开启设置,仅允许由本组织或企业提供许可证的用户触发代码审查,组织级开启后仓库管理员无法关闭。
GitHub Next 的 Don Syme 提出在 CI 和 CD 之外增加第三根支柱 Continuous AI,即由仓库事件或定时触发的自动化 AI 工作流,用于持续文档、代码改进、问题分诊和故障分析。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日还下调了 Sonnet 5.5 与订阅计划价格。
推荐理由:汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗数据,便于判断小模型在 Agent 工作流中的成本取舍。
Anthropic 最新的轻量模型 Claude Haiku 5.5 已在 GitHub Copilot 正式可用,面向 Copilot Pro、Pro+、Max。
推荐理由:官方说明 Haiku 5.5 在 Copilot 中的可用范围与计费方式,便于团队评估是否切换轻量模型。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别数据库密码等非结构化密钥,候选批次评估耗时低于 2 毫秒,可将可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度的数据说明密钥泄露与代码量同步增长,并给出把检测前移到 push 环节的模型方案。
GitHub 发布用于密钥检测的微调模型,可读取上下文代码识别无固定格式的密码等凭据,且不生成代码或文本。已有 AI 检测密码告警的客户自动升级到新模型,AI 检测密钥的推送保护进入 private preview,Copilot CLI 和 Copilot App 的 /security-review 命令中的 AI 密钥扫描也将很快进入 private preview。
推荐理由:GitHub 把微调后的密钥检测模型接入推送保护与 Copilot 安全审查,读者可据此判断其计费与启用方式。
GitHub Copilot 的本地沙箱功能正式可用,覆盖 Copilot CLI、Copilot 应用和使用 Agent Host 的 VS Code 会话。
推荐理由:官方说明了本地沙箱在三个入口的正式可用状态与策略边界,可据此判断智能体工作流的权限控制方式。
GitHub Copilot CLI 从 1.0.94-0 版本起,可用 /model 发现正在运行的本地 Ollama 实例中的受支持模型,与已配置模型和 GitHub Copilot 云端模型并列展示。
GitHub 发现部分 IDE 将 Copilot Agent 会话迁移到 Copilot SDK 后未标识来源,导致用量指标中 Agent 活动和代码行数被少计、部分被算作 Copilot CLI 活动。
GitHub 发布 ReviewBench,一个面向 AI 代码审查的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含 219 个 pull request、覆盖 19 种语言。
推荐理由:GitHub 公开了代码审查基准的构建方法与评分口径,读者可据此判断自家审查 Agent 的强弱项。
Jesse Vincent 的 AI 同事将 #164 过快合并进 main,AI PM Cadence Sen 随即自主发起无责复盘,追问合并时的状态判断依据。
GitHub 博客提出 AI 时代开发者应加强的三项技能:学会指挥 AI 而非只是使用它、不要轻信 AI 的第一个答案、用 AI 省下的时间解决更大的问题。文中提到 GitHub Copilot 内置的 Rubber Duck agent 会用第二个模型审查计划、代码和测试,以发现首个模型遗漏的问题。
GitHub Copilot app 的 canvases 是一种可自定义界面,用户只需在 Agent 会话中输入 /create-canvas 技能并用自然语言描述需求,Agent 就会生成界面并在右侧面板打开。
推荐理由:原文给出 /create-canvas 的提示词写法与双向协作机制,读者可据此把日常流程做成可复用画布。
GitHub 认为 chat 是大多数场景下错误的 AI 交互界面,主张用 GitHub Copilot app 中的 canvas 替代。canvas 是运行在 Copilot app 内的全栈应用,可与 agent 双向通信、调用第三方 API 并在本地执行代码,例如做出 Connect 4 游戏、Winget 包管理界面和 SQLite 操作界面。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需传入 GitHub owner/repo,Agent 就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM Agent,读者可据此判断自动化安全测试的边界。
GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超百万行改动和 400 多条行内评论的开源 PR 做压力测试。代码行高度可预先精确计算,但评论高度依赖 markdown 换行、折叠区、回复框和图片加载,只能在渲染时确定,因此把文档高度拆成确定性的代码几何与动态块几何两套体系,动态块按文件、行号和侧别锚定并惰性测量。
GitHub Next staff research engineer Maggie Appleton 在 Pragmatic Engineer 播客中分享设计工程实践:她用手绘笔记本草图启动项目,因为比向 Claude Code 描述更快,且次日仍可回溯。
GitHub Podcast 最新一期拆解了五个 AI 热门论断:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是可读的打包经验,后者是连接工具与数据的标准接口,二者可组合使用。
Cursor 推出代码托管服务 Origin,今日起在所有付费计划上以早期 beta 形式逐步开放,企业组织管理员可选择退出。首批功能包括仓库、pull request、代码浏览和 GitHub 同步,Origin 托管的仓库以 Origin 为唯一来源,同步的 GitHub 仓库仍以 GitHub 为准、双向同步 PR 评论。
推荐理由:Cursor 把代码托管、PR 与 Agent 放进同一入口,读者可据此判断它与 GitHub 的分工边界。
JetBrains Air 发布新版本,通过 JetBrains 与 Zed 开发的 Agent Client Protocol(ACP)支持 GitHub Copilot、OpenCode、Pi、Cline 等兼容 ACP 的编码 Agent,不再局限于内置的 Claude、Codex、Gemini CLI 和 Junie。
推荐理由:Air 通过 ACP 接入外部编码 Agent 与本地模型,读者可据此判断多 Agent 工作流的接入方式。
MCP 工具注解自 2025-03-26 规范修订引入,目前包含 readOnlyHint、destructiveHint、idempotentHint、openWorldHint 四个布尔提示,规范明确它们只是"提示",客户端须默认视为不可信。