微软推出决策专用模型 Microsoft-Decision-1,基于 Qwen3.5-9B 后训练
微软发布 Microsoft-Decision-1,一个专做选择题的决策模型,基于阿里开源模型 Qwen3.5-9B 后训练,只做一遍推理就输出结构化结果和校准过的概率分。
微软发布 Microsoft-Decision-1,一个专做选择题的决策模型,基于阿里开源模型 Qwen3.5-9B 后训练,只做一遍推理就输出结构化结果和校准过的概率分。
OpenAI 为在 Windows 上使用 Codex 的开发者推出新的沙箱模式,基于 Microsoft 的 Execution Containers(MXC),带来更快的配置、更强的网络管控和更细粒度的文件访问控制,需要兼容的 Windows 11 设备。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别数据库密码等非结构化密钥,候选批次评估耗时低于 2 毫秒,可将可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度的数据说明密钥泄露与代码量同步增长,并给出把检测前移到 push 环节的模型方案。
GitHub Copilot 的本地沙箱功能正式可用,覆盖 Copilot CLI、Copilot 应用和使用 Agent Host 的 VS Code 会话。
推荐理由:官方说明了本地沙箱在三个入口的正式可用状态与策略边界,可据此判断智能体工作流的权限控制方式。
GitHub 发布 ReviewBench,一个面向 AI 代码审查的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含 219 个 pull request、覆盖 19 种语言。
推荐理由:GitHub 公开了代码审查基准的构建方法与评分口径,读者可据此判断自家审查 Agent 的强弱项。
MCP 的 Enterprise-Managed Authorization(EMA)扩展现已稳定,组织可通过其身份提供商集中管理 MCP 服务器授权,用户首次登录即可自动连接所需服务器,无需逐个应用 OAuth。
推荐理由:MCP 官方发布企业级授权扩展,读者可了解其 ID-JAG 流程与已接入的客户端和服务器生态。
MCP 工具注解自 2025-03-26 规范修订引入,目前包含 readOnlyHint、destructiveHint、idempotentHint、openWorldHint 四个布尔提示,规范明确它们只是"提示",客户端须默认视为不可信。
Steve Yegge 提出"AI 吸血鬼"概念,认为 AI 确实能带来 10 倍生产力,但价值捕获机制决定了开发者要么被公司榨干、要么公司被竞争对手淘汰。他以 Opus 4.5/4.6 配合 Claude Code 为例,称 AI 编程在 2025 年 11 月 24 日到达事件视界,并提到 Claude Code 已在微软工程团队中迅速占据主导。