Gemini CLI v0.63.0 发布
Gemini CLI 发布 v0.63.0,修复连接恢复时显示重试进度指示器、区分 MCP 启用配置缺失与 JSON 格式错误、恢复能力检测后暂停的 stdin 等问题。核心侧限制工具输出大小并优化长时间运行 Agent 循环的内存生命周期,同时在非交互模式下启用自主计划执行。
Gemini CLI 发布 v0.63.0,修复连接恢复时显示重试进度指示器、区分 MCP 启用配置缺失与 JSON 格式错误、恢复能力检测后暂停的 stdin 等问题。核心侧限制工具输出大小并优化长时间运行 Agent 循环的内存生命周期,同时在非交互模式下启用自主计划执行。
Google 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可将文本、图像、音频和视频映射到统一嵌入空间。
推荐理由:Google 发布 740M 参数端侧多模态嵌入模型,给出量化内存与向量截断等可核对的部署数据。
Google 在 Gemini API 和 Google AI Studio 发布 Gemini 3.8 Live、3.8 Live Extended Thinking 与 Gemini 3.5 Transcribe。
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups(GDG)在 115 个国家举办 800 多场活动,预计近百万开发者参与。
Google 发布 8 月 AI 更新汇总,推出面向编码与 Agent 的 Gemini 3.7 Flash,每百万 token 价格为首发 3.6 Flash 的一半,距 3.6 Flash 发布仅三周。
Google Antigravity 为 Teamwork 框架推出多项更新,该框架让自主 AI 智能体团队协作、互评并迭代数小时至数天,以解决复杂长周期任务。
推荐理由:原文列出多智能体协作在数学与系统工程上的具体产出,可据此判断长周期自主团队框架的实际能力边界。
Google DeepMind 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供,新增场景延展、首尾帧插值、4K 升采样等生成视频控制能力。
Google 公布 Gemma 4 Good Challenge 获奖名单,赛事收到超 1600 份提交,开发者用 LiteRT、Cactus、Ollama、llama.cpp、Unsloth 在受限硬件上部署 Gemma 4。
Google 宣布 Gemma 系列模型累计下载量突破 10 亿次,社区两年来发布超过 10 万个 Gemma 模型变体,形成其称为 Gemmaverse 的生态。
Ollama 0.31 让 Gemma 4 在 Apple Silicon 上生成 token 平均提速近 90%,该加速默认开启且不改变模型输出。提速来自多 token 预测(MTP):Gemma 4 附带一个小型草稿模型,先提出后续若干 token,主模型一次验证并保留一致的部分,代码场景因可预测性高而受益明显。
推荐理由:原文给出 MTP 加速的实测数据与实现细节,读者可据此判断本地编码 Agent 的响应速度变化。