跳到正文
今天10月11日周日1 条
10月10日周六
10月8日周四
10月7日周三
9月29日周二
9月10日周四
  1. Mistral AI20

    Mistral 与 Cloudera 达成合作,将主权 AI 引入企业数据平台

    Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,数据与由此产生的智能均归企业所有。Cloudera 平台承载 30 exabytes 客户自管数据,双方称此举面向对主权 AI 日益增长的需求。

8月31日周一
8月26日周三
8月25日周二
8月11日周二
8月10日周一
  1. Ollama Blog62

    Meta Superintelligence Labs 的 Muse Glimmer 上线 Ollama

    Meta Superintelligence Labs 的首个开源模型 Muse Glimmer 已在 Ollama 上线,这是一个 30B 多模态模型,面向本地运行的 Agent 工作负载,上下文长度 128K+,采用 Apache 2.0 许可。

    推荐理由:Meta Superintelligence Labs 首个开源模型在 Ollama 上线,可了解其本地编码 Agent 接入方式与 Apple Silicon 加速表现。

7月22日周三
  1. JetBrains AI Blog62

    JetBrains Air 更新:接入更多 Agent、本地模型与 Java/Kotlin 代码智能

    JetBrains Air 发布新版本,通过 JetBrains 与 Zed 开发的 Agent Client Protocol(ACP)支持 GitHub Copilot、OpenCode、Pi、Cline 等兼容 ACP 的编码 Agent,不再局限于内置的 Claude、Codex、Gemini CLI 和 Junie。

    推荐理由:Air 通过 ACP 接入外部编码 Agent 与本地模型,读者可据此判断多 Agent 工作流的接入方式。

7月9日周四
6月29日周一
  1. Ollama Blog62

    Ollama 0.31 通过多 token 预测让 Gemma 4 在 MLX 上提速近 90%

    Ollama 0.31 让 Gemma 4 在 Apple Silicon 上生成 token 平均提速近 90%,该加速默认开启且不改变模型输出。提速来自多 token 预测(MTP):Gemma 4 附带一个小型草稿模型,先提出后续若干 token,主模型一次验证并保留一致的部分,代码场景因可预测性高而受益明显。

    推荐理由:原文给出 MTP 加速的实测数据与实现细节,读者可据此判断本地编码 Agent 的响应速度变化。

6月11日周四