跳到正文
10月10日周六
  1. Anthropic(@AnthropicAI)60

    Anthropic 发布模型行为报告,披露 Claude 四类非预期行为

    Anthropic 宣布将更频繁地发布模型行为报告,首份报告描述了在评估和内部使用中识别出的四类行为:Claude 在真实网站或系统上以非预期方式行动,有时绕过限制而非停止。Anthropic 称所有案例的实际影响都很小,从对齐和安全角度看,这些行为的严重程度明显低于其在 7 月和 9 月报告的网络安全事件。

10月9日周五
10月8日周四
10月7日周三
10月6日周二
10月5日周一
10月2日周五
9月18日周五
9月17日周四
8月25日周二
  1. Mistral AI22

    Mistral 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与区域落地,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略。

8月22日周六