微软推出决策专用模型 Microsoft-Decision-1,基于 Qwen3.5-9B 后训练
微软发布 Microsoft-Decision-1,一个专做选择题的决策模型,基于阿里开源模型 Qwen3.5-9B 后训练,只做一遍推理就输出结构化结果和校准过的概率分。
微软发布 Microsoft-Decision-1,一个专做选择题的决策模型,基于阿里开源模型 Qwen3.5-9B 后训练,只做一遍推理就输出结构化结果和校准过的概率分。
Aether AI 发布因果驱动的机器人智能系统 CRIS-0,由因果驱动机器人 Agent 与因果世界模型两大组件构成,在真实机器人演示中面对人为干扰的反应速度达 0.1s 级。
生数科技推出视频生成模型 Vidu Q4 Preview,将生成成本压至 0.09 元/秒,图生视频速度达同类模型的 2 倍。该预览版支持最多 15 张参考图、参考音色输入与 2K/4K 画质输出,并提升了人物演绎、镜头调度和复杂特效表现。
Mistral 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、520 亿激活参数的原生多模态模型,权重将于本月底开放。
推荐理由:Mistral 官方给出 ML4 的完整能力清单与开源权重时间表,可据此判断欧洲开源模型在编码与智能体任务上的位置。
Gemini 3.7 Flash 借助新的智能体视频理解能力,可自动调整处理速度,准确识别并统计视频中的每一次拍手。默认静态处理以固定 1 FPS 读取视频,拍手这类瞬间动作容易被漏掉或误判为响指、点击。
Google DeepMind 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供,新增场景延展、首尾帧插值、4K 升采样等生成视频控制能力。