文远知行发布的物理AI认知基础大模型,首创‘最小物理事实单元’理解框架
「WITT的核心看点是首个通过真实道路物理事实验证的AI认知框架,标志着中国自动驾驶从‘感知-规划’范式向‘可验证物理理解’范式跃迁。」
近7日信号 2 条
PrismML 基于 Qwen3.6 的轻量化多模态模型,支持在 iPhone 17 Pro(12GB内存)本地运行
「Bonsai 27B的核心看点是:首个在消费级移动设备上实证可行的27B级多模态量化模型,以工程极致压缩撬动边缘AI原生应用爆发前夜。」
近7日信号 4 条
Soofi 联盟发布的德英双语开源混合 Mamba-Transformer MoE 基座模型
「Soofi S 30B-A3B 是少数真正开源、双语优化、混合架构的 MoE 基座模型,对德语区中小开发者和本地化 AI 工具创业者有明确技术红利,但中文市场适配弱、生态支持缺位,暂难形成规模化创业抓手。」
近7日信号 4 条
Meta 的开源模型系列,开源生态的引爆者;Llama 4 争议后光环褪色,Meta 转向超级智能实验室。
「开源王座的易主进行时:它证明了开源领导权不是终身制,持续交付才是。」
近7日信号 2 条
Meta 推出的首个提供 API 的 Muse Spark 系列模型,聚焦智能体工具调用与计算机使用能力提升
近7日信号 1 条
Gemini App集成的先进音乐生成模型,支持文本/图像输入生成30秒音乐
「Lyria 3不是独立产品,而是Google AI OS的内容表达入口——其真正价值在于将音乐生成从工具升级为‘自然交互原语’,引爆创作者经济新交互范式。」
近7日信号 1 条
Google DeepMind面向复杂任务优化的智能模型,强调深度推理与多步决策
「Gemini 3.1 Pro是谷歌展示AI底层攻坚能力的技术宣言,而非面向中国市场的可商用产品或创业接口。」
近7日信号 1 条
Google DeepMind新一代音乐生成模型,支持更长曲目与结构化创作
「Lyria 3 Pro的核心看点是Google以基建级方式将AI音乐‘水电化’,但真正可捕获的价值不在模型本身,而在它引爆的下游模板经济与场景化工作流重构。」
近7日信号 1 条
Google DeepMind优化的实时语音交互模型,降低延迟并提升语音交互自然度
近7日信号 1 条
Google DeepMind面向具身智能的增强版机器人推理模型,强化空间与多视角理解能力
近7日信号 1 条
Google DeepMind新一代语音生成模型,支持细粒度音频标签控制
近7日信号 1 条
Google DeepMind推出的扩散架构Gemma变体,文本生成速度提升4倍
近7日信号 1 条
OpenAI新一代语音模型,驱动ChatGPT Voice实现自然人机语音交互
近7日信号 1 条