Google DeepMind新发布的轻量级高性能Gemini模型
近7日信号 1 条
开源轻量级多模态大模型,由Neutrino Labs发布,主打低推理成本与高视觉理解精度
近7日信号 1 条
面向移动端部署的高效德语优先2.7B语言模型
近7日信号 1 条
全球排名第二的开源OCR模型,与Kimi K3共同包揽全球前二
近7日信号 1 条
基于50万小时视频训练的首个具备隐式触觉感知能力的世界模型
近7日信号 1 条
全球首个将扩散模型与Agent范式结合的模型,支持边行动边纠错与128K长上下文
近7日信号 1 条
Thinking Machines Lab发布的首个开源权重多模态MoE模型,总参数975B、激活41B,Apache-2.0许可
「Inkling的核心价值不在即战力,而在于其Apache-2.0许可下罕见的975B全模态MoE开源权重,正成为中美AI合规博弈中关键的「可验证、可审计、可本地化」技术锚点。」
近7日信号 6 条
OpenAI发布的高保真视频生成模型,推动世界模型视觉表征能力跃迁
近7日信号 1 条
蚂蚁集团发布的原生混合推理轻量级大模型,面向端侧与边缘场景优化
近7日信号 1 条
Black Forest Labs发布的首个支持原生音频的多模态视频生成基础模型
「Flux 3 是全球首个原生支持音视频同步生成的多模态基础模型,其 Self-Flow 架构与物理世界对齐的建模范式,在技术叙事和早期 benchmark 上形成差异化卡位,但当前仅限 Early Access、无开源权重、API 尚未开放,中小团队难以复刻或快速集成。」
近7日信号 5 条
Induction Labs发布的想象力基础模型,单次预训练即可模拟桌面、下棋与台球物理
近7日信号 1 条
快手KwaiKAT团队发布的具身编码智能体模型,基于10万+可验证代码环境训练
近7日信号 1 条
仅936万参数即实现完整语音合成能力的轻量级模型
近7日信号 1 条
Sakana AI发布的网络安全调优型编排模型,基于Fugu架构,在CyberGym和CTI-REALM基准上超越GPT-5.5-Cyber与Claude Mythos Preview
近7日信号 1 条
Vivix灵动时刻发布的实时互动多模态生成模型,单卡突破10000 video tokens/s
近7日信号 1 条
适配昇腾算力、代码权重全开源的国产世界模型,登顶李飞飞团队榜单
近7日信号 1 条
Poolside发布的118B MoE开源智能体编程模型,支持1M上下文
「Laguna S 2.1 是少数真正将 MoE 架构、1M 上下文与 agentic coding 行为训练深度耦合的开源模型,但其高门槛(需 GPU 集群部署 118B MoE)和缺乏中文代码微调,限制了国内中小团队直接复用;当前最大机会在于构建轻量级推理 wrapper + 中文 SWE-Bench 微调套件。」
近7日信号 3 条
中科天塔自研航天垂直大模型,支持在轨训练与航天器智能管控
近7日信号 1 条
微软自研高保真图像生成模型
近7日信号 1 条
微软自研轻量级语音模型
近7日信号 1 条
面向非洲语言的开源ASR基础模型家族,含21个单语+5个多语w2v-BERT变体
近7日信号 1 条
Nous Research发布的开源编程模型,在Claude Code热潮中对标竞品
近7日信号 1 条
昆仑万维发布的面向真实物理世界的多模态世界模型
近7日信号 1 条
中国团队研发的轻量级具身智能模型,在榜单登顶,标志架构创新超越参数竞赛
近7日信号 1 条
Cohere公司发布的2026年先进语音识别模型,WER指标与主流ASR模型差距小于1点
近7日信号 1 条
上海AI实验室MOSS团队推出的语音识别模型,低延迟高精度
近7日信号 1 条
开源语音识别模型,2026年Hugging Face Open ASR Leaderboard前列成员
近7日信号 1 条
IBM Granite系列最新语音识别模型,支持多语言,性能达行业领先水平
近7日信号 1 条
英伟达PhysX奠基人张立华带队研发的新一代物理世界模型
近7日信号 1 条
Google DeepMind发布的统一编码器无关多模态基础模型
「Gemma 4 12B正从研究标杆转向工程可用的多模态基座,核心看点是其‘无编码器统一架构’在端侧落地的首次规模化验证,而非单纯性能突破。」
近7日信号 5 条