Reducto发布的单通路文档解析模型,整合OCR、版面检测、表格识别与格式理解
近7日信号 1 条
OpenBMB发布的25亿参数端侧大模型,支持131K上下文,在34项基准测试中平均得分53.9
近7日信号 1 条
阿里巴巴发布的首个面向自动驾驶的视觉语言基础模型
近7日信号 1 条
智谱AI发布的前沿编程模型,具备涌现的网络空间能力
「GLM-5.3-Flash以‘320B总参/18B激活+国产卡原生支持+1M上下文+多模态编程涌现’重构AI创业成本边界,是中国首个具备全球级性价比碾压力的开源网络空间智能基座。」
近7日信号 29 条
李飞飞团队发布的全球首个多模态世界模型,支持单图重建3D世界并生成机器人训练场
「Atlas是全球首个具备像素级相机控制+单图3D重建+时空联合建模能力的多模态世界模型,短期核心价值在高端仿真基建与AIGC内容生产范式升级,但技术黑盒化、算力门槛高、API未开放,个人/小团队难以复刻或商用落地。」
近7日信号 3 条
智象(HiDream.ai)发布的具身世界模型,支持物理交互与多模态环境理解
近7日信号 1 条
MBZUAI旗下IFM实验室发布的6款Apache 2.0许可开源大模型系列(0.9B–375B)
近7日信号 1 条
沙特AI公司HUMAIN发布的疑似套壳MiniMax M3的大模型
近7日信号 1 条
Meta FAIR等机构提出的冻结式LLM裁判模型,用于在GPU执行前对AI实验方案进行排序筛选
近7日信号 1 条
H公司发布的单塔多模态编码器系列,摒弃视觉塔与因果解码器,支持多语言文本与图像块联合编码
近7日信号 1 条
Google DeepMind推出的跳过物理模拟、直接从实时卫星数据学习的高分辨率天气预测模型
近7日信号 1 条
Meta Superintelligence Labs发布的实时语音转录模型,80毫秒低延迟分块处理,支持说话人分离与句界检测
近7日信号 1 条
Google发布的实时音乐生成模型,支持更富表现力的人声与编曲
近7日信号 1 条
Generalist发布的通用多模态机器人模型,强调持续预训练下的智能涌现与ICL能力
近7日信号 1 条
一种用于混合大模型的线性注意力变体,其循环状态以固定大小压缩上下文
近7日信号 1 条
IJCAI 2026发表的2B参数视觉-语言-动作模型,支持长程机械臂操控
近7日信号 1 条
本地部署的大语言模型,在基准测试中性能优于DeepSeek V4 Flash
近7日信号 3 条
欧洲主导的开源大语言模型,参数量4380亿,强调多语言与合规性
近7日信号 1 条
谷歌最新轻量级多模态图像生成模型
近7日信号 1 条
一种无需词汇表头投影的隐式思考方法,缓解大语言模型离散token输出瓶颈
近7日信号 1 条
阿里巴巴发布的AI音乐生成模型,标志着已关停五年的虾米音乐以AI形态回归
「情感IP+AI音乐的稀缺性组合,短期流量与怀旧势能突出,但技术同质化严重、B端变现路径未验证。」
近7日信号 3 条
新型端侧语言模型架构,通过扩散生成机制提升 Agent 执行效率,挑战 GPT 范式
近7日信号 1 条
14MB超轻量基础模型,专为手机、可穿戴设备、智能家居及机器人等边缘设备优化
近7日信号 2 条
腾讯混元发布的7.7B参数开源模型,支持1M上下文,强调‘模型即agent’架构
「中国首个将MCP协议深度耦合进开源模型的Agent-ready基座,短期价值不在模型本身,而在其撬动的腾讯系Agent基础设施生态入口。」
近7日信号 5 条
Cohere发布的2.3B参数多模态文档理解模型,支持PDF/幻灯片/图像转Markdown及结构化描述
近7日信号 2 条
Meta发布的30B多模态Agent模型,支持128K上下文与本地部署优化
近7日信号 1 条
阿里巴巴高德发布的首个无长程依赖万帧级流式3D重建模型
近7日信号 1 条
乐聚发布的面向工业场景优化的具身智能模型,强调中训练(Mid-train)能力
近7日信号 1 条
Google Research与UNSW联合推出的0.72M参数双流连续血糖监测(CGM)基础模型
近7日信号 1 条
IBM发布的开源推理大模型系列(3B/8B/30B),支持原生思维链开关与工具调用,面向企业场景
「Granite 4.2 是少有的 Apache 2.0 授权、原生支持思维链+工具调用的轻量级企业级开源模型,为国产私有化AI Agent产品提供高兼容性基座,但需警惕IBM后续商业层绑定风险。」
近7日信号 3 条