MiniMax开源权重音乐生成模型,支持单次生成5分钟完整歌曲
近7日信号 1 条
阿里巴巴发布的端到端AI音乐模型,支持自然语言驱动整曲生成(词曲编唱)
近7日信号 1 条
智象未来发布的原生全模态交互式世界模型,支持时空一致长时推演
近7日信号 1 条
OpenAI面向网络安全场景推出的GPT-5.6变体,含红蓝双队能力
近7日信号 1 条
Mistral发布的3B参数多模态内容审核开源模型
「Shieldstral是当前最值得国内技术团队评估集成的开源多模态内容审核基座,技术成熟度与部署友好性远超同类竞品,但商业化生态与本土适配尚处早期。」
近7日信号 5 条
支持24FPS画面+48kHz立体声实时生成的世界模型
近7日信号 1 条
面向小批量快速解码优化的高效MoE结构
近7日信号 1 条
SpaceXAI发布的第四代大语言模型,宣称追平第一梯队能力
近7日信号 2 条
首次部署于真实商超场景的物理世界模型,支撑具身智能机器人货架作业
近7日信号 1 条
面向科学发现的智能体基础模型,支持多模态科学证据推理、工具交互与长周期任务
近7日信号 1 条
基于完全合规后训练数据构建的10亿参数开源语言模型,强调数据伦理与前沿性能平衡
近7日信号 1 条
面向手机、可穿戴设备、智能家居和机器人的14MB轻量级具身智能体大模型
近7日信号 2 条
Liquid AI发布的31亿参数端侧视觉语言模型,支持屏幕阅读、物体定位与工具调用
近7日信号 1 条
由Dyna Robotics发布的百万小时人类视频预训练世界动作模型,推动具身智能发展
近7日信号 1 条
北大、南洋理工等联合推出的人形机器人全身协同作业模型
近7日信号 1 条
NVIDIA加速的开源权重世界模型,支持本地视频生成,6.8秒多镜头视频,原生ComfyUI集成
「LTX-2.5 是少数真正实现本地化、低延迟、多镜头同步视频生成的开源世界模型,对中小视频创作工具厂商和AIGC插件开发者构成高价值技术杠杆。」
近7日信号 2 条
英伟达正在研发的万亿参数开源大模型,旨在对标全球最佳开源模型
近7日信号 1 条
英伟达开源轻量级大模型,3.6B参数,推理速度达670 token/s,性能媲美gpt-oss-120b
「Nemotron 3.5 Lightning 是当前国产边缘推理场景下稀缺的高性能开源轻量模型,其 open-weight 属性+实测670 token/s 推理速度构成对中小AI应用厂商的强技术杠杆。」
近7日信号 4 条
webAI发布的1.7B/3B参数形式逻辑模型家族,支持本地硬件运行,用于英语到一阶逻辑的自动形式化
近7日信号 1 条
OpenAI面向网络安全防御场景推出的专用大模型,支持漏洞研究与渗透测试
近7日信号 1 条
字节跳动Seed团队推出的原生音视频全双工大模型,支持视听文多模态实时连续交互
近7日信号 1 条
端侧原生视觉语言模型,3B参数实现物理世界精准感知
近7日信号 1 条
NVIDIA发布的开源全双工语音到语音模型,支持约450ms轮转延迟与实时工具调用
近7日信号 1 条
Google DeepMind研发的气象预测AI模型,已用于飓风路径精准预报
「WeatherNext是顶尖科研级气象AI,技术领先但非创业友好型产品——其核心价值在于赋能国家级气象机构与灾害响应系统,而非直接面向中小开发者或商业SaaS市场。」
近7日信号 4 条
Pokee AI 发布的 28B 参数文本模型,支持 10M token 上下文,专为边缘/客户侧部署设计
近7日信号 1 条
OpenAI内部数学与理论计算机科学专用模型,已解决10个长期悬而未决的开放问题
「Astra是OpenAI内部封禁级科研模型,当前零开放、零API、零商用路径,其核心价值在于验证AGI在形式化推理上的突破性临界点,而非可复用的产品机会。」
近7日信号 3 条
腾讯混元发布的多语种语音识别模型,中文WER 3.34%
「腾讯混元Hy ASR 3.0 preview是当前国内ASR技术标杆,但其高度集成大模型语义理解的架构与闭源预训练范式,大幅抬高了中小团队复刻门槛;真正机会在于垂直场景轻量化适配(如医疗问诊语音结构化)而非通用ASR替代。」
近7日信号 4 条
Liquid AI发布的端侧智能体模型,支持128K上下文、工具调用与开源权重
近7日信号 1 条
小米发布的面向真实移动操作任务的具身基座模型,基于10万小时真实世界数据预训练
近7日信号 2 条
昆仑万维方汉提出的具身智能核心解法,强调异构数据处理能力
「世界模型当前核心看点是‘异构数据闭环能力’——昆仑万维提出的‘用多源传感器+真实场景反馈驱动预训练’路径,正成为区分真伪世界模型的唯一硬门槛,也是具身智能从Demo走向规模化交付的生死线。」
近7日信号 7 条