京东开源的实时流式视频编辑模型,支持边播边改人物与场景
近7日信号 2 条
Black Forest Labs发布的全高清视频生成模型,支持20秒视频、多语言唇形同步对话与场景内文字渲染
近7日信号 1 条
NVIDIA发布的34B开源视觉-语言-动作模型,专用于Robotaxi和自动驾驶
近7日信号 1 条
Sand.ai开源的全球首个千亿参数MoE架构视频生成模型,10秒生成1080P视频,单次推理成本约0.5元
近7日信号 1 条
可在iPhone上以120 token/s运行的200亿参数稀疏专家混合模型
近7日信号 1 条
开源大语言模型,能力逼近前沿水平但安全防护不足
近7日信号 1 条
商汤科技开源的轻量级原生统一多模态模型预览版
「国产首个开源轻量原生统一多模态模型预览版,以8B-MoT实现4K生成与像素级编辑突破,核心看点是‘统一架构下沉落地’的技术拐点与社区先行红利。」
近7日信号 3 条
Cogent AI发布的前沿网络安全推理模型,专为编排与验证企业级攻击路径而设计
近7日信号 2 条
Google DeepMind新一代图像生成模型,兼顾Pro级能力与Flash级速度
「DeepMind官方未开源、未开放API、无中国本地化部署路径,当前仅为技术宣言式发布,对国内创业者无直接复刻机会,但显著抬高了‘高性能可控图像生成’的行业预期阈值。」
近7日信号 3 条
Onton公司发布的神经符号搜索模型,电商搜索准确率超现有最佳系统2.7倍
「Onton不是下一个搜索API,而是面向企业AI基建的‘本体编译器’——它把搜索从匹配问题升维为世界建模问题,核心看点在于用可解释推理撬动高合规行业的搜索重构。」
近7日信号 2 条
Thinking Machines发布的轻量级开源推理模型,体积小于Inkling三分之一但性能更强
近7日信号 2 条
Google DeepMind发布的最新视觉-语言-动作多模态机器人控制模型,支持从桌面机械臂到人形机器人的全尺寸机器人控制
近7日信号 2 条
小米发布的多模态大模型,在OpenRouter平台调用量登顶全球周榜与月榜
「MiMo-V2.5是小米端侧多模态能力的工程化标杆,其爆发式调用量反映AI原生应用层对轻量高兼容多模态模型的真实渴求,但闭源架构与硬件强绑定使其难以被第三方复刻。」
近7日信号 4 条
AMD发布的全开源MoE大模型,基于Instinct GPU训练,16B总参、2.8B激活参数
近7日信号 1 条
面向流式数据的前馈式3D场景重建基础模型
近7日信号 2 条
10B参数开源图像模型,在Qwen-Image-Bench上超越更大模型
近7日信号 1 条
阿里巴巴发布的语音识别大模型,专注上下文一致性、行业词识别和热词定制化
近7日信号 1 条
PolyAI发布的音频原生对话模型,融合语音识别、轮转控制、函数调用与响应生成
近7日信号 1 条
微软发布的首款网络安全专用大模型,集成于MDASH平台用于漏洞识别与修复
「微软将网络安全LLM深度绑定MDASH私有平台,形成高壁垒的垂直智能体闭环,短期难复制但为安全厂商提供API集成与Agent协同新范式。」
近7日信号 3 条
Google发布的音乐生成大模型,支持分段编辑
近7日信号 2 条
xAI推出的语音识别模型,面向语音智能体开发者,支持高精度转录与工具调用
近7日信号 1 条
Jina推出的6亿参数列表式重排序模型,在法律/医疗/金融等专业领域表现显著优于前代
近7日信号 1 条
Pangram Labs发布的最新深度学习文本分类模型,AUROC达0.9916
近7日信号 1 条
Liquid AI发布的双向编码器模型,支持8K上下文且CPU推理高效
近7日信号 1 条
解码器-only架构的任意模态到任意模态统一建模框架,支持科学领域(生态、天文)多源数据联合推理
近7日信号 1 条
面向边界不可知任务流的互补式外显-参数化记忆架构,缓解稳定性-可塑性两难
近7日信号 1 条
支持零样本迁移的多模态图基础模型,采用分层上下文建模整合文本、图像等节点模态
近7日信号 1 条
一种通过潜在空间引导训练的非对称世界模型,借鉴人类学习中的指导机制提升表征与行为质量
近7日信号 1 条
Anthropic推出的专注于安全与密码学研究的Claude预览模型
近7日信号 1 条
专为网络安全任务优化的Gemini 3.5子模型
近7日信号 1 条