AI商业灯塔
模型SenseNova U1.5-Lite-Preview71

商汤科技开源的轻量级原生统一多模态模型预览版

国产首个开源轻量原生统一多模态模型预览版,以8B-MoT实现4K生成与像素级编辑突破,核心看点是‘统一架构下沉落地’的技术拐点与社区先行红利。

近7日信号 3

公司陶世智能科技

精密减速器厂商,专注微型环面包络蜗轮蜗杆减速器及机器人关节模组

近7日信号 1

公司清博空天

空间态势感知(SSA)公司,提供低轨卫星监测与碰撞风险预警服务

近7日信号 1

产品WorkBuddy AI记忆眼镜60

腾讯云WorkBuddy生态首款接入的AI记忆眼镜,搭载WakeeMemory OS实现工作场景感知与上下文行动项生成

WorkBuddy AI记忆眼镜不是硬件创业机会,而是腾讯以端侧工作记忆OS(WakeeMemory OS)为锚点、在AI办公物理入口完成战略卡位的‘操作系统级产品’,其真正价值在于定义人机协同的新工作协议(如MCP接入、人机双写、安全中心默认化),而非眼镜本身。

近7日信号 21

开源ForgeStencil

面壁智能与OpenBMB联合开源的Stencil优化AI系统,支持CAE/电磁/中子学仿真加速

近7日信号 1

产品GenOffice

面向macOS和Windows的AI原生办公套件,含文档、表格、演示和PDF功能

近7日信号 2

开源QM Multiplayer Agent Harness

YC开源的MIT许可多玩家智能体协同框架,支持Slack和Web环境

近7日信号 1

产品AI选秀元年

以AI生成虚拟爱豆为核心的娱乐工业新范式

近7日信号 1

开源Qwen 80B Mac/iPhone Inference

在Mac上用4.3GB RAM运行80B Qwen模型、在iPhone上运行35B模型的轻量级推理实现

近7日信号 1

论文Real-Time Detection and Repair of LLM Agent Failures

提出实时检测与修复LLM智能体失败的新方法,避免二次LLM判别带来的高成本

近7日信号 1

论文Grounding Agentic VLMs with Dedicated Segmentation

针对细粒度车辆损伤评估任务,提出专用分割模块增强视觉语言模型的空间接地能力

近7日信号 1

论文CTRAG: In-Context Retrieval-based Framework for Automated Compliance Checking

提出基于上下文检索的自动化合规检查框架CTRAG,利用大模型提升监管生态信任度

近7日信号 1

论文Cultural Awareness is Represented but Not Decoded

实证分析18个开源大模型对全球神话知识的表征与解码能力落差,揭示文化默认偏见机制

近7日信号 1

论文Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions

倡导并初步构建人类-AI交互的纵向研究范式,关注认知、发展与社会层面的长期影响

近7日信号 1

论文SWE-Touch: Benchmarking Coding Agents When Users Touch the Code

首个支持用户实时介入代码的编码智能体评测基准,模拟真实协作开发场景

近7日信号 1

论文CMuon: Accelerating and Stabilizing Diffusion Transformer Training

通过分块动量正交化技术加速并稳定扩散Transformer训练,降低DiT模型训练成本

近7日信号 1

论文Abduction Without a Body? Representational Grounding and the Abduction Loop

探讨科学溯因是否必须依赖具身感知,提出脱离物理耦合的表征性溯因循环理论框架

近7日信号 1

论文RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory

提出Reduced-Order Utility States机制,在自进化智能体记忆中平衡反馈覆盖率与记忆-奖励陷阱

近7日信号 1

论文LiveMem: Maintaining Memory State Continuity in Long-Running LLM Inference

为长时运行大模型智能体设计持久化内存状态连续性机制,解决交互流超出上下文窗口的根本挑战

近7日信号 1

论文Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation

通过监测跨会话能力累积效应检测AI滥用,针对多智能体协同架构提出新型风险监控范式

近7日信号 1

论文Analytic Planning under Uncertainty with Moment Closure

提出基于矩闭合的解析规划方法,在随机环境中实现对预测不确定性的严格建模与传播

近7日信号 1

论文MedPRESS: A Multi-turn Benchmark for Patient-Pressure-Induced Medical Sycophancy in LLMs

首个面向医患高压对话场景的多轮基准测试,评估大模型在患者压力诱导下的医疗谄媚倾向

近7日信号 1

论文Uncertainty Is Not Enough: Value-of-Information Routing for Mixtures of LoRA Experts

提出基于信息价值(VoI)的LoRA专家路由机制,突破仅依赖不确定性判断的局限,提升参数高效混合专家系统决策质量

近7日信号 1

论文A Taxonomy of Cognitive Capability Gaps in Generative and Agentic AI

系统性构建生成式与智能体AI的认知能力缺口分类体系,涵盖持续推理、自适应行为、持久记忆与自我调节四大维度

近7日信号 1

论文Structured Memory for Edge Language Models

针对边缘端大模型提出O(1)状态注入的结构化记忆机制,解决RAG预填充开销与Transformer KV缓存膨胀问题

近7日信号 1

论文AtumAI: A Principled Framework for Agentic Generation of Datacenter Control-Plane Policies

面向数据中心控制平面策略生成的智能体化原则性框架,聚焦于解决硬件-软件栈复杂、设计空间庞大及策略原型周期长等工程瓶颈

近7日信号 1

论文CoWAM: Coordination Contracts for Selective Policy Intervention with WAMs

面向世界动作模型(WAMs)的选择性干预层CoWAM,支持双臂机器人策略协调控制

近7日信号 1

论文UEmbed: Unified Sparse and Dense Multimodal Embeddings

统一稀疏与稠密表征的多模态嵌入框架,提升检索增强生成(RAG)中语义匹配精度

近7日信号 1

论文GradCuit: Credit-Assigned Gradient Flow Enables Robust and Interpretable Test-Time Latent Reasoning

提出GradCuit方法,通过信用分配梯度流实现鲁棒可解释的测试时隐状态推理

近7日信号 1

论文onepot-Bench 0: towards lab-aware in silico chemistry benchmarks

面向实验室场景的首个计算化学能力评测基准,覆盖实验规划、执行与分析全流程

近7日信号 1