AI商业灯塔
公司QueryStory

利用LLM与网络安全技术提升AI查询可信度的初创公司

近7日信号 1

论文Action Command Computing for VLA

IJCAI 2026入选论文,提出将动作调度前移至推理前端,提升VLA模型1.79倍速度

近7日信号 1

产品RoboHarness

面向具身智能的异构模型编排框架,支持VLA/WAM/RL/TAMP零样本协同

近7日信号 1

产品GPU租金悖论

AI算力租赁价格未随硬件迭代下降反而上涨的现象,反映专用推理需求刚性

近7日信号 1

产品即梦片场

即梦AI推出的AI原生影视内容厂牌,提供算力、资金与行业资源支持电影/剧集项目

近7日信号 1

论文LiveEdit: Real-time Streaming Video Editing Framework

清华与港科大提出的流式视频编辑框架,支持文本驱动、低延迟实时编辑,达12.66 FPS

近7日信号 1

公司福建智算方舟

福建省智算基础设施运营主体,落子长乐机场综保区智算中心

近7日信号 1

公司达卯科技

专注算电协同与绿色AI算力基础设施的科技公司

近7日信号 2

产品硅谷具身模型(无后训练)

无需后训练、单次观看即学会任务的具身智能模型,被称作具身智能GPT时刻

近7日信号 1

产品小宇宙《AI趋势报告》

播客平台小宇宙发布的年度AI应用趋势观察报告,聚焦AI创作、办公与协作型AI

近7日信号 1

产品Expertise AI

面向专业领域知识图谱构建与专家意图建模的AI协作平台

近7日信号 1

产品Evidence Core

面向AI原生应用的证据链验证与可追溯性基础设施

近7日信号 1

产品PHASE-Tree

为长线AI角色构建可演化人格骨架的技术框架

近7日信号 1

公司Runable

专注AI代理商业化的初创公司,获2100万美元融资

近7日信号 1

论文Meta^n: Recursive Self-Improvement through Emergent Depth

提出递归自改进新范式,突破LLM代理元层级固定瓶颈

近7日信号 1

论文SkillForge: Evolving Verifiable Skills for Reinforcement Learning Agents

面向强化学习智能体的可验证技能演化框架,解决跨回合知识复用难题

近7日信号 1

论文Evidence Blindness in Direct Corpus Interaction: Persistent Navigation with AtlasNav

提出AtlasNav导航机制,解决直接语料交互(DCI)中证据可达却不可用的‘证据盲区’问题

近7日信号 1

论文StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing

提出StepGuard逐步骤防护机制,在工具调用环节实现细粒度安全控制与效用平衡

近7日信号 1

论文Linear Probing Provides Robust and Efficient Detection of Machine-Generated Text

提出基于线性探针的机器生成文本检测方法,具备强泛化性与低数据依赖,显著优于监督式检测器

近7日信号 1

论文Right Diagnoses, Decorative Reasoning: A Perturbation Audit of Medical Chain-of-Thought

对医学链式推理进行扰动审计,揭示CoT结论正确但推理过程不可靠的普遍现象

近7日信号 1

论文CAFE: Self-Improving Search Agents Need Co-Evolving Feedback

提出CAFE框架,将反馈建模为轨迹内学习的协同进化信号,解决结果监督无法定位中间错误的问题

近7日信号 1

论文StarHarness: Evolving Harnesses with Stratified Search for Enterprise Environments

提出StarHarness框架,在固定模型权重前提下进化企业环境专属Agent Harness,支持提示、工具接口、MCP提供者等多维适配

近7日信号 1

论文Automatic Model Card Generation Using an LLM

利用大模型自动生成标准化Model Card,提升AI模型透明度与可问责性

近7日信号 1

论文Structurally-bounded Agentic Graph Exploration for Evidence-Grounded Scholarly DeepSearch

提出Crase有界学术搜索框架,通过1.5跳引用邻域结构化扩展替代开放循环搜索,提升可解释性与可控性

近7日信号 1

论文Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining

发现语言模型预训练中有效学习率(ELR)主导损失动态,匹配ELR可使不同配置训练轨迹坍缩一致

近7日信号 1

论文BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes

提出BrowserForge并行浏览器沙箱框架,支持基于像素渲染的Web Agent规模化高质量交互轨迹采集

近7日信号 1

论文SPO++: Stream-Aligned Policy Optimization for Asynchronous Agentic RL

提出SPO++异步策略优化框架,消除多分支rollout同步等待瓶颈,提升工具调用型Agent的RL训练效率

近7日信号 1

论文Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses

提出Recuris递归经验-工作记忆架构,解决长周期任务中历史膨胀导致的状态模糊与技能错配问题

近7日信号 1

论文What FID Hides: Detecting, Ranking, and Diagnosing Deviations in Generative Evaluation

揭示FID评估指标的局限性,指出其一阶二阶矩摘要会掩盖分布差异,提出更鲁棒的生成模型评估诊断方法

近7日信号 1

开源Scientific Agent Skills

面向科研场景的AI Agent技能库,覆盖生物、化学、医药、药物发现等领域,含163个已验证技能与100+科学数据库

近7日信号 1