AI商业灯塔
产品PULSE具身智能系统

星炽动力推出的具身智能系统,支持多场景任务理解与策略调整

近7日信号 1

公司谦合益邦

3D存算一体芯片企业,发布全球首款4层3D DRAM堆叠存算一体芯片

近7日信号 1

产品卡卡西机器人学习系统

具身智能系统,支持3秒视频演示即学新动作

近7日信号 1

产品雷鸟iO AR眼镜

全球首款全天候主动式AI AR眼镜,续航两天,重量仅34g

近7日信号 1

产品iForge

自托管一体化研发协作平台,覆盖任务、代码、评审、CI/CD全链路

近7日信号 1

开源Pragmatic Chunker

面向RAG场景的语义切片与向量入库工具,Java 17构建

近7日信号 1

开源OpenConnector

面向AI Agent的开源连接器网关,解决SaaS服务安全接入问题

近7日信号 1

公司灵犀智涌

中科大博士创立的工业具身智能公司,主推ROSS Harness与CONWAY工业原生模型协同演进架构

近7日信号 1

论文大模型智能体正在重蹈强化学习的覆辙

IJCAI 2026论文,指出基础模型智能体面临仿真到现实鸿沟及多语言环境适应性断崖问题

近7日信号 1

产品国产预制算力

工厂预制率超90%的AI算力基础设施,24小时内投运,交付效率提升70%

近7日信号 1

模型Claude Opus 560

Anthropic即将发布的Claude旗舰模型,据称具备Fable 5水平且价格减半

Claude Opus 5的核心看点是首次在商业API中稳定交付‘单提示生成带物理引擎/音效/实时渲染的可运行3D Web游戏’能力(如Wave Racer、LOTR场景),但其6.9亿token单次消耗、无中文语义优化、无中国境内API接入通道、Anthropic对key分发与用量审计极度严苛,导致中国个人开发者无法低成本复现或商业化套利,仅适合作为技术水位标尺与高预算企业级Agent验证基线。

近7日信号 51

公司Jeff Dean新公司48

Jeff Dean离开Google后创立的新AI公司

Jeff Dean新公司Discovery Loop是顶级AI人才与资本背书的‘超级信号’,但其技术方向未公开、产品形态不明,当前对创业者无直接复用价值,对投资人却是不可忽视的赛道风向标。

近7日信号 6

产品全员养虾

美团内部AI Agent大规模应用计划,8万员工参与,日耗千万级算力

近7日信号 1

公司Micro1

AI训练数据初创公司,受益于AI训练数据需求激增

近7日信号 1

公司蚂蚁灵波58

蚂蚁集团孵化的具身智能企业,专注服务机器人研发与商业化

蚂蚁灵波的核心看点是‘具身智能领域首个以OS级通用大脑为支点、依托蚂蚁支付-履约闭环实现B端商业化冷启动的平台型技术公司’,其真正壁垒不在算法领先性,而在将机器人从硬件终端升维为服务节点的能力——让物业、商超、物流等客户无需自建robot fleet,即可调用LingBot大脑接入自有或第三方硬件完成任务调度与结算。

近7日信号 14

产品认知操作系统

AI时代个体应对知识过载与能力重构的核心心智框架与实践方法论

近7日信号 1

产品AI互动内容平台

被资本密集押注的AI原生互动内容平台,被视为游戏与短视频融合的新范式

近7日信号 2

论文DARS: Dual-Level Credit Assignment RL with Structured Reasoning for Instruction-Based Image Editing

针对指令驱动图像编辑任务,提出双层级信用分配强化学习框架DARS,结合结构化推理解决稀疏奖励问题

近7日信号 1

论文Task-CoEvolve: Efficient Harness Optimization via Adaptive Validation Task Selection

面向Agent Harness的高效优化方法,通过自适应验证任务选择提升LLM智能体性能

近7日信号 1

论文Ask Self, Ask Others: Relation Is All You Need

提出Relation新型token混合原语,替代注意力机制,显式建模Self与Exchange关系

近7日信号 1

论文From Agent Behaviour to Agent-Friendly Documentation

首次实证研究编码智能体如何发现、阅读和编写技术文档,揭示人写文档与AI用文档的鸿沟

近7日信号 1

论文The Third Restructuring of Software Form: From the Three-Tier Architecture to Storage, Models, and Agents

提出软件范式演进第三阶段Software 3.0,即从存储、模型到智能体的架构重构

近7日信号 1

论文MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use

首个评测大模型记忆使用中认知陷阱(如确认偏误、锚定效应)的基准

近7日信号 1

论文ContractScrub: A benchmark for final review of legal contracts

首个面向交易合同最终审阅环节(错误与不一致检测)的法律AI评测基准

近7日信号 1

模型Daedalus-150M

专为CPU推理优化的1.5亿参数卷积-注意力混合小模型,支持4-bit量化单用户单token推理

近7日信号 1

论文InsufficiencyBench: Evaluating LLM legal advice on underspecified user queries

首个专门评测LLM法律建议在用户问题信息不足时表现的基准

近7日信号 1

论文Rule-Compliant Visual Spatial Planning for Multimodal Large Language Models

首次探索多模态大模型在显式/未见规则约束下的视觉空间规划能力

近7日信号 1

论文Break It Down, Pass It On: Cross-Task Skill Transfer in LLM Agents

研究LLM智能体跨任务技能迁移的可靠性机制,识别迁移失败与负迁移场景

近7日信号 1

论文Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization

三阶段后训练方法,将文档知识内化至模型参数,实现免检索问答

近7日信号 1

论文Phantom Gains: Auditing Self-Improvement Against a Measured Null

提出基于测量零假设的自我改进审计框架,避免噪声导致的虚假性能提升误判

近7日信号 1