AI商业灯塔
论文Interpretable AI predicts a 2026 summer dry anomaly in central China

可解释深度学习模型结合大气环流动力预测,成功预判2026年夏季中国中部长期干旱异常,体现AI在气候治理与公共政策中的落地潜力

近7日信号 1

论文Open-MOPD: Diagnosing and Fixing Capability Imbalance in Multi-Teacher On-Policy Distillation

首个诊断并修复多教师在线策略蒸馏中能力失衡问题的开源框架,对Meta AI Personal Superintelligence、Claude Opus 5等多专家融合系统具方法论意义

近7日信号 1

论文Lévy Attention: Single-Pass Predictive Uncertainty for Continuous-Time Attention

为不规则采样时间序列建模引入Lévy过程建模注意力机制,首次在单次前向传播中输出预测置信度,填补连续时间AI模型可信度空白

近7日信号 1

论文Beyond Teacher Likelihood: Group-Calibrated On-Policy Distillation for Long-Context Reasoning

针对长上下文推理任务,提出组校准的在线策略蒸馏方法,解决token级教师监督导致的局部合理但全局证据缺失问题,对Qwen 3.8 Max、DeepSeek-V4-Flash等长上下文模型优化有直接参考价值

近7日信号 1

论文ADEPT: Accelerating Dexterity via Pre-Training and Post-Training using Reinforcement Learning

面向高自由度具身机器人长程操作任务的强化学习框架,专注仿真到现实(sim-to-real)灵巧性迁移,与宇树科技、小马智行等具身智能实践强相关

近7日信号 1

论文SPADE: Self-Play in Adaptive Synthetic Executable Environments

提出基于自博弈的自适应合成可执行环境框架,支持语言智能体持续生成多样化、自演化目标以实现连续自我改进

近7日信号 1

产品AI同居伴侣系统

女博士构建的三层记忆AI生活伴侣,集成物理设备控制与日常交互

近7日信号 1

开源agentctxsync

开源的AI代理上下文同步工具,解决多设备间AI记忆不一致问题

近7日信号 1

公司Compute Valuation Startup

帮助华尔街为AI算力定价的初创公司

近7日信号 1

产品Meta AI Personal Superintelligence49

Meta正在构建的个人超智能系统,聚焦个性化AI代理

Meta PSI不是产品而是权力重构宣言,其真正价值不在技术实现,而在迫使所有中国AI厂商回答:当超级智能必须‘属于每个人’时,你的终端入口、数据主权和商业模式是否经得起重估?

近7日信号 7

模型Ornith-1.5

基于自我支架向自我改进演进的新型开源语言模型

近7日信号 1

论文AI递归自我改进可能不会快速到来

探讨AI递归自我改进在现实工程与理论约束下的延迟可能性,质疑行业过度乐观预期

近7日信号 1

公司鹿明机器人

专注产业具身智能的机器人公司,聚焦工业场景落地与无本体数据采集

近7日信号 3

论文OOD Generalized Generative AI

IJCAI 2026清华王鑫团队Tutorial:面向生成式AI的分布外泛化理论框架

近7日信号 1

论文1-bit Quantization for LLMs on Edge Devices

IJCAI 2026报告:面向边缘设备的千亿参数大模型无重训1比特量化方法

近7日信号 1

公司章鱼动力

具身智能机器人公司,聚焦‘脑-手-数据’技术体系

近7日信号 1

公司超智算科技

专注智能算力资源共享与弹性调度的国产算力基础设施公司

近7日信号 1

公司共绩科技

专注算力调度与异构资源协同的AI基础设施公司

近7日信号 2

论文SpeechSense: A Paralinguistic-Focused Dataset for Fine-Grained Speech Sentiment Analysis

发布SpeechSense数据集,首个聚焦副语言特征的细粒度语音情感分析基准,覆盖语调、节奏、停顿等维度

近7日信号 1

论文Collective Counterfactual Planning: Coordination, Consent, and Verification under Representational Constraints

提出集体反事实规划(CCP)形式化模型,刻画多智能体在表征约束下的协同规划、共识与验证机制

近7日信号 1

论文EvoTS-Agent: A Self-Evolving LLM Agent for Financial Time Series Change Point Detection

提出自演化LLM智能体EvoTS-Agent,专用于金融时序变点检测,解决非平稳性与市场机制异质性挑战

近7日信号 1

论文Grading Needs a Rubric, Not Intelligence

提出any-to-bench框架,证明小模型按显式评分标准批改开放题答案可媲美大模型

近7日信号 1

论文Towards Zero-Shot Task Transfer with Neurosymbolic World Models

探索基于神经符号世界模型实现零样本任务迁移的新路径,弥合纯神经与符号方法在环境建模上的鸿沟

近7日信号 1

论文Recirculation

提出一种即插即用的推理时架构增强方法,显著降低现成基础模型的困惑度并提升生成与推理准确率,且几乎不增加延迟

近7日信号 1

论文Judge, Retrieve, or Abstain: Uncertainty-Guarded LLM Judging

提出带不确定性防护的LLM评判框架,在主观任务评测中提供可证明的风险控制保证,解决‘过度自信评判’问题

近7日信号 1

论文Policy-Invariant Reward Shaping from LLM Feedback

提出一种从大语言模型反馈中提取策略不变奖励塑形信号的理论框架,为混合式强化学习智能体提供可证明的稳定性保障

近7日信号 1

论文The IOL-AI Challenge: An Open Challenge towards Advancing Linguistic Reasoning

发起面向语言学推理的开放挑战赛,聚焦模型发现隐含规则系统的能力,填补数学/代码之外的推理评测空白

近7日信号 1

论文Chain-of-Experience for Continual LLM Improvement

提出‘经验链’机制,使大语言模型能在推理时通过迭代交互持续提升自身能力,突破传统静态评测范式

近7日信号 1

论文Optimize Your Sampling: Tuned Diffusion Sampling with Bayesian Optimization

利用贝叶斯优化自动调优扩散模型采样过程,在保持质量前提下显著降低计算开销

近7日信号 1

论文StagedWorkspace: A Versioned Workspace for Knowledge-Work Agents

提出面向知识工作智能体的版本化工作区框架,统一管理代码/文档等数字资产的解析视图、原生文件与变更历史

近7日信号 1