AI商业灯塔
论文Atlas: A World Model for Spatial Intelligence62

Anthropic提出的面向空间智能的世界模型,支持具身智能体的环境建模与推理

Atlas是首个在ECCV 2026引爆产业共识的多模态空间世界模型,虽无API/SDK开放,但已成硬科技融资新锚点与物理AI基础设施叙事核心。

近7日信号 20

论文Mathematicians' Open Letter on AI Threats to Intellectual Work35

25位顶尖数学家联署公开信,警示AI实验室正威胁数学研究的原创性与可信性

一场高声量、低落地的学术伦理倡议,核心价值在于激活数学/STEM圈层对AI滥用的警觉性,但无产品接口、无技术方案、无商业化路径。

近7日信号 7

论文Pace the Frontier55

Anthropic CEO提出的AI发展减速与安全治理框架倡议

不是技术产品而是政策杠杆,核心看点在于它正将AI安全从技术讨论升级为全球监管议程,为中国AI治理服务商创造首个制度性窗口期。

近7日信号 5

论文Navier-Stokes Solver for Millennium Problem54

OpenAI宣称解决纳维-斯托克斯千禧年难题的AI求解器研究

OpenAI此举本质是向全球科学共同体发射一枚可信度信标,核心看点不在求解本身,而在其验证了AI驱动‘假设-证明-实验’科研闭环的可行性。

近7日信号 7

论文Inverse Self-Supervision for 3D Spatial Intelligence

TUM Angela Dai教授提出逆向自监督范式,利用物理机制构建3D空间智能结构先验

近7日信号 2

论文Show-o: Unified Autoregressive and Discrete Diffusion for Embodied AI

NUS Show Lab提出融合自回归与离散扩散的单Transformer具身大模型底座,发表于ECCV 2026

近7日信号 2

论文A Severe Misalignment in Mathematics56

探讨AI在数学研究中因目标错位导致的严重对齐失败案例

这不是一篇技术论文,而是一份面向中国科研基础设施升级的‘对齐风险预警地图’,核心看点在于它正在倒逼AI4S从‘效率革命’转向‘范式可信度建设’。

近7日信号 3

论文Looped Transformers and Hidden Reasoning

探讨循环式Transformer架构与隐式推理机制的前沿研究

近7日信号 3

论文An Alien Mind

OpenAI首席科学家撰文警示AI逼近递归自我改进临界点,呼吁系统性风险管控

近7日信号 2

论文The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement

提出Headroom-Closed Index(HCI)指标,系统分析当前AI系统实现真正递归自我改进的瓶颈与路径

近7日信号 2

论文WHALE: Harness-Weighted Agent Learning

提出Harness作为Agent执行层核心组件,强调模型权重与运行时框架共同构成完整Agent

近7日信号 1

论文AI-driven materials discovery workflow

arXiv预印本论文,提出AI闭环指导材料合成首次即成功的新范式

近7日信号 1

论文Looped Transformers and Hidden Reasoning

提出递归循环Transformer(RLT)架构,通过跨token传递decoder状态实现无界时序深度

近7日信号 1

论文Dramatic insider warnings over AI fall flat with some in Silicon Valley

探讨AI领域内部人士对系统性风险的警示在科技圈内未获足够重视的现象

近7日信号 1

论文It's Not RoPE that Creates Sinks: The Role of Self-Concentration and Value-Non-Mixing in Attention

揭示注意力Sink现象主因是自集中与值非混合,而非RoPE位置编码

近7日信号 2

论文Reasoning Steps Separability in LLM Internal States

新研究发现模型推理步骤(计算、公式检索、演绎)在中间层内部状态中具有清晰可分性,对AI安全意义重大

近7日信号 1

论文Physics-Based Multimodal Fusion

吴佳俊团队在ECCV 2026提出的基于物理统一性的多模态融合新范式

近7日信号 1

论文The widening evaluation gap in medical large language model research 2023 to 2026

揭示2023–2026年医学大模型研究中模型迭代速度与临床验证周期之间的显著评估鸿沟

近7日信号 1

论文SpecGuard: Inference-Time Backdoor Detection For Free

提出无需额外训练的推理时大模型后门检测方法SpecGuard

近7日信号 1

论文Logit Refiner: Improving Visual Autoregressive Models via Intra-Scale Dependency Modeling

提出Intra-Scale Dependency建模方法,改进视觉自回归模型(VAR)的并行解码缺陷

近7日信号 1

论文From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge

通过层间干预实证揭示Qwen/Llama/GPT等主流模型知识调用的动态分层机制

近7日信号 1

论文RetroThinker: Enabling Retrospective Thinking in Speech LLMs

首次为语音大模型引入回溯式思考机制,在语音LLM中实现类似文本LLM的反思能力

近7日信号 1

论文Domain-Specific Hallucination Detection in Large Language Models

提出多信号融合的领域特异性幻觉检测流水线,在医疗、金融等高风险领域显著提升检测精度

近7日信号 1

论文Nuha-Speech: Building General-Purpose Arabic Speech-LLMs

首个通用阿拉伯语语音大模型基础设施,填补多语言语音LLM关键语种空白

近7日信号 1

论文CausalArena: Benchmarking Causal Discovery in the Foundation Model Era

首个面向大模型时代的因果发现评测基准,支持结构因果模型与真实世界数据联合评估

近7日信号 1

论文MindTopo: Can Foundation Models Reason in Topological Space?

探究大模型在拓扑空间(非度量)中的推理能力,为几何泛化提供新基准

近7日信号 1

论文Artificial Id: Drive and Persistent Alignment in Agentic AI

提出'人工ID'概念,探讨具身智能体在跨任务持续运行中的目标一致性与对齐机制

近7日信号 1

论文Generative Marketing Mix Modeling (GMMM)

提出生成式营销组合建模框架,链接GEO/GEM数据与业务影响的因果推断方法

近7日信号 1

论文Can Edge-Deployable Vision-Language Models Identify Species?

首次系统评估边缘部署型视觉语言模型在野外相机陷阱场景下的物种识别能力

近7日信号 1

论文Diffusion TV: Experiencing Diffusion Models through Tangible, Embodied Interaction

通过改装CRT电视实现对扩散模型的具身交互式体验,用户可物理调节天线控制AI生成图像清晰度

近7日信号 2