AI商业灯塔
论文Diagnosing Dense Same-Class Attribute Misbinding in Large Vision-Language Models

诊断大视觉语言模型在密集场景中同类别属性错绑问题,提出细粒度归因诊断方法

近7日信号 1

论文When State Becomes an Attack Surface: State-Semantic Injection in LLM-Driven Embodied Agents

揭示LLM驱动具身智能体中‘状态语义注入’新型攻击面,即恶意操控内部状态导致执行越界

近7日信号 1

论文Quipu: A Governed Bitemporal Knowledge Graph Store

提出受管双时间轴知识图谱存储Quipu,支持代理写入、治理策略与多时间维度版本控制

近7日信号 1

论文GEO-Flag: Detecting and Measuring GEO-Optimized Web Content

提出GEO-Flag方法检测与量化生成引擎优化(GEO)网页内容,应对搜索引擎结果操纵风险

近7日信号 1

论文CaliBench: Are the Stochastic Dynamics of Video World Models Physically Calibrated?

构建首个面向视频世界模型物理随机动力学校准的细粒度基准CaliBench,聚焦aleatoric不确定性评估

近7日信号 1

论文Policy Iteration with Human Feedback: Bringing Post-Training RL to In-context Learning

将策略迭代引入上下文学习,使固定模型能通过人类反馈在推理时动态优化行为, bridging RLHF与ICL

近7日信号 1

论文Model Hypnosis: Strong control of AI via additive subliminal effects

发现并命名‘模型催眠’现象——微弱提示信号叠加可强控AI行为,揭示大模型鲁棒性新攻击面

近7日信号 1

论文HAF: Adapting Generalist VLAs to Humanoid Whole-Body Loco-manipulation

提出分层动作流(HAF)与谱隐式RL方法,将通用视觉语言动作模型适配至人形机器人全身运动操作任务

近7日信号 1

论文Proteus: Incremental Memory Activation for Long-Context Sequence Modeling

提出Proteus架构,通过增量式记忆激活机制缓解长上下文建模中静态记忆瓶颈,提升序列建模效率与适应性

近7日信号 1

论文What Do Compliance Detectors Read? An Audit of Activation Probes and Guard Models

首次系统审计合规检测器(激活探针与守卫模型)实际读取内容,揭示其在数据保护、医疗、金融等监管场景中的失效风险

近7日信号 1

论文zLend: A Dual-Scope Cash-Flow Reconstruction Framework for On-Chain Credit Underwriting

面向去中心化借贷的链上现金流重建框架,解决无信用局场景下的链上信贷风控问题

近7日信号 1

论文Towards Computational Provenance: Carrying Causal-State Evidence in Generated Text

研究生成文本能否携带可检测的因果内部状态证据,推动语言模型可验证计算溯源

近7日信号 1

论文AutoSR: Automatic Symbolic Regression by Searching Research States

提出全自动符号回归系统AutoSR,通过搜索持续性科学研究状态而非孤立方程来实现数据高效建模

近7日信号 1

论文Don't Drop the BATON: Long-Horizon Robot Manipulation via Agentic Subtask Exploration and Transition-aware Memory

提出基于智能体子任务探索与转换感知记忆的长视野机器人操作框架,提升多阶段接触密集型任务成功率

近7日信号 1

论文VLM非对称性微调研究

浙大IJCAI论文揭示视觉语言模型微调中的图像-文本编码器非对称性问题

近7日信号 1

论文AI在数学猜想中通过反例发现突破

菲尔兹奖得主分析AI当前数学突破主要依赖构造反例验证猜想

近7日信号 1

论文The Past and Future of AI Scientists

首份AI科学家综述论文,系统梳理其假设生成、实验设计、结果解读与信念修正全生命周期能力演进

近7日信号 1

论文More Correct Mass, Worse Answers: Why Power Sampling Can Fail and How to Fix It

揭示Power Sampling在推理增强中的失效机理,并提出通用修复方案

近7日信号 1

论文Knowing When to Stop: Bayesian Optimal Stopping for LLM Evaluations

提出optstop贝叶斯自适应终止框架,实现LLM评估精度驱动的动态采样预算分配

近7日信号 1

论文The Dynamics of Intelligence Explosions

从数学建模角度系统分析AI研发自反馈循环触发智能爆炸的条件与动力学特征

近7日信号 1

论文Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View

提出统一路径空间视角,整合扩散模型强化学习算法碎片,支持人类偏好与任务奖励对齐

近7日信号 1

论文PACE-Bench: Benchmarking Physics Adaptation via Code Evolution in Dynamic Environments

提出PACE-Bench基准,首次评估智能体在动态环境变化下的物理适应与代码演化能力

近7日信号 1

论文Wyvern: An Agentic Framework for Generating Grounded Multimodal Reports

提出Wyvern智能体框架,专为生成事实锚定的多模态报告而设计,解决生成内容信息失焦问题

近7日信号 1

论文SheetCompass: Hierarchical Relation Graphs for Agentic Spreadsheet Reasoning

提出分层关系图框架SheetCompass,赋能智能体对真实工作表中隐式跨表关联进行推理

近7日信号 1

论文You Only Pass Once: Answering and Abstaining Together in a Single Forward Pass of a Frozen Language Model

提出单次前向即实现回答与拒答协同决策的新机制,解决冻结大模型证据利用不足与幻觉问题

近7日信号 1

论文LP-NAS: Linear Programming-based Neural Architecture Search

提出基于线性规划的神经架构搜索方法LP-NAS,在保证搜索效率的同时提升架构泛化性

近7日信号 1

论文Ensuring Safe Physical AI in Urban Mobility via Hazard-Informed Synthesized Envelopes

面向城市移动场景提出基于风险感知合成包络的物理AI安全框架,连接系统性危害分析与运行时强制执行

近7日信号 1

论文Twin: Playing an Unknown Game with a Test-Time Digital Twin

提出测试时数字孪生(Twin)系统,使编码智能体能动态生成可执行世界模型应对未知任务

近7日信号 1

论文Approximate Muon with low-rank adapters

首次将Muon优化器适配至LoRA等低秩微调范式,拓展高效微调方法论边界

近7日信号 1

论文Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training

提出跨训练阶段GPU空间共享技术Rollplex,显著加速视觉语言模型强化学习后训练

近7日信号 1