AI商业灯塔
论文Beyond Trial-and-Error: Agentic Optimization for Image-to-Video Adherence

提出基于智能体的图像到视频一致性优化框架,解决黑盒I2V模型在专业工作流中缺乏细粒度控制与可靠性的核心瓶颈

近7日信号 1

论文A Framework for Designing Reward Functions: From Objectives to Features to Human-Aligned Reward Functions

面向非专家的奖励函数形式化设计流程,支持从自然语言任务描述生成符合人类偏好排序的对齐奖励函数

近7日信号 1

论文Constructing Dynamic Master Logic Models as Knowledge Graphs for Complex System Diagnostics

利用检索增强大模型自动构建动态主逻辑(DML)知识图谱,将专家经验转化为可推理的系统诊断结构化知识表示

近7日信号 1

论文AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses

提出测试时强模型到弱模型能力迁移新范式,通过Harness机制实现无需参数更新的零样本蒸馏,突破传统训练时蒸馏局限

近7日信号 1

论文DreamFly: Causal Memory and Receding-Horizon Diffusion Planning for Aerial Vision-Language Navigation

面向空中视觉-语言导航的具身智能体框架,融合因果记忆与滚动时域扩散规划,在部分可观测环境下实现长程视觉导航

近7日信号 1

论文AVA-Encoder: Towards Agent-Native Video Representation Learning

面向具身智能体的原生视频表征学习框架,旨在提升AI代理从高质量影视内容中学习并生成电影级视频的能力

近7日信号 1

论文Stealing Reasoning Traces from Proprietary LLM APIs

揭示如何低成本蒸馏闭源模型推理过程的论文

近7日信号 2

论文Mapping and Measuring the Behavioral Evolution of Large Language Models

构建32个大语言模型的行为演化图谱,首次系统刻画模型代际行为变迁与家族关联

近7日信号 1

论文SCOUT: Symmetric Consensus Outlier Detection for Failure Localization in LLM Pre-Training

针对大模型预训练故障定位提出的对称共识异常检测方法,解决同步传播导致的故障根源模糊问题

近7日信号 1

论文ReRound: Reconstructive Rounding to Resolve Midpoint Ambiguity in Calibration-Free LLM Quantization

一种无需校准的LLM权重量化后处理方法,通过重构式舍入解决标准舍入在量化区间中点附近的模糊性问题

近7日信号 1

论文SkillZip: Evaluation-Free Skill Compression for Self-Evolving Agents by Discovering Reusable Structure

面向自演化智能体的无评估技能压缩方法,通过发现可复用结构降低技能冗余,支持高效长期进化

近7日信号 1

论文Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

揭示智能体编码中CLAUDE.md文件持续膨胀现象,归因于代理式记忆的灾难性累积而非遗忘

近7日信号 1

论文Actions Speak Louder than Words: Measuring Cross-Lingual Policy Retention in Tool-Using Agents

提出工具调用智能体跨语言策略保留度评估方法,关注动作序列一致性而非最终答案

近7日信号 1

论文Attention-Path Fragility as an Uncertainty Signal in Large Language Models

提出注意力路径脆弱性作为LLM不确定性新信号,通过扰动注意力路径量化预测稳定性

近7日信号 1

论文The Illusion of Cross-Lingual Safety in Low-Resource Languages

揭示多语言大模型安全对齐在低资源语言中的失效现象,挑战英语中心化安全范式

近7日信号 1

论文Scheduling Mixed RL Rollouts Beyond Prefix Locality

面向大语言模型强化学习后训练的混合rollout调度方法,突破前缀局部性限制提升推理效率与泛化性

近7日信号 1

论文MultiModal Code-Switching: Interleaving Visual Objects into Language for Explicit Object-Level Alignment

多模态语码转换新范式,在语言中显式交织视觉对象token,实现细粒度物体级对齐

近7日信号 1

论文From Interpretability to Control: Insights from Six Years of the TrustNLP Workshop

基于TrustNLP研讨会六年演进的综述,标志可信赖NLP从后验可解释性迈向可控性与干预能力

近7日信号 1

论文How to Verify Consistency of Probabilistic Claims

提出多项式时间可验证的概率性断言自洽性检验方法,支撑AI安全中‘诚实性’形式化验证

近7日信号 1

论文Test-Time Self-Evolving GUI Visual Grounding via Reflection-Guided On-Policy Self-Distillation

面向GUI智能体的测试时自演化视觉定位方法,通过反思引导的在线策略自蒸馏实现零样本界面适应

近7日信号 1

论文Long-Horizon AI Research for Grothendieck Constant

人类-AI协作数学研究案例,聚焦格罗滕迪克常数上界改进,探索AI在长期数学推理中的有效范式

近7日信号 1

论文ConVAWG: A Retrieval-Grounded Framework for Controlled Synthetic Dialogue Generation in Violence Against Women and Girls

面向针对妇女和女童暴力(VAWG)领域的可控合成对话生成框架,基于检索增强保障真实性与安全性

近7日信号 1

论文Surgical WAM: A World-Action Model for Data-Efficient Surgical Robot Learning

面向外科手术机器人的世界-动作模型,解决手术操作数据稀缺瓶颈

近7日信号 1

论文Previous-Token Prediction

IIT Bombay与Adobe Research提出的逆向语言模型,可近乎完美地从LLM输出中重构原始提示

近7日信号 1

论文Riemann Hypothesis Progress via Anthropic Models

Anthropic模型在黎曼猜想这一数学难题上取得突破性进展

近7日信号 2

论文Distill Skills into Weights, Not Prompts: Abstract Skills as Privileged Signals for On-Policy Self-Distillation

提出技能蒸馏新范式SKALD,将抽象技能作为特权信号注入权重而非提示词,提升策略自蒸馏效果

近7日信号 1

论文Multi-Agent AI Safety as an Institutional Design Problem

将多智能体安全问题重构为制度设计问题,分析任务委托、信息流动与资源共享规则对集体行为的影响

近7日信号 1

论文Mismatch Matters: On-Policy Distillation Beyond Token Agreement

揭示监督蒸馏中‘退化一致’陷阱,提出超越token匹配的策略蒸馏新准则

近7日信号 1

论文CEAA: A Cognitive Embodied Agents Architecture for Interactive Computing Systems

提出认知具身智能体架构CEAA,支持实时交互虚拟环境中的认知能力建模

近7日信号 1

论文RynnValue: Scaling Robotic Value Foundation Models with Temporal Distance

RynnValue通过时序距离建模,从异构大数据中规模化学习通用机器人价值基础模型

近7日信号 1