AI商业灯塔
论文Differentiable Logic Gate Networks for EEG Classification

面向边缘设备的可微分逻辑门网络,实现低延迟脑电信号分类

近7日信号 1

论文TRIM: Reducing AI-Generated CodeSlop

通过最小化智能体轨迹减少AI生成代码冗余(CodeSlop)

近7日信号 1

论文FlashRT

面向实时多模态应用的智能体调度框架,优化异构模型流水线部署

近7日信号 1

论文Learning Adaptive Safety Margins for Visual Navigation

为视觉导航机器人提出自适应安全边距学习方法,解决室内避障校准难题

近7日信号 1

论文SWE-Pruner Pro

提出编码大模型自带上下文剪枝能力,无需额外分类器

近7日信号 1

论文VEHBench

首个面向振动能量收集器设计的LLM辅助工程诊断基准

近7日信号 1

论文Patch Policy: Efficient Embodied Control via Dense Visual Representations

提出基于ViT密集视觉表征的具身控制策略,提升机器人学习效率

近7日信号 1

论文Model Collapse

Nature封面研究揭示AI模型在封闭数据循环中退化的系统性现象

近7日信号 1

论文One Token Is Enough

布拉格经济大学提出的基于单Token随机性测试鉴别套壳大模型的方法论论文

近7日信号 1

论文LLM-Powered Agentic AI for 5G/6G Networks: A Tutorial and Survey on Architectures, Protocols, and Standardization

首份面向5G/6G网络的LLM智能体AI综述,覆盖架构、协议与标准化进展

近7日信号 1

论文Frontier Language Models Struggle to Copy: Text Can Be Better Viewed in 2D

揭示前沿大模型在字符串精确复制任务上的系统性失败,提出二维文本表征新视角

近7日信号 1

论文JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models

提出JoyNexus框架,支持视觉-语言-动作(VLA)模型的多租户、服务导向型后训练

近7日信号 1

论文The Honest Quorum Problem: Epistemic Byzantine Fault Tolerance for Agentic Infrastructure

提出面向智能体基础设施的“诚实法定人数”问题,定义认知拜占庭容错新范式

近7日信号 1

论文CRAFT: Clustering Rubrics to Diagnose Weak LLM Capabilities and Generate Targeted Fine-Tuning Data

提出CRAFT框架,通过聚类评测标准诊断LLM能力短板并生成定向微调数据

近7日信号 1

论文A Methodology for Auditable Trustworthiness Levels in AI Lifecycle Governance

提出可审计的AI可信度等级方法论,用于全生命周期治理中的透明化、可争议性评估

近7日信号 1

论文Harmonizing AI Safety Thresholds

呼吁建立统一前沿AI安全能力阈值标准以提升可验证性与可比性

近7日信号 1

论文PagedWeight: Efficient MoE LLM Serving with Dynamic Quality-Aware Weight Quantization

提出动态质量感知权重量化方法以提升MoE大模型服务效率

近7日信号 1

论文J-space: Latent Subspace in Claude Models

Anthropic提出的Claude大模型内部潜意识推理空间理论,尚未正式发表但引发行业关注

近7日信号 1

论文VLA Models Are More Generalizable Than...

CVPR 2026冠军论文,指出空间表征瓶颈是VLA泛化关键,仅需4K参数校准即可显著提升

近7日信号 1

论文Grokipedia vs Wikipedia: An LLM-Based Audit of Political Neutrality along Ideologies

基于Grok构建的Grokipedia与维基百科的政治中立性跨意识形态对比审计

近7日信号 1

论文Scaling Behavior Foundation Model for Humanoid Robots

面向人形机器人控制的行为基础模型缩放研究,支撑具身通用智能体发展

近7日信号 1

论文The Industrialization of Research: On AI-Driven Science and Its Consequences

探讨AI作为自主科研参与者引发的科研工业化变革及其社会影响

近7日信号 1

论文MedFailBench: A Clinician-Built Open-Source Benchmark for Medical AI Safety Boundary Inspection

由临床医生构建的开源医疗AI安全边界检验基准,按严重性标注失效类型

近7日信号 1

论文Benchmarking Multimodal Large Language Models for Scientific Visualization Literacy

首个面向科学可视化理解能力的MLLM评测基准,超越图表识别,聚焦SciVis素养评估

近7日信号 1

论文Plover: Steering GUI Agents through Plan-Centric Interaction

提出以计划为中心的交互范式,提升GUI智能体在动态界面环境中的意图对齐能力

近7日信号 1

论文BadWAM: When World-Action Models Dream Right but Act Wrong

指出世界-动作模型(WAM)存在‘预测正确但执行错误’的根本缺陷,揭示其耦合表征的内在风险

近7日信号 1

论文Expanding the Lexicon of Ge'ez Based African Languages: A Comparative Study of Amharic and Tigrinya

针对吉兹字母系非洲语言(阿姆哈拉语/提格里尼亚语)开展分词器优化研究,显著降低 OOV 率与子词碎片化

近7日信号 1

论文When Words Are Safe But Actions Kill: Probing Physical Danger Beyond Text Safety in Hidden-State Risk Space

首次系统探测 LLM 作为具身规划器时的语言安全与物理危险解耦现象,定义隐状态风险空间评估范式

近7日信号 1

论文In-Place Tokenizer Expansion for Pre-trained LLMs

提出原位分词器扩展方法,无需重训练即可动态适配新语言与部署需求,缓解低资源语言 OOV 问题

近7日信号 1

论文AutoSynthesis: An agentic system for automated meta-analysis

提出 AutoSynthesis 系统,首个基于多智能体协同的全自动元分析框架,用于医学与政策领域证据合成

近7日信号 1