诊断大视觉语言模型在密集场景中同类别属性错绑问题,提出细粒度归因诊断方法
近7日信号 1 条
揭示LLM驱动具身智能体中‘状态语义注入’新型攻击面,即恶意操控内部状态导致执行越界
近7日信号 1 条
提出受管双时间轴知识图谱存储Quipu,支持代理写入、治理策略与多时间维度版本控制
近7日信号 1 条
提出GEO-Flag方法检测与量化生成引擎优化(GEO)网页内容,应对搜索引擎结果操纵风险
近7日信号 1 条
构建首个面向视频世界模型物理随机动力学校准的细粒度基准CaliBench,聚焦aleatoric不确定性评估
近7日信号 1 条
将策略迭代引入上下文学习,使固定模型能通过人类反馈在推理时动态优化行为, bridging RLHF与ICL
近7日信号 1 条
发现并命名‘模型催眠’现象——微弱提示信号叠加可强控AI行为,揭示大模型鲁棒性新攻击面
近7日信号 1 条
提出分层动作流(HAF)与谱隐式RL方法,将通用视觉语言动作模型适配至人形机器人全身运动操作任务
近7日信号 1 条
提出Proteus架构,通过增量式记忆激活机制缓解长上下文建模中静态记忆瓶颈,提升序列建模效率与适应性
近7日信号 1 条
首次系统审计合规检测器(激活探针与守卫模型)实际读取内容,揭示其在数据保护、医疗、金融等监管场景中的失效风险
近7日信号 1 条
面向去中心化借贷的链上现金流重建框架,解决无信用局场景下的链上信贷风控问题
近7日信号 1 条
研究生成文本能否携带可检测的因果内部状态证据,推动语言模型可验证计算溯源
近7日信号 1 条
提出全自动符号回归系统AutoSR,通过搜索持续性科学研究状态而非孤立方程来实现数据高效建模
近7日信号 1 条
提出基于智能体子任务探索与转换感知记忆的长视野机器人操作框架,提升多阶段接触密集型任务成功率
近7日信号 1 条
浙大IJCAI论文揭示视觉语言模型微调中的图像-文本编码器非对称性问题
近7日信号 1 条
菲尔兹奖得主分析AI当前数学突破主要依赖构造反例验证猜想
近7日信号 1 条
首份AI科学家综述论文,系统梳理其假设生成、实验设计、结果解读与信念修正全生命周期能力演进
近7日信号 1 条
揭示Power Sampling在推理增强中的失效机理,并提出通用修复方案
近7日信号 1 条
提出optstop贝叶斯自适应终止框架,实现LLM评估精度驱动的动态采样预算分配
近7日信号 1 条
从数学建模角度系统分析AI研发自反馈循环触发智能爆炸的条件与动力学特征
近7日信号 1 条
提出统一路径空间视角,整合扩散模型强化学习算法碎片,支持人类偏好与任务奖励对齐
近7日信号 1 条
提出PACE-Bench基准,首次评估智能体在动态环境变化下的物理适应与代码演化能力
近7日信号 1 条
提出Wyvern智能体框架,专为生成事实锚定的多模态报告而设计,解决生成内容信息失焦问题
近7日信号 1 条
提出分层关系图框架SheetCompass,赋能智能体对真实工作表中隐式跨表关联进行推理
近7日信号 1 条
提出单次前向即实现回答与拒答协同决策的新机制,解决冻结大模型证据利用不足与幻觉问题
近7日信号 1 条
提出基于线性规划的神经架构搜索方法LP-NAS,在保证搜索效率的同时提升架构泛化性
近7日信号 1 条
面向城市移动场景提出基于风险感知合成包络的物理AI安全框架,连接系统性危害分析与运行时强制执行
近7日信号 1 条
提出测试时数字孪生(Twin)系统,使编码智能体能动态生成可执行世界模型应对未知任务
近7日信号 1 条
首次将Muon优化器适配至LoRA等低秩微调范式,拓展高效微调方法论边界
近7日信号 1 条
提出跨训练阶段GPU空间共享技术Rollplex,显著加速视觉语言模型强化学习后训练
近7日信号 1 条