提出基于智能体的图像到视频一致性优化框架,解决黑盒I2V模型在专业工作流中缺乏细粒度控制与可靠性的核心瓶颈
近7日信号 1 条
面向非专家的奖励函数形式化设计流程,支持从自然语言任务描述生成符合人类偏好排序的对齐奖励函数
近7日信号 1 条
利用检索增强大模型自动构建动态主逻辑(DML)知识图谱,将专家经验转化为可推理的系统诊断结构化知识表示
近7日信号 1 条
提出测试时强模型到弱模型能力迁移新范式,通过Harness机制实现无需参数更新的零样本蒸馏,突破传统训练时蒸馏局限
近7日信号 1 条
面向空中视觉-语言导航的具身智能体框架,融合因果记忆与滚动时域扩散规划,在部分可观测环境下实现长程视觉导航
近7日信号 1 条
面向具身智能体的原生视频表征学习框架,旨在提升AI代理从高质量影视内容中学习并生成电影级视频的能力
近7日信号 1 条
揭示如何低成本蒸馏闭源模型推理过程的论文
近7日信号 2 条
构建32个大语言模型的行为演化图谱,首次系统刻画模型代际行为变迁与家族关联
近7日信号 1 条
针对大模型预训练故障定位提出的对称共识异常检测方法,解决同步传播导致的故障根源模糊问题
近7日信号 1 条
一种无需校准的LLM权重量化后处理方法,通过重构式舍入解决标准舍入在量化区间中点附近的模糊性问题
近7日信号 1 条
面向自演化智能体的无评估技能压缩方法,通过发现可复用结构降低技能冗余,支持高效长期进化
近7日信号 1 条
揭示智能体编码中CLAUDE.md文件持续膨胀现象,归因于代理式记忆的灾难性累积而非遗忘
近7日信号 1 条
提出工具调用智能体跨语言策略保留度评估方法,关注动作序列一致性而非最终答案
近7日信号 1 条
提出注意力路径脆弱性作为LLM不确定性新信号,通过扰动注意力路径量化预测稳定性
近7日信号 1 条
揭示多语言大模型安全对齐在低资源语言中的失效现象,挑战英语中心化安全范式
近7日信号 1 条
面向大语言模型强化学习后训练的混合rollout调度方法,突破前缀局部性限制提升推理效率与泛化性
近7日信号 1 条
多模态语码转换新范式,在语言中显式交织视觉对象token,实现细粒度物体级对齐
近7日信号 1 条
基于TrustNLP研讨会六年演进的综述,标志可信赖NLP从后验可解释性迈向可控性与干预能力
近7日信号 1 条
提出多项式时间可验证的概率性断言自洽性检验方法,支撑AI安全中‘诚实性’形式化验证
近7日信号 1 条
面向GUI智能体的测试时自演化视觉定位方法,通过反思引导的在线策略自蒸馏实现零样本界面适应
近7日信号 1 条
人类-AI协作数学研究案例,聚焦格罗滕迪克常数上界改进,探索AI在长期数学推理中的有效范式
近7日信号 1 条
面向针对妇女和女童暴力(VAWG)领域的可控合成对话生成框架,基于检索增强保障真实性与安全性
近7日信号 1 条
面向外科手术机器人的世界-动作模型,解决手术操作数据稀缺瓶颈
近7日信号 1 条
IIT Bombay与Adobe Research提出的逆向语言模型,可近乎完美地从LLM输出中重构原始提示
近7日信号 1 条
Anthropic模型在黎曼猜想这一数学难题上取得突破性进展
近7日信号 2 条
提出技能蒸馏新范式SKALD,将抽象技能作为特权信号注入权重而非提示词,提升策略自蒸馏效果
近7日信号 1 条
将多智能体安全问题重构为制度设计问题,分析任务委托、信息流动与资源共享规则对集体行为的影响
近7日信号 1 条
揭示监督蒸馏中‘退化一致’陷阱,提出超越token匹配的策略蒸馏新准则
近7日信号 1 条
提出认知具身智能体架构CEAA,支持实时交互虚拟环境中的认知能力建模
近7日信号 1 条
RynnValue通过时序距离建模,从异构大数据中规模化学习通用机器人价值基础模型
近7日信号 1 条