受认知异质性启发的测试时推理框架,提升LLM长程规划与迭代纠错能力
近7日信号 1 条
提出可验证激活解释的可解码性监督方法,解决自然语言自动编码器解释忠实性评估缺陷
近7日信号 1 条
探索基于VR与强化学习的微型人形机器人遥操作-定位-操控一体化框架
近7日信号 1 条
面向临床检测流程的HIPAA合规AI增强型实验室信息管理系统架构,实现端到端生物标志物检测工作流优化
近7日信号 1 条
提出融合物理信息的Petrov-Galerkin框架Kolmogorov-Arnold网络,用于高效求解正反向偏微分方程,克服MLP谱偏差缺陷
近7日信号 1 条
机器人灵巧操作方案提供商,专注工业制造与精密装配场景,研发高自由度灵巧手及视触觉闭环系统
近7日信号 1 条
基于工业世界模型与大模型封装的硬件工程设计研发智能体平台,支持3D方案与2D图纸智能生成
近7日信号 1 条
工业AI设计研发解决方案供应商,自研工业世界模型与自然语言大模型,推出‘则形AI’智能体平台
近7日信号 1 条
开源集体智能引擎,支持数万个AI模型通过多种协调策略协同工作,提升可靠性、可审计性与鲁棒性
近7日信号 1 条
美图发起1亿元AI影像生成技术竞赛,面向全行业征集创新方案
近7日信号 1 条
思科发布的两个轻量开源网络安全模型,单位成本漏洞检出率超大模型150倍
近7日信号 1 条
Substack平台新增AI内容检测工具,支持对文章、笔记及评论进行AI生成概率评估
「不是AI检测技术本身的价值闪光点,而是Substack借该功能将‘人类作者信用’产品化、货币化的关键一步。」
近7日信号 2 条
Google DeepMind最快速、最具成本效益的Gemini 3系列模型
「Gemini 3.1 Flash-Lite不是创业机会,而是对中国AI基建能力的一次压力测试:它迫使国产云厂商必须在3个月内交出同等性价比的‘中文友好型轻量Agent引擎’,否则将加速客户向GCP迁移。」
近7日信号 6 条
为AI智能体构建原生支付基础设施的初创公司,获3000万美元A轮融资
近7日信号 1 条
对AI代码生成能力快速标准化与同质化趋势的深度分析,指出差异正上移至问题定义与系统设计层
近7日信号 1 条
专注AI时代端点安全的新一代网络安全公司,应对AI代理与开发者工具带来的新型企业风险
近7日信号 1 条
中国领先的智能机器人公司,专注协作机器人及AI驱动的具身智能解决方案
近7日信号 1 条
提出基于在线策略蒸馏扩散草稿器的自适应推测解码方法,提升LLM推理效率
近7日信号 1 条
首个面向多方会议场景的多模态大模型心智理论评测基准
近7日信号 1 条
提出推理时引导方法缓解大模型跨语言事实不一致性问题
近7日信号 1 条
首次系统性实证研究提示工程三大核心决策(格式/指令数/上下文长度)对模型遵从性与幻觉的影响
近7日信号 1 条
面向财务报表舞弊检测的泛化性评测基准,聚焦鲁棒评估与新任务设计
近7日信号 1 条
融合图特征、模型可解释性与智能体案例调查的可审计欺诈检测分层流水线
近7日信号 1 条
揭示可信CI/CD智能体流水线在权威框架下被外部输入污染后成为攻击面的风险
近7日信号 1 条
指出当前AI安全监测忽视隐性高危故障,呼吁关注部署系统中未被量化的安全挑战
近7日信号 1 条
LangGraph在长时态业务流程中的图式工作流实践指南,聚焦状态保持与多步生成
近7日信号 1 条
面向无人机实时自主飞行的符号距离函数建图与加速运动规划一体化方法
近7日信号 1 条
提出Off-Context GRPO方法,利用特权信息提升困难问题上的推理学习信号
近7日信号 1 条
面向机制可解释性的电路发现、评估与应用工具包,支持模型剪枝、编辑与定向微调
近7日信号 1 条
构建自动化AI研发安全评估框架,用于检测不可信AI代理输出的安全风险
近7日信号 1 条