面向人类世的地球系统耦合基础模型,统一物理地球与社会观测表征
近7日信号 1 条
匹配作者重写基准数据集,用于评估AI文本检测器在改写场景下的鲁棒性
近7日信号 1 条
面向数学问题求解的智能体工具流验证方法,提升LLM自我纠错可靠性
近7日信号 1 条
基于偏好反馈的多目标强化学习对齐框架,平衡性能与效率等竞争性目标
近7日信号 1 条
结合多目标优化与工具增强的符号回归框架,提升科学方程发现可靠性
近7日信号 1 条
面向《龙与地下城》战斗场景的规则密集型战术推理基准
近7日信号 1 条
针对KV缓存压缩中信息丢失问题,提出被忽略注意力贡献重建方法
近7日信号 1 条
提出自动化任务序列编排方法,缓解多策略LLM微调中的适配干扰问题
近7日信号 1 条
首个评估人类与多模态大模型对二人熟识度推断能力的基准
近7日信号 1 条
查询自适应的鲁棒向量搜索策略,解决固定参数导致的性能波动问题
近7日信号 1 条
面向视觉-语言-动作强化学习的世界批评模型,提升机器人操作泛化能力
近7日信号 1 条
首个将LLM智能体作为序列化超参优化器进行评测的基准
近7日信号 1 条
面向企业文档结构化抽取的任务基准,强调模式引导与证据溯源
近7日信号 1 条
面向智能体LLM服务的精确状态化分词方法,解决重复分词开销问题
近7日信号 1 条
前OpenAI CTO Mira Murati创立的AI实验室
「Mira Murati新创AI实验室以‘高效推理’为旗帜发布Inkling-Small,虽未开源训练代码与推理栈,但开放权重+MoE架构释放中小团队微调与垂直部署机会;当前更适合作为技术风向标而非可复刻创业模板。」
近7日信号 2 条
Thinking Machines发布的轻量级开源推理模型,体积小于Inkling三分之一但性能更强
近7日信号 2 条
基于U-Net、Grounding DINO、SAM和Mask R-CNN构建的高分辨率航拍影像建筑轮廓提取完整流程
近7日信号 1 条
接管维克托·M·布兰科望远镜并自主规划观测方向的AI系统,标志“自主天文台”进展
近7日信号 1 条
GPT-5.6 Pro首次尝试即解决数学家长期攻坚的单位距离猜想反例问题
「本质是AI科研能力的里程碑式信号,但非独立产品或创业机会——它验证了大模型在形式化推理上的跃迁,短期价值在于重塑数学研究范式与AI可信度叙事,而非直接变现。」
近7日信号 2 条
Claude生成反例证伪Jacobian猜想,展示大模型数学推理突破
「一场由世界杯中场休息触发的数学圈信任地震,核心看点是AI首次以可验证、可理解、可传播的方式击穿人类顶级数学直觉的权威性,倒逼科研范式与教育体系重构。」
近7日信号 10 条
字节跳动豆包AI手机第二代商用机型,聚焦AI智能体手机入口生态竞争
「豆包手机二代是字节以AI智能体重构移动入口的战略锚点,但生态封闭性与国民应用接入不确定性严重制约第三方复刻空间,当前核心价值在于验证‘AI原生OS+本地智能体’的商业化临界点。」
近7日信号 2 条
指AI生成内容导致人类原创性思维退化、认知能力被算法驯化的现象
近7日信号 1 条
面向软硬件开发的开源AI智能体,自称在软硬件任务上超越现有所有AI智能体
近7日信号 1 条
利用AI加速寻找新型芯片材料(如替代硅的候选物)的前沿研发方向
近7日信号 1 条
关于生成式AI训练数据是否侵犯艺术家版权的全球性法律与伦理争议
近7日信号 1 条
网易游戏《天下》获王祖贤肖像授权,以AI数字分身形式重现经典角色,推动影视IP与AI技术融合
近7日信号 1 条
DeepSeek原生终端AI编程智能体,基于前缀缓存稳定性设计,支持长期运行
近7日信号 1 条
DeepSeek官方本地推理引擎,支持Metal/CUDA/ROCm,适配DeepSeek-V4-Flash等模型
近7日信号 1 条
开源CLI工具,赋予AI智能体跨平台(Twitter/Reddit/YouTube/GitHub/Bilibili/小红书)实时读取与搜索能力,零API费用
近7日信号 1 条
Meta为AI智能体设计的记忆辅助代理,通过结构化记忆库防止主代理在长任务中重复错误
近7日信号 1 条