AI商业灯塔
论文TerraNova: A Foundation Model for the Anthropocene

面向人类世的地球系统耦合基础模型,统一物理地球与社会观测表征

近7日信号 1

论文ARB: A Matched Authorship-Rewriting Benchmark Dataset for AI-Text Detector Evaluation

匹配作者重写基准数据集,用于评估AI文本检测器在改写场景下的鲁棒性

近7日信号 1

论文AMTFV: Agentic Mathematical Tool-Flow Verification for LLM Self-Correction

面向数学问题求解的智能体工具流验证方法,提升LLM自我纠错可靠性

近7日信号 1

论文LEMUR: Learning to Align with Multi-Objective Reinforcement Learning from Preference Feedback

基于偏好反馈的多目标强化学习对齐框架,平衡性能与效率等竞争性目标

近7日信号 1

论文MOT-SR: Multi-Objective Tool-Augmented Scientific Equation Discovery with Large Language Models

结合多目标优化与工具增强的符号回归框架,提升科学方程发现可靠性

近7日信号 1

论文DungeonBench: A Benchmark for Rules-Rich Tactical Reasoning in Dungeons & Dragons Combat

面向《龙与地下城》战斗场景的规则密集型战术推理基准

近7日信号 1

论文ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression

针对KV缓存压缩中信息丢失问题,提出被忽略注意力贡献重建方法

近7日信号 1

论文The Parts Are Greater Than the Sum: Automated Task Sequencing for Efficient Training of Multi-Policy LLMs

提出自动化任务序列编排方法,缓解多策略LLM微调中的适配干扰问题

近7日信号 1

论文FriendBench: Benchmarking Dyadic Familiarity Inference in Humans and Multimodal Large Language Models

首个评估人类与多模态大模型对二人熟识度推断能力的基准

近7日信号 1

论文QASP: Query-Adaptive Robust Vector Search Policy

查询自适应的鲁棒向量搜索策略,解决固定参数导致的性能波动问题

近7日信号 1

论文WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning

面向视觉-语言-动作强化学习的世界批评模型,提升机器人操作泛化能力

近7日信号 1

论文AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimizers

首个将LLM智能体作为序列化超参优化器进行评测的基准

近7日信号 1

论文ExtractBench: A Benchmark for Schema-Guided Enterprise Document Extraction

面向企业文档结构化抽取的任务基准,强调模式引导与证据溯源

近7日信号 1

论文TokTier: Exact Stateful Tokenization for Agentic LLM Serving

面向智能体LLM服务的精确状态化分词方法,解决重复分词开销问题

近7日信号 1

公司Thinking Machines48

前OpenAI CTO Mira Murati创立的AI实验室

Mira Murati新创AI实验室以‘高效推理’为旗帜发布Inkling-Small,虽未开源训练代码与推理栈,但开放权重+MoE架构释放中小团队微调与垂直部署机会;当前更适合作为技术风向标而非可复刻创业模板。

近7日信号 2

模型Inkling Small

Thinking Machines发布的轻量级开源推理模型,体积小于Inkling三分之一但性能更强

近7日信号 2

产品GeoAI建筑轮廓提取工作流

基于U-Net、Grounding DINO、SAM和Mask R-CNN构建的高分辨率航拍影像建筑轮廓提取完整流程

近7日信号 1

产品AI望远镜调度系统

接管维克托·M·布兰科望远镜并自主规划观测方向的AI系统,标志“自主天文台”进展

近7日信号 1

论文Unit Distance Conjecture refutation by GPT-5.6 Pro28

GPT-5.6 Pro首次尝试即解决数学家长期攻坚的单位距离猜想反例问题

本质是AI科研能力的里程碑式信号,但非独立产品或创业机会——它验证了大模型在形式化推理上的跃迁,短期价值在于重塑数学研究范式与AI可信度叙事,而非直接变现。

近7日信号 2

论文Claude Fable counterexample to Jacobian Conjecture36

Claude生成反例证伪Jacobian猜想,展示大模型数学推理突破

一场由世界杯中场休息触发的数学圈信任地震,核心看点是AI首次以可验证、可理解、可传播的方式击穿人类顶级数学直觉的权威性,倒逼科研范式与教育体系重构。

近7日信号 10

产品豆包手机二代 NaviX Ultra51

字节跳动豆包AI手机第二代商用机型,聚焦AI智能体手机入口生态竞争

豆包手机二代是字节以AI智能体重构移动入口的战略锚点,但生态封闭性与国民应用接入不确定性严重制约第三方复刻空间,当前核心价值在于验证‘AI原生OS+本地智能体’的商业化临界点。

近7日信号 2

产品AI知识转基因危机

指AI生成内容导致人类原创性思维退化、认知能力被算法驯化的现象

近7日信号 1

产品Sprocket

面向软硬件开发的开源AI智能体,自称在软硬件任务上超越现有所有AI智能体

近7日信号 1

产品AI驱动的半导体材料发现

利用AI加速寻找新型芯片材料(如替代硅的候选物)的前沿研发方向

近7日信号 1

产品AI艺术版权争议

关于生成式AI训练数据是否侵犯艺术家版权的全球性法律与伦理争议

近7日信号 1

产品网易《天下》AI数字分身项目

网易游戏《天下》获王祖贤肖像授权,以AI数字分身形式重现经典角色,推动影视IP与AI技术融合

近7日信号 1

开源DeepSeek-Reasonix

DeepSeek原生终端AI编程智能体,基于前缀缓存稳定性设计,支持长期运行

近7日信号 1

开源ds4

DeepSeek官方本地推理引擎,支持Metal/CUDA/ROCm,适配DeepSeek-V4-Flash等模型

近7日信号 1

开源Agent-Reach

开源CLI工具,赋予AI智能体跨平台(Twitter/Reddit/YouTube/GitHub/Bilibili/小红书)实时读取与搜索能力,零API费用

近7日信号 1

产品Meta AI Memory Coach

Meta为AI智能体设计的记忆辅助代理,通过结构化记忆库防止主代理在长任务中重复错误

近7日信号 1