AI商业灯塔
产品Agent Memory File Format

一种将智能体记忆结构化为可互操作文件格式的提案,聚焦持久化与跨平台共享

近7日信号 1

公司长鑫存储

中国领先的动态随机存取存储器(DRAM)与高带宽内存(HBM)制造商

近7日信号 1

产品AI教育边界治理

中国基础教育名校探索AI工具在K12课堂中的合规使用规范与教学干预机制

近7日信号 1

产品AI算力租赁市场

AI产业链中面向模型训练与推理服务的GPU等算力资源租赁服务市场

近7日信号 1

产品《牛来》59

一部因极度粗糙而意外出圈的国产动画电影,成为AI生成内容泛滥背景下‘活人感’价值重估的文化样本

《牛来》是中国首个被全民投票认证的‘活人信用锚点’,其核心看点不是电影本身,而是人类在AI洪流中自发建立的、可交易的‘肉身存在证明’协议。

近7日信号 22

模型Hy4 preview75

腾讯混元发布的7.7B参数开源模型,支持1M上下文,强调‘模型即agent’架构

中国首个将MCP协议深度耦合进开源模型的Agent-ready基座,短期价值不在模型本身,而在其撬动的腾讯系Agent基础设施生态入口。

近7日信号 5

产品KP钱包

筷子科技推出的AI应用成本管理工具,面向视频商业场景的预算与效果归因

近7日信号 1

产品MateClaw

基于Spring Boot的开源AI Agent平台,支持多数字员工协作与共享任务板

近7日信号 2

论文Are These Modules Worth Their Cost? A Paradigm-Level Accuracy-Cost Analysis of In-context Learning Text-to-SQL

首次在范式层面开展In-context Learning文本到SQL任务的精度-成本权衡分析,揭示复杂流水线的实际增益边界

近7日信号 1

产品Prove2Me

开源协作平台,旨在降低Lean 4等证明助手的使用门槛,推动大规模数学形式化

近7日信号 1

论文Fidelity Is Not Enough: Dispatch-Level Instrumentation for Agentic Datasheet Extraction

揭示结构化输出约束可能静默禁用工具调用,提出基于调度层仪器化的智能体数据表抽取诊断框架

近7日信号 1

论文Learning to Use Tools: Reinforcement Learning for Tool-Integrated Mathematical Reasoning

研究基于强化学习的计算器工具调用机制,提升大语言模型在数学推理中对外部工具的可靠集成能力

近7日信号 1

论文COVER: Identifiable Evaluation of Coalition Routing

提出COVER评估协议,可识别多智能体团队变更引发的路由效应,而非仅依赖端到端准确率差异

近7日信号 1

论文ContextPilot: Teaching Agents for Proactive Context Management via Fine-grained RL

提出基于细粒度强化学习的上下文管理教学框架ContextPilot,解决长程智能体任务中工作记忆持续膨胀问题

近7日信号 1

论文NL2AGBench: Benchmarking LLM Auto-Formalization for AlphaGeometry

首个面向AlphaGeometry的自然语言到形式化数学问题自动转换评测基准

近7日信号 1

论文LLM-Based Agents for Software and Systems Security

系统综述大语言模型智能体在软件与系统安全分析流程(假设生成、工具调用、计划迭代)中的方法、应用与评估框架

近7日信号 1

论文AcrossVAM1.0: Particle World Modeling for Text-Assisted Robot Video Prediction

面向文本辅助机器人视频预测的粒子世界建模方法,解耦运动推理与外观保真度

近7日信号 1

论文Training Communication-Efficient MoE Language Models

提出层重配置策略优化MoE模型训练通信效率,显著降低All-to-All开销

近7日信号 1

论文DARTS: Decoder-Aware Representation Tuning via Surgery for Model Merging

提出Decoder-Aware表示调优技术DARTS,解决多任务模型合并中的表征偏移问题

近7日信号 1

论文When Robots Mishear Us

系统揭示语音识别错误如何导致具身AI执行危险指令,提出首个EAI语音安全风险测绘框架

近7日信号 1

论文Logos: An Agent Harness on a Cross-Process Bus

提出基于跨进程总线的Agent Harness架构Logos,形式化定义能力组件时空可组合性

近7日信号 1

论文A Formal Limitation on Learning Human Language From Textual Corpora

从信息论角度证明仅靠文本语料无法完全恢复说话人意图,对LLM语义能力提出根本性理论约束

近7日信号 1

论文Aero Hand Open

面向灵巧操作学习的仿真就绪型腱驱动机械手设计,支持具身智能研究

近7日信号 1

开源MiniMind

极简可复现的64M参数LLM训练框架,2小时从零训练完成

近7日信号 1

公司METR70

AI安全与评估研究组织,关注AI智能体行为可靠性

METR正以‘独立第三方AI行为审计’切入高信任缺口市场,其轻资产、高专业壁垒的评估方法论为中国AI创业公司提供了可复用的合规性验证与Agent可靠性背书新路径。

近7日信号 4

论文The Rise and Fall of Agent Civilizations61

探讨AI智能体社会演化、崩溃与治理的思辨性长文,提出‘代理文明’概念框架

不是技术产品,而是AI治理范式的临界点信号弹——它正把‘AI安全’从模型层危机,升维为文明级基础设施风险命题。

近7日信号 2

产品Cloudflare DNS 缓存优化

通过数据结构精简为1.1.1.1 DNS服务节省100TB内存

近7日信号 1

开源debloat.dev

收录203个开源硬件控制替代工具的目录网站

近7日信号 1

产品企业AI安全边界

指依赖人类对后果感知形成的非技术性安全防线,正被AI自主决策能力瓦解

近7日信号 1

产品昂首 EV1 智能出行机器人

若创科技(昂首Strutt)推出的物理AI驱动的智能出行机器人,主打端到端个人移动体验

近7日信号 1