AI商业灯塔
产品AI岗位压缩指数

衡量AI导致岗位净减少速度的关键社会经济指标,标志AI影响从效率提升进入结构性替代阶段

近7日信号 1

产品AI手搓工具

指用户利用AI低门槛自主构建的个性化生产力工具,反映AI赋能个体开发者的新范式

近7日信号 1

模型世界动作模型 ω-0

北大、南洋理工等联合推出的人形机器人全身协同作业模型

近7日信号 1

产品阿里云模块化AIDC57

全球首个百日交付的全模块化AI数据中心架构

阿里云模块化AIDC的核心看点是:以工业化方式重构AI算力基建交付范式,成为物理AI时代最硬的‘算力地基’标准制定者。

近7日信号 3

产品极壳外骨骼

00后创业者毛榉团队研发的面向徒步场景的轻量化动力外骨骼系统

近7日信号 1

产品知力·纳米科普科幻AI大片创作平台

360科技与《知识就是力量》联合推出的AI驱动科普科幻影视内容生成平台

近7日信号 1

产品ShieldFont

一种旨在污染AI训练数据但不影响人类阅读体验的对抗性字体技术

近7日信号 1

公司Pragmatik Labs

林俊旸创办的AI基础设施公司,获红杉、腾讯投资

近7日信号 2

产品Embabel Agent

面向JVM生态的智能体框架,支持Java/Kotlin等语言构建AI智能体

近7日信号 1

开源LTX-2

Lightricks官方发布的LTX-2音视频生成模型Python推理与LoRA微调包

近7日信号 1

模型LTX-2.574

NVIDIA加速的开源权重世界模型,支持本地视频生成,6.8秒多镜头视频,原生ComfyUI集成

LTX-2.5 是少数真正实现本地化、低延迟、多镜头同步视频生成的开源世界模型,对中小视频创作工具厂商和AIGC插件开发者构成高价值技术杠杆。

近7日信号 2

产品Langfuse71

开源LLM可观测性与评估平台,支持追踪、评估和监控大模型应用

Langfuse 是当前国内 LLM 应用落地阶段最成熟、可即插即用的可观测性基建选择,小团队能快速集成并形成产品差异化护城河。

近7日信号 3

开源RAGFlow

融合RAG与智能体能力的开源检索增强生成引擎,构建LLM上下文层

近7日信号 1

产品PPT-Master

AI驱动的原生PowerPoint生成工具,支持图表、动画、音频旁白及自定义模板

近7日信号 1

产品Macro

面向团队的AI原生统一工作空间,集成邮件、聊天、文档、任务、智能体、通话与CRM,支持@链接和共享AI记忆

近7日信号 1

论文Mapping and Measuring the Behavioral Evolution of Large Language Models

构建32个大语言模型的行为演化图谱,首次系统刻画模型代际行为变迁与家族关联

近7日信号 1

论文SCOUT: Symmetric Consensus Outlier Detection for Failure Localization in LLM Pre-Training

针对大模型预训练故障定位提出的对称共识异常检测方法,解决同步传播导致的故障根源模糊问题

近7日信号 1

产品V-FiLLM

面向结构化金融数据的可验证大语言模型推理评测基准框架

近7日信号 1

论文ReRound: Reconstructive Rounding to Resolve Midpoint Ambiguity in Calibration-Free LLM Quantization

一种无需校准的LLM权重量化后处理方法,通过重构式舍入解决标准舍入在量化区间中点附近的模糊性问题

近7日信号 1

论文SkillZip: Evaluation-Free Skill Compression for Self-Evolving Agents by Discovering Reusable Structure

面向自演化智能体的无评估技能压缩方法,通过发现可复用结构降低技能冗余,支持高效长期进化

近7日信号 1

论文Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

揭示智能体编码中CLAUDE.md文件持续膨胀现象,归因于代理式记忆的灾难性累积而非遗忘

近7日信号 1

论文Actions Speak Louder than Words: Measuring Cross-Lingual Policy Retention in Tool-Using Agents

提出工具调用智能体跨语言策略保留度评估方法,关注动作序列一致性而非最终答案

近7日信号 1

论文Attention-Path Fragility as an Uncertainty Signal in Large Language Models

提出注意力路径脆弱性作为LLM不确定性新信号,通过扰动注意力路径量化预测稳定性

近7日信号 1

论文The Illusion of Cross-Lingual Safety in Low-Resource Languages

揭示多语言大模型安全对齐在低资源语言中的失效现象,挑战英语中心化安全范式

近7日信号 1

论文Scheduling Mixed RL Rollouts Beyond Prefix Locality

面向大语言模型强化学习后训练的混合rollout调度方法,突破前缀局部性限制提升推理效率与泛化性

近7日信号 1

论文MultiModal Code-Switching: Interleaving Visual Objects into Language for Explicit Object-Level Alignment

多模态语码转换新范式,在语言中显式交织视觉对象token,实现细粒度物体级对齐

近7日信号 1

论文From Interpretability to Control: Insights from Six Years of the TrustNLP Workshop

基于TrustNLP研讨会六年演进的综述,标志可信赖NLP从后验可解释性迈向可控性与干预能力

近7日信号 1

论文How to Verify Consistency of Probabilistic Claims

提出多项式时间可验证的概率性断言自洽性检验方法,支撑AI安全中‘诚实性’形式化验证

近7日信号 1

论文Test-Time Self-Evolving GUI Visual Grounding via Reflection-Guided On-Policy Self-Distillation

面向GUI智能体的测试时自演化视觉定位方法,通过反思引导的在线策略自蒸馏实现零样本界面适应

近7日信号 1

论文Long-Horizon AI Research for Grothendieck Constant

人类-AI协作数学研究案例,聚焦格罗滕迪克常数上界改进,探索AI在长期数学推理中的有效范式

近7日信号 1