论文
StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing
提出StepGuard逐步骤防护机制,在工具调用环节实现细粒度安全控制与效用平衡
档案回溯至 2026-08 · 收录于 2026-08-26热度 0.1
safetyguardrailtool-use
暂未评估,等待下一轮评分。
事件时间线
- 2026-08-25 🏁 里程碑arXiv发布StepGuard实现LLM Agent工具调用的逐步骤安全防护
关联信号
想把「StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing」相关的机会落到自己的业务上?
想把 AI 机会落到自己的业务上?
灯塔背后的优秘智能团队提供:AI 落地咨询 · GEO 优化(让 AI 搜索推荐你的品牌) · 定制开发。留下需求,1 个工作日内回复。