2026-09-24

让 Agent 更可靠地调用工具和复用技能、识别并缓解模型安全、越狱和对齐风险、提升 RAG 检索和知识库问答可靠性

今天主要跟进:让 Agent 更可靠地调用工具和复用技能、识别并缓解模型安全、越狱和对齐风险、提升 RAG 检索和知识库问答可靠性。

发布 2026-09-24 目标源日 2026-09-22 实际源日 2026-09-22 候选 414 重点 6 关注 20

本期从 2026-09-22 论文源抓取并去重 414 篇候选论文,筛选 6 篇重点论文与 20 篇补充关注。

今天最值得跟进的方向

今天的高分论文主要指向:让 Agent 更可靠地调用工具和复用技能、识别并缓解模型安全、越狱和对齐风险、提升 RAG 检索和知识库问答可靠性。下面按核心问题、方法线索、主要论点和关键词整理,便于快速判断后续跟进价值。

其他值得关注

KwaiMind Technical Report

中文标题KwAIMind技术报告

关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。

PACT: From Credit Assignment to Critic Alignment

中文标题PACT:来自 Credit Assignment to Critic Alignment

关注理由涉及模型安全、护栏路由、风险分类或治理评测,可作为安全评测与治理工具链的补充线索。

Risk-Aware Online Conformal State Probing

中文标题风险意识在线适形状态探测

关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。

阅读边界

  • 自动排序会偏向有社区信号、代码信号和工程关键词的论文。
  • 简报默认基于标题、摘要和公开元数据,不替代全文精读。
  • 外部 API 限流或不可用时,相关信号会降级为空并在内部记录中保留说明。