让 Agent 更可靠地调用工具和复用技能、提升 RAG 检索和知识库问答可靠性、提升模型推理、规划和验证能力
今天主要跟进:让 Agent 更可靠地调用工具和复用技能、提升 RAG 检索和知识库问答可靠性、提升模型推理、规划和验证能力。
本期从 2026-09-09 论文源抓取并去重 354 篇候选论文,筛选 6 篇重点论文与 20 篇补充关注。
本期重点
今天最值得跟进的方向
今天的高分论文主要指向:让 Agent 更可靠地调用工具和复用技能、提升 RAG 检索和知识库问答可靠性、提升模型推理、规划和验证能力。下面按核心问题、方法线索、主要论点和关键词整理,便于快速判断后续跟进价值。
重点论文:核心问题、方法线索与关键词
让 Agent 更可靠地调用工具和复用技能
中文标题AgentAudit:An Open,Extensible 框架 面向 Full-Lifecycle Trust 评测 of AI Agents
信号显示现有的评估框架大多只评估AI Agent的一部分,如任务完成( AgentBench )或安全鲁棒性( AgentDojo , ASB ) ,而不是规划、工具选择、工具执行、内存和推理的完整管道
关键词agentalignmentevaluationbenchmark
代码/数据需查看原文确认
提升 RAG 检索和知识库问答可靠性
中文标题跨物种动物再识别与语义一致性学习
信号显示可普遍化的动物再识别( ReID )旨在识别具有不同形态和生态环境的物种中的个体动物
关键词ragservingevaluationcode
代码/数据需查看原文确认
提升模型推理、规划和验证能力
中文标题月球漫步:通过动画/视觉特效预制作中的初级主管审核工作流程,通过意图-证据-行动对齐来调解操作
信号显示动画和视觉特效预制作评审要求团队将松散指定的创意意图(简报、不断发展的规范、异构引用和口头决定)翻译成初级艺术家可以执行的修订,而无需反复澄清
关键词workflowalignmentevaluationcode
代码/数据需查看原文确认
提升 RAG 检索和知识库问答可靠性
中文标题融合失败时:用于多模态医学图像分割的腐败感知重新平衡融合
信号显示多模态医学图像分割利用了互补的诊断信息,但当空间对齐的输入质量不同时,融合可能会低于单模态基线
关键词raginferencealignmentcode
代码/数据需查看原文确认
提升 RAG 检索和知识库问答可靠性
中文标题是什么让对抗性示例跨Deepfake检测器传输?
信号显示Deepfake检测器仍然容易受到基于传输的黑盒攻击,其中对抗性示例在源代理模型上生成并传输到攻击者未知的目标模型
关键词ragevaluationcodetraining
代码/数据需查看原文确认
提升代码生成、执行反馈和自动修复能力
中文标题针对大型语言模型的任意密码攻击不需要微调
信号显示大语言模型的安全和安保研究主要关注检测和预防越狱攻击:绕过对抗性用户从模型中获取不必要或有害的输出
关键词alignmentsafetyfine-tuningjailbreak
代码/数据需查看原文确认
其他值得关注
中文标题3rd Place Solution to Human Motion Challenges in Real-World 与 Clinical Settings (MoCha) @ECCV2026:Language-Aligned Motion Representations 面向 Domain-Generalizable UPDRS-Gait Severity Estimation
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
中文标题EEGBind :通过以EEG为中心的多峰结合检测发作间期癫痫样放电
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
中文标题PELM :采用推测解码和动态电压频率缩放的节能型器件上LLM推理
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
Watermarks Without Verification: AI Text Watermarking After the EU AI Act
中文标题未经验证的水印:欧盟AI法案后的AI文本水印
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
ProbPlug: A Plugin Uncertainty Network for Reliable Confidence in LLM Binary Classification
中文标题ProbPlug:A Plugin Uncertainty Network 面向 Reliable Confidence in LLM Binary Classification
关注理由涉及推理成本、延迟、吞吐和部署约束,可补充系统优化方向。
When Does Defendant Statement Matter? A Study of Bias and Persuasion in LLM-Simulated Jurors
中文标题被告陈述何时重要? LLM模拟陪审员中的偏见和说服力研究
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
When Does Low-Bit Quantization Preserve the Decisions of Vector Search?
中文标题低位量化何时保留矢量搜索的决策?
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
Subgroup Membership Inference Audits of Differentially Private Synthetic Text
中文标题差异私有合成文本的亚组成员资格推断审计
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
Distilling Image Prototypes for Guided Test-Time Adaptation
中文标题蒸馏图像原型,用于引导测试时间适应
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
Settling: Equilibrium Inference for Non-Convex Validity Sets
中文标题结算:非凸有效性集的平衡推断
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
TEFM: Token-Efficient Faithful Modeling for Structured Data
中文标题TEFM:Token-Efficient Faithful Modeling 面向 Structured Data
关注理由涉及数据工程中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
IdeaAMBIG: Benchmarking Implementation-Critical Gaps in Research-Idea Specifications
中文标题IdeaAMBIG:基准ing Implementation-Critical Gaps in Research-Idea Specifications
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
ConvMem: Convolutional Memory for Long-Context Reasoning
中文标题ConvMem:Convolutional Memory 面向 Long-Context Reasoning
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs
中文标题仅忘记重要的事情:对强大的LLM进行层级选择性学习
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
中文标题Glyph:A Multi-Strategy Agentic System 面向 Column Description 与 Sensitivity-Ontology Tagging of Enterprise Data Catalogs
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
中文标题PACE:Perceived-Latency-Aware Cascading Service Routing 与 Filler Control 面向 QoE-Efficient Retrieval-Augmented Dialogue Serving
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
中文标题为什么视频仍然如此昂贵?视频和视听LLM中的推理效率机制调查
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
中文标题网络金融蔓延:通过银行系统模拟人工智能供应商妥协的传播
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
中文标题学习适应和校准:医学VLM中少量不确定性预测的分数分布一致性
关注理由涉及模型安全、护栏路由、风险分类或治理评测,可作为安全评测与治理工具链的补充线索。
TRACE: Training Reasoning Agents for Causal Exploration with Synthesized Rewards
中文标题TRACE :使用综合奖励培训因果探索的推理代理
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
阅读边界
- 自动排序会偏向有社区信号、代码信号和工程关键词的论文。
- 简报默认基于标题、摘要和公开元数据,不替代全文精读。
- 外部 API 限流或不可用时,相关信号会降级为空并在内部记录中保留说明。