提升 RAG 检索和知识库问答可靠性、让 Agent 更可靠地调用工具和复用技能
今天主要跟进:提升 RAG 检索和知识库问答可靠性、让 Agent 更可靠地调用工具和复用技能、让 Agent 更可靠地调用工具和复用技能。
本期从 2026-09-16 论文源抓取并去重 431 篇候选论文,筛选 6 篇重点论文与 20 篇补充关注。
本期重点
今天最值得跟进的方向
今天的高分论文主要指向:提升 RAG 检索和知识库问答可靠性、让 Agent 更可靠地调用工具和复用技能、让 Agent 更可靠地调用工具和复用技能。下面按核心问题、方法线索、主要论点和关键词整理,便于快速判断后续跟进价值。
重点论文:核心问题、方法线索与关键词
提升 RAG 检索和知识库问答可靠性
中文标题LLM偏好调整的零次序范例
信号显示直接偏好对齐方法因其计算和内存效率而被广泛用于将大语言模型( LLM )与人类偏好对齐
关键词ragalignmentfine-tuningmemory
代码/数据需查看原文确认
让 Agent 更可靠地调用工具和复用技能
中文标题脉冲:在单线程CPU上解锁实用图像压缩
信号显示尽管最近在学习图像压缩方面取得了进展,但现有方法在资源受限的硬件上仍然计算昂贵,特别是CPU
关键词agentlatencycompressioncode
代码/数据需查看原文确认
让 Agent 更可靠地调用工具和复用技能
中文标题Collective Loss of Control in LLM Agent Systems:An Epidemic Account of Mutation,Contagion,与 Recovery
信号显示多智能体系统如何从局部偏差演变为集体失控?
关键词agentdeploymentevaluationbenchmark
代码/数据需查看原文确认
让 Agent 更可靠地调用工具和复用技能
中文标题WetRobo:A Reproducible Robot Kit 面向 Coding Agents in Biological Laboratories
信号显示自动化生物研究需要通用、可重复的机器人系统,允许个人湿实验室研究人员委派机器人任务,而无需执行远程操作或神经网络训练
关键词agentcodevision-languagerobotics
代码/数据需查看原文确认
让 Agent 更可靠地调用工具和复用技能
中文标题FIVE-VLA :具有循环动作记忆的快速有效的自动驾驶
信号显示最先进的自动驾驶视觉-语言-动作模型( VLA )面临严重限制:参数计数过多,高分辨率图像处理效率低下,以及缺乏时间内存
关键词benchmarkcodevision-languagememory
代码/数据需查看原文确认
让 Agent 更可靠地调用工具和复用技能
中文标题用于自动驾驶中选择性轨迹规划的流程引导占用进化风险感知世界建模
信号显示自动驾驶的安全运动规划需要预测不断变化的交通风险,并决定何时修改当前的计划轨迹
关键词ragevaluationtemporalmotion
代码/数据需查看原文确认
其他值得关注
CapMap-MS-TTA: 3rd Place Solution for the MUMU Track of the 8th LSVOS Challenge at ECCV 2026
中文标题CapMap-MS-TTA : ECCV 2026第八届LSVOS挑战赛MUMU赛道第三名解决方案
关注理由涉及训练与后训练中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
OmniRisk: Omnidirectional Trajectory-Risk Learning for Agile Quadrotor Dynamic Avoidance
中文标题OmniRisk:Omnidirectional Trajectory-Risk Learning 面向 Agile Quadrotor Dynamic Avoidance
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
Can MiniMax-H3 Reason About the Physical World? An Evaluation of Omni-Modal Generative Model
中文标题MiniMax-H3能否解释物理世界的原因?全模态生成模型的评估
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
Visual Autoregressive Priors for RAW-to-sRGB Image Signal Processing
中文标题Visual Autoregressive Priors 面向 RAW-to-sRGB Image Signal Processing
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
BENCHCOMPASS: From Scores to Signals for Training and Harness Decisions in Payment-Domain LLMs
中文标题BENCHCOMPASS:来自 Scores to Signals 面向 Training 与 Harness Decisions in Payment-Domain LLMs
关注理由涉及数据工程中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
WAVE-Go: World-Model Navigation with Adaptive Execution for Wheel-Legged Robots
中文标题WAVE-Go :适用于轮腿机器人的自适应执行世界模型导航
关注理由涉及代码智能中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
中文标题询问工具,不要猜测:客服代表工具呼叫会保留他们的进度,服务系统应该读取它
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
SURF: Subtractive Updates for Recommender Forgetting
中文标题SURF:Subtractive Updates 面向 Recommender Forgetting
关注理由涉及视频生成中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
RankGround: Efficient High-Resolution GUI Grounding via Lightweight Reranker-Guided Crop Selection
中文标题RankGround :通过轻量级Reranker引导的作物选择实现高效的高分辨率GUI接地
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
Reasoning through Evolution: Automatic Meta-path Discovery for LLM-based Fake News Detection
中文标题通过演进进行推理:基于LLM的虚假新闻检测的自动元路径发现
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
Hardware-Free Robotics Laboratories in Mixed Reality
中文标题混合现实中的无硬件机器人实验室
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
Occluded Gait Recognition with Mixture of Experts: An Action Detection Perspective
中文标题混合专家的闭塞步态识别:行动检测视角
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
中文标题HiLNO :对一般几何体上的PDE进行多尺度监控的分层潜伏神经算子
关注理由涉及推理与规划中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
Where Should Agents Live? Energy-Memory Characterization of Agentic AI for the Edge-Cloud Continuum
中文标题客服代表应该住在哪里?用于边缘云连续体的智能AI的能量-记忆表征
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
I code or AI code: A comparative evaluation of AI-rated scores in classroom observations
中文标题I代码或AI代码:课堂观察中AI评级分数的比较评估
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
${M}^2$Tok: Multi-head Multi-codebook Discrete Action Tokenization for Vision-Language-Action Models
中文标题${M}^2$Tok:Multi-head Multi-codebook Discrete Action Tokenization 面向 视觉-语言-动作模型
关注理由涉及多模态模型中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
中文标题CPR :将钢琴渲染中的全局构图、本地表演和全序列精炼与连续自回归建模相结合
关注理由涉及视觉与图像生成中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
Colla-Q: Toward Collaborative Experts in MoE Quantization via Minimax Precision Balancing
中文标题Colla-Q :通过Minimax Precision Balancing面向教育部量化方面的协作专家
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
Designing Agentic AI Workflow Portfolios under Imperfect Selection and Compute Cost
中文标题Designing Agentic AI Workflow Portfolios under Imperfect Selection 与 Compute Cost
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
中文标题弱对齐可见红外图像中面向目标的标签效率对齐共识教学
关注理由涉及多模态模型中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
阅读边界
- 自动排序会偏向有社区信号、代码信号和工程关键词的论文。
- 简报默认基于标题、摘要和公开元数据,不替代全文精读。
- 外部 API 限流或不可用时,相关信号会降级为空并在内部记录中保留说明。