提升模型推理、规划和验证能力、让 Agent 更可靠地调用工具和复用技能、识别并缓解模型安全、越狱和对齐风险
今天主要跟进:提升模型推理、规划和验证能力、让 Agent 更可靠地调用工具和复用技能、识别并缓解模型安全、越狱和对齐风险。
本期从 2026-07-09 论文源抓取并去重 291 篇候选论文,筛选 6 篇重点论文与 20 篇补充关注。
本期重点
今天最值得跟进的方向
今天的高分论文主要指向:提升模型推理、规划和验证能力、让 Agent 更可靠地调用工具和复用技能、识别并缓解模型安全、越狱和对齐风险。下面按核心问题、方法线索、主要论点和关键词整理,便于快速判断后续跟进价值。
重点论文:核心问题、方法线索与关键词
提升模型推理、规划和验证能力
中文标题一种safety-oriented hypothetico-deductive 框架 面向 AI-assisted differential diagnosis
信号显示诊断错误是患者安全的主要威胁,但目前的大语言模型( LLM )系统通常将诊断视为一次性预测任务,缺乏针对错过的高风险替代方案的保障措施或对其推理的严格验证
关键词workflowretrievalsafetyevaluation
代码/数据需查看原文确认
让 Agent 更可靠地调用工具和复用技能
中文标题从提示到合同:可审计企业LLM代理的线束工程
信号显示企业大语言模型( LLM )应用程序通常以原型开始,其行为由提示和检索上下文承载
关键词agentretrievalsafetycode
代码/数据需查看原文确认
识别并缓解模型安全、越狱和对齐风险
中文标题通过自适应特征保留的权力转换和符号保留分数聚合对大型语言模型进行结构化修剪
信号显示本文提出了一种改进的大语言模型( LLM )结构化修剪方法,该方法解决了将自适应特征保留( AFR ) (一种非结构化修剪技术)适应结构化修剪的关键挑战
关键词inferenceservingalignmentsystems
代码/数据需查看原文确认
提升模型推理、规划和验证能力
中文标题小心您自动完成的内容:后门代码完成的取证归因
信号显示大语言模型支持强大的代码完成系统,通过预测后续代码行来帮助开发人员
关键词deploymentevaluationcodefine-tuning
代码/数据需查看原文确认
提升 RAG 检索和知识库问答可靠性
中文标题LTM:Large-scale Terrain Model 面向 Wildfire-prone Landscapes
信号显示在评估野火危险时,准确的3D地形图对于应急响应至关重要
关键词ragalignmentevaluationeval
代码/数据需查看原文确认
提升 RAG 检索和知识库问答可靠性
中文标题UltraX :使用自适应编程编辑大规模优化预训练数据
信号显示随着可用的训练数据接近其物理极限,缩放定律的收益已开始减少
关键词raginferencealignmentdata
代码/数据需查看原文确认
其他值得关注
It Takes Few to TANGO: A Quantized Distributed Model for Binaural Speech Enhancement
中文标题探戈很少:双耳语音增强的量化分布式模型
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
BiSCo-LLM: Lookup-Free Binary Spherical Coding for Extreme Low-Bit Large Language Model Compression
中文标题BiSCo-LLM:Lookup-Free Binary Spherical Coding 面向 Extreme Low-Bit Large Language Model Compression
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
ImputeViz: A Visual Analytics Dashboard for Diagnosing Missing Data and Comparing Imputation Methods
中文标题ImputeViz:A Visual Analytics Dashboard 面向 Diagnosing Missing Data 与 Comparing Imputation Methods
关注理由涉及推理与规划中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
SHAP-Weighted Cross-Modal Expert Fusion for Emotion and Sentiment Recognition: Evidence and Limits
中文标题SHAP-Weighted Cross-Modal Expert Fusion 面向 Emotion 与 Sentiment Recognition:Evidence 与 Limits
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
SMetric: Rethink LLM Scheduling for Serving Agents with Balanced Session-centric Scheduling
中文标题SMetric :重新思考LLM调度,为具有平衡会话中心调度的座席提供服务
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
中文标题VocaDet :通过可视化标记和矢量数据库检索进行样本驱动的开放词汇表对象检测和分割
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
Systematic Evaluation of Learning Rate Scheduling Strategies Across Heterogeneous Architectures
中文标题跨异构架构的学习率调度策略的系统评估
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
中文标题上下文访问鸿沟:交互级架构作为代理不平等的补充维度
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
Ensemble Diversity Optimization for Subjective Supervision
中文标题主观监督的集合多样性优化
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
MatBind: A Shared Embedding Space for Multimodal Materials Characterization
中文标题MatBind:A Shared Embedding Space 面向 Multimodal Materials Characterization
关注理由涉及检索、知识库问答与证据可靠性,可作为 RAG 评测和企业知识系统的补充线索。
When Synthetic Speech Is All You Have: Better Call GRPO
中文标题当你只有合成语音时:更好地调用GRPO
关注理由涉及模型安全、护栏路由、风险分类或治理评测,可作为安全评测与治理工具链的补充线索。
On Exploring Input Resolution Scaling For Anytime LiDAR Object Detection
中文标题关于探索随时激光雷达物体检测的输入分辨率缩放
关注理由涉及推理成本、延迟、吞吐和部署约束,可补充系统优化方向。
H3D: Benchmarking Unsupervised Text Hashing for Fine-Grained Document Deduplication
中文标题H3D :对无监督文本哈希进行基准测试,以实现细粒度文档重复数据删除
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
MobiDiff: Semantic-Aware Multi-Channel Discrete Diffusion for Human Mobility Data Generation
中文标题MobiDiff:Semantic-Aware Multi-Channel Discrete Diffusion 面向 Human Mobility Data Generation
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
ArtMine: Discovering and Formalizing Artistic Processes
中文标题ArtMine:Discovering 与 Formalizing Artistic Processes
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
On the Design of Mixture-of-Experts for Dynamic Gaussian Splatting
中文标题动态高斯溅射混合专家的设计
关注理由涉及训练与后训练中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
TVTA: Trajectory-Aware Viseme-Guided Temporal Aggregation for Event-Based Lip Reading
中文标题TVTA:Trajectory-Aware Viseme-Guided Temporal Aggregation 面向 Event-Based Lip Reading
关注理由涉及工具调用、执行反馈和可复用能力,可作为 Agent 工作流可靠性的补充线索。
RhyMix: A Lightweight Adaptive Multi-Rhythm Network for Long-Term Time Series Forecasting
中文标题RhyMix:A Lightweight Adaptive Multi-Rhythm Network 面向 Long-Term Time Series Forecasting
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
Multimodal 3D LUT Generation via StatLUT with Statistical Features for Photorealistic Style Transfer
中文标题通过StatLUT生成多模态3D LUT ,具有用于逼真风格转移的统计特征
关注理由涉及视觉与图像生成中的新任务、数据或系统线索,可作为后续跟进清单的一部分。
Benchmark Evaluation of Feredated Learning on Multi-organ Images
中文标题多器官图像上自由学习的基准评估
关注理由涉及任务设置、指标和失效案例,可补充模型评测与回归测试。
阅读边界
- 自动排序会偏向有社区信号、代码信号和工程关键词的论文。
- 简报默认基于标题、摘要和公开元数据,不替代全文精读。
- 外部 API 限流或不可用时,相关信号会降级为空并在内部记录中保留说明。