2026-08-12

Internal Generation Record

Internal generation metadata: 453 candidate papers.

Published 2026-08-12 Target source 2026-08-10 Actual source 2026-08-10 Candidates 453 Featured 6 Tracked 20

Generation Record

This page preserves selected papers, candidate scale, and source-date metadata for traceability. The page only changes presentation, not selected papers, ordering, or counts.

Internal generation record. Fetched at 2026-08-11T21:59:20.987643+00:00. Generated at 2026-08-11T22:11:24.597124+00:00. Machine-readable details stay under data/processed and data/reports.

Selected papers

RankTakeawayTopicarXiv
1make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2608.09408
2make agents use tools and reusable skills more reliablyReasoning and Planning2608.09867
3improve model reasoning, planning, and verificationData Engineering2608.09818
4make agents use tools and reusable skills more reliablyAgents and Tool Use2608.09476
5make agents use tools and reusable skills more reliablyCode Intelligence2608.09273
7make RAG retrieval and knowledge-base QA more reliableMultimodal Models2608.09240
6make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.09270
8use benchmarks and evaluations to expose model weaknessesSystems and Deployment2608.09225
9make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2608.09146
10make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.09097
11make agents use tools and reusable skills more reliablyRetrieval and RAG2608.09028
12improve image generation, visual understanding, and controllable renderingTraining and Post-training2608.09590
13strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2608.09529
14make agents use tools and reusable skills more reliablyAgents and Tool Use2608.09507
15make RAG retrieval and knowledge-base QA more reliableRobotics and Embodied AI2608.09448
16improve model reasoning, planning, and verificationRetrieval and RAG2608.09393
17make RAG retrieval and knowledge-base QA more reliableRobotics and Embodied AI2608.09303
18strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2608.09302
19improve code generation, execution feedback, and automated repairBenchmarks and Evaluation2608.09930
20make agents use tools and reusable skills more reliablyAgents and Tool Use2608.09928
21improve model reasoning, planning, and verificationRetrieval and RAG2608.09908
22strengthen multimodal understanding of charts, documents, and visual evidenceSystems and Deployment2608.09907
23identify and reduce safety, jailbreak, and alignment risksBenchmarks and Evaluation2608.09900
24make agents use tools and reusable skills more reliablyAgents and Tool Use2608.09885
25improve model reasoning, planning, and verificationTraining and Post-training2608.09836
26make agents use tools and reusable skills more reliablyAgents and Tool Use2608.09828