2026-08-23

Internal Generation Record

Internal generation metadata: 291 candidate papers.

Published 2026-08-23 Target source 2026-08-21 Actual source 2026-08-20 Candidates 291 Featured 6 Tracked 20 Source date fallback

Generation Record

This page preserves selected papers, candidate scale, and source-date metadata for traceability. The page only changes presentation, not selected papers, ordering, or counts.

Internal generation record. Fetched at 2026-08-22T21:32:01.011840+00:00. Generated at 2026-08-22T21:33:05.888072+00:00. Machine-readable details stay under data/processed and data/reports.

Selected papers

RankTakeawayTopicarXiv
27make RAG retrieval and knowledge-base QA more reliableTraining and Post-training2608.20011
28make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.20005
29improve code generation, execution feedback, and automated repairTraining and Post-training2608.19973
30make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.19914
31make agents use tools and reusable skills more reliablyRetrieval and RAG2608.19875
35make agents use tools and reusable skills more reliablyCode Intelligence2608.19799
32make RAG retrieval and knowledge-base QA more reliableTraining and Post-training2608.19871
33make RAG retrieval and knowledge-base QA more reliableTraining and Post-training2608.19825
34make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.19800
36strengthen multimodal understanding of charts, documents, and visual evidenceBenchmarks and Evaluation2608.19735
37make agents use tools and reusable skills more reliablyAgents and Tool Use2608.19729
38improve code generation, execution feedback, and automated repairVision and Image Generation2608.19719
39strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2608.19710
40make RAG retrieval and knowledge-base QA more reliableRetrieval and RAG2608.19680
41make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2608.19662
42make agents use tools and reusable skills more reliablyRetrieval and RAG2608.19625
43make agents use tools and reusable skills more reliablyAgents and Tool Use2608.19621
44make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.19598
45strengthen multimodal understanding of charts, documents, and visual evidenceTraining and Post-training2608.19589
46improve code generation, execution feedback, and automated repairSafety and Alignment2608.19579
47improve model reasoning, planning, and verificationReasoning and Planning2608.19536
48make agents use tools and reusable skills more reliablyAgents and Tool Use2608.19526
49make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2608.20181
50make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2608.20169
51make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2608.20009
52use benchmarks and evaluations to expose model weaknessesBenchmarks and Evaluation2608.19981