2026-09-03

Internal Generation Record

Internal generation metadata: 486 candidate papers.

Published 2026-09-03 Target source 2026-09-01 Actual source 2026-09-01 Candidates 486 Featured 6 Tracked 20

Generation Record

This page preserves selected papers, candidate scale, and source-date metadata for traceability. The page only changes presentation, not selected papers, ordering, or counts.

Internal generation record. Fetched at 2026-09-02T23:16:20.207398+00:00. Generated at 2026-09-02T23:17:56.291741+00:00. Machine-readable details stay under data/processed and data/reports.

Selected papers

RankTakeawayTopicarXiv
1make agents use tools and reusable skills more reliablyAgents and Tool Use2609.00759
2improve code generation, execution feedback, and automated repairBenchmarks and Evaluation2609.01511
3improve code generation, execution feedback, and automated repairBenchmarks and Evaluation2609.01470
4improve code generation, execution feedback, and automated repairRobotics and Embodied AI2609.01453
7strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2609.01147
8make RAG retrieval and knowledge-base QA more reliableVision and Image Generation2609.01123
5improve code generation, execution feedback, and automated repairBenchmarks and Evaluation2609.01249
6make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2609.01148
9make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2609.01073
10make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2609.00923
11strengthen multimodal understanding of charts, documents, and visual evidenceBenchmarks and Evaluation2609.00909
12improve model reasoning, planning, and verificationReasoning and Planning2609.00738
13make RAG retrieval and knowledge-base QA more reliableRetrieval and RAG2609.00689
14make agents use tools and reusable skills more reliablyRetrieval and RAG2609.00666
15make agents use tools and reusable skills more reliablyAgents and Tool Use2609.00643
16make RAG retrieval and knowledge-base QA more reliableRetrieval and RAG2609.00551
17improve model reasoning, planning, and verificationData Engineering2609.01575
18improve model reasoning, planning, and verificationReasoning and Planning2609.01558
19make agents use tools and reusable skills more reliablyAgents and Tool Use2609.01335
20improve code generation, execution feedback, and automated repairTraining and Post-training2609.01161
21improve code generation, execution feedback, and automated repairSafety and Alignment2609.01046
22improve code generation, execution feedback, and automated repairTraining and Post-training2609.00968
23make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2609.00959
24strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2609.00708
25improve model reasoning, planning, and verificationSafety and Alignment2609.00624
26make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2609.01603