2026-09-26

Internal Generation Record

Internal generation metadata: 497 candidate papers.

Published 2026-09-26 Target source 2026-09-24 Actual source 2026-09-24 Candidates 497 Featured 6 Tracked 20

Generation Record

This page preserves selected papers, candidate scale, and source-date metadata for traceability. The page only changes presentation, not selected papers, ordering, or counts.

Internal generation record. Fetched at 2026-09-25T23:56:03.622738+00:00. Generated at 2026-09-25T23:57:39.758615+00:00. Machine-readable details stay under data/processed and data/reports.

Selected papers

RankTakeawayTopicarXiv
1make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2609.30217
2improve model reasoning, planning, and verificationReasoning and Planning2609.29983
3make agents use tools and reusable skills more reliablyAgents and Tool Use2609.29044
4improve model reasoning, planning, and verificationReasoning and Planning2609.30192
5make RAG retrieval and knowledge-base QA more reliableRetrieval and RAG2609.30087
6make agents use tools and reusable skills more reliablyTraining and Post-training2609.29816
7improve code generation, execution feedback, and automated repairBenchmarks and Evaluation2609.29633
8make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2609.29465
9strengthen multimodal understanding of charts, documents, and visual evidenceRobotics and Embodied AI2609.29382
10make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2609.29118
11improve model reasoning, planning, and verificationRobotics and Embodied AI2609.28984
12improve model reasoning, planning, and verificationBenchmarks and Evaluation2609.29973
13make agents use tools and reusable skills more reliablyMultimodal Models2609.29933
14make agents use tools and reusable skills more reliablyAgents and Tool Use2609.29875
15make RAG retrieval and knowledge-base QA more reliableVideo Generation2609.29825
16improve code generation, execution feedback, and automated repairCode Intelligence2609.29429
17make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2609.29347
18make agents use tools and reusable skills more reliablyData Engineering2609.29191
19improve code generation, execution feedback, and automated repairVideo Generation2609.29092
20make RAG retrieval and knowledge-base QA more reliableRobotics and Embodied AI2609.29000
21improve model reasoning, planning, and verificationVideo Generation2609.28956
22make agents use tools and reusable skills more reliablyAgents and Tool Use2609.28919
23make RAG retrieval and knowledge-base QA more reliableSystems and Deployment2609.30245
24strengthen multimodal understanding of charts, documents, and visual evidenceReasoning and Planning2609.30238
25improve model reasoning, planning, and verificationBenchmarks and Evaluation2609.30205
26improve code generation, execution feedback, and automated repairSystems and Deployment2609.30037