2026-09-29

Internal Generation Record

Internal generation metadata: 444 candidate papers.

Published 2026-09-29 Target source 2026-09-27 Actual source 2026-09-25 Candidates 444 Featured 6 Tracked 20 Source date fallback

Generation Record

This page preserves selected papers, candidate scale, and source-date metadata for traceability. The page only changes presentation, not selected papers, ordering, or counts.

Internal generation record. Fetched at 2026-09-28T16:31:05.944784+00:00. Generated at 2026-09-28T16:32:43.212633+00:00. Machine-readable details stay under data/processed and data/reports.

Selected papers

RankTakeawayTopicarXiv
1make agents use tools and reusable skills more reliablyAgents and Tool Use2609.31234
2make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2609.30967
3improve code generation, execution feedback, and automated repairSystems and Deployment2609.31558
4make agents use tools and reusable skills more reliablyRetrieval and RAG2609.31511
7make agents use tools and reusable skills more reliablySafety and Alignment2609.31186
8improve code generation, execution feedback, and automated repairTraining and Post-training2609.31009
5make agents use tools and reusable skills more reliablyAgents and Tool Use2609.31318
6make agents use tools and reusable skills more reliablyAgents and Tool Use2609.31197
9improve model reasoning, planning, and verificationRetrieval and RAG2609.31005
10improve model reasoning, planning, and verificationMultimodal Models2609.30979
11make agents use tools and reusable skills more reliablyAgents and Tool Use2609.30940
12make agents use tools and reusable skills more reliablyAgents and Tool Use2609.30856
13make RAG retrieval and knowledge-base QA more reliableCode Intelligence2609.30819
14make agents use tools and reusable skills more reliablySafety and Alignment2609.30818
15improve code generation, execution feedback, and automated repairTraining and Post-training2609.30802
16make agents use tools and reusable skills more reliablyAgents and Tool Use2609.30783
17improve model reasoning, planning, and verificationRetrieval and RAG2609.30719
18make agents use tools and reusable skills more reliablyData Engineering2609.30714
19make RAG retrieval and knowledge-base QA more reliableRetrieval and RAG2609.31573
20improve model reasoning, planning, and verificationRetrieval and RAG2609.31342
21make agents use tools and reusable skills more reliablyData Engineering2609.31288
22make agents use tools and reusable skills more reliablyAgents and Tool Use2609.31039
23improve model reasoning, planning, and verificationInterpretability2609.30993
24improve code generation, execution feedback, and automated repairBenchmarks and Evaluation2609.30867
25use benchmarks and evaluations to expose model weaknessesSystems and Deployment2609.30854
26make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2609.30813