2026-07-19

Internal Generation Record

Internal generation metadata: 326 candidate papers.

Published 2026-07-19 Target source 2026-07-17 Actual source 2026-07-16 Candidates 326 Featured 6 Tracked 20 Source date fallback

Generation Record

This page preserves selected papers, candidate scale, and source-date metadata for traceability. The page only changes presentation, not selected papers, ordering, or counts.

Internal generation record. Fetched at 2026-07-18T22:02:06.507283+00:00. Generated at 2026-07-18T22:03:31.359948+00:00. Machine-readable details stay under data/processed and data/reports.

Selected papers

RankTakeawayTopicarXiv
27improve image generation, visual understanding, and controllable renderingBenchmarks and Evaluation2607.14932
28identify and reduce safety, jailbreak, and alignment risksBenchmarks and Evaluation2607.14888
29make agents use tools and reusable skills more reliablyAgents and Tool Use2607.14777
30make agents use tools and reusable skills more reliablyMultimodal Models2607.14756
31make RAG retrieval and knowledge-base QA more reliableSystems and Deployment2607.14747
35improve model reasoning, planning, and verificationTraining and Post-training2607.14682
32make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2607.14737
33make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2607.14703
34strengthen multimodal understanding of charts, documents, and visual evidenceBenchmarks and Evaluation2607.14683
36use benchmarks and evaluations to expose model weaknessesBenchmarks and Evaluation2607.14673
37improve model reasoning, planning, and verificationSystems and Deployment2607.14661
38improve model reasoning, planning, and verificationBenchmarks and Evaluation2607.14660
39make agents use tools and reusable skills more reliablyAgents and Tool Use2607.14658
40make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2607.14651
41make agents use tools and reusable skills more reliablyMultimodal Models2607.14631
42improve model reasoning, planning, and verificationReasoning and Planning2607.14628
43make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2607.14613
44make RAG retrieval and knowledge-base QA more reliableBenchmarks and Evaluation2607.14604
45strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2607.14587
46make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2607.14561
47make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2607.14544
48make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2607.14543
49make agents use tools and reusable skills more reliablyBenchmarks and Evaluation2607.14514
50strengthen multimodal understanding of charts, documents, and visual evidenceMultimodal Models2607.14510
51improve code generation, execution feedback, and automated repairSafety and Alignment2607.14480
52make RAG retrieval and knowledge-base QA more reliableData Engineering2607.15265