2026-08-01
Today tracks: make agents use tools and reusable skills more reliably, make agents use tools and reusable skills more reliably, make agents use tools and reusable skills more reliably.
469 candidates 6 featured Source 2026-07-30 Read 2026-07-25
Today tracks: make agents use tools and reusable skills more reliably, make agents use tools and reusable skills more reliably, strengthen multimodal understanding of charts, documents, and visual evidence.
321 candidates 6 featured Source 2026-07-23 Read 2026-07-24
Today tracks: make agents use tools and reusable skills more reliably, test temporal consistency and motion realism in video generation, make RAG retrieval and knowledge-base QA more reliable.
292 candidates 6 featured Source 2026-07-22 Read 2026-07-23
Today tracks: make agents use tools and reusable skills more reliably, make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably.
305 candidates 6 featured Source 2026-07-21 Read 2026-07-20
Today tracks: make agents use tools and reusable skills more reliably, improve model reasoning, planning, and verification, improve code generation, execution feedback, and automated repair.
326 candidates 6 featured Source 2026-07-16 Read 2026-07-16
Today tracks: make agents use tools and reusable skills more reliably, make RAG retrieval and knowledge-base QA more reliable, improve model reasoning, planning, and verification.
307 candidates 6 featured Source 2026-07-14 Read 2026-07-15
Today tracks: strengthen multimodal understanding of charts, documents, and visual evidence, make agents use tools and reusable skills more reliably, improve model reasoning, planning, and verification.
374 candidates 6 featured Source 2026-07-13 Read 2026-07-13
Today tracks: improve model reasoning, planning, and verification, make agents use tools and reusable skills more reliably, identify and reduce safety, jailbreak, and alignment risks.
291 candidates 6 featured Source 2026-07-09 Read 2026-07-09
Today tracks: make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably, make RAG retrieval and knowledge-base QA more reliable.
332 candidates 6 featured Source 2026-07-07 Read 2026-07-08
Today tracks: improve code generation, execution feedback, and automated repair, improve code generation, execution feedback, and automated repair, make agents use tools and reusable skills more reliably.
369 candidates 6 featured Source 2026-07-06 Read 2026-07-04
Today tracks: strengthen multimodal understanding of charts, documents, and visual evidence, make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably.
445 candidates 6 featured Source 2026-07-02 Read 2026-07-03
Today tracks: improve code generation, execution feedback, and automated repair, improve code generation, execution feedback, and automated repair, make agents use tools and reusable skills more reliably.
393 candidates 6 featured Source 2026-07-01 Read 2026-07-02
Today tracks: strengthen multimodal understanding of charts, documents, and visual evidence, improve model reasoning, planning, and verification, make agents use tools and reusable skills more reliably.
453 candidates 6 featured Source 2026-06-30 Read 2026-06-29
Today tracks: make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably, make agents use tools and reusable skills more reliably.
386 candidates 6 featured Source 2026-06-25 Read 2026-06-28
Today tracks: make RAG retrieval and knowledge-base QA more reliable, improve model reasoning, planning, and verification, make RAG retrieval and knowledge-base QA more reliable.
386 candidates 6 featured Source 2026-06-25 Read 2026-06-25
Today tracks: improve model reasoning, planning, and verification, make agents use tools and reusable skills more reliably, make RAG retrieval and knowledge-base QA more reliable.
364 candidates 6 featured Source 2026-06-23 Read 2026-06-24
Today tracks: strengthen multimodal understanding of charts, documents, and visual evidence, make agents use tools and reusable skills more reliably, make agents use tools and reusable skills more reliably.
457 candidates 6 featured Source 2026-06-22 Read 2026-06-23
Today tracks: make RAG retrieval and knowledge-base QA more reliable, make RAG retrieval and knowledge-base QA more reliable, improve code generation, execution feedback, and automated repair.
419 candidates 6 featured Source 2026-06-18 Read 2026-06-22
Today tracks: make agents use tools and reusable skills more reliably, improve code generation, execution feedback, and automated repair, make agents use tools and reusable skills more reliably.
419 candidates 6 featured Source 2026-06-18 Read 2026-06-21
Today tracks: make agents use tools and reusable skills more reliably, strengthen multimodal understanding of charts, documents, and visual evidence, strengthen multimodal understanding of charts, documents, and visual evidence.
419 candidates 6 featured Source 2026-06-18 Read 2026-06-20
Today tracks: improve code generation, execution feedback, and automated repair, make RAG retrieval and knowledge-base QA more reliable, make RAG retrieval and knowledge-base QA more reliable.
419 candidates 6 featured Source 2026-06-18 Read 2026-06-17
Today tracks: make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably, make RAG retrieval and knowledge-base QA more reliable.
465 candidates 6 featured Source 2026-06-15 Read 2026-06-15
Today tracks: make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably, make RAG retrieval and knowledge-base QA more reliable.
395 candidates 6 featured Source 2026-06-11 Read 2026-06-12
Today tracks: make RAG retrieval and knowledge-base QA more reliable, make agents use tools and reusable skills more reliably, make agents use tools and reusable skills more reliably.
383 candidates 6 featured Source 2026-06-10 Read 2026-06-09
Today tracks: make agents use tools and reusable skills more reliably, improve model reasoning, planning, and verification, strengthen multimodal understanding of charts, documents, and visual evidence.
344 candidates 6 featured Source 2026-06-05 Read 2026-06-08
Today tracks: improve model reasoning, planning, and verification, strengthen multimodal understanding of charts, documents, and visual evidence, make RAG retrieval and knowledge-base QA more reliable.
344 candidates 6 featured Source 2026-06-05 Read 2026-06-07
Today tracks: vision-language representation editing, coding-agent skill reuse, video-instance segmentation diagnostics, and low-data text-to-music generation.
344 candidates 5 featured Source 2026-06-05 Read