NOLLI: A Difficulty-Calibrated Puzzle Benchmark for Diagnosing the English-Korean Performance Gap Paper • 2608.04397 • Published 1 day ago • 15
Meshy T2: Fast Native Mesh Generation with Flow Matching Paper • 2607.28675 • Published 10 days ago • 53
Explicit Layer Modeling for Video Object Insertion and Layer Decomposition Paper • 2607.25802 • Published 10 days ago • 8
ReDesign: Recovering Editable Design Structures from Images via Agentic Decomposition Paper • 2607.25565 • Published 10 days ago • 65
Leveraging External Knowledge for Historical Document Restoration via Retrieval-Augmented Large Language Models Paper • 2607.21936 • Published 14 days ago • 11
LAMAR: An Open Language-Aware Multilingual Alignment Reranker Paper • 2607.22042 • Published 14 days ago • 16
AREX: Towards a Recursively Self-Improving Agent for Deep Research Paper • 2607.21461 • Published 15 days ago • 151
AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report Paper • 2607.18367 • Published 17 days ago • 59
DiffGI: Differentiable Geometry Images for High-Fidelity Thin-Shell 3D Generation Paper • 2607.13365 • Published 23 days ago • 21
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable Paper • 2607.13285 • Published 24 days ago • 232
4D Human-Scene Reconstruction from Low-Overlap Captures Paper • 2607.09125 • Published 28 days ago • 53
Video Generation Models are General-Purpose Vision Learners Paper • 2607.09024 • Published 28 days ago • 87
Why Can't I Open My Drawer? Mitigating Object-Driven Shortcuts in Zero-Shot Compositional Action Recognition Paper • 2601.16211 • Published Jul 2 • 54