Dream-RSI: Recursive Self-Improvement through Evolving Worlds Paper • 2609.14858 • Published 9 days ago • 242
Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning Paper • 2607.12395 • Published Jul 14 • 92
ToFu: A White-Box, Token-Efficient Agent Harness for Researchers Paper • 2607.11423 • Published Jul 13 • 16
Parallel-Probe: Towards Efficient Parallel Thinking via 2D Probing Paper • 2602.03845 • Published Feb 3 • 27
AICC: Parse HTML Finer, Make Models Better -- A 7.3T AI-Ready Corpus Built by a Model-Based HTML Parser Paper • 2511.16397 • Published Nov 20, 2025 • 12
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models Paper • 2507.15512 • Published Jul 21, 2025 • 3