When2Think: Learning Difficulty-Aware Length Control for Efficient Hybrid Reasoning Models Paper • 2609.19671 • Published 6 days ago • 47
Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening Paper • 2609.18708 • Published 7 days ago • 76
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 16 days ago • 372
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation Paper • 2609.08798 • Published 15 days ago • 81
Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding Paper • 2609.04131 • Published 20 days ago • 31
Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills Paper • 2609.02749 • Published 21 days ago • 401
huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF Image-Text-to-Text • 27B • Updated 1 day ago • 2.25M • 862
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 265