Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity Paper • 2607.00248 • Published 20 days ago • 32
MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training Paper • 2606.30406 • Published 21 days ago • 15
VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement Paper • 2607.00446 • Published 19 days ago • 23
Ko-WideSearch: A Korean Breadth-Search Benchmark for Exhaustive Set Enumeration by Web Agents Paper • 2606.27595 • Published 25 days ago • 8
TUA-Bench: A Benchmark for General-Purpose Terminal-Use Agents Paper • 2606.28480 • Published 24 days ago • 48
Agentic Abstention: Do Agents Know When to Stop Instead of Act? Paper • 2606.28733 • Published 23 days ago • 148
Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning Paper • 2606.31825 • Published 20 days ago • 29
Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning Paper • 2606.31825 • Published 20 days ago • 29
SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning Paper • 2606.22873 • Published 28 days ago • 15
Ko-WideSearch: A Korean Breadth-Search Benchmark for Exhaustive Set Enumeration by Web Agents Paper • 2606.27595 • Published 25 days ago • 8
Qwen-AgentWorld: Language World Models for General Agents Paper • 2606.24597 • Published 27 days ago • 149
OpenBioRQ: Unsolved Biomedical Research Questions for Agents Paper • 2606.21959 • Published about 1 month ago • 4
OpenBioRQ: Unsolved Biomedical Research Questions for Agents Paper • 2606.21959 • Published about 1 month ago • 4