bottlecapai/ThinkingCap-Qwen3.6-27B Image-Text-to-Text • 27B • Updated about 10 hours ago • 35.1k • • 654
OpenResearcher Collection OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis • 8 items • Updated Mar 24 • 18
Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models Paper • 2602.12036 • Published Feb 12 • 95