Datasets with reasoning traces for math and code (Train + Eval)
Maojia Song
OrangeEye
AI & ML interests
None yet
Recent Activity
upvoted a paper about 1 hour ago
Recursive self-improvement of AI research agents upvoted a paper about 14 hours ago
StartupBench: Benchmarking General-Purpose Agents on Market-Validated End-to-End Workflows upvoted a paper about 14 hours ago
AgentMercury: Your Agent Can Synthesize Verifiable Environments for Business Scenarios at scale