-
Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs
Paper • 2605.09063 • Published • 82 -
NanoResearch: Co-Evolving Skills, Memory, and Policy for Personalized Research Automation
Paper • 2605.10813 • Published • 15 -
AutoMedBench: Towards Medical AutoResearch with Agentic AI Models
Paper • 2606.01961 • Published • 26
Dingjie Song
songdj
AI & ML interests
None yet
Recent Activity
liked a dataset 4 days ago
secemp9/arxiv-complete authored a paper 17 days ago
Dr. Claw: An AI Scientist Workspace for Vibe Research upvoted a paper 17 days ago
Dr. Claw: An AI Scientist Workspace for Vibe ResearchOrganizations
None yet