EurekAgent: Agent Environment Engineering is All You Need For Autonomous Scientific Discovery Paper • 2606.13662 • Published Jun 11 • 31
EurekAgent: Agent Environment Engineering is All You Need For Autonomous Scientific Discovery Paper • 2606.13662 • Published Jun 11 • 31
Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces Paper • 2605.29288 • Published May 28 • 9
LongTraceRL Collection LongTraceRL: Learning Long-Context Reasoning from Search Agent Trajectories with Rubric Rewards • 5 items • Updated Jun 1 • 1
LongTraceRL: Learning Long-Context Reasoning from Search Agent Trajectories with Rubric Rewards Paper • 2605.31584 • Published May 29 • 43
Benchmarking Foundation Models with Language-Model-as-an-Examiner Paper • 2306.04181 • Published Jun 7, 2023
CPM: A Large-scale Generative Chinese Pre-trained Language Model Paper • 2012.00413 • Published Dec 1, 2020
MAVEN-Arg: Completing the Puzzle of All-in-One Event Understanding Dataset with Event Argument Annotation Paper • 2311.09105 • Published Nov 15, 2023
KEPLER: A Unified Model for Knowledge Embedding and Pre-trained Language Representation Paper • 1911.06136 • Published Nov 13, 2019
Adversarial Language Games for Advanced Natural Language Intelligence Paper • 1911.01622 • Published Nov 5, 2019
GOAL: A Challenging Knowledge-grounded Video Captioning Benchmark for Real-time Soccer Commentary Generation Paper • 2303.14655 • Published Mar 26, 2023
Sub-Character Tokenization for Chinese Pretrained Language Models Paper • 2106.00400 • Published Jun 1, 2021
COPEN: Probing Conceptual Knowledge in Pre-trained Language Models Paper • 2211.04079 • Published Nov 8, 2022 • 1
ADELIE: Aligning Large Language Models on Information Extraction Paper • 2405.05008 • Published May 8, 2024 • 2