-
Beyond A*: Better Planning with Transformers via Search Dynamics Bootstrapping
Paper • 2402.14083 • Published • 47 -
Linear Transformers are Versatile In-Context Learners
Paper • 2402.14180 • Published • 7 -
Training-Free Long-Context Scaling of Large Language Models
Paper • 2402.17463 • Published • 24 -
The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits
Paper • 2402.17764 • Published • 629
Yang Lee
innovation64
AI & ML interests
AGI
Recent Activity
upvoted a paper about 11 hours ago
LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks upvoted a paper about 20 hours ago
Mental World Modeling upvoted a paper about 20 hours ago
From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement