AgentRoom: Concurrent Multi-Agent Coding in a CRDT-Backed Shared Workspace Paper • 2608.23740 • Published 5 days ago • 7
Automata from Agent Traces: Failure and Next-Step Prediction Paper • 2608.23670 • Published 5 days ago • 4
Control Reinforcement Learning: Interpretable Token-Level Steering of LLMs via Sparse Autoencoder Features Paper • 2602.10437 • Published Feb 12 • 2
OptimismBench: Forecasting Bias and the Alignment Effect in Language Model Judgment Paper • 2607.26981 • Published about 1 month ago • 2
Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects Paper • 2607.20596 • Published Jul 22 • 2
Running 4 CorrSteer: Correlation-Based Steering of Language Models via Sparse Autoencoders 🧭 4 Steer language model output by clicking visual layers
CorrSteer: Steering Improves Task Performance and Safety in LLMs through Correlation-based Sparse Autoencoder Feature Selection Paper • 2508.12535 • Published Aug 18, 2025 • 2
Running 84 Bringing paper to life: A modern template for scientific writing 📝 84 Explore an interactive galaxy visualization of scientific article