Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Spaces:
ehwkang
/
researchbot
like
0
Running
App
Files
Files
Community
Fetching metadata from the HF Docker repository...
main
researchbot
/
src
/
data
1.62 MB
Ctrl+K
Ctrl+K
2 contributors
History:
18 commits
ehwkang
Rename src/data/Globally Convergent Offline Reinforcement Learning with Smoothed Bellman Residual Minimization to src/data/Globally Convergent Offline Reinforcement Learning with Smoothed Bellman Residual Minimization.txt
4d0cb56
verified
2 months ago
AI alignment methods are probably (and provably) more efficient than you think.txt
Safe
73.8 kB
Upload 4 files
2 months ago
An End-to-end Offline RL Approach to Multi-turn Agentic Alignment.txt
Safe
96.9 kB
Upload 4 files
2 months ago
Bounded (O(1)) Regret Recommendation Learning via Synthetic Controls Oracle.txt
Safe
63.9 kB
Rename src/data/Bounded_SC.txt to src/data/Bounded (O(1)) Regret Recommendation Learning via Synthetic Controls Oracle.txt
9 months ago
Empirical risk minimization for Inverse RL and Dynamic Discrete Choice models.txt
Safe
244 kB
Rename src/data/ERMIRL.txt to src/data/Empirical risk minimization for Inverse RL and Dynamic Discrete Choice models.txt
9 months ago
Globally Convergent Offline Reinforcement Learning with Smoothed Bellman Residual Minimization.txt
Safe
77.7 kB
Rename src/data/Globally Convergent Offline Reinforcement Learning with Smoothed Bellman Residual Minimization to src/data/Globally Convergent Offline Reinforcement Learning with Smoothed Bellman Residual Minimization.txt
2 months ago
Is O(log N) practical_Near-Equivalence Between Delay Robustness and Bounded Regret in Bandits and RL.txt
Safe
90.8 kB
Upload Is O(log N) practical_Near-Equivalence Between Delay Robustness and Bounded Regret in Bandits and RL.txt
9 months ago
LLM Personas as a Substitute for Field Experiments in Method Benchmarking
Safe
81.2 kB
Create LLM Personas as a Substitute for Field Experiments in Method Benchmarking
8 months ago
Learning NP-Hard Multi-Agent Assignment Planning using GNN_Inference on a Random Graph and Provable Auction-Fitted Q-learning.txt
Safe
110 kB
Rename src/data/MRRC.txt to src/data/Learning NP-Hard Multi-Agent Assignment Planning using GNN_Inference on a Random Graph and Provable Auction-Fitted Q-learning.txt
9 months ago
Personalized Alignment Revisited_The Necessity and Sufficiency of User Diversity.txt
Safe
162 kB
Upload 4 files
2 months ago
Reasonably reasoning AI agents avoid game-theoretic failures in zero-shot, provably.txt
Safe
285 kB
Upload 4 files
2 months ago
Stability and Generalization for Bellman Residuals.txt
Safe
104 kB
Upload Stability and Generalization for Bellman Residuals.txt
9 months ago
TextBO: Bayesian Optimization in Language Space for Eval-Efficient Self-Improving AI.txt
Safe
233 kB
Rename src/data/Bayesian optimization in language space: An eval-efficient AI self-improvement framework.txt to src/data/TextBO: Bayesian Optimization in Language Space for Eval-Efficient Self-Improving AI.txt
2 months ago