Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
SeanWang0027
/
ftb-sciworld-repro
like
0
Reinforcement Learning
English
on-policy-distillation
llm-agents
scienceworld
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
ftb-sciworld-repro
/
tcod
/
trinity
/
trainer
291 kB
Ctrl+K
Ctrl+K
1 contributor
History:
1 commit
SeanWang0027
Upload folder using huggingface_hub
8c9ba62
verified
13 days ago
tinker
Upload folder using huggingface_hub
13 days ago
verl
Upload folder using huggingface_hub
13 days ago
__init__.py
153 Bytes
Upload folder using huggingface_hub
13 days ago
tinker_trainer.py
16.3 kB
Upload folder using huggingface_hub
13 days ago
trainer.py
11.5 kB
Upload folder using huggingface_hub
13 days ago
verl_trainer.py
31.7 kB
Upload folder using huggingface_hub
13 days ago