nielsr's picture
nielsr HF Staff
Add metadata, link to paper
0b3ce58 verified
|
Raw
History Blame
1.6 kB
---
language: en
license: apache-2.0
pipeline_tag: text-generation
library_name: transformers
---
# πŸ¦’ The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation
This repository hosts the models from **PlanPhys**, a family of foundation models designed for researching multi-turn long-horizon planning.
The PlanPhys model family explores different training strategies, including Random model, SFT model, OPD model.
Paper: https://huggingface.co/papers/2607.24720
Project page: https://quester-one.github.io/PlanPhysWebsite/
Code: https://github.com/Quester-one/PlanPhysCode
---
## πŸš€ Model Zoo
We provide multiple PlanPhys models (**The data is in each Files and version**):
| Model |
|---|
| πŸ”Ή [PlanPhys-Model-Pre-Training-Random](https://huggingface.co/MultimodalAgent/PlanPhys-Model-Pre-Training-Random) |
| πŸ”Ή [PlanPhys-Model-Pre-Training-Scaling](https://huggingface.co/MultimodalAgent/PlanPhys-Model-Pre-Training-Scaling) |
| πŸ”Ή [PlanPhys-Model-Pre-Training-Distribution](https://huggingface.co/MultimodalAgent/PlanPhys-Model-Pre-Training-Distribution) |
| πŸ”Ή [PlanPhys-Model-Pre-Training-Ensemble](https://huggingface.co/MultimodalAgent/PlanPhys-Model-Pre-Training-Ensemble) |
---
## πŸ“ Citation
If you find PlanPhys useful in your research, please cite:
```bibtex
@article{PlanPhys,
title={The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation},
author={},
journal={},
year={}
}
```