Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

SamWang0405
/
Syncopate-AgenticRL

Reinforcement Learning
PEFT
Safetensors
Chinese
lora
agentic
verl
tool-use
Model card Files Files and versions
xet
Community

Instructions to use SamWang0405/Syncopate-AgenticRL with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Libraries
  • PEFT

    How to use SamWang0405/Syncopate-AgenticRL with PEFT:

    Task type is invalid.
  • Notebooks
  • Google Colab
  • Kaggle
Syncopate-AgenticRL / sft
1.62 GB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 1 commit
SamWang0405's picture
SamWang0405
底座与出处链:SFT merged 底座 ×2(不可比特复现的真身,重合并实测 4.9e-4 抖动)+ SFT LoRA adapter ×2;README 结构与用法改为单仓库 subfolder 口径
e2b6e22 about 22 hours ago
  • v13
    底座与出处链:SFT merged 底座 ×2(不可比特复现的真身,重合并实测 4.9e-4 抖动)+ SFT LoRA adapter ×2;README 结构与用法改为单仓库 subfolder 口径 about 22 hours ago
  • v13r2
    底座与出处链:SFT merged 底座 ×2(不可比特复现的真身,重合并实测 4.9e-4 抖动)+ SFT LoRA adapter ×2;README 结构与用法改为单仓库 subfolder 口径 about 22 hours ago