Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
wangclnlp
/
GRAM-RR-LLaMA-3.1-8B-RewardModel
like
2
Text Generation
Safetensors
English
llama
Reward
RewardModel
RewardReasoning
Reasoning
RLHF
Best-of-N
conversational
arxiv:
2509.02492
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
GRAM-RR-LLaMA-3.1-8B-RewardModel
Commit History
Update README.md
47fb536
verified
wangclnlp
commited on
Sep 4, 2025
Upload README.md with huggingface_hub
5b5261b
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
0013266
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
706ea74
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
1d97403
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
6c53225
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
46fabba
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
4af9bd0
verified
wangclnlp
commited on
Aug 31, 2025
Upload folder using huggingface_hub
0060ca9
verified
wangclnlp
commited on
Aug 31, 2025
initial commit
337d41a
verified
wangclnlp
commited on
Aug 30, 2025