Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
bk1dr
/
qwen3-8b-code-pkpo
like
0
Reinforcement Learning
Safetensors
qwen3
code
pkpo
livecodebench
License:
other
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
qwen3-8b-code-pkpo
/
eval
120 kB
Ctrl+K
Ctrl+K
1 contributor
History:
2 commits
bk1dr
Ship best-by-validation checkpoint stage1_group3
a4c4924
verified
about 1 month ago
baseline_results.json
8.8 kB
Upload merged PKPO run
about 1 month ago
eval_subset.json
9.36 kB
Upload merged PKPO run
about 1 month ago
final_results.json
8.32 kB
Ship best-by-validation checkpoint stage1_group3
about 1 month ago
full_schedule_endpoint_results.json
8.93 kB
Ship best-by-validation checkpoint stage1_group3
about 1 month ago
selection_results.json
29.5 kB
Ship best-by-validation checkpoint stage1_group3
about 1 month ago
sft_log.json
18.4 kB
Upload merged PKPO run
about 1 month ago
training_stage_log.json
36.6 kB
Upload merged PKPO run
about 1 month ago