Text Generation
PEFT
Safetensors
lora
trl
grpo
gdpo
dpo
divpo
rlhf
diversity
creative-writing
mode-collapse
Instructions to use Mercity/creative-writing-llm with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use Mercity/creative-writing-llm with PEFT:
Task type is invalid.
- Notebooks
- Google Colab
- Kaggle
Add outputs/pool_4b
Browse files- .gitattributes +1 -0
- outputs/pool_4b/emb_train.npy +3 -0
- outputs/pool_4b/pool_train.jsonl +3 -0
- outputs/pool_4b/summary_train.json +37 -0
.gitattributes
CHANGED
|
@@ -40,3 +40,4 @@ logs/figures/E0-baseline_trajectory.png filter=lfs diff=lfs merge=lfs -text
|
|
| 40 |
logs/figures/E0_entropy_live.png filter=lfs diff=lfs merge=lfs -text
|
| 41 |
logs/figures/E0_live_dashboard.png filter=lfs diff=lfs merge=lfs -text
|
| 42 |
outputs/pairs_4b/multipos_train.jsonl filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
| 40 |
logs/figures/E0_entropy_live.png filter=lfs diff=lfs merge=lfs -text
|
| 41 |
logs/figures/E0_live_dashboard.png filter=lfs diff=lfs merge=lfs -text
|
| 42 |
outputs/pairs_4b/multipos_train.jsonl filter=lfs diff=lfs merge=lfs -text
|
| 43 |
+
outputs/pool_4b/pool_train.jsonl filter=lfs diff=lfs merge=lfs -text
|
outputs/pool_4b/emb_train.npy
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d04e5ffcfa653c90b65c1bb9593b4a5a297ebd50798ef29b7f8eff538cd7b604
|
| 3 |
+
size 49152128
|
outputs/pool_4b/pool_train.jsonl
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:dcf05f378b65db749dde407cf48f2d25fc33bdd3f5780510c8c904d23fe7c986
|
| 3 |
+
size 45736834
|
outputs/pool_4b/summary_train.json
ADDED
|
@@ -0,0 +1,37 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"tag": "4b",
|
| 3 |
+
"model": "Qwen/Qwen3-4B-Instruct-2507",
|
| 4 |
+
"split": "train",
|
| 5 |
+
"n_prompts": 1000,
|
| 6 |
+
"n_per_prompt": 16,
|
| 7 |
+
"n_stories": 16000,
|
| 8 |
+
"temperature": 1.0,
|
| 9 |
+
"seed": 1234,
|
| 10 |
+
"gate_pass_rate": 0.992,
|
| 11 |
+
"ends_cleanly_rate": 0.9959375,
|
| 12 |
+
"median_words": 386.0,
|
| 13 |
+
"quality_mean": 6.447013608870968,
|
| 14 |
+
"quality_sd": 0.8326229583324123,
|
| 15 |
+
"novelty_mean": 5.795047883064516,
|
| 16 |
+
"deviation_mean": 0.13211679685430608,
|
| 17 |
+
"logdet_mean": -30.41581650515965,
|
| 18 |
+
"gen_minutes": 15.88515907128652,
|
| 19 |
+
"judge_cost": {
|
| 20 |
+
"calls": 17124,
|
| 21 |
+
"tok_in": 18416228,
|
| 22 |
+
"tok_out": 680627,
|
| 23 |
+
"usd": 2.7688,
|
| 24 |
+
"rows": 16130,
|
| 25 |
+
"hits": 0,
|
| 26 |
+
"misses": 15872,
|
| 27 |
+
"hit_rate": 0.0
|
| 28 |
+
},
|
| 29 |
+
"judge_health": {
|
| 30 |
+
"calls_ok": 17124,
|
| 31 |
+
"failed": 77,
|
| 32 |
+
"empty_content": 224,
|
| 33 |
+
"truncated": 257,
|
| 34 |
+
"fail_rate": 0.004476483925353177,
|
| 35 |
+
"last_error": "ValueError: empty content (reasoning ate the budget?)"
|
| 36 |
+
}
|
| 37 |
+
}
|