Pranav2748 commited on
Commit
36dc922
·
verified ·
1 Parent(s): 348f33d

Add outputs/pool_4b

Browse files
.gitattributes CHANGED
@@ -40,3 +40,4 @@ logs/figures/E0-baseline_trajectory.png filter=lfs diff=lfs merge=lfs -text
40
  logs/figures/E0_entropy_live.png filter=lfs diff=lfs merge=lfs -text
41
  logs/figures/E0_live_dashboard.png filter=lfs diff=lfs merge=lfs -text
42
  outputs/pairs_4b/multipos_train.jsonl filter=lfs diff=lfs merge=lfs -text
 
 
40
  logs/figures/E0_entropy_live.png filter=lfs diff=lfs merge=lfs -text
41
  logs/figures/E0_live_dashboard.png filter=lfs diff=lfs merge=lfs -text
42
  outputs/pairs_4b/multipos_train.jsonl filter=lfs diff=lfs merge=lfs -text
43
+ outputs/pool_4b/pool_train.jsonl filter=lfs diff=lfs merge=lfs -text
outputs/pool_4b/emb_train.npy ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d04e5ffcfa653c90b65c1bb9593b4a5a297ebd50798ef29b7f8eff538cd7b604
3
+ size 49152128
outputs/pool_4b/pool_train.jsonl ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:dcf05f378b65db749dde407cf48f2d25fc33bdd3f5780510c8c904d23fe7c986
3
+ size 45736834
outputs/pool_4b/summary_train.json ADDED
@@ -0,0 +1,37 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "tag": "4b",
3
+ "model": "Qwen/Qwen3-4B-Instruct-2507",
4
+ "split": "train",
5
+ "n_prompts": 1000,
6
+ "n_per_prompt": 16,
7
+ "n_stories": 16000,
8
+ "temperature": 1.0,
9
+ "seed": 1234,
10
+ "gate_pass_rate": 0.992,
11
+ "ends_cleanly_rate": 0.9959375,
12
+ "median_words": 386.0,
13
+ "quality_mean": 6.447013608870968,
14
+ "quality_sd": 0.8326229583324123,
15
+ "novelty_mean": 5.795047883064516,
16
+ "deviation_mean": 0.13211679685430608,
17
+ "logdet_mean": -30.41581650515965,
18
+ "gen_minutes": 15.88515907128652,
19
+ "judge_cost": {
20
+ "calls": 17124,
21
+ "tok_in": 18416228,
22
+ "tok_out": 680627,
23
+ "usd": 2.7688,
24
+ "rows": 16130,
25
+ "hits": 0,
26
+ "misses": 15872,
27
+ "hit_rate": 0.0
28
+ },
29
+ "judge_health": {
30
+ "calls_ok": 17124,
31
+ "failed": 77,
32
+ "empty_content": 224,
33
+ "truncated": 257,
34
+ "fail_rate": 0.004476483925353177,
35
+ "last_error": "ValueError: empty content (reasoning ate the budget?)"
36
+ }
37
+ }