pangkaiyu commited on
Commit
d042b2b
·
verified ·
1 Parent(s): bb8c541

Add files using upload-large-folder tool

Browse files
This view is limited to 50 files because it contains too many changes.   See raw diff
Files changed (50) hide show
  1. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi.jsonl +0 -0
  2. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi_default_performance.json +25 -0
  3. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi_wer_details.jsonl +0 -0
  4. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank0.log +4 -0
  5. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank1.log +2 -0
  6. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank2.log +2 -0
  7. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank3.log +2 -0
  8. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank4.log +2 -0
  9. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank5.log +2 -0
  10. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank6.log +2 -0
  11. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank7.log +2 -0
  12. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi.jsonl +0 -0
  13. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi_default_performance.json +25 -0
  14. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi_wer_details.jsonl +0 -0
  15. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank0.log +4 -0
  16. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank1.log +2 -0
  17. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank2.log +2 -0
  18. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank3.log +2 -0
  19. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank4.log +2 -0
  20. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank5.log +2 -0
  21. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank6.log +2 -0
  22. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank7.log +2 -0
  23. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus.jsonl +0 -0
  24. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus_default_performance.json +121 -0
  25. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus_wer_details.jsonl +0 -0
  26. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank0.log +5 -0
  27. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank1.log +2 -0
  28. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank2.log +2 -0
  29. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank3.log +2 -0
  30. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank4.log +2 -0
  31. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank5.log +2 -0
  32. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank6.log +2 -0
  33. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank7.log +2 -0
  34. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1.jsonl +0 -0
  35. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1_default_performance.json +13 -0
  36. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1_wer_details.jsonl +0 -0
  37. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank0.log +4 -0
  38. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank1.log +2 -0
  39. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank2.log +2 -0
  40. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank3.log +2 -0
  41. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank4.log +2 -0
  42. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank5.log +2 -0
  43. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank6.log +2 -0
  44. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank7.log +2 -0
  45. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo.jsonl +0 -0
  46. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo_default_performance.json +25 -0
  47. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo_wer_details.jsonl +0 -0
  48. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/logs/rank0.log +4 -0
  49. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/logs/rank1.log +2 -0
  50. mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/logs/rank2.log +2 -0
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi_default_performance.json ADDED
@@ -0,0 +1,25 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "task": "ASR",
3
+ "dataset": "chime4_dev-real_kimi",
4
+ "model": "Step-Audio-2-mini-all-lora1",
5
+ "date": "2026-01-05 08:36:28.405629",
6
+ "performance": {
7
+ "bus": {
8
+ "wer": 4.14,
9
+ "total": 410
10
+ },
11
+ "caf": {
12
+ "wer": 3.9,
13
+ "total": 410
14
+ },
15
+ "ped": {
16
+ "wer": 3.42,
17
+ "total": 410
18
+ },
19
+ "str": {
20
+ "wer": 3.66,
21
+ "total": 410
22
+ }
23
+ },
24
+ "eval_method": "qwen2-audio-impl"
25
+ }
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi_wer_details.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank0.log ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ 2026-01-05 03:39:29 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:29 | INFO | Msg example: {'index': 1, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C0103_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
3
+ 2026-01-05 03:42:05 | INFO | model Step-Audio-2-mini-all-lora1, data chime4_dev-real_kimi, all 8 result merged to mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/Step-Audio-2-mini-all-lora1_chime4_dev-real_kimi.jsonl.
4
+ 2026-01-05 03:42:05 | INFO | skip eval for chime4_dev-real_kimi
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank1.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:17 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:17 | INFO | Msg example: {'index': 2, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C0105_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank2.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:18 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:18 | INFO | Msg example: {'index': 3, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C010C_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank3.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:19 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:19 | INFO | Msg example: {'index': 4, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C010G_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank4.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:18 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:18 | INFO | Msg example: {'index': 5, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C010J_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank5.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:18 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:18 | INFO | Msg example: {'index': 6, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C010K_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank6.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:18 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:18 | INFO | Msg example: {'index': 7, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C010L_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_dev-real_kimi/logs/rank7.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:39:17 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_dev-real_kimi
2
+ 2026-01-05 03:39:17 | INFO | Msg example: {'index': 8, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/dt05_bus_real/F01_050C010O_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-dev-real', 'dataset_name': 'chime4_dev-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi_default_performance.json ADDED
@@ -0,0 +1,25 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "task": "ASR",
3
+ "dataset": "chime4_test-real_kimi",
4
+ "model": "Step-Audio-2-mini-all-lora1",
5
+ "date": "2026-01-05 08:36:29.163296",
6
+ "performance": {
7
+ "bus": {
8
+ "wer": 7.62,
9
+ "total": 330
10
+ },
11
+ "caf": {
12
+ "wer": 5.14,
13
+ "total": 330
14
+ },
15
+ "ped": {
16
+ "wer": 4.75,
17
+ "total": 330
18
+ },
19
+ "str": {
20
+ "wer": 4.59,
21
+ "total": 330
22
+ }
23
+ },
24
+ "eval_method": "qwen2-audio-impl"
25
+ }
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi_wer_details.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank0.log ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ 2026-01-05 03:42:05 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:42:05 | INFO | Msg example: {'index': 1, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C0202_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
3
+ 2026-01-05 03:44:13 | INFO | model Step-Audio-2-mini-all-lora1, data chime4_test-real_kimi, all 8 result merged to mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/Step-Audio-2-mini-all-lora1_chime4_test-real_kimi.jsonl.
4
+ 2026-01-05 03:44:13 | INFO | skip eval for chime4_test-real_kimi
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank1.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:41:53 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:41:53 | INFO | Msg example: {'index': 2, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C0204_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank2.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:41:46 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:41:46 | INFO | Msg example: {'index': 3, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C0209_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank3.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:42:05 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:42:05 | INFO | Msg example: {'index': 4, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C020E_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank4.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:41:56 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:41:56 | INFO | Msg example: {'index': 5, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C020F_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank5.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:41:55 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:41:55 | INFO | Msg example: {'index': 6, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C020G_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank6.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:41:57 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:41:57 | INFO | Msg example: {'index': 7, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C020H_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/chime4_test-real_kimi/logs/rank7.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:41:55 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: chime4_test-real_kimi
2
+ 2026-01-05 03:41:55 | INFO | Msg example: {'index': 8, 'audio': ['/workspace/intern/pangkaiyu/dg/CHIME-4/CHiME4/data/audio/16kHz/isolated_1ch_track/et05_bus_real/F05_440C020I_BUS.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'chime4-test-real', 'dataset_name': 'chime4_test-real_kimi', 'lang': 'en', 'subset': 'bus'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus_default_performance.json ADDED
@@ -0,0 +1,121 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "task": "ASR",
3
+ "dataset": "noizeus",
4
+ "model": "Step-Audio-2-mini-all-lora1",
5
+ "date": "2026-01-05 08:36:27.449734",
6
+ "performance": {
7
+ "airport_0dB": {
8
+ "wer": 19.01,
9
+ "total": 30
10
+ },
11
+ "airport_10dB": {
12
+ "wer": 1.24,
13
+ "total": 30
14
+ },
15
+ "airport_15dB": {
16
+ "wer": 1.24,
17
+ "total": 30
18
+ },
19
+ "airport_5dB": {
20
+ "wer": 7.44,
21
+ "total": 30
22
+ },
23
+ "babble_0dB": {
24
+ "wer": 36.36,
25
+ "total": 30
26
+ },
27
+ "babble_10dB": {
28
+ "wer": 2.89,
29
+ "total": 30
30
+ },
31
+ "babble_15dB": {
32
+ "wer": 2.48,
33
+ "total": 30
34
+ },
35
+ "babble_5dB": {
36
+ "wer": 4.55,
37
+ "total": 30
38
+ },
39
+ "car_0dB": {
40
+ "wer": 31.4,
41
+ "total": 30
42
+ },
43
+ "car_10dB": {
44
+ "wer": 3.72,
45
+ "total": 30
46
+ },
47
+ "car_15dB": {
48
+ "wer": 2.48,
49
+ "total": 30
50
+ },
51
+ "car_5dB": {
52
+ "wer": 7.85,
53
+ "total": 30
54
+ },
55
+ "exhibition_0dB": {
56
+ "wer": 29.34,
57
+ "total": 30
58
+ },
59
+ "exhibition_10dB": {
60
+ "wer": 4.13,
61
+ "total": 30
62
+ },
63
+ "exhibition_15dB": {
64
+ "wer": 2.48,
65
+ "total": 30
66
+ },
67
+ "exhibition_5dB": {
68
+ "wer": 7.44,
69
+ "total": 30
70
+ },
71
+ "restaurant_0dB": {
72
+ "wer": 23.97,
73
+ "total": 30
74
+ },
75
+ "restaurant_10dB": {
76
+ "wer": 1.65,
77
+ "total": 30
78
+ },
79
+ "restaurant_15dB": {
80
+ "wer": 2.07,
81
+ "total": 30
82
+ },
83
+ "restaurant_5dB": {
84
+ "wer": 7.02,
85
+ "total": 30
86
+ },
87
+ "station_0dB": {
88
+ "wer": 23.14,
89
+ "total": 30
90
+ },
91
+ "station_10dB": {
92
+ "wer": 2.89,
93
+ "total": 30
94
+ },
95
+ "station_15dB": {
96
+ "wer": 1.65,
97
+ "total": 30
98
+ },
99
+ "station_5dB": {
100
+ "wer": 8.26,
101
+ "total": 30
102
+ },
103
+ "street_0dB": {
104
+ "wer": 38.43,
105
+ "total": 30
106
+ },
107
+ "street_10dB": {
108
+ "wer": 4.13,
109
+ "total": 30
110
+ },
111
+ "street_15dB": {
112
+ "wer": 2.07,
113
+ "total": 30
114
+ },
115
+ "street_5dB": {
116
+ "wer": 11.16,
117
+ "total": 30
118
+ }
119
+ },
120
+ "eval_method": "qwen2-audio-impl"
121
+ }
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus_wer_details.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank0.log ADDED
@@ -0,0 +1,5 @@
 
 
 
 
 
 
1
+ 2026-01-05 03:38:26 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:26 | INFO | Msg example: {'index': 0, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp01_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
3
+ 2026-01-05 03:39:29 | INFO | waiting for other ranks to finish, time elapsed: 10s
4
+ 2026-01-05 03:39:29 | INFO | model Step-Audio-2-mini-all-lora1, data noizeus, all 8 result merged to mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/Step-Audio-2-mini-all-lora1_noizeus.jsonl.
5
+ 2026-01-05 03:39:29 | INFO | skip eval for noizeus
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank1.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:26 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:26 | INFO | Msg example: {'index': 1, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp02_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank2.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:26 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:26 | INFO | Msg example: {'index': 2, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp03_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank3.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:26 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:26 | INFO | Msg example: {'index': 3, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp04_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank4.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:31 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:31 | INFO | Msg example: {'index': 4, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp05_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank5.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:26 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:26 | INFO | Msg example: {'index': 5, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp06_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank6.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:26 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:26 | INFO | Msg example: {'index': 6, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp07_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/noizeus/logs/rank7.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:38:31 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: noizeus
2
+ 2026-01-05 03:38:31 | INFO | Msg example: {'index': 7, 'audio': ['/workspace/intern/pangkaiyu/Kimi-Audio/Kimi-Audio-Evalkit/data/downloaded_datasets/noizeus/noizeus/airport/0dB/sp08_airport_sn0.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'noizeus', 'dataset_name': 'noizeus', 'lang': 'en', 'subset': 'airport_0dB'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1_default_performance.json ADDED
@@ -0,0 +1,13 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "task": "ASR",
3
+ "dataset": "tedlium_test1",
4
+ "model": "Step-Audio-2-mini-all-lora1",
5
+ "date": "2026-01-05 08:36:30.049671",
6
+ "performance": {
7
+ "TEDLIUM-test": {
8
+ "wer": 2.49,
9
+ "total": 1155
10
+ }
11
+ },
12
+ "eval_method": "qwen2-audio-impl"
13
+ }
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1_wer_details.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank0.log ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ 2026-01-05 03:44:13 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:44:13 | INFO | Msg example: {'index': 0, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-16.11-27.84-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
3
+ 2026-01-05 03:47:02 | INFO | model Step-Audio-2-mini-all-lora1, data tedlium_test1, all 8 result merged to mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/Step-Audio-2-mini-all-lora1_tedlium_test1.jsonl.
4
+ 2026-01-05 03:47:02 | INFO | skip eval for tedlium_test1
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank1.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:43:55 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:43:55 | INFO | Msg example: {'index': 1, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-27.84-38.316-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank2.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:43:45 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:43:45 | INFO | Msg example: {'index': 2, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-38.316-47.64-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank3.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:44:10 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:44:10 | INFO | Msg example: {'index': 3, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-47.64-57.27-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank4.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:44:01 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:44:01 | INFO | Msg example: {'index': 4, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-57.27-63.88-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank5.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:43:55 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:43:55 | INFO | Msg example: {'index': 5, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-63.88-71.56-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank6.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:44:04 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:44:04 | INFO | Msg example: {'index': 6, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-71.56-79.704-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/tedlium_test1/logs/rank7.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 03:44:00 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: tedlium_test1
2
+ 2026-01-05 03:44:00 | INFO | Msg example: {'index': 7, 'audio': ['/workspace/intern/pangkaiyu/dg/tedlium_release1_data/test/wav/MichaelSpecter-79.704-87.33-<o,f0,male>.wav'], 'text': 'Please transcribe the audio content into text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'tedlium', 'dataset_name': 'tedlium_test1', 'lang': 'en', 'subset': 'TEDLIUM-test'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo_default_performance.json ADDED
@@ -0,0 +1,25 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "task": "ASR",
3
+ "dataset": "voices_dev_clo",
4
+ "model": "Step-Audio-2-mini-all-lora1",
5
+ "date": "2026-01-05 08:36:40.007096",
6
+ "performance": {
7
+ "babb": {
8
+ "wer": 1.96,
9
+ "total": 364
10
+ },
11
+ "musi": {
12
+ "wer": 1.56,
13
+ "total": 371
14
+ },
15
+ "none": {
16
+ "wer": 1.63,
17
+ "total": 380
18
+ },
19
+ "tele": {
20
+ "wer": 1.65,
21
+ "total": 351
22
+ }
23
+ },
24
+ "eval_method": "qwen2-audio-impl"
25
+ }
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo_wer_details.jsonl ADDED
The diff for this file is too large to render. See raw diff
 
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/logs/rank0.log ADDED
@@ -0,0 +1,4 @@
 
 
 
 
 
1
+ 2026-01-05 04:13:28 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: voices_dev_clo
2
+ 2026-01-05 04:13:28 | INFO | Msg example: {'index': 1, 'audio': ['/workspace/intern/pangkaiyu/dg/VOiCES_Box_unzip/Development_Data/Automatic_Speech_Recognition/ASR_dev.v2/rm1/babb/sp_0032-1182/sp0112/Lab41-SRI-VOiCES-rm1-babb-sp0112-ch123215-sg0025-mc01-stu-clo-dg080.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'voices', 'dataset_name': 'voices_dev_clo', 'lang': 'en', 'subset': 'babb'}}
3
+ 2026-01-05 04:19:18 | INFO | model Step-Audio-2-mini-all-lora1, data voices_dev_clo, all 8 result merged to mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/Step-Audio-2-mini-all-lora1_voices_dev_clo.jsonl.
4
+ 2026-01-05 04:19:18 | INFO | skip eval for voices_dev_clo
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/logs/rank1.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 04:12:11 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: voices_dev_clo
2
+ 2026-01-05 04:12:11 | INFO | Msg example: {'index': 2, 'audio': ['/workspace/intern/pangkaiyu/dg/VOiCES_Box_unzip/Development_Data/Automatic_Speech_Recognition/ASR_dev.v2/rm1/babb/sp_0032-1182/sp0122/Lab41-SRI-VOiCES-rm1-babb-sp0122-ch121729-sg0002-mc02-lav-clo-dg060.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'voices', 'dataset_name': 'voices_dev_clo', 'lang': 'en', 'subset': 'babb'}}
mini_whole/mini-encoder+align-whole1226_signal_new1-dpdc-low-lora-1gpu-bs16_1_gckF2000/Step-Audio-2-mini-all-lora1/voices_dev_clo/logs/rank2.log ADDED
@@ -0,0 +1,2 @@
 
 
 
1
+ 2026-01-05 04:11:53 | INFO | Running Step-Audio-2-mini-all-lora1 on dataset: voices_dev_clo
2
+ 2026-01-05 04:11:53 | INFO | Msg example: {'index': 3, 'audio': ['/workspace/intern/pangkaiyu/dg/VOiCES_Box_unzip/Development_Data/Automatic_Speech_Recognition/ASR_dev.v2/rm1/babb/sp_0032-1182/sp0122/Lab41-SRI-VOiCES-rm1-babb-sp0122-ch121730-sg0014-mc01-stu-clo-dg000.wav'], 'text': 'Please transcribe the spoken content into written text.', 'meta': {'task': 'ASR', 'interactive': 'Audio-analysis', 'audio_type': 'Speech', 'dataset_series': 'voices', 'dataset_name': 'voices_dev_clo', 'lang': 'en', 'subset': 'babb'}}