whisper-medium-komixv2 (int8 q8, ONNX)

seastar105/whisper-medium-komixv2λ₯Ό optimum 1.27 + onnxruntime 1.29둜 μ΅μŠ€ν¬νŠΈν•˜κ³  int8(q8) 동적 μ–‘μžν™”ν•œ λͺ¨λΈ β€” meeting-ai-pwa의 전사(STT) κΈ°λ³Έ λͺ¨λΈ 승격용.

파일

파일 크기 λΉ„κ³ 
onnx/encoder_model_quantized.onnx ~314MB encoder (q8)
onnx/decoder_model_merged_quantized.onnx ~873MB merged decoder (q8)
κ·Έ μ™Έ β€” tokenizer/config (optimum 읡슀포트 원본)

λ‘œλ“œ 방법 (transformers.js)

import { pipeline } from '@huggingface/transformers';
const asr = await pipeline('automatic-speech-recognition', 'ALLUCY-Rodent/whisper-medium-ko', {
  dtype: { encoder_model: 'q8', decoder_model_merged: 'q8' },
});

λ³€ν™˜ μž¬ν˜„

# 1) 읡슀포트 (--task μƒλž΅ ν•„μˆ˜ β€” merged 디코더 미생성 버그)
optimum-cli export onnx -m seastar105/whisper-medium-komixv2 .convert/whisper-medium-komixv2-onnx
# 2) q8 μ–‘μžν™”
python scripts/quantize_whisper_ko.py <encoder.onnx> <encoder_q8.onnx>
python scripts/quantize_whisper_merged_decoder.py <decoder_merged.onnx> <decoder_merged_q8.onnx>

A/B 검증: 2026-08-26, AI Hub 단문 3 + μž₯λ¬Έ 38.8s β€” small(+11.2%p 정확도 μš°μœ„).

Downloads last month
11
Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for ALLUCY-Rodent/whisper-medium-ko

Quantized
(1)
this model