# 모델별 변환 결과 각 모델의 FP32·양자화 원본 복사본, 변환 ONNX, ONNX Runtime 출력 비교, ONNX-MLIR 파일을 저장한다. ```text models/// ├── source/ 원본 FP32·양자화 모델 ├── baseline/ 원본 실행 검증 ├── onnx/ 변환 ONNX와 출력 비교 ├── mlir/ ONNX-MLIR 변환 결과 ├── graphs/netron Netron ONNX PNG와 메타데이터 └── run_result.json ``` 원본 모델은 `research/downloads/`에 있고 경로와 SHA-256은 [`../model_registry.csv`](../model_registry.csv)에 기록되어 있다. ## 공개 양자화 모델 정밀도 아래 정밀도는 새로 양자화한 결과가 아니라 확보한 공개 양자화 artifact의 구조를 검사한 값이다. `INT8`은 signed 8-bit, `UINT8`은 unsigned 8-bit이며, 양자화 convolution과 dense 연산의 누산기는 일반적으로 INT32를 사용한다. 내부 연산이 8-bit여도 모델 입출력 경계는 FP32일 수 있다. | 모델 | 양자화 방식 | 가중치 정밀도 | activation/core 정밀도 | 모델 입력 → 출력 | |---|---|---|---|---| | AD01 | Static PTQ, full integer | INT8 | INT8 | INT8 → INT8 | | LM04 | Dynamic ONNX quantization | INT8/UINT8 | 선택 MatMul은 dynamic UINT8, 나머지는 FP32 | INT64 tokens → FP32 | | OD06 | Static full-integer core | INT8 | INT8 | UINT8 → FP32 raw heads | | OD07 | Static full-integer core | INT8 | INT8 | UINT8 → FP32 raw heads | | SG06 | Full integer | UINT8 | UINT8 | UINT8 → INT64 class IDs | | SG07 | Full integer | UINT8 | UINT8 | UINT8 → INT64 class IDs | | SG08 | Full integer | UINT8 | UINT8 | UINT8 → INT64 class IDs | | SP01 | Static full integer | INT8 | INT8 | INT8 → INT8 | | SP02 | Full-integer public artifact | INT8 | INT8 | INT8 → INT8 | | SP08 | Full integer, legacy UINT8 artifact | UINT8 | UINT8 | UINT8 → UINT8 | | SP09 | Clustered model + static PTQ | INT8 | INT8 | INT8 → INT8 | | VC01 | Static full integer | INT8 | INT8 | INT8 → INT8 | | VC02 | Static full integer | INT8 | INT8 | INT8 → INT8 | | VC03 | QAT/FakeQuant + full integer | UINT8 | UINT8 | UINT8 → UINT8 | | VC04 | QAT/FakeQuant + full integer | UINT8 | UINT8 | UINT8 → UINT8 | | VC05 | Static INT8 | INT8 | INT8 | UINT8 → FP32 | | VC06 | Static Q/DQ INT8 ONNX | INT8 | INT8 core with FP32 boundaries | FP32 → FP32 | | VC09 | Static PTQ ONNX | INT8 | UINT8/INT8 core with FP32 boundaries | FP32 → FP32 | | VC11 | Static full integer | INT8 | INT8/UINT8 | UINT8 → UINT8 | | VC12 | Static PTQ ONNX | INT8 | UINT8/INT8 core with FP32 boundaries | FP32 → FP32 | | VC13 | Static PTQ, mixed QOperator/QDQ | INT8 | UINT8/INT8 core with FP32 boundaries | FP32 → FP32 | 모델별 scale, zero point, ONNX 표현과 ONNX-MLIR 보존 결과는 [`../reports/conversion/quantization_preservation.csv`](../reports/conversion/quantization_preservation.csv)에 있다.