final_M5 / README.md
Databaker's picture
Update README.md
a934d8c verified
|
Raw
History Blame Contribute Delete
917 Bytes
# final_M5
藏文OCR藏汉英混排识别模型 **M5**
## 内容
| 文件 | 用途 | MD5 |
|---|---|---|
| `inference.json` / `inference.pdiparams` / `inference.yml` | 推理模型三件套,下载即可直接推理 | pdiparams `399a70dd` |
| `best_accuracy.pdparams` | M5 原始训练权重(复现/继续微调) | `a9006328` |
## 直接推理
```python
from paddlex import create_model
ocr = create_model(model_name="PP-OCRv5_server_rec", model_dir="./final_M5")
for res in ocr.predict("test.png", batch_size=1):
print(res["rec_text"], res["rec_score"])
```
## 谱系
```
官方PP-OCRv5预训练
→ M2(全量76万真实数据训练,2026-02-25)
→ M5(M2基座 + 人工标注混排微调,2026-03-19)= 本模型
```
- 基座 M2 已覆盖全量真实下载数据(openpecha + pdf_ocr,765,728条)
- M5 微调数据:human_mixed_train.txt(真实采样 + 合成 + 人工标注)