# final_M5 藏文OCR藏汉英混排识别模型 **M5** ## 内容 | 文件 | 用途 | MD5 | |---|---|---| | `inference.json` / `inference.pdiparams` / `inference.yml` | 推理模型三件套,下载即可直接推理 | pdiparams `399a70dd` | | `best_accuracy.pdparams` | M5 原始训练权重(复现/继续微调) | `a9006328` | ## 直接推理 ```python from paddlex import create_model ocr = create_model(model_name="PP-OCRv5_server_rec", model_dir="./final_M5") for res in ocr.predict("test.png", batch_size=1): print(res["rec_text"], res["rec_score"]) ``` ## 谱系 ``` 官方PP-OCRv5预训练 → M2(全量76万真实数据训练,2026-02-25) → M5(M2基座 + 人工标注混排微调,2026-03-19)= 本模型 ``` - 基座 M2 已覆盖全量真实下载数据(openpecha + pdf_ocr,765,728条) - M5 微调数据:human_mixed_train.txt(真实采样 + 合成 + 人工标注)