| # final_M5 |
| |
| 藏文OCR藏汉英混排识别模型 **M5** |
| |
| ## 内容 |
| |
| | 文件 | 用途 | MD5 | |
| |---|---|---| |
| | `inference.json` / `inference.pdiparams` / `inference.yml` | 推理模型三件套,下载即可直接推理 | pdiparams `399a70dd` | |
| | `best_accuracy.pdparams` | M5 原始训练权重(复现/继续微调) | `a9006328` | |
|
|
| ## 直接推理 |
|
|
| ```python |
| from paddlex import create_model |
| ocr = create_model(model_name="PP-OCRv5_server_rec", model_dir="./final_M5") |
| for res in ocr.predict("test.png", batch_size=1): |
| print(res["rec_text"], res["rec_score"]) |
| ``` |
|
|
| ## 谱系 |
|
|
| ``` |
| 官方PP-OCRv5预训练 |
| → M2(全量76万真实数据训练,2026-02-25) |
| → M5(M2基座 + 人工标注混排微调,2026-03-19)= 本模型 |
| ``` |
|
|
| - 基座 M2 已覆盖全量真实下载数据(openpecha + pdf_ocr,765,728条) |
| - M5 微调数据:human_mixed_train.txt(真实采样 + 合成 + 人工标注) |
| |