哥们,这效果也太差了

#34
by AlexLee111 - opened

不是哥们,咱能别过拟合测评集吗?

不说别的,就说pdf解析,真实场景上跑你们这个pdf析速度慢的离谱,我一开始还纳闷,拿结果一看一堆复读机样本,效果差的和前几天百度unlimt ocr有的一拼,两个都是复读🐔

那技术报告写的花里胡哨的,你们自己信吗?

调你们这个模型我周末都在加班,调出来这效果,你说叫人蚌埠崩溃?????

麻烦拿点有诚意的东西,不然我以后再也不碰浑圆

可以同步一下推理代码,以及部署方式
如果目前使用llamacpp部署,会因为EOS默认对齐120020导致重复预测
推荐使用vllm部署

确实太拉了,用它官方的推理代码,测一张身份证简单的信息提取,生成的东西乱七八糟。

感谢两位反馈,check后发现hf的eos符设置错误,导致模型重复预测幻觉输出,目前hf的model config已经fix
同时transformer input的连接与训练不一致,也会在今日进行仓库更新
欢迎持续反馈

+1,卡了我巨长时间以为自己哪配错了;(

不止,hg的transformer测试代码,processer没有禁用use_fast属性,会导致图片预处理完全错误,导致胡乱输出。

不止,hg的transformer测试代码,processer没有禁用use_fast属性,会导致图片预处理完全错误,导致胡乱输出。

我操哥们,这bug怎么de出来的,总算能用了🤣

不止,hg的transformer测试代码,processer没有禁用use_fast属性,会导致图片预处理完全错误,导致胡乱输出。

你好,感谢关注,我们也注意到了这一点,也能复现这个问题,可以参考官方 GitHub 仓库里的推理代码,这份是正确的
https://github.com/Tencent-Hunyuan/HunyuanOCR/blob/main/inference/transformers/infer_hf_8gpu_hyocr15.py

对于 fast processer 的问题修复的 pull request 在这: https://github.com/huggingface/transformers/pull/47499
可以本地执行这些修改,尝试一下问题是否修复

Tencent org

请问在upstream的transformer可以正常工作吗?

请问现在正常了吗?问题已经全部修复了?我直接拉最新的代码就能正常跑了吗?

请问现在正常了吗?问题已经全部修复了?我直接拉最新的代码就能正常跑了吗?

你好,我们近期又进行了一轮测试,也推出了一个同时支持 Transformers、vLLM、DFlash 的推理环境,可以参考以下链接进行配置和使用
https://github.com/Tencent-Hunyuan/HunyuanOCR/blob/main/docs/inference/inference_zh.md
我们推荐使用 vLLM 引擎进行推理
如果机器没有 CUDA13,可以参考下面这个环境单独配置 CUDA12 的 vLLM 推理
https://github.com/Tencent-Hunyuan/HunyuanOCR/blob/main/docs/inference/archive/vLLM_zh.md

在使用前请重新拉取或者更新 tencent/HunyuanOCR 模型,以保证配置文件为最新版

GitHub 仓库中所有公布的环境均经过测试,如果在使用过程中仍发现问题,欢迎进一步讨论

Sign up or log in to comment