Утечка оперативной памяти при использовании giga am v3 e2e rnnt на gpu
Я использую модель GigaAM (v3_e2e_rnnt) для speech-to-text.
Столкнулся с проблемой: при работе на GPU наблюдается постоянный рост оперативной памяти (RAM).
При этом GPU память (VRAM) ведёт себя нормально, растёт именно RAM процесса, память не освобождается после завершения обработки. Если запускать на CPU, такой проблемы нет.
Это известная проблема?
Есть ли рекомендуемый способ использовать модель без роста RAM?
При этом GPU память (VRAM) ведёт себя нормально, растёт именно RAM процесса, память не освобождается после завершения обработки. Если запускать на CPU, такой проблемы нет.
память выделяется для аудио данных которые загружаются в память видеокарты. Устроено так что после того как объем памяти выделен он остаётся зарезервированным для этого процесса, и не уменьшается но и не увеличивается если не отправлять более объемные записи. сделано для оптимизации, чтобы не выделять память при каждом запросе. Это можно очистить через torch.cuda.empty_cache() но вроде как не рекомендуется