refactor load_expert_model to disable quantization for stability and update memory usage estimation 8c6849b nexusbert commited on 14 days ago
refactor model loading functions for improved readability and maintainability f9c4d2c nexusbert commited on 14 days ago
apply dynamic quantization to expert and translation models for improved CPU performance e6c621c nexusbert commited on 14 days ago
Initial TerraSyncra AI deployment - CPU optimized with lazy loading and Qwen 1.8B model 9ebe82e nexusbert commited on Feb 25