[general] name = "orbitquant-packed-matmul" version = 1 edition = 5 license = "Apache-2.0" backends = ["cpu", "cuda", "metal"] upstream = "https://github.com/iamwavecut/OrbitQuant" source = "https://huggingface.co/WaveCut/orbitquant-packed-matmul" [general.hub] repo-id = "WaveCut/orbitquant-packed-matmul" [torch] src = [ "torch-ext/torch_binding.cpp", "torch-ext/torch_binding.h", ] [torch.stable-abi] cpu = "2.11" [kernel.packed_matmul_cpu] backend = "cpu" depends = ["torch"] include = ["orbitquant_packed_matmul_cpu"] src = [ "orbitquant_packed_matmul_cpu/cpu_isa.cpp", "orbitquant_packed_matmul_cpu/cpu_kernel_args.h", "orbitquant_packed_matmul_cpu/cpu_pool.cpp", "orbitquant_packed_matmul_cpu/cpu_pool.h", "orbitquant_packed_matmul_cpu/cpu_threads.cpp", "orbitquant_packed_matmul_cpu/cpu_threads.h", "orbitquant_packed_matmul_cpu/packed_adaln_cpu.cpp", "orbitquant_packed_matmul_cpu/packed_matmul_cpu.cpp", "orbitquant_packed_matmul_cpu/packed_matmul_cpu.h", "orbitquant_packed_matmul_cpu/packed_matmul_scalar.cpp", "orbitquant_packed_matmul_cpu/packed_matmul_neon.cpp", "orbitquant_packed_matmul_cpu/packed_matmul_x86_avx512.cpp", "orbitquant_packed_matmul_cpu/quantize_activations_cpu.cpp", ] [kernel.packed_matmul_cpu_x86_avx2] backend = "cpu" depends = ["torch"] include = ["orbitquant_packed_matmul_cpu"] cxx-flags = ["$<$:/arch:AVX2>"] src = [ "orbitquant_packed_matmul_cpu/cpu_msvc_avx2.cpp", "orbitquant_packed_matmul_cpu/packed_matmul_x86.cpp", ] [kernel.packed_matmul_cuda] backend = "cuda" depends = ["torch"] src = ["orbitquant_packed_matmul_cuda/packed_matmul.cu"] [kernel.packed_matmul_metal] backend = "metal" depends = ["torch"] src = [ "orbitquant_packed_matmul_metal/packed_matmul.mm", "orbitquant_packed_matmul_metal/packed_matmul.metal", ]