Q1_0_g128 CPU kernel fix + AVX2 SIMD (fork of PrismML-Eng/llama.cpp)

03ba2cd verified 2 months ago

397 Bytes

	#pragma once
	#include "common.h"

	size_t ggml_backend_amx_desired_wsize(const struct ggml_tensor * dst);

	size_t ggml_backend_amx_get_alloc_size(const struct ggml_tensor * tensor);

	void ggml_backend_amx_convert_weight(struct ggml_tensor * tensor, const void * data, size_t offset, size_t size);

	void ggml_backend_amx_mul_mat(const struct ggml_compute_params * params, struct ggml_tensor * dst);