Q1_0_g128 CPU kernel fix + AVX2 SIMD (fork of PrismML-Eng/llama.cpp)

03ba2cd verified 6 days ago

518 Bytes

	#pragma once

	#include "common.h"

	#ifdef __cplusplus
	extern "C" {
	#endif

	void ggml_compute_forward_add_non_quantized(const struct ggml_compute_params * params, struct ggml_tensor * dst);
	void ggml_compute_forward_sub(const struct ggml_compute_params * params, struct ggml_tensor * dst);
	void ggml_compute_forward_mul(const struct ggml_compute_params * params, struct ggml_tensor * dst);
	void ggml_compute_forward_div(const struct ggml_compute_params * params, struct ggml_tensor * dst);

	#ifdef __cplusplus
	}
	#endif