Download ggml/include/ggml-cuda.h from OpenTransformer/llama.cpp-prismml: direct link, hf CLI and curl.
- Browser
- Download file 1.59 kB
-
https://huggingface.co/OpenTransformer/llama.cpp-prismml/resolve/main/ggml/include/ggml-cuda.h
- Command line
-
hf download hf://OpenTransformer/llama.cpp-prismml/ggml/include/ggml-cuda.h
-
curl -L -o ggml-cuda.h https://huggingface.co/OpenTransformer/llama.cpp-prismml/resolve/main/ggml/include/ggml-cuda.h
1.59 kB
| extern "C" { | |
| // backend API | |
| GGML_BACKEND_API ggml_backend_t ggml_backend_cuda_init(int device); | |
| GGML_BACKEND_API bool ggml_backend_is_cuda(ggml_backend_t backend); | |
| // device buffer | |
| GGML_BACKEND_API ggml_backend_buffer_type_t ggml_backend_cuda_buffer_type(int device); | |
| // split tensor buffer that splits matrices by rows across multiple devices | |
| GGML_BACKEND_API ggml_backend_buffer_type_t ggml_backend_cuda_split_buffer_type(int main_device, const float * tensor_split); | |
| // pinned host buffer for use with the CPU backend for faster copies between CPU and GPU | |
| GGML_BACKEND_API ggml_backend_buffer_type_t ggml_backend_cuda_host_buffer_type(void); | |
| GGML_BACKEND_API int ggml_backend_cuda_get_device_count(void); | |
| GGML_BACKEND_API void ggml_backend_cuda_get_device_description(int device, char * description, size_t description_size); | |
| GGML_BACKEND_API void ggml_backend_cuda_get_device_memory(int device, size_t * free, size_t * total); | |
| GGML_BACKEND_API bool ggml_backend_cuda_register_host_buffer(void * buffer, size_t size); | |
| GGML_BACKEND_API void ggml_backend_cuda_unregister_host_buffer(void * buffer); | |
| GGML_BACKEND_API ggml_backend_reg_t ggml_backend_cuda_reg(void); | |
| } | |