summaryrefslogtreecommitdiff
path: root/ik_llama-cpp-vulkan.nix
blob: 976dfc610deb25246f75114654d5907c8817a2b1 (plain)
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
{ inputs }:
self: super: {
  ik_llama-cpp-vulkan-git =
    with super;
    stdenv.mkDerivation (finalAttrs: {
      pname = "ik_llama-cpp-vulkan";
      version = "git"; # try not to break buildsystem
      src = fetchGit {
        url = "https://github.com/ikawrakow/ik_llama.cpp";
        ref = "main";
        submodules = true;
      };
      preConfigure = ''
        prependToVar cmakeFlags "-DLLAMA_BUILD_COMMIT:STRING=master"
        prependToVar cmakeFlags "-DLLAMA_BUILD_NUMBER:STRING=666"
      '';
      NIX_CFLAGS_COMPILE = "-mavx -mavx2 -mssse3 -mfma -mf16c -mbmi2 -fno-finite-math-only -O3";
      NIX_CXXFLAGS_COMPILE = "-mavx -mavx2 -mssse3 -mfma -mf16c -mbmi2 -fno-finite-math-only -O3";
      buildInputs = [
        self.shaderc_my
        vulkan-headers
        vulkan-loader
        spirv-headers
        openssl
        clblast
        blas
      ];
      nativeBuildInputs = [
        cmake
        spirv-tools
        installShellFiles
        ninja
        pkg-config
      ];
      cmakeFlags = with self.lib; [
        (cmakeBool "GGML_NATIVE" false)
        (cmakeBool "LLAMA_BUILD_EXAMPLES" false)
        (cmakeBool "LLAMA_BUILD_SERVER" true)
        (cmakeBool "LLAMA_BUILD_TESTS" false)
        (cmakeBool "LLAMA_OPENSSL" true)
        (cmakeBool "BUILD_SHARED_LIBS" true)
        (cmakeBool "GGML_BLAS" true)
        (cmakeBool "GGML_CLBLAST" true)
        (cmakeBool "GGML_CUDA" false)
        (cmakeBool "GGML_HIP" false)
        (cmakeBool "GGML_METAL" false)
        (cmakeBool "GGML_RPC" true)
        (cmakeBool "GGML_VULKAN" true)
#        (cmakeFeature "LLAMA_BUILD_NUMBER" finalAttrs.version)
        (cmakeBool "CMAKE_SKIP_BUILD_RPATH" true)
        "-DLLAMA_BUILD_WEBUI=OFF"
        "-DLLAMA_BUILD_UI=OFF"
      ];
      postInstall = ''
        mkdir -p $out/include
        cp $src/include/llama.h $out/include/
      '';
      meta = {
        description = "Inference of Meta's LLaMA model (and others) in pure C/C++";
        homepage = "https://github.com/ggml-org/llama.cpp";
        license = lib.licenses.mit;
        mainProgram = "llama";
        platforms = lib.platforms.unix;
      };
    });
}