summaryrefslogtreecommitdiff
path: root/sci-misc/llama-cpp
diff options
context:
space:
mode:
authorroot <root@alpha.trunkmasters.com>2026-06-04 16:24:49 -0500
committerroot <root@alpha.trunkmasters.com>2026-06-04 16:24:49 -0500
commita3ceca1b4c0d9bdb550dc23f06ffbb5a8e033bc7 (patch)
tree0c52bbae1c242fbc296bd650fcd1167685f81492 /sci-misc/llama-cpp
parentbfd9c39e4712ebdb442d4ca0673061faed1e70e1 (diff)
downloadbaldeagleos-repo-a3ceca1b4c0d9bdb550dc23f06ffbb5a8e033bc7.tar.gz
baldeagleos-repo-a3ceca1b4c0d9bdb550dc23f06ffbb5a8e033bc7.tar.xz
baldeagleos-repo-a3ceca1b4c0d9bdb550dc23f06ffbb5a8e033bc7.zip
Adding metadata
Diffstat (limited to 'sci-misc/llama-cpp')
-rw-r--r--sci-misc/llama-cpp/Manifest8
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre6980.ebuild132
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre7276.ebuild132
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre7611.ebuild132
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre7924.ebuild162
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre8198.ebuild162
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre8628.ebuild162
-rw-r--r--sci-misc/llama-cpp/llama-cpp-0_pre8838.ebuild167
-rw-r--r--sci-misc/llama-cpp/llama-cpp-9999.ebuild168
-rw-r--r--sci-misc/llama-cpp/metadata.xml21
10 files changed, 0 insertions, 1246 deletions
diff --git a/sci-misc/llama-cpp/Manifest b/sci-misc/llama-cpp/Manifest
deleted file mode 100644
index 9f2d63aa5f70..000000000000
--- a/sci-misc/llama-cpp/Manifest
+++ /dev/null
@@ -1,8 +0,0 @@
-DIST ggml-org_models_tinyllamas_stories15M-q4_0-99dd1a73db5a37100bd4ae633f4cfce6560e1567.gguf 19077344 BLAKE2B 16e65adf9785e3091c51f1de59e5580f93fb47f79961513aeb3dbb8a0f5930f7120f0304f0f293a006170805e2b70ee1fcff0496b63356323d32c2caa55be8a8 SHA512 f9944886089958e0d97b1906cfd45020e0821c65429346e76fae29136c634ae5d039dffbae5933a95b0674f4acd87b656feb9f9e1b16dd434c5c9b5886f4f617
-DIST llama-cpp-0_pre6980.tar.gz 26431911 BLAKE2B b7d7c0dcdabde01acb816e73bc344564823dd1fc498fb98bf3c611b2d7a964af4d94f7cad533fe675a30685d510829160e392ab0f3bd16f4757a2f3446b8e3ca SHA512 33e63336ad7c0fc653acd409d9314ce3fc3755ed1c03b4806c647b7c80d91b3c883aec6633334555c3855a24276d4975a54c96af91df8d2f818d4dd1dbcbabfb
-DIST llama-cpp-0_pre7276.tar.gz 27765814 BLAKE2B d0553ab1dd29c9d93a18c6217aab4553faf09e385a94b90732a537bbcf9bded54d5cda28553543e2c0cc71b6a157bfb80a48405f3f8281c51525757967b33e16 SHA512 3035fe53fea2ca3b0f35e479f4eaec75e38a2ea670600445776cd6fa696fc83ca19eb6dd7cd2ab1da69e78293c62318b5182e6e5b3423ae6c1f00854c5132a4c
-DIST llama-cpp-0_pre7611.tar.gz 28622786 BLAKE2B 3c345645c9bcf07d8a513b9e883619b31b5254581f73429d638403758429fd2dfc5f78a22d538e8d88eb6c1be74bf805481af697480727ed750492ddec5c37fe SHA512 c6c4780d7e68adfc385b57c6f7530423f8205bfa283572b0d414d55e143c03307e98676e41ad527c37d7837f831f8ff24be0f7bf59e366ea82f3802cdc946821
-DIST llama-cpp-0_pre7924.tar.gz 28899921 BLAKE2B b89c8c170d1c2d52390dfef35a4e0857b4a3aa174077f2fdfa0fbbe1a254c5e6ae9b976bde9f52e42ed3932403aec728b9c415ca44ccd22c061e7e8a1e481526 SHA512 689c73215e795a53be1d0e6a639983aded1ed7bdeb3a261556de3db2cfdc765a7daf4aa142433f5e99a255dc123035a929b57868d3941ddda400a3c2b1db31cb
-DIST llama-cpp-0_pre8198.tar.gz 29091642 BLAKE2B b5d02310a7e71fec88e29094aa7936cb520530fb9f81cef58f87c97948e6116734f9a19da5ad8daba1027f8e26308e5fa1f3e91e33a49539929f6e3475b08429 SHA512 bc8aef7cb29a32e0acf90d50cbf426c1a42d99659747203449ebf85f0c9c2fed98fd23b7e50b963dd537d3d6edecf17936d0cf7ae04266df4723e2d4a5c7ecfa
-DIST llama-cpp-0_pre8628.tar.gz 29611654 BLAKE2B 5efeb855b5833ca7a0ba552a142e9fac08773e0f0f31d9d3188c03840d91c91aa22edaf310a6472c9077cd4fb2a48c82371887374fb6d417dd022a18c51ff9e2 SHA512 7b86c37b3f926a0983fe6648629019e9f32001dbf474de9278d94d5e1a9e4c37dfaa9832557555724941c32c437efcbf2e91b0b0ad558936657e14ec5e52f8f0
-DIST llama-cpp-0_pre8838.tar.gz 33811834 BLAKE2B 1223a15237186dc8e11c454d76adfd875a9d6b3ee56c046fc0cf63415c7ebbb4b0dc2da49b7e697ecd9908dad6adcb4f2a5bd4665b7118d2c2508e3b215c1f39 SHA512 d345a2645dcad2564f94efdef45a7681b85f4079d30e68297b42a529ccfe4f50429067dce8685791c914cd59d00843c8e5d02c6ef7ce2d97bb990d6c896f5e9f
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre6980.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre6980.ebuild
deleted file mode 100644
index a81045e6d7d7..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre6980.ebuild
+++ /dev/null
@@ -1,132 +0,0 @@
-# Copyright 2025 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-if [[ "${PV}" != "9999" ]]; then
- KEYWORDS="~amd64"
- MY_PV="b${PV#0_pre}"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
-else
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-fi
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-IUSE="curl openblas +openmp blis hip cuda opencl vulkan flexiblas"
-REQUIRED_USE="?? ( openblas blis flexiblas )"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- hip? ( >=dev-util/hip-6.3:=
- >=sci-libs/hipBLAS-6.3:=
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? ( dev-util/vulkan-headers )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use hip; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
-
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
-
- cmake_src_prepare
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl ON OFF)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda ON OFF)
- -DGGML_OPENCL=$(usex opencl ON OFF)
- -DGGML_OPENMP=$(usex openmp ON OFF)
- -DGGML_VULKAN=$(usex vulkan ON OFF)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use hip; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre7276.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre7276.ebuild
deleted file mode 100644
index a81045e6d7d7..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre7276.ebuild
+++ /dev/null
@@ -1,132 +0,0 @@
-# Copyright 2025 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-if [[ "${PV}" != "9999" ]]; then
- KEYWORDS="~amd64"
- MY_PV="b${PV#0_pre}"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
-else
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-fi
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-IUSE="curl openblas +openmp blis hip cuda opencl vulkan flexiblas"
-REQUIRED_USE="?? ( openblas blis flexiblas )"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- hip? ( >=dev-util/hip-6.3:=
- >=sci-libs/hipBLAS-6.3:=
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? ( dev-util/vulkan-headers )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use hip; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
-
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
-
- cmake_src_prepare
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl ON OFF)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda ON OFF)
- -DGGML_OPENCL=$(usex opencl ON OFF)
- -DGGML_OPENMP=$(usex openmp ON OFF)
- -DGGML_VULKAN=$(usex vulkan ON OFF)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use hip; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre7611.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre7611.ebuild
deleted file mode 100644
index a81045e6d7d7..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre7611.ebuild
+++ /dev/null
@@ -1,132 +0,0 @@
-# Copyright 2025 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-if [[ "${PV}" != "9999" ]]; then
- KEYWORDS="~amd64"
- MY_PV="b${PV#0_pre}"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
-else
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-fi
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-IUSE="curl openblas +openmp blis hip cuda opencl vulkan flexiblas"
-REQUIRED_USE="?? ( openblas blis flexiblas )"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- hip? ( >=dev-util/hip-6.3:=
- >=sci-libs/hipBLAS-6.3:=
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? ( dev-util/vulkan-headers )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use hip; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
-
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
-
- cmake_src_prepare
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl ON OFF)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda ON OFF)
- -DGGML_OPENCL=$(usex opencl ON OFF)
- -DGGML_OPENMP=$(usex openmp ON OFF)
- -DGGML_VULKAN=$(usex vulkan ON OFF)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use hip; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre7924.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre7924.ebuild
deleted file mode 100644
index ff61000fd086..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre7924.ebuild
+++ /dev/null
@@ -1,162 +0,0 @@
-# Copyright 2026 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-TINY_LLAMAS_COMMIT="99dd1a73db5a37100bd4ae633f4cfce6560e1567"
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-if [[ ${PV} == *9999* ]]; then
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-else
- MY_PV="b${PV#0_pre}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- KEYWORDS="~amd64"
-fi
-
-SRC_URI+="
- examples? (
- https://huggingface.co/ggml-org/tiny-llamas/resolve/${TINY_LLAMAS_COMMIT}/stories15M-q4_0.gguf
- -> ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf
- )
-"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-
-# wwma USE explained here: https://github.com/ggml-org/llama.cpp/blob/master/docs/build.md#hip
-IUSE="curl openblas +openmp blis rocm cuda opencl vulkan flexiblas wmma examples"
-
-REQUIRED_USE="
- ?? (
- openblas
- blis
- flexiblas
- )
- wmma? (
- rocm
- )
-"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- rocm? (
- >=dev-util/hip-${ROCM_VERSION}:=
- >=sci-libs/hipBLAS-${ROCM_VERSION}:=
- wmma? (
- >=sci-libs/rocWMMA-${ROCM_VERSION}:=
- )
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? ( dev-util/vulkan-headers )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use rocm; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
- cmake_src_prepare
- if use examples; then
- mkdir -p "${BUILD_DIR}/tinyllamas" || die
- cp "${DISTDIR}/ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf" \
- "${BUILD_DIR}/tinyllamas/stories15M-q4_0.gguf" || die
- fi
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_EXAMPLES=$(usex examples)
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda)
- -DGGML_OPENCL=$(usex opencl)
- -DGGML_OPENMP=$(usex openmp)
- -DGGML_VULKAN=$(usex vulkan)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use rocm; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- -DGGML_HIP_ROCWMMA_FATTN=$(usex wmma)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre8198.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre8198.ebuild
deleted file mode 100644
index ff61000fd086..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre8198.ebuild
+++ /dev/null
@@ -1,162 +0,0 @@
-# Copyright 2026 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-TINY_LLAMAS_COMMIT="99dd1a73db5a37100bd4ae633f4cfce6560e1567"
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-if [[ ${PV} == *9999* ]]; then
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-else
- MY_PV="b${PV#0_pre}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- KEYWORDS="~amd64"
-fi
-
-SRC_URI+="
- examples? (
- https://huggingface.co/ggml-org/tiny-llamas/resolve/${TINY_LLAMAS_COMMIT}/stories15M-q4_0.gguf
- -> ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf
- )
-"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-
-# wwma USE explained here: https://github.com/ggml-org/llama.cpp/blob/master/docs/build.md#hip
-IUSE="curl openblas +openmp blis rocm cuda opencl vulkan flexiblas wmma examples"
-
-REQUIRED_USE="
- ?? (
- openblas
- blis
- flexiblas
- )
- wmma? (
- rocm
- )
-"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- rocm? (
- >=dev-util/hip-${ROCM_VERSION}:=
- >=sci-libs/hipBLAS-${ROCM_VERSION}:=
- wmma? (
- >=sci-libs/rocWMMA-${ROCM_VERSION}:=
- )
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? ( dev-util/vulkan-headers )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use rocm; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
- cmake_src_prepare
- if use examples; then
- mkdir -p "${BUILD_DIR}/tinyllamas" || die
- cp "${DISTDIR}/ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf" \
- "${BUILD_DIR}/tinyllamas/stories15M-q4_0.gguf" || die
- fi
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_EXAMPLES=$(usex examples)
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda)
- -DGGML_OPENCL=$(usex opencl)
- -DGGML_OPENMP=$(usex openmp)
- -DGGML_VULKAN=$(usex vulkan)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use rocm; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- -DGGML_HIP_ROCWMMA_FATTN=$(usex wmma)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre8628.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre8628.ebuild
deleted file mode 100644
index ff61000fd086..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre8628.ebuild
+++ /dev/null
@@ -1,162 +0,0 @@
-# Copyright 2026 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-TINY_LLAMAS_COMMIT="99dd1a73db5a37100bd4ae633f4cfce6560e1567"
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-if [[ ${PV} == *9999* ]]; then
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-else
- MY_PV="b${PV#0_pre}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- KEYWORDS="~amd64"
-fi
-
-SRC_URI+="
- examples? (
- https://huggingface.co/ggml-org/tiny-llamas/resolve/${TINY_LLAMAS_COMMIT}/stories15M-q4_0.gguf
- -> ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf
- )
-"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-
-# wwma USE explained here: https://github.com/ggml-org/llama.cpp/blob/master/docs/build.md#hip
-IUSE="curl openblas +openmp blis rocm cuda opencl vulkan flexiblas wmma examples"
-
-REQUIRED_USE="
- ?? (
- openblas
- blis
- flexiblas
- )
- wmma? (
- rocm
- )
-"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- rocm? (
- >=dev-util/hip-${ROCM_VERSION}:=
- >=sci-libs/hipBLAS-${ROCM_VERSION}:=
- wmma? (
- >=sci-libs/rocWMMA-${ROCM_VERSION}:=
- )
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? ( dev-util/vulkan-headers )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use rocm; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
- cmake_src_prepare
- if use examples; then
- mkdir -p "${BUILD_DIR}/tinyllamas" || die
- cp "${DISTDIR}/ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf" \
- "${BUILD_DIR}/tinyllamas/stories15M-q4_0.gguf" || die
- fi
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_EXAMPLES=$(usex examples)
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda)
- -DGGML_OPENCL=$(usex opencl)
- -DGGML_OPENMP=$(usex openmp)
- -DGGML_VULKAN=$(usex vulkan)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use rocm; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- -DGGML_HIP_ROCWMMA_FATTN=$(usex wmma)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-0_pre8838.ebuild b/sci-misc/llama-cpp/llama-cpp-0_pre8838.ebuild
deleted file mode 100644
index 2295b3df8093..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-0_pre8838.ebuild
+++ /dev/null
@@ -1,167 +0,0 @@
-# Copyright 2026 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-TINY_LLAMAS_COMMIT="99dd1a73db5a37100bd4ae633f4cfce6560e1567"
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-if [[ ${PV} == *9999* ]]; then
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-else
- MY_PV="b${PV#0_pre}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- KEYWORDS="~amd64"
-fi
-
-SRC_URI+="
- examples? (
- https://huggingface.co/ggml-org/tiny-llamas/resolve/${TINY_LLAMAS_COMMIT}/stories15M-q4_0.gguf
- -> ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf
- )
-"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-
-# wwma USE explained here: https://github.com/ggml-org/llama.cpp/blob/master/docs/build.md#hip
-IUSE="curl openblas +openmp blis rocm cuda opencl openssl vulkan flexiblas wmma examples"
-
-REQUIRED_USE="
- ?? (
- openblas
- blis
- flexiblas
- )
- wmma? (
- rocm
- )
-"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- rocm? (
- >=dev-util/hip-${ROCM_VERSION}:=
- >=sci-libs/hipBLAS-${ROCM_VERSION}:=
- wmma? (
- >=sci-libs/rocWMMA-${ROCM_VERSION}:=
- )
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
- openssl? ( dev-libs/openssl:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? (
- dev-util/spirv-headers
- dev-util/vulkan-headers
- )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use rocm; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
- cmake_src_prepare
- if use examples; then
- mkdir -p "${BUILD_DIR}/tinyllamas" || die
- cp "${DISTDIR}/ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf" \
- "${BUILD_DIR}/tinyllamas/stories15M-q4_0.gguf" || die
- fi
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_EXAMPLES=$(usex examples)
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl)
- -DLLAMA_OPENSSL=$(usex openssl)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda)
- -DGGML_OPENCL=$(usex opencl)
- -DGGML_OPENMP=$(usex openmp)
- -DGGML_VULKAN=$(usex vulkan)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use rocm; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- -DGGML_HIP_ROCWMMA_FATTN=$(usex wmma)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/llama-cpp-9999.ebuild b/sci-misc/llama-cpp/llama-cpp-9999.ebuild
deleted file mode 100644
index 6c83acbe7a6f..000000000000
--- a/sci-misc/llama-cpp/llama-cpp-9999.ebuild
+++ /dev/null
@@ -1,168 +0,0 @@
-# Copyright 2026 Gentoo Authors
-# Distributed under the terms of the GNU General Public License v2
-
-EAPI=8
-
-ROCM_VERSION="6.3"
-
-inherit cmake cuda rocm linux-info
-
-TINY_LLAMAS_COMMIT="99dd1a73db5a37100bd4ae633f4cfce6560e1567"
-
-DESCRIPTION="Port of Facebook's LLaMA model in C/C++"
-HOMEPAGE="https://github.com/ggml-org/llama.cpp"
-
-if [[ ${PV} == *9999* ]]; then
- inherit git-r3
- EGIT_REPO_URI="https://github.com/ggml-org/llama.cpp.git"
-else
- MY_PV="b${PV#0_pre}"
- SRC_URI="https://github.com/ggml-org/llama.cpp/archive/refs/tags/${MY_PV}.tar.gz -> ${P}.tar.gz"
- S="${WORKDIR}/llama.cpp-${MY_PV}"
- KEYWORDS="~amd64"
-fi
-
-SRC_URI+="
- examples? (
- https://huggingface.co/ggml-org/tiny-llamas/resolve/${TINY_LLAMAS_COMMIT}/stories15M-q4_0.gguf
- -> ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf
- )
-"
-
-LICENSE="MIT"
-SLOT="0"
-CPU_FLAGS_X86=( avx avx2 f16c )
-
-# wwma USE explained here: https://github.com/ggml-org/llama.cpp/blob/master/docs/build.md#hip
-IUSE="curl openblas +openmp blis rocm cuda opencl openssl vulkan flexiblas wmma examples"
-
-REQUIRED_USE="
- ?? (
- openblas
- blis
- flexiblas
- )
- wmma? (
- rocm
- )
-"
-
-# curl is needed for pulling models from huggingface
-# numpy is used by convert_hf_to_gguf.py
-CDEPEND="
- curl? ( net-misc/curl:= )
- openblas? ( sci-libs/openblas:= )
- openmp? ( llvm-runtimes/openmp:= )
- blis? ( sci-libs/blis:= )
- flexiblas? ( sci-libs/flexiblas:= )
- rocm? (
- >=dev-util/hip-${ROCM_VERSION}:=
- >=sci-libs/hipBLAS-${ROCM_VERSION}:=
- wmma? (
- >=sci-libs/rocWMMA-${ROCM_VERSION}:=
- )
- )
- cuda? ( dev-util/nvidia-cuda-toolkit:= )
- openssl? ( dev-libs/openssl:= )
-"
-DEPEND="${CDEPEND}
- opencl? ( dev-util/opencl-headers )
- vulkan? (
- dev-util/spirv-headers
- dev-util/vulkan-headers
- )
-"
-RDEPEND="${CDEPEND}
- dev-python/numpy
- opencl? ( dev-libs/opencl-icd-loader )
- vulkan? ( media-libs/vulkan-loader )
-"
-BDEPEND="media-libs/shaderc"
-
-pkg_setup() {
- if use rocm; then
- linux-info_pkg_setup
- if linux-info_get_any_version && linux_config_exists; then
- if ! linux_chkconfig_present HSA_AMD_SVM; then
- ewarn "To use ROCm/HIP, you need to have HSA_AMD_SVM option enabled in your kernel."
- fi
- fi
- fi
-}
-
-src_prepare() {
- use cuda && cuda_src_prepare
- cmake_src_prepare
- if use examples; then
- mkdir -p "${BUILD_DIR}/tinyllamas" || die
- cp "${DISTDIR}/ggml-org_models_tinyllamas_stories15M-q4_0-${TINY_LLAMAS_COMMIT}.gguf" \
- "${BUILD_DIR}/tinyllamas/stories15M-q4_0.gguf" || die
- fi
-}
-
-src_configure() {
- local mycmakeargs=(
- -DLLAMA_BUILD_WEBUI=OFF
- -DLLAMA_BUILD_TESTS=OFF
- -DLLAMA_BUILD_EXAMPLES=$(usex examples)
- -DLLAMA_BUILD_SERVER=ON
- -DCMAKE_SKIP_BUILD_RPATH=ON
- -DGGML_NATIVE=0 # don't set march
- -DGGML_RPC=ON
- -DLLAMA_CURL=$(usex curl)
- -DLLAMA_OPENSSL=$(usex openssl)
- -DBUILD_NUMBER="1"
- -DGENTOO_REMOVE_CMAKE_BLAS_HACK=ON
- -DGGML_CUDA=$(usex cuda)
- -DGGML_OPENCL=$(usex opencl)
- -DGGML_OPENMP=$(usex openmp)
- -DGGML_VULKAN=$(usex vulkan)
-
- # avoid clashing with whisper.cpp
- -DCMAKE_INSTALL_LIBDIR="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- -DCMAKE_INSTALL_RPATH="${EPREFIX}/usr/$(get_libdir)/llama.cpp"
- )
-
- if use openblas ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=OpenBLAS
- )
- fi
-
- if use blis ; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FLAME
- )
- fi
-
- if use flexiblas; then
- mycmakeargs+=(
- -DGGML_BLAS=ON -DGGML_BLAS_VENDOR=FlexiBLAS
- )
- fi
-
- if use cuda; then
- local -x CUDAHOSTCXX="$(cuda_gccdir)"
- # tries to recreate dev symlinks
- cuda_add_sandbox
- addpredict "/dev/char/"
- fi
-
- if use rocm; then
- rocm_use_hipcc
- mycmakeargs+=(
- -DGGML_HIP=ON -DAMDGPU_TARGETS=$(get_amdgpu_flags)
- -DGGML_HIP_ROCWMMA_FATTN=$(usex wmma)
- )
- fi
-
- cmake_src_configure
-}
-
-src_install() {
- cmake_src_install
- dobin "${BUILD_DIR}/bin/rpc-server"
-
- # avoid clashing with whisper.cpp
- rm -rf "${ED}/usr/include"
-}
diff --git a/sci-misc/llama-cpp/metadata.xml b/sci-misc/llama-cpp/metadata.xml
deleted file mode 100644
index 40b30da374c6..000000000000
--- a/sci-misc/llama-cpp/metadata.xml
+++ /dev/null
@@ -1,21 +0,0 @@
-<?xml version="1.0" encoding="UTF-8"?>
-<!DOCTYPE pkgmetadata SYSTEM "https://www.gentoo.org/dtd/metadata.dtd">
-<pkgmetadata>
- <maintainer type="person">
- <email>negril.nx+gentoo@gmail.com</email>
- <name>Paul Zander</name>
- </maintainer>
- <use>
- <flag name="blis">Build a BLIS backend</flag>
- <flag name="flexiblas">Build a FlexiBLAS backend</flag>
- <flag name="rocm">Build a HIP (ROCm) backend</flag>
- <flag name="hip">Build a HIP (ROCm) backend</flag>
- <flag name="wmma">Use rocWMMA to enhance flash attention performance</flag>
- <flag name="openblas">Build an OpenBLAS backend</flag>
- <flag name="opencl">Build an OpenCL backend, so far only works on Adreno and Intel GPUs</flag>
- <flag name="openssl">Use openssl to support HTTPS</flag>
- </use>
- <upstream>
- <remote-id type="github">ggml-org/llama.cpp</remote-id>
- </upstream>
-</pkgmetadata>