-
Notifications
You must be signed in to change notification settings - Fork 20.9k
All issues
Issue creation is restricted in this repository
Issues
is:issue state:open
is:issue state:open
Search results
- Status: Open.#26038 In ggml-org/llama.cpp;
- Status: Open.#26034 In ggml-org/llama.cpp;
- Status: Open.#26031 In ggml-org/llama.cpp;
- Status: Open.#26025 In ggml-org/llama.cpp;
Feature Request: Next generation samplers that should be able to beat top-n sigma and other SOTA samplers
enhancementNew feature or requestNew feature or requestStatus: Open.#26020 In ggml-org/llama.cpp;Feature Request: Add ubuntu CUDA 13 release binaries (x64/arm64)
enhancementNew feature or requestNew feature or requestStatus: Open.#26019 In ggml-org/llama.cpp;- Status: Open.#26017 In ggml-org/llama.cpp;
[SYCL] Low generation throughput on Intel Arc compared to Vulkan backend
enhancementNew feature or requestNew feature or requestStatus: Open.#26010 In ggml-org/llama.cpp;Feature Request: server: add option to concatenate prompts on /completion endpoint
enhancementNew feature or requestNew feature or requestStatus: Open.#26008 In ggml-org/llama.cpp;- Status: Open.#25992 In ggml-org/llama.cpp;
- Status: Open.#25986 In ggml-org/llama.cpp;