forked from ggml-org/llama.cpp
-
Notifications
You must be signed in to change notification settings - Fork 15
All issues
Issue creation is restricted in this repository
Issues
is:issue state:open
is:issue state:open
Search results
server: Responses API rejects empty reasoning items
bugSomething isn't workingSomething isn't workingStatus: Open.#50 In am17an/llama.cpp;server: /v1/models returns boolean vocab_type instead of integer
bugSomething isn't workingSomething isn't workingStatus: Open.#49 In am17an/llama.cpp;server: CLI JSON schema rejects chat generation prefix
bugSomething isn't workingSomething isn't workingStatus: Open.#48 In am17an/llama.cpp;core: M-RoPE embedding batches overread null or one-plane positions
bugSomething isn't workingSomething isn't workingStatus: Open.#47 In am17an/llama.cpp;server router: CLI API key fails for chat when an API-key file is also used
bugSomething isn't workingSomething isn't workingStatus: Open.#46 In am17an/llama.cpp;CUDA graphs: speculative decoding repeatedly resets warmup state
bugSomething isn't workingSomething isn't workingStatus: Open.#45 In am17an/llama.cpp;server router: queued model evicts the model serving its triggering request
bugSomething isn't workingSomething isn't workingStatus: Open.#44 In am17an/llama.cpp;server: malformed tool-call history returns HTTP 500
bugSomething isn't workingSomething isn't workingStatus: Open.#43 In am17an/llama.cpp;server: identical multimodal embeddings differ with default unified KV cache
bugSomething isn't workingSomething isn't workingStatus: Open.#42 In am17an/llama.cpp;server: LFM2.5 MoE with DSpark aborts during CPU context init
bugSomething isn't workingSomething isn't workingStatus: Open.#41 In am17an/llama.cpp;server: model-less preset spawns another router
bugSomething isn't workingSomething isn't workingStatus: Open.#40 In am17an/llama.cpp;server: PEG until() accepts a missing final delimiter
bugSomething isn't workingSomething isn't workingStatus: Open.#39 In am17an/llama.cpp;