llama.cpp v0.4.1 adds Maple 20B, Tencent Hy 4, and Spark2.5 support
ggml
llama.cpp v0.4.1 (Sep 14) adds support for Maple 20B-A1B, Tencent Hy 4, and Spark2.5 models, refactors JSON schema handling, and adds JSONL logging via --log-jsonl. The mmap/mlock/direct-io flags are replaced by a unified --load-mode option.
Why it matters
A minor-version bump with day-one support for three new open models and a breaking change to load flags that local-LLM tooling will need to track.
Importance: 2/5
Minor version with day-one support for three new open models and breaking CLI change
Sources
official
ggml-org/llama.cpp Releases (v0.4.1)