llama.cpp v0.4.1 добавляет поддержку Maple 20B, Tencent Hy 4 и Spark2.5
ggml
llama.cpp v0.4.1 (14 сентября) добавляет поддержку моделей Maple 20B-A1B, Tencent Hy 4 и Spark2.5, рефакторит обработку JSON-схем и добавляет JSONL-логирование через --log-jsonl. Флаги mmap/mlock/direct-io заменены единым --load-mode.
Почему это важно
Минорный релиз с поддержкой трёх новых открытых моделей в день выхода и ломающим изменением флагов загрузки, за которым придётся следить локальному LLM-инструментарію.
Важность: 2/5
Минорная версия с поддержкой трёх новых открытых моделей в день выхода и ломающим изменением CLI
Источники
официальный
ggml-org/llama.cpp Releases (v0.4.1)