Ollama v0.33.1: поддержка Qwen3.8 Flash Next и structured-output в mlxrunner

Ollama

инструменты официальный 1 ист. ~1 мин

v0.33.1 (26 авг.) добавляет поддержку MLX для Qwen3.8 Flash Next, делает патчи совместимости cmake идемпотентными, обновляет встроенные деревья MLX и llama.cpp, а также добавляет поддержку structured-output в MLX runner (включая обход таймаутов Metal GPU при загрузке моделей с медленных накопителей).

Почему это важно

Qwen3.8 Flash Next на Apple Silicon закрывает разрыв между десктопной сборкой Ollama и свежей линейкой Qwen; structured-output в mlxrunner открывает сценарии constrained-decoding на локальных Mac.

Важность: 2/5

default

Источники

официальный Ollama v0.33.1 release