-
PrismML выпустила Bonsai 27B: первую модель класса 27B, работающую на iPhone
PrismML
models-llm
-
llama.cpp v0.3.0 — первый помеченный стабильный релиз ночного b10621; мультимодальность dots3-note, MTP для GLM-4.5-Air, tensor-split DeepSeek 4, ggml v0.22.0
ggml-org
tools
-
Ollama v0.23.1: MTP-спекулятивное декодирование Gemma 4 даёт ускорение в 2× на Apple Silicon
tools
-
Ollama v0.24.0: интеграция с Codex App и улучшения MLX-семплера
Ollama
tools
-
Ollama v0.30.10: модели Cohere Command A и North на Apple Silicon через MLX
Ollama
tools
-
Ollama v0.31.1: Gemma 4 почти на 90% быстрее на Apple Silicon через MTP
Ollama
tools
-
Ollama v0.31.2: ядро small-batch matmul для MLX, llama.cpp сборка 9840, обновления CUDA
tools
-
llama.cpp b10603-b10615 — GLM-4.5-Air MTP, Deepseek 4 -sm tensor, тюнинг Metal flash-attn vec для M1 Pro/M2 Ultra/M5 Max
ggml-org
tools
-
Ollama v0.33.1: поддержка Qwen3.8 Flash Next и structured-output в mlxrunner
Ollama
tools
-
Волна llama.cpp за 1–2 сентября: +4,9% к генерации от фикса n-gram-поиска, слитый CUDA-редукшн для MoE
ggml
tools
-
Ollama v0.34.0-rc1: локальные модели можно использовать прямо в ChatGPT Desktop
tools
-
Ollama v0.34.1 выводит создание MLX-моделей из safetensors из эксперимента и ускоряет /api/tags в десять раз
Ollama
tools
-
Ollama v0.23.3: исправления MLX runner и совместимость с Metal в macOS 26
Ollama
tools