#streaming
- Thinking Machines Lab представляет TML-Interaction-Small: мультимодальная модель MoE на 276B для работы в реальном времени Thinking Machines Lab models-llm
- OpenAI GPT-Live: полнодуплексные голосовые модели приходят на смену Advanced Voice Mode OpenAI audio
- MiniCPM-o 4.5: полнодуплексное омнимодальное AI в реальном времени на граничных устройствах OpenBMB / Tsinghua University research
- ElevenLabs запускает ElevenMusic: ИИ-создание музыки, ремикширование и стриминг на одной платформе ElevenLabs audio
- OpenAI добавила голосовое управление ChatGPT в десктоп-приложение с поддержкой Codex OpenAI tools
- Mage-VL: эффективная кодек-нативная потоковая мультимодальная базовая модель Microsoft research
- JoyAI-VL-Interaction: открытая VLM на 8B для взаимодействия в реальном времени с автономным управлением очередью речи JD.com research
- Audio Interaction Model: унифицированный стриминговый фреймворк, объединяющий офлайн и реальновременную обработку аудио по инструкциям research
- Wan-Streamer v0.1: сквозная интерактивная фундаментальная модель реального времени с задержкой менее 550 мс Wan-AI research
- ElevenLabs запускает ElevenMusic — платформу для создания, ремикширования и стриминга AI-музыки ElevenLabs audio
- LangChain Stack: провайдер-независимые колбэки токенов контентных блоков для Anthropic, Groq, Mistral LangChain tools
- llama.cpp b9754: прогресс загрузки модели в реальном времени через SSE и PEG-парсер грамматик tools
- Claude Code v2.1.199: стекирование slash-skill и улучшение надёжности стриминга Anthropic tools
- GitHub Copilot CLI отказывается от требования PAT в Actions; потоковая передача агентских сессий в превью GitHub tools
- LightMem-Ego: лёгкая потоковая мультимодальная память для смартфонов и AI-очков ZJUNLP research
- Mage-VL: эффективная codec-native стриминговая мультимодальная базовая модель Microsoft research