#multilingual
- Ideogram 4.0 выходит как открытая модель text-to-image с 9,3B параметров и нативным разрешением 2K Ideogram image
- Gemini 3.5 Live Translate: синхронный перевод речи на 70+ языках Google DeepMind audio
- Mistral выпускает OCR 4: SOTA-модель для работы с документами с возможностью локального развёртывания Mistral AI models-llm
- ByteDance выпускает Seedream 5.0 Pro с профессиональным послойным редактированием и многоязычным рендерингом текста ByteDance / Seed image
- Исследование Anthropic: ценности Claude существенно различаются в зависимости от версии модели и языка Anthropic research
- Tencent EVIE-Preview-4.5B возглавляет ViDoRe V3 с компактным 128-мерным мультиязычным визуальным поиском документов Tencent tools
- Cartesia выпускает TTS Sonic-3.6 и заявляет верхнюю строчку Elo, обгоняя Eleven v3 Cartesia audio
- Саудовская HUMAIN представила humain-m3 — арабскую фронттирную модель на 428B параметров, созданную MiniMax MiniMax models-llm
- IBM Granite Embedding Multilingual R2: контекст 32K и лучший результат среди моделей до 100M параметров IBM tools
- Yandex Improves Alice AI ART: Russian Text in Generated Images 3x More Accurate Yandex image
- ChatGPT добавляет помощь с произношением на 60+ языках и хаб Чемпионата мира OpenAI tools
- xAI расширяет Grok Voice 21 новым многоязычным флагманским голосом xAI audio
- Mistral и HUMAIN объявляют о стратегическом сотрудничестве в сфере суверенного ИИ в Саудовской Аравии Mistral industry
- Meta Superintelligence Labs выпустила Muse Voice Transcribe — модель распознавания речи в реальном времени Meta audio
- Сбер GigaChat добавляет поддержку якутского языка Sber models-llm
- Navana.ai запустила голосовую AI-модель Bodhi TTS для 10 индийских языков Navana.ai audio
- AI-чат Яндекс Карт расширяет рекомендации на культурный и активный отдых Yandex tools