#mathematics
- OpenAI заявляет, что внутренняя модель нашла решение Millennium Prize-задачи о Навье—Стоксе OpenAI research
- AI Co-Mathematician от Google DeepMind достигает 48% на FrontierMath Tier 4 Google DeepMind research
- SU-01: рассуждения на уровне золотой медали олимпиады через curriculum SFT и двухэтапный RL SU-01 Team research
- SOOHAK: фронтирные LLM решают сложную математику, но не распознают неразрешимые задачи research
- Следующая модель OpenAI Astra решила десять открытых проблем в математике и теоретической информатике OpenAI research
- Исследовательская модель Claude повышает нижнюю оценку нулей дзета-функции Римана с 41,6% до 67,2% Anthropic research
- MaxProof: модель MiniMax превышает пороги золотых медалей IMO и USAMO в формальной математике MiniMax research
- Mistral выпускает Leanstral 1.5: открытая модель формальной верификации для Lean 4 Mistral research
- NVIDIA открыла рецепт золотого уровня IMO с пайплайном Nemotron на естественном языке NVIDIA research
- AI Co-Mathematician: Google DeepMind достигает 48% на FrontierMath Tier 4 Google DeepMind research
- Обзор LLM-систем в формальной математике: где современные системы отстают UCLA research
- Агенты Gemini 3.7 Flash в Antigravity решают открытые математические задачи и собирают симулятор RISC-V Google DeepMind research
- Soohak: 64 математика создали исследовательский бенчмарк, который ставит frontier LLM в тупик Seoul National University research
- OpenAI формирует консультативную группу по математике и AI OpenAI research
- AdvancedMathBench: набор бенчмарков для генерации и верификации математических доказательств InternLM research
- Скандал OpenAI вокруг Navier-Stokes разгорается: математики выступают против из-за авторства и поведения OpenAI industry