Новые модели ИИ выходят так часто, что за ними трудно успеть. Сентябрь 2026 года — хороший повод свериться: вышли новые поколения у OpenAI, Anthropic, xAI, Alibaba, Zhipu, DeepSeek и Meta*. Рассказываем главное для тех, кто работает с MiMo Code.
Коротко о каждой модели
- Muse Spark 1.3 от Meta* — мультимодальная модель для долгих агентных задач: окно на 1 млн токенов, понимание изображений, видео и документов. Вышла 2 сентября, веса закрыты.
- xAI после нескольких переносов выпустила Grok 4.7 — 21 сентября. Новая базовая модель, упор на код и агентные задачи, окно на 500 тысяч токенов; цена в API осталась как у Grok 4.6.
- Новая DeepSeek V4.1 Flash — быстрая модель с нативным пониманием картинок и окном на 1 млн токенов. Вышла 10 сентября, веса открыты под MIT, а в API она стоит от $0,15 за миллион входных токенов.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- Anthropic обновила старшую линейку: Claude Opus 5.5 вышла 22 сентября. Компания заявляет уровень Fable 5.1 при цене ниже, чем у Opus 5, и ответы на треть быстрее. Рассуждение у модели включено всегда, регулируется только глубина.
- Главная новость месяца — поколение GPT-6. В нём три модели: Astra для самых сложных задач, Sol для повседневной работы и быстрая Luna. Astra открылась 4 сентября, Sol и Luna — 22 сентября; окно у всех — 1,05 млн токенов.
- Zhipu AI (Z.ai) выпустила GLM 5.3 — открытую модель для кода на 753 млрд параметров с окном на 1 млн токенов — и первые мультимодальные модели серии: Flash и ускоренный FlashX, который с 18 сентября выдаёт до 200 токенов в секунду.
Главное изменение месяца
Новинки объединяют две вещи. Во-первых, огромное окно контекста — около миллиона токенов у GPT-6, Claude Opus 5.5, Qwen 3.8, GLM 5.3, DeepSeek V4.1 Flash и Muse Spark 1.3. Во-вторых, понимание изображений почти у всех: скриншот или фото можно просто приложить к вопросу.
Что это значит для программирования
Почти все новинки сентября делают упор на код и агентные задачи. Окно на миллион токенов у GPT-6, Claude Opus 5.5, Qwen 3.8 и GLM 5.3 позволяет загрузить в модель целый проект, а открытые GLM 5.3 и Qwen 3.8 27B подойдут тем, кому код нельзя отправлять в чужое облако.
Что выбрать под задачу
- Короткие ответы, письма, переводы — GPT-6 Luna или DeepSeek V4.1 Flash.
- Длинные документы целиком — Claude Opus 5.5 или GPT-6 Sol.
- Программирование — Claude Opus 5.5, Grok 4.7 или GLM 5.3.
- Картинки и скриншоты на входе — Qwen 3.8 Max или DeepSeek V4.1 Flash.
- Аудио и видео на входе — Qwen 3.8 Omni Flash.
Как попробовать новые модели из России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Короткие ответы
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Можно ли скачать GPT-6 или Claude Opus 5.5?
Нет, их веса закрыты — они работают только в облаке. Скачать и запустить у себя можно открытые модели: Qwen 3.8 27B, GLM 5.3, DeepSeek V4.1 Flash.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Появятся ли новые модели в работе с MiMo Code?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.