За один месяц обновились почти все главные нейросети — от GPT-6 до DeepSeek. Собрали новинки сентября 2026 года в одном месте, с датами и ценами из официальных источников, и посмотрели на них с точки зрения пользователя GigaChat.
Коротко о каждой модели
- DeepSeek 10 сентября выпустила V4.1 Flash — первую модель новой архитектуры с нативным зрением: 552 млрд параметров, окно на 1 млн токенов, открытая лицензия MIT. В API она уже заменила экспериментальную V4 Flash Vision.
- Claude Opus 5.5 — новая модель Anthropic для длинных задач: кода, аналитики, работы с большими документами. Вышла 22 сентября, окно на 1 млн токенов, знания до июня 2026 года; в API — $4 за миллион входных токенов.
- Zhipu AI (Z.ai) выпустила GLM 5.3 — открытую модель для кода на 753 млрд параметров с окном на 1 млн токенов — и первые мультимодальные модели серии: Flash и ускоренный FlashX, который с 18 сентября выдаёт до 200 токенов в секунду.
- Grok 4.7 вышла 21 сентября. По данным xAI, это заметное улучшение Grok 4.6 при той же цене и скорости: сильнее в программировании и многошаговых задачах, понимает картинки, держит 500 тысяч токенов контекста.
- Muse Spark 1.3 от Meta* — мультимодальная модель для долгих агентных задач: окно на 1 млн токенов, понимание изображений, видео и документов. Вышла 2 сентября, веса закрыты.
- У OpenAI вышло поколение GPT-6: флагман Astra, рабочая Sol и лёгкая Luna. В API они стоят $10, $2 и $0,10 за миллион входных токенов — разница в сто раз, поэтому модель стоит выбирать под задачу. Версии Pro — это не отдельные модели, а режим углублённого рассуждения.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
Что объединяет новинки
Если свести месяц к одной мысли: мощные модели стали дешевле, а дешёвые — умнее. Claude Opus 5.5 стоит меньше Opus 5, GPT-6 Sol вдвое дешевле предшественника, а DeepSeek перевела запросы к флагману V4 Pro на быструю V4.1 Flash.
Где новые модели пригодятся для чат-ботов
В чат-ботах главное изменение — окно на миллион токенов стало нормой: в один разговор помещаются книги и пачки документов. А быстрые модели вроде GPT-6 Luna и DeepSeek V4.1 Flash стали настолько дешёвыми, что их можно использовать без оглядки на лимиты.
Какую модель выбрать
- Короткие ответы, письма, переводы — GPT-6 Luna или DeepSeek V4.1 Flash.
- Длинные документы целиком — Claude Opus 5.5 или GPT-6 Sol.
- Программирование — Claude Opus 5.5, Grok 4.7 или GLM 5.3.
- Картинки и скриншоты на входе — Qwen 3.8 Max или DeepSeek V4.1 Flash.
- Аудио и видео на входе — Qwen 3.8 Omni Flash.
Как попробовать новые модели из России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Короткие ответы
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Можно ли скачать GPT-6 или Claude Opus 5.5?
Нет, их веса закрыты — они работают только в облаке. Скачать и запустить у себя можно открытые модели: Qwen 3.8 27B, GLM 5.3, DeepSeek V4.1 Flash.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Появятся ли новые модели в работе с GigaChat?
Новые модели не заменяют сам GigaChat, а дополняют его: помогают подготовить текст, разобрать исходники, составить точный запрос. Попробовать их можно по кнопке на этой странице — без VPN.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.