Если вы следите за нейросетями вполглаза, сентябрь 2026-го легко пропустить, а зря: вышли GPT-6, Claude Opus 5.5, Grok 4.7, Qwen 3.8 и ещё несколько моделей. Коротко о каждой — и о том, что это меняет для пользователей Reflect AI.
Что вышло в сентябре
- Anthropic 22 сентября выпустила Claude Opus 5.5. По заявлению компании, на большинстве задач она держит уровень самой мощной Fable 5.1, а стоит на 40% дешевле Opus 5. Окно — 1 млн токенов, ответ — до 128 тысяч токенов.
- DeepSeek V4.1 Flash вышла 10 сентября: понимает изображения, держит 1 млн токенов контекста и, по заявлению DeepSeek, обходит даже собственный флагман V4 Pro. С 14 сентября запросы к V4 Pro в API обслуживает именно она.
- xAI после нескольких переносов выпустила Grok 4.7 — 21 сентября. Новая базовая модель, упор на код и агентные задачи, окно на 500 тысяч токенов; цена в API осталась как у Grok 4.6.
- У китайской Zhipu AI — GLM 5.3 (753 млрд параметров, окно 1 млн токенов) и мультимодальные GLM 5.3 Flash и FlashX. Веса GLM 5.3 Flash открыты под свободной лицензией MIT.
- Muse Spark 1.3 от Meta* — мультимодальная модель для долгих агентных задач: окно на 1 млн токенов, понимание изображений, видео и документов. Вышла 2 сентября, веса закрыты.
- OpenAI выпустила поколение GPT-6 из трёх моделей. Флагман Astra (общий доступ с 4 сентября) рассчитан на сложный анализ, код и длинные задачи, Sol (22 сентября) — рабочая модель на каждый день, Luna — самая быстрая и дешёвая. У всех трёх окно на 1,05 млн токенов и понимание картинок.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
Общий тренд: миллион токенов и дешёвые быстрые модели
Если свести месяц к одной мысли: мощные модели стали дешевле, а дешёвые — умнее. Claude Opus 5.5 стоит меньше Opus 5, GPT-6 Sol вдвое дешевле предшественника, а DeepSeek перевела запросы к флагману V4 Pro на быструю V4.1 Flash.
Что это значит для продуктивности
Для ежедневной работы главное — баланс цены и качества: письма и заметки быстрее отдать лёгкой модели (GPT-6 Luna, DeepSeek V4.1 Flash), а отчёты и документы — GPT-6 Sol или Claude Opus 5.5.
Какую модель выбрать
- Короткие ответы, письма, переводы — GPT-6 Luna или DeepSeek V4.1 Flash.
- Длинные документы целиком — Claude Opus 5.5 или GPT-6 Sol.
- Программирование — Claude Opus 5.5, Grok 4.7 или GLM 5.3.
- Картинки и скриншоты на входе — Qwen 3.8 Max или DeepSeek V4.1 Flash.
- Аудио и видео на входе — Qwen 3.8 Omni Flash.
Доступ из России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Попробовать новые модели без VPN →
Короткие ответы
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Что стало с DeepSeek V4 Flash Vision?
Экспериментальная модель выведена из работы: с 10 сентября её запросы в API DeepSeek обслуживает V4.1 Flash, которая понимает картинки лучше.
Можно ли скачать GPT-6 или Claude Opus 5.5?
Нет, их веса закрыты — они работают только в облаке. Скачать и запустить у себя можно открытые модели: Qwen 3.8 27B, GLM 5.3, DeepSeek V4.1 Flash.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Появятся ли новые модели в работе с Reflect AI?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.