Новые модели ИИ выходят так часто, что за ними трудно успеть. Сентябрь 2026 года — хороший повод свериться: вышли новые поколения у OpenAI, Anthropic, xAI, Alibaba, Zhipu, DeepSeek и Meta*. Рассказываем главное для тех, кто работает с Suno AI.
Новые модели по порядку
- Anthropic обновила старшую линейку: Claude Opus 5.5 вышла 22 сентября. Компания заявляет уровень Fable 5.1 при цене ниже, чем у Opus 5, и ответы на треть быстрее. Рассуждение у модели включено всегда, регулируется только глубина.
- xAI после нескольких переносов выпустила Grok 4.7 — 21 сентября. Новая базовая модель, упор на код и агентные задачи, окно на 500 тысяч токенов; цена в API осталась как у Grok 4.6.
- GLM 5.3 от Zhipu — открытая модель, которую разработчик называет самой сильной среди открытых для программирования. Рядом — GLM 5.3 Flash, понимающая картинки и видео, и её скоростной режим FlashX.
- Qwen 3.8 — это пять моделей сразу. Старшая Max работает в облаке и держит 1 млн токенов, 27B можно скачать и запустить у себя (лицензия Apache 2.0), а Omni Flash, вышедшая 18 сентября, умеет разбирать голос и видео.
- Meta* 2 сентября выпустила Muse Spark 1.3 — модель рассуждений с окном на 1 млн токенов, которая понимает изображения, видео и документы. По заявлению компании, на те же задачи она тратит на четверть меньше токенов, чем версия 1.2.
- DeepSeek 10 сентября выпустила V4.1 Flash — первую модель новой архитектуры с нативным зрением: 552 млрд параметров, окно на 1 млн токенов, открытая лицензия MIT. В API она уже заменила экспериментальную V4 Flash Vision.
- У OpenAI вышло поколение GPT-6: флагман Astra, рабочая Sol и лёгкая Luna. В API они стоят $10, $2 и $0,10 за миллион входных токенов — разница в сто раз, поэтому модель стоит выбирать под задачу. Версии Pro — это не отдельные модели, а режим углублённого рассуждения.
Общий тренд: миллион токенов и дешёвые быстрые модели
Новинки объединяют две вещи. Во-первых, огромное окно контекста — около миллиона токенов у GPT-6, Claude Opus 5.5, Qwen 3.8, GLM 5.3, DeepSeek V4.1 Flash и Muse Spark 1.3. Во-вторых, понимание изображений почти у всех: скриншот или фото можно просто приложить к вопросу.
Что это значит для работы со звуком
Звук напрямую понимает только одна модель из новинок — Qwen 3.8 Omni Flash: расшифровка, конспект записи, разбор интервью. Остальные помогут с текстом для озвучки и сценарием подкаста.
Что выбрать под задачу
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Доступ из России
С доступом всё не так просто: OpenAI и Anthropic официально не работают в России, сервисы Meta* запрещены, а оплатить API российской картой нельзя. Проще всего пользоваться новинками через агрегатор с рублёвой оплатой — там не нужен VPN и зарубежная карта.
Короткие ответы
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Что значит «окно на миллион токенов»?
Это объём текста, который модель держит в голове за один запрос: несколько толстых книг, большой архив документов или целый программный проект.
Можно ли скачать GPT-6 или Claude Opus 5.5?
Нет, их веса закрыты — они работают только в облаке. Скачать и запустить у себя можно открытые модели: Qwen 3.8 27B, GLM 5.3, DeepSeek V4.1 Flash.
Появятся ли новые модели в работе с Suno AI?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.