Инструкция по моделям · Июль 2026

Что, когда и почему

Рабочий реестр aisq Обновлено 25 июля 2026 14 мин чтения
TL;DR. Лучшей модели во всём не бывает. Бывает правильная модель под конкретную задачу. Это наш рабочий реестр: как мы в aisq подбираем модель и почему ставить один «топ» на всё дорого и глупо.

Фронтир больше не делится на «американский топ» и «дешёвые китайские модели». Claude Opus 5 остаётся премиальным эталоном для сложной работы, но Kimi K3 уже играет в той же лиге по коду и длинным агентным задачам, а Qwen 3.8 Max Alibaba — полноценная frontier-модель для разработки, анализа данных и tool calling, уже подключённая в AISQ. В России быстро растут собственные сильные ветки: GigaChat 3.5 Ultra и семейство Alice AI.

Источники: открытые бенчмарки (SWE-bench Pro, Intelligence Index, LMArena, BenchLM), обзоры плюс наш опыт в Studio. Оценки характера моделей субъективные, цены ориентировочные и могут меняться.

01Что такое токены — и за что вы платите

Токены — это небольшие фрагменты текста, которыми модель читает запрос и пишет ответ. Это не всегда слова: короткое слово может быть одним токеном, длинное — несколькими; знаки препинания и код тоже учитываются.

В прайсе есть две цены: вход — ваш запрос, история диалога и прикреплённый текст; выход — ответ модели. Обычно выход дороже: его модель создаёт по одному фрагменту за раз.

Как прикинуть расход. Для обычной переписки 1 000 токенов — это ориентировочно несколько страниц коротких сообщений, а не фиксированное число слов. Точную сумму сервис считает по фактическому объёму. На странице цен можно переключать расчёт между 1 000 и 1 000 000 токенов — так легче сравнивать недорогие и флагманские модели.

Что такое vision — и когда он нужен

Vision — это способность модели понимать не только текст, но и изображение: фотографию, скриншот, диаграмму, график, таблицу на картинке, чертёж или страницу документа. Для ежедневной работы с визуальными материалами подойдут MiniMax M3 и GPT-5.6 Terra; для большого PDF, аудио или видео — Gemini Flash. Gemma 4 31B пригодится, когда нужен доступный мультимодальный разбор по-русски.

Важно про PDF. PDF бывает «текстовым», когда из него можно извлечь символы, и сканом. Скан договора или отчёта — это по сути набор фотографий страниц: чтобы прочитать печать, подпись, график, таблицу или плохо распознанный текст, нужна модель с vision и, при необходимости, OCR. Даже тогда сверяйте реквизиты, суммы и юридически значимые формулировки с оригиналом.

Карта моделей: разные архетипы AI вокруг центральной нейросети
Обложка инструкции. Разные школы глобального и российского AI-фронтира вокруг одной нейросети. Тёплая editorial-палитра под бренд aisq.

02Карта: ум vs цена

Свежий срез: Intelligence Index и актуальная рыночная цена миллиона выходных токенов. В выборке — модели, которые можно реально запустить через API сегодня.

Artificial Analysis · 25.07.2026 ↗

Выше — сильнее по совокупному индексу; левее — дешевле. На графике показана ориентировочная публичная API-цена за 1М выходных токенов, ось логарифмическая. Текущая цена запроса в aisq всегда отображается до отправки.

Это не «абсолютный IQ», а ориентир по совокупности проверяемых задач Artificial Analysis. График хорошо показывает практическую развилку: MiniMax M3 и DeepSeek V4 Pro дают много результата за доллар, Kimi K3 уже вошёл в верхнюю мировую группу, а Opus 5 берут тогда, когда цена ошибки выше цены запроса.

Топ-фронтир: три AI-личности у стола
Топ-фронтир. Три персонажа в редакционной постановке: старшая сестра, средняя и сводный брат из другой семьи.

02Топ-фронтир: уже не только США

Claude Opus 5 ~1 575 / 7 875 ₽ за 1М вход/выход

Премиальный флагман Anthropic и один из ориентиров глобального фронтира. Opus 5 особенно силён там, где модель должна сама проверить результат, найти первопричину ошибки и пройти длинную цепочку действий до готового результата — в коде, исследованиях, автоматизации и сложной офисной работе.

Код-ревью боевых систем, разбор архитектуры
Юридические и медицинские тексты, где цена ошибки высокая
Квартальная стратегия, финальный драфт для инвестора
FAQ, рерайт постов, простые агенты: переплата в 5-15 раз без разницы в результате

Kimi K3 945 / 4 725 ₽ за 1М вход/выход

Не «дешёвый китайский аналог», а полноценный top-frontier. Открытая мультимодальная модель Moonshot на 2,8 трлн параметров получила контекст 1М токенов и рассчитана на длинный кодинг, работу с большим репозиторием, инструментами и автономными агентными цепочками. В независимых оценках K3 конкурирует с сильнейшими американскими моделями, а в Arena вышла в лидеры по созданию веб-интерфейсов.

Большие репозитории, сложная отладка и код с многими итерациями
Длинные агенты, vision, инструменты и большой рабочий контекст
Фронтирное качество заметно дешевле Opus 5
Для короткого вопроса слишком тяжёлая: начинайте с Luna, MiniMax M3 или бесплатной модели

Qwen 3.8 Max 700 / 2 000 ₽ за 1М вход/выход · доступна в AISQ

Флагман Alibaba и полноценный участник глобального top-frontier. Qwen 3.8 Max уже подключена в AISQ: берите её для full-stack разработки, рефакторинга нескольких файлов, анализа данных, офисных сценариев и автономных агентов с инструментами. Это большая модель для случая, когда задача ещё не разложена на шаги и важно получить правильный первый проход, а не просто самый дешёвый ответ.

Код, таблицы, SQL, дашборды, презентации и сложные рабочие документы
Vision: скриншоты, диаграммы, сканы и UI-макеты
Не показываем неработающий пункт в Studio только ради хайпа

Claude Sonnet 5 ~630 / 3 150 ₽ за 1М вход/выход до 31 августа 2026

Сейчас это главная рабочая модель Anthropic: планирует, ходит по инструментам, держит большой репозиторий и доводит задачу до результата. По агентности уже близок к Opus, но дешевле — поэтому именно с него стоит начинать код, ресёрч и сложные документы.

Рабочая лошадка: код, ресёрч, агенты, длинные PDF, боты для бизнеса
Скриншот в код: лучший vision в связке цена-качество
Финал для клиента: тут лучше не экономить и поднять до Opus

GPT-5.6 Luna / Terra / Sol Luna 300 / 1 800 ₽ · Terra 750 / 4 500 ₽ · Sol 1 500 / 9 000 ₽ за 1М

Три ступени одной семьи. Luna — для быстрого чата, bulk и недорогих агентов. Terra — главный рабочий GPT: код, таблицы, документы и длинные задачи. Sol — для сложных агентов, computer-use, security и финальной проверки.

Посты, презентации, поддержка, всё где нужен живой тон
Математика и строгие рассуждения

Gemini 3.1 Pro ~600 / 3 600 ₽ за 1М вход/выход

Королева контекста. Миллион токенов (в пять раз больше Claude) и лучшее соотношение цены к качеству среди топов. Всё в одной модели: текст, картинки, видео, аудио. В тонком кодинге и точном следовании инструкции иногда уступает Opus и Sonnet.

Длинные PDF (книги, логи, договоры), видеоаналитика, «закинуть всё сразу»
Для быстрых массовых задач есть Gemini 3.5 Flash и Gemini 3.1 Flash Lite

Grok 4.5 525 / 1 575 ₽ за 1М вход/выход

Новый флагман xAI для кода, агентных задач и работы со знаниями. Берём, когда нужен независимый от OpenAI и Anthropic сильный исполнитель для сложной рабочей цепочки.

Код, агентные сценарии и многошаговые задачи
Второе мнение для важных решений и исследований

Grok 4.6 600 / 2 000 ₽ за 1М вход/выход

Свежий флагман xAI с контекстом 500K и обязательным reasoning. Он особенно полезен, когда нужно не просто продолжить текст, а пройти длинную инженерную или исследовательскую цепочку: понять файлы, проверить гипотезы, вызвать инструменты и аккуратно собрать результат.

Сложный код, STEM, глубокий разбор и многошаговые агентные задачи
Файлы и изображения на входе, структурированный ответ и tool calling
Для короткого вопроса берите Fast-модель: Grok 4.6 будет избыточен и дороже

Grok 4.3 Fast 328 / 656 ₽ за 1М вход/выход

Быстрая бесрассуждающая ветка Grok 4.3: для обычного чата, изображений на входе и задач, где важнее скорость ответа, чем длинная внутренняя цепочка рассуждений.

Быстрые рабочие ответы, краткий разбор изображений, частые вызовы
Для сложной математики и глубокого планирования выбирайте Grok 4.5 или другие флагманы

Что почитать о новом фронтире. релиз Opus 5 у Anthropic ↗, разбор Kimi K3 у AP ↗, материал Alibaba о Qwen 3.8 Max ↗. Это свежие материалы июля 2026, а не пересказ старой таблицы моделей.

03Рабочие модели aisq

Для повседневной сильной работы рекомендуем MiniMax M3, Qwen 3.8 Max, Gemini Flash или GPT-5.6 Terra: письма, планы, документы, анализ и рабочий код. Если задача новая и требования расплывчаты, начинайте с Kimi K3, GPT-5.6 Terra или Claude Sonnet 5 — большая модель чаще правильно разложит работу с первого прохода. Карточки ниже — экономные модели для понятной, повторяемой рутины: черновиков, классификации, типовых писем, простого кода и массовой обработки.

Qwen 3.6 35B Fast входит в Free · 0.035 / 0.250 ₽ за 1k при платном продолжении

Быстрый повседневный чат с обработкой в России. Это первая линия для коротких вопросов, черновиков и простых задач; есть режим с рассуждением, если нужен более вдумчивый ответ.

FAQ, боты, черновики, маршрутизация запросов
Bulk: классификация тысяч документов, чистка RAG-выборок
Для сложного кода, многошаговых агентов и финального текста лучше перейти на Pro-модель

Qwen 3.8 27B / Fast входит в Free · РУ-маршрут

Свежая, более сильная ветка Qwen в двух понятных режимах: Fast для мгновенного рабочего ответа и обычная Qwen 3.8 для задач, где полезно сначала подумать. Это удобный следующий шаг после Qwen 3.6: без иностранной авторизации и с обработкой в России.

Fast: письма, конспекты, быстрый код, разбор инструкции и ежедневный чат
Обычная: анализ, планирование, сложный промпт, вдумчивый код
Не vision-модель: для скриншотов и PDF с картинками выбирайте Gemini, GPT или Nano Banana в Studio

GPT-OSS 120B входит в Free · 0.008 / 0.038 ₽ за 1k при платном продолжении

Открытая 120B модель для строгих форматов, структурированного JSON и недорогих агентных задач.

Строгий JSON, извлечение данных и понятные форматы ответа
Batch-извлечение данных в строгий JSON без regex-костылей
Не для casual-чата и не как русскоязычный ассистент по умолчанию

Gemma 4 31B входит в Free · 0.030 / 0.088 ₽ за 1k при платном продолжении

Мультимодальная модель для изображений и документов. Берём, когда нужен более внимательный разбор визуального материала, чем в быстром чате.

Разбор видео и пачки изображений, длинные мультимодальные документы

MiniMax M3 0.095 / 0.378 ₽ за 1k in/out

Экономичная мультимодальная модель с контекстом 1М токенов. Подходит для длинных файлов, массовых задач, недорогих агентов и чернового прохода по большому объёму данных.

Лучший бюджетный старт для длинного контекста и частых агентных вызовов
Финальный аудит критичного кода лучше отдать Kimi K3, Sonnet 5 или Opus 5

04Открытый фронтир и специалисты

Открытый фронтир: GLM, DeepSeek, Qwen, Kimi
Открытый фронтир. Тушь и вектор: GLM держит безопасность, DeepSeek пишет код, Qwen тащит рутину, Kimi заходит как второй топ.

Open-weight модели уже не просто догнали фронтир на отдельных задачах: Kimi K3 находится в верхней мировой группе, а DeepSeek, GLM и MiniMax часто дают лучший результат на рубль. Происхождение модели больше не определяет её класс — определяют реальные способности, цена и ограничения конкретного маршрута.

DeepSeek V4 Pro / Flash 0.131 / 0.261 · 0.027 / 0.054 ₽ за 1k

DeepSeek — это не «ещё один дешёвый чат», а практичный инженер. Он не платит за светскую беседу, зато хорошо читает большой проект, находит причину бага, пишет патч и не боится длинной цепочки правок. Pro берите для архитектуры, математики и сложной отладки; Flash — для быстрых итераций, bulk-обработки и агента с многими вызовами инструментов. Оба держат 1M контекста, JSON и tool calling.

Coding-агент с тулами, большие объёмы кода, длинный контекст
На субъективно-креативных задачах уступает Opus

GLM-5.2 0.279 / 0.900 ₽ за 1k

Модель для кода, аналитики, безопасности и длинного контекста. Подходит как сильный рабочий вариант для агентных задач.

Security-аудит, поиск уязвимостей, code review в безопасности
Бюджетная замена Opus для кодовых агентов

Предупреждение. Open-weight модели отлично работают как исполнители под чёткое ТЗ, но автономности им пока доверять рано. Давай узкую, хорошо ограниченную задачу и проверяй ответ так же внимательно, как писал бы код сам. Что-то регулярно теряется по дороге — это их характер, а не баг. Для их профильных задач в aisq берём GLM-5.2 и DeepSeek V4. Мнение основателя aisq, но проверено на практике.

Российский контур: GigaChat и Alice AI

Российские модели пока не стоит автоматически ставить выше глобального фронтира, но у них есть практические преимущества: русский язык, локальный контекст, российская инфраструктура и понятная корпоративная юрисдикция. Для документов, поддержки, RAG и внутренних систем это часто важнее ещё нескольких баллов зарубежного бенчмарка.

Данные в РФ. Модели с отметкой «РУ» в AISQ используют российский маршрут обработки. Это может помочь оператору персональных данных выполнить требование локализации из ч. 5 ст. 18 Закона № 152‑ФЗ, если он работает с данными граждан РФ. Но выбор маршрута сам по себе не заменяет правовое основание, согласия, внутренние документы и другие обязанности оператора. AISQ не создаёт отдельную копию запросов или файлов для обучения моделей; история и технические записи хранятся только по правилам политики конфиденциальности.

GigaChat 0.133 / 0.133 · 1.020 / 1.020 · 1.326 / 1.326 ₽ за 1k

Сильная российская линейка Сбера для русского языка, документов, функций и мультимодальных бизнес-сценариев. Для русских юридических и официальных документов без образца в AISQ рекомендуем начать с GigaChat 2 Max: он лучше ориентируется в деловом русском и типовых формулировках. Это не юридическая консультация — финальную версию всегда проверяет профильный специалист. Новый open-source флагман GigaChat 3.5 Ultra — уже 432B-модель с упором на код, агентов и сложные предметные области; он стал компактнее прежнего Ultra, использует меньше KV-кеша и быстрее генерирует. Но в коммерческом маршруте AISQ сейчас доступны проверенные GigaChat 2 Lite, Pro и Max — 3.5 добавим после стабильного платного API.

Русские документы, образование, корпоративные помощники и function calling
GigaChat 2 Max держит 128k контекста и работает с текстом, изображениями и аудио
Не выдаём open-source релиз 3.5 за уже подключённую коммерческую модель

Alice AI LLM / Flash 1.020 / 2.448 · 0.088 / 0.264 ₽ за 1k

Флагманская и быстрая модели Яндекса для русского бизнеса. Основная Alice AI LLM хорошо объясняет сложные вещи, пишет и редактирует тексты, отвечает по документам и базам знаний. Flash почти в пять раз дешевле прежней ветки и рассчитана на массовые диалоги, модерацию, классификацию обращений и поддержку с высокой нагрузкой.

RAG по российским документам, продажи, обучение и деловая переписка
Flash — поддержка, модерация, классификация и большие потоки однотипных запросов
Оптимизированная токенизация русского текста и обработка в российской инфраструктуре

Подробнее о российских моделях. В таблице указаны текущие цены aisq. Итоговая стоимость зависит от объёма входа и ответа и показывается в интерфейсе до запроса. технический разбор GigaChat 3.5 от команды Сбера ↗, анонс Alice AI LLM Flash ↗, возможности Alice AI LLM для бизнеса ↗.

05Стратегия: четыре уровня

Раньше уровней было три, теперь четыре. Логика простая: начинай снизу и поднимайся, только если результат не устроил.

УровеньМоделиКогда
FreeQwen 3.6 35B Fast, GPT-OSS 120B, Gemma 4 31BFAQ, черновики, классификация и простые рабочие задачи
CheapDeepSeek V4 Flash, Gemini 3.1 Flash Lite, MiniMax M3Частые вызовы агента, быстрые правки, массовая обработка
StandardMiniMax M3, GPT-5.6 Luna, DeepSeek V4 Pro, GLM-5.2, Gemini 3.5 FlashОсновной чат Pro, агенты с тулами, код, документы и мультимодальные задачи
PremiumKimi K3, Sonnet 5, Opus 5, GPT-5.6 Terra / Sol, Gemini 3.1 ProТочность, длинный reasoning, vision-heavy, финал для клиента

Как это работает в Studio, шаг за шагом:

  1. Вопрос сначала попадает на бесплатный Qwen 3.6 35B Fast, получаем черновик.
  2. Справился, отдаём как есть.
  3. Не тянет, поднимаем на GPT-5.6 Luna или DeepSeek V4 Pro — по типу задачи.
  4. Если вы пока не уверены, как именно решить задачу, начинайте сразу с Claude Sonnet 5, GPT-5.6 Terra или GPT-5.6 Sol: большая модель чаще выберет правильный план и доведёт первый проход до рабочего результата. После этого повторяемые части можно перенести на быструю модель.
  5. И там не то, берём Kimi K3, Sonnet 5, GPT-5.6 Sol или Opus 5 ради топ-качества.
  6. Код идёт своей веткой: DeepSeek V4-Pro / V4-Flash, fallback это gpt-oss-120b или GLM-5.2 под security.
  7. Для свежих данных запускай агентный поиск, а итоговый разбор делай через GPT-5.6 Terra.
  8. Длинные PDF, договоры и большие материалы разбирает Gemini 3.1 Pro.
  9. Контекст сохраняется при переключении: не копируешь диалог в новый чат.

Пример из практики. Клиент присылает 80-страничный PDF. MiniMax M3 недорого извлекает требования, DeepSeek V4 Pro пишет код, а Opus 5 или GPT-5.6 Sol делает финальный ревью. Мы платим за флагман только там, где его точность реально нужна.

06Светофор LLM: что под какую задачу

Первая линия это то, с чего начать. Дальше есть куда удешевить или добить качеством.

ЗадачаПервая линияДешевлеТоп-качество
Coding-агент (open-weight SOTA)DeepSeek V4-ProDeepSeek V4-FlashSonnet 5
Стратегия, анализ, длинные текстыGPT-5.6 TerraKimi K3Opus 5
Быстрые ответы, FAQ, чат-ботQwen 3.6 35B FastGemini 3.1 Flash Lite
Основной чат ProGPT-5.6 TerraGPT-5.6 LunaSonnet 5
Дешёвый фронтир вместо OpusKimi K3DeepSeek V4 ProOpus 5
Премиум-чат Pro+GPT-5.6 TerraSonnet 5Opus 5
Математика, рассужденияGPT-5.6 TerraDeepSeek V4 ProGPT-5.6 Sol
Vision (скриншот в код)Sonnet 5GPT-5.6 LunaGPT-5.6 Sol
Огромный контекст (256k+)DeepSeek V4 (1M)GPT-5.6 Luna (1M)GPT-5.6 Sol (1M)
Длинные PDF, книги, архивыGemini 3.1 ProGemini 2.5 FlashGPT-5.6 Sol
Длинный reasoning, строгий JSONDeepSeek V4 Progpt-oss-120bGPT-5.6 Sol
Свежая инфа и трендыGPT-5.6 Terra + агентный поискGPT-5.6 Luna + агентный поискGPT-5.6 Sol + агентный поиск
Open-weight: код и аналитикаDeepSeek V4 ProGLM-5.2
Многоязычный чатGPT-5.6 LunaGemini 3.5 FlashClaude Sonnet 5
Security researchGPT-5.6 SolGLM-5.2Opus 5
Русский языкQwen 3.6 35B FastAlice AIGPT-5.6 Terra
Bulk, RAG-черновики, классификацияGemini 3.1 Flash LiteQwen 3.6 35B Fast
Агент с туламиSonnet 5GPT-5.6 LunaGPT-5.6 Sol

07Картинки

Модели генерации картинок как художественные инструменты
Выбирайте не «самую умную» модель, а подходящий режим. Одни модели создают новый кадр по описанию, другие умеют аккуратно менять готовую картинку или удерживать героя по референсам.

Сначала выберите режим

Текст → изображение создаёт новый кадр с нуля. Изображение → изображение получает исходник и команду вроде «замени фон» или «убери чашку». Референс помогает сохранить человека, товар или стиль, но не делает результат точной копией.

Что нужно сделатьПервая линияЧто важно знать
Создать новый кадр только по описаниюSeedream 5, Krea 2, Grok 2 Image, Ideogram 4Загрузить исходник нельзя или он не нужен: управляйте сценой словами.
Изменить часть готовой картинкиGPT Image 2.5 (лайт), Nano Banana 2, Qwen Image 3.0Загрузите исходник и отдельно напишите, что изменить и что обязательно оставить без изменений.
Сохранить героя, товар или стильNano Banana 2 / Pro, GPT Image 2.5, Qwen Image 3.0 ProИспользуйте чистые референсы одного персонажа; одинаковая одежда и свет заметно повышают стабильность.
Быстро проверить много идейZ-Image Turbo, Krea 2 TurboСначала найдите композицию на дешёвых вариантах, затем повторите лучший замысел в финальной модели.

Русский текст на изображении. Если надпись должна реально читаться, первая линия в aisq — GPT Image 2.5 и Nano Banana 2 / Pro. Они лучше остальных понимают компоновку и кириллицу, но даже их результат нужно проверить буква за буквой. Ideogram 4 особенно хорош для коротких латинских заголовков, а Qwen — для английского и китайского; точный русский текст мы им не обещаем. Длинный текст безопаснее наложить после генерации в редакторе.

Что выбрать по задаче

ЗадачаРекомендуемПочемуЦена в aisq
Человек, fashion, lifestyleKrea 2 Large или Seedream 5 ProЕстественный свет, кожа, одежда и рекламная фотография.19 ₽ / 15 ₽
Один персонаж в серии кадровNano Banana Pro; дешевле — Nano Banana 2Лучше удерживают лицо, одежду и предметы при смене сцены.45 ₽ / 22 ₽
Инфографика и карточка товара на русскомGPT Image 2 или Nano Banana 2 LiteПонимают иерархию блоков и лучше работают с кириллицей. Цифры и орфографию всё равно проверяйте.10 ₽
Плакат, логотип, крупный короткий заголовокIdeogram 4Сильная типографика и чистая композиция; для русского финала лучше GPT Image 2.16 ₽
Реклама с множеством условийGPT Image 2Хорошо следует сложной инструкции и умеет исправлять исходник обычной фразой.от 19 ₽
Точечно убрать, заменить или перекрасить объектGPT Image 2, Nano Banana 2, Qwen Image 3.0Это полноценное редактирование исходника, а не новая случайная картинка на ту же тему.от 10 ₽
Фотореал или концепт только по текстуSeedream 5 Pro, Krea 2 Large, Grok 2 ImageХороши для нового кадра с нуля; для локальной правки выберите модель с режимом редактирования.15–20 ₽

Быстрые и бюджетные

МодельСильные стороныРедактирует исходникЦена/шт
Z-Image TurboНаброски, концепт-арт и много быстрых итерацийДа, простые изменения1,50 ₽
Krea 2 TurboБыстрый подбор стиля и фотореалистичные черновикиНет, в текущем режиме aisq только по тексту5 ₽
Qwen Image 3.0Недорогие макеты и правки по референсу, до 2KДа10 ₽
Nano Banana 2 LiteПосты, карточки, кириллица и недорогие правки исходникаДа10 ₽

Nano Banana 2 Lite — лучший недорогой старт, если нужно не просто нарисовать новый кадр, а поправить готовый: сменить фон, одежду, цвет или надпись. Полную Nano Banana 2 выбирайте, когда важнее стабильность героя и сложная композиция.

Светофор картинок

ЗадачаПервая линияДешевлеТоп-качество
Быстрый черновикZ-Image TurboKrea 2 Turbo
Пост или карточка без обязательного текстаSeedream 5 LiteZ-Image TurboSeedream 5 Pro
Фотореалистичный маркетингSeedream 5 ProKrea 2 TurboGPT Image 2
Русский текст и инфографикаGPT Image 2Nano Banana 2 LiteNano Banana Pro
Люди, портреты, fashionKrea 2 LargeKrea 2 TurboSeedream 5 Pro
Персонаж в нескольких сценахNano Banana 2Qwen Image 3.0Nano Banana Pro
Точечно заменить объект или фонGPT Image 2Qwen Image 3.0Nano Banana Pro
Новый кадр только по описаниюSeedream 5 ProZ-Image TurboGrok 2 Image

Как просить локальную правку. Не пишите просто «сделай лучше». Укажите область и ограничение: «замени только синюю чашку на красную; лицо, руки, фон, свет и кадрирование не меняй». Для серии с одним героем приложите тот же референс к каждой генерации.

08Промпт-инжиниринг: куда его скидывать

Промпт-инжиниринг через LLM
Промпт-инжиниринг. Стол с ноутбуком, формула «Subject + Style + Lighting» на экране, примеры вокруг.

Для «рабочих лошадок» и ниже промпт-инжиниринг обязателен, иначе результат средний. Это не волшебные слова, а структура:

[Subject] + [Style/Artist ref] + [Lighting] + [Composition/Camera] + [Color palette] + [Mood] + [Negative: что убрать]

Хороший промпт, хорошая картинка. Плохой промпт, лотерея.

Лайфхак. Писать промпт руками лень? Загрузи референс в Qwen 3.6 35B Fast, Claude Sonnet 5 или GPT-5.6 Luna и попроси собрать промпт под Seedream 5, Qwen Image 3.0, GPT Image 2 или Z-Image.

09Видео и 3D

У видео главный выбор — не бренд, а вход. Текст → видео придумывает весь кадр с нуля. Изображение → видео оживляет уже утверждённый кадр и лучше удерживает героя или товар. Для рекламы обычно надёжнее сначала сделать ключевой кадр в Studio, а затем анимировать его.

Сначала зафиксируйте героя: character sheet для серии

Если персонаж должен появиться в нескольких сценах, не просите каждую модель заново «угадать» его внешность. Сначала соберите один референс-лист: герой в полный рост спереди, сбоку и со спины, несколько крупных планов лица и отдельные детали одежды. Такой лист становится визуальным паспортом персонажа для последующих кадров.

  1. Возьмите чистое исходное фото — лучше в полный рост или хотя бы по колено, без сильных фильтров и перекрытий лица.
  2. В режиме «Режиссёр изображений» прикрепите его как @фото1. Если одежду, обувь или предмет нужно сохранить по отдельным образцам, добавьте их как @фото2, @фото3 и подпишите роль каждого файла.
  3. Попросите собрать лист на спокойном фоне: одинаковый свет, одна одежда, нейтральная поза, без надписей и лишних предметов.
  4. Проверьте лицо, силуэт и детали. Только после этого передавайте лист в режим «Изображение → видео» или в режиссёр видео.
По загруженному @фото1 создай референс-лист одного персонажа для серии видео.
Покажи три вида в полный рост: анфас, профиль и со спины; шесть крупных планов головы под разными углами; отдельно — обувь, верхнюю одежду и важные аксессуары.
Сохрани без изменений лицо, возраст, телосложение, причёску, цвета и посадку одежды. Во всех ячейках один рост и один комплект одежды.
Свет ровный студийный, фон белый или светло-серый, без текста, рамок, лишних людей и новых предметов. Фотореалистичная предпродакшн-разметка, аккуратная сетка, одинаковый масштаб.

Для товара работает тот же принцип. Напишите: «@фото1 — образец композиции, @фото2 — изделие, @фото3 — нужный цвет и материал». Сначала утвердите лист ракурсов, затем оживляйте его в видео. Это заметно надёжнее, чем пытаться исправлять разные формы и детали уже после генерации ролика.

Важно: character sheet не гарантирует идеальную идентичность в каждом кадре. Он задаёт модели единый визуальный ориентир; лучше сохранять тот же референс, описание одежды и формат кадра во всех последующих запусках.

ЗадачаМодельКакой входЧто получитеЦена в aisq
Люди, актёры, естественная пластикаKling 3.0 StandardТолько описаниеПлавный social- или lifestyle-кадр на 3–15 секунд.от 80 ₽ / 3 с
Реклама и управляемое движение камерыWAN 2.7Описание или стартовый кадрСтабильная композиция, пролёт, панорама или наезд камеры.158 ₽ / 5 с в 720p
Премиальный сюжетный финалVeo 3.1 FastТолько описаниеКинематографичный 8-секундный кадр; в текущем режиме aisq без аудио.252 ₽ / 8 с
Сложная сцена сразу со звукомSeedance 2.0Описание, можно приложить референс720p, синхронное аудио и точные команды для камеры.378 ₽ / 5 с в 720p
Недорогой ролик со звукомLTX 2.3Отдельные режимы по тексту и по картинке5–20 секунд, 480p–1080p; удобен для раскадровок, рекламы и быстрых версий.от 33 ₽ / 5 с
Быстро проверить сценарийGrok Imagine VideoТолько описание6 или 10 секунд в 480p/720p.95–157 ₽
Удержать героя или продукт по нескольким фотоGrok References → VideoОт 1 до 7 референсовСогласованный персонаж, товар и стиль между кадрами.95–157 ₽
Оживить один утверждённый кадрRunway Gen-4 TurboСтартовый кадр обязателенАккуратное движение при сохранении исходной композиции.89 ₽ / 5 с
Длиннее и точнее оживить один кадрGrok Imagine Video 1.5Стартовый кадр обязателенДо 15 секунд, управление действием и камерой, 480p/720p.130–665 ₽

Как удержать одного персонажа в видео. Не начинайте каждый ролик заново по тексту. Сначала создайте и утвердите портрет или полный рост, затем используйте этот кадр в Runway, LTX Image → Video или Grok Image → Video. Если есть несколько ракурсов героя или товара, выбирайте Grok References → Video.

3D: Hunyuan3D 3.1 Rapid — быстрый меш без текстуры за 30 ₽. Hunyuan3D v3 — детальный GLB за 141 ₽. Rodin 2.5 — 149 ₽ за чистую сетку и материалы по одному или нескольким ракурсам. Meshy 6 — продакшн-вариант за 275 ₽ с PBR-картами.

10Аудио

11Агенты: когда нужны тулы

Обычный чат отвечает текстом. Агент может перейти от совета к действию: найти свежие данные, прочитать сайт, разобрать документ, распознать аудио или собрать изображение. Перед платным действием aisq показывает стоимость, а результат генерации сохраняет в общей истории.

Универсальный агент

Подходит для задач, где одного ответа мало. Он ищет информацию в интернете и Telegram, читает сайты, PDF и офисные файлы, запускает OCR, разбирает аудио, помогает с кодом и сводит найденное в понятный результат. Просто опишите конечную цель — агент сам выберет нужные инструменты и покажет ход работы.

Режиссёр изображений

Превращает короткую идею в готовый кадр: уточняет формат, композицию, свет, камеру, стиль, надписи и ограничения, затем предлагает подходящую модель. В одном диалоге можно продолжать правки выбранной версии, а не начинать всё заново.

Несколько фото без путаницы. Прикрепите до четырёх изображений — они получат имена @фото1, @фото2 и далее. Напишите по-человечески: «@фото1 — образец, @фото2 — изделие, @фото3 — нужный цвет». Для готовой композиции нажмите «Повторить сцену»: первое фото сохранит расположение, фон, свет и ракурс, а второе задаст нового героя или объект.

Режиссёр видео

Разворачивает идею в сценарий ролика: длительность, формат площадки, последовательность кадров, движение камеры и непрерывность героя или товара. На выходе вы получаете готовый промпт и рекомендацию модели; запуск видео подтверждается отдельно, поэтому дорогая генерация не начнётся незаметно.

ЗапросРежим
«Напиши пост про X»Чат
«Найди 10 новостей про X и сведи в саммари»Агент (поиск + RAG)
«Разбери мой PDF и собери 3 слайда»Агент (файл + vision)
«Сделай ресёрч по 5 конкурентам»Агент (поиск + RAG + таблица)
«Переведи текст»Чат
«Расшифруй подкаст и сделай саммари»Агент (Whisper + RAG)

12Универсальные правила

  1. Сначала дешёвая модель. Устроил результат, не плати больше.
  2. Переключение модели прямо в диалоге, киллер-фича aisq. Контекст не теряется.
  3. Тулы удорожают запрос, но экономят твоё время. Пользуйся, только помни про лимиты.
  4. Индикатор стоимости в Studio показывает цену запроса в реальном времени.
  5. Цена относится к каждому созданному результату. Если модель успешно сделала картинку, видео, аудио или 3D, генерация оплачивается, даже когда творческий результат вам не подошёл. Подтверждённая техническая ошибка не тарифицируется.
  6. Картинки и видео дороже текста. Для черновиков начинайте с Z-Image Turbo, а дорогую модель подключайте после выбора композиции.
  7. Для продакшна бери Pro с бонусами. Месячный пакет выгоднее разовой оплаты из кошелька.
  8. RAG требует эмбеддингов. Каждый документ это эмбеддинг + rerank + LLM, учитывай.
  9. Open-weight и китайские, отличные исполнители, но не автономные агенты. ТЗ чёткое, проверка тоже.
  10. Промпт для картинки лень писать руками? Скинь задачу в Qwen 3.6 35B Fast, Sonnet или GLM и попроси собрать.

Обновлено: 30 июля 2026. Источники: Artificial Analysis, официальные карточки моделей и собственные проверки в Studio. Возможности маршрутов и цены aisq могут меняться; актуальная сумма всегда показывается до запуска.