Суть урока
Генерация картинок с помощью AI в 2026 году похожа на камеру в смартфоне 2010 года. Нажать кнопку и получить картинку может каждый. Разница между «фоткой» и «фотографией» в технике, знании инструмента и доработке после генерации.
Рынок делят пять главных инструментов, у каждого своя специализация. Midjourney — художник. ChatGPT Images — универсал, который уже под рукой. Flux — открытые модели и скорость. Recraft — мастер векторной графики. Ideogram — мастер надписей. Универсального чемпиона нет. Профессионал держит в работе 2–3 инструмента и знает, какой где сильнее.
В этом уроке разберём честно: как устроены цены, рабочие схемы для разных задач, юридические подводные камни и типичные ошибки, которые отличают «картинку от AI» от материала, готового к публикации.
Писать код в этом уроке не нужно: задание в разделе «Практика» делается в браузере или в телефоне. Примеры со скриптами помечены как необязательные, они для тех, кто программирует.
Предупреждение: этот рынок меняется быстрее остальных. Названия версий и условия в уроке даны на октябрь 2026, а актуальные цены и версии смотри на странице Актуальное сейчас и в каталоге инструментов. Цены сервисов в уроке заменены ссылками на их страницы с тарифами, а цифры в примерах расчёта условные.
🎯 Как выбрать инструмент
Главный вопрос — не «какой инструмент лучше», а «что я делаю и для какой площадки».
Берёшь Midjourney, если:
- ✓ Нужны художественные картинки: иллюстрации, концепт-арт
- ✓ Нужны подборки картинок-образцов для настроения проекта (их называют mood board) или обложки для YouTube в художественном стиле
- ✓ Готов работать на сайте сервиса по подписке (раньше основным способом был Discord)
- ✓ Качество важнее скорости
Берёшь ChatGPT Images (модели GPT Image), если:
- ✓ Нужна фотореалистичная картинка с надписью
- ✓ Уже пользуешься ChatGPT (картинки доступны и на бесплатном тарифе, с лимитами)
- ✓ Не хочешь разбираться в настройках: достаточно описать картинку словами
- ✓ Нужны быстрые наброски для презентаций
Берёшь Flux, если:
- ✓ Нужны скорость и объём (100+ изображений в день)
- ✓ Нужен фотореализм
- ✓ Нужна модель с открытыми весами, то есть такая, которую можно скачать и запустить на своём компьютере (понадобится мощная видеокарта)
- ✓ Лицензию проверишь заранее: у разных моделей Flux она разная
Берёшь Recraft, если:
- ✓ Нужны логотипы, иконки, векторная графика
- ✓ Делаешь фирменный стиль или инфографику
- ✓ На выходе нужен файл SVG (векторный формат: картинка увеличивается без потери качества и правится по частям)
- ✓ Нужны аккуратные надписи на картинке
Берёшь Ideogram, если:
- ✓ Делаешь постеры и рекламу для соцсетей с надписями
- ✓ Нужен длинный текст на картинке (несколько строк)
- ✓ Бюджет минимальный (есть бесплатный тариф)
Если не знаешь, с чего начать: связка Flux + Ideogram + Recraft закрывает большинство задач. Midjourney добавь, когда нужна художественность, а ChatGPT Images бери, если уже пользуешься ChatGPT.
Ключевые концепции
- Диффузионная модель (diffusion model) — нейросеть, которая учится восстанавливать изображение из шума. На этом принципе построены многие генераторы картинок
- Промпт — запрос к AI: описание картинки словами. От того, как он составлен, зависит очень многое
- Пропорции кадра (aspect ratio, AR) — соотношение ширины и высоты картинки. 16:9 для YouTube, 9:16 для Reels и TikTok, 1:1 для Instagram, 4:5 для Facebook
- Seed (зерно) — число, которое задаёт случайность. Тот же промпт и тот же seed дают тот же результат
- Образец стиля (style reference, sref) — картинка, с которой модель берёт стиль
- Образец персонажа (character reference) — картинка, по которой модель сохраняет внешность героя от кадра к кадру. В Midjourney V8 это делает Edit Model, а параметр
--crefостался в старых версиях - Inpainting (правка части картинки) — меняешь выбранную область, остальное остаётся как было
- Outpainting (дорисовка) — расширение картинки за её границы
- Негативный промпт (negative prompt) — описание того, чего на картинке быть НЕ должно. Есть не у всех моделей
- Guidance scale (CFG) — насколько строго модель следует промпту. Шкала у каждой модели своя, и этот параметр есть не у всех сервисов
- API — способ подключить сервис к своей программе. Нужен разработчикам; чтобы делать картинки на сайте сервиса, он не нужен
Теория
Пять главных инструментов 2026 года
Midjourney V8
Старейший и самый узнаваемый сервис. Делает упор на художественное качество. С 24 июля 2026 года версия по умолчанию — V8.2: в ней доработаны эстетика и подстройка под твой вкус. Начиная с V8 есть режим HD, в котором картинка сразу получается в разрешении 2K, и надписи в кадре стали точнее. Правки по описанию и работа с картинками-образцами идут через Edit Model, а из картинок можно делать короткие видео.
Цена: только платная подписка, бесплатного тарифа нет. Самый дешёвый тариф называется Basic. На старших тарифах больше быстрого времени генерации (сервис считает его в минутах работы своих видеокарт), а на тарифах Pro и Mega есть скрытый режим (Stealth Mode): твои картинки не видны другим. Режим HD тратит больше времени генерации. Тарифы и цены: https://docs.midjourney.com/hc/en-us/articles/27870484040333-Comparing-Midjourney-Plans
Как работать: на сайте сервиса, по подписке. Раньше основным способом был бот в Discord с командами /imagine, /blend, /describe; он работает и сейчас. Параметры вроде --ar пишутся в конце запроса.
Сильные стороны:
- Сильная художественная стилизация
- Образцы стиля и персонажа, чтобы серия картинок выглядела единой
- Большое сообщество, где делятся стилями и настройками
- Скрытый режим на тарифах Pro и Mega: твои генерации не видны публично
Слабые стороны:
- Нет официального публичного API (проверь на сайте сервиса, не появился ли)
- Надписи получаются лучше, чем раньше, но для текста на картинке надёжнее Ideogram
- Сложно автоматизировать скриптами
- Интерфейс и параметры непривычны новичкам
Лучше всего для: художественных обложек YouTube, обложек книг, концепт-арта, иллюстраций к статьям, подборок картинок-образцов.
ChatGPT Images / GPT Image (OpenAI)
DALL-E 2 и DALL-E 3 отключены в API OpenAI 12 мая 2026 года. Их сменили модели семейства GPT Image: в API это gpt-image-2 и две модели gpt-image-2.5. В самом ChatGPT генерация встроена и называется ChatGPT Images: она доступна на всех тарифах, включая бесплатный, а режим с обдумыванием (Thinking) есть только на платных. Версия 2.0 (апрель 2026) лучше рисует текст, в том числе не латиницей. Версия 2.5 (8 сентября 2026) добавила шаблоны, а в мобильном приложении ещё и набросок от руки прямо в чате и правки по комментариям на самой картинке.
Цена: в ChatGPT генерация входит в тариф с его лимитами. В API оплата идёт по токенам (единицам расчёта), стоимость одной картинки зависит от размера и качества. Актуальные цены: https://developers.openai.com/api/docs/pricing
Сильные стороны:
- Хорошо понимает длинные описания
- Правка словами прямо в диалоге
- Надписи в кадре (начиная с версии 2.0 заметно лучше)
- Простой API для разработчиков
Слабые стороны:
- Меньше ручных настроек, чем у открытых моделей
- «Почерк AI» бывает заметнее, чем у Flux: сравни на своей задаче
- Фильтры иногда блокируют безобидные запросы
Лучше всего для: быстрых набросков для слайдов, фотореалистичных предметных фото, картинок для блога, когда нужно быстро и без настроек.
Flux (Black Forest Labs)
Flux запустила в 2024 году команда выходцев из Stability AI. На сайте компании (bfl.ai) в октябре 2026 года — семейство FLUX 3: FLUX 3 Image (вышла 1 октября 2026), FLUX 3 Video и FLUX Tools для точной правки. Пользоваться можно в песочнице (Playground: страница, где модель пробуют прямо в браузере) или через API; у части моделей есть открытые веса, их можно скачать и запустить у себя. Без кода проще всего работать через сервисы-витрины вроде Krea, где собраны модели разных компаний, в том числе Flux.
Раньше (Flux 1) семейство делилось на быструю Schnell, Dev с некоммерческой лицензией и Pro только через API. Эти названия ещё встречаются в старых материалах, а в новых версиях набор моделей и их лицензии другие. Лицензия зависит от модели: перед коммерческим использованием открой её страницу и прочитай условия.
Цена: у провайдеров API (fal.ai, Replicate и другие) оплата идёт за изображение, цены различаются по версиям и меняются. Смотри цены выбранного провайдера: https://fal.ai/models. За запуск открытых весов у себя не платишь за каждую картинку, но нужна мощная видеокарта, а для коммерческого использования может понадобиться лицензия.
Сильные стороны:
- Сильный фотореализм
- Скорость (быстрые версии отвечают за секунды)
- Открытые веса у части моделей
- Поддержка LoRA: это небольшая надстройка, которой модель дообучают на своих картинках, чтобы она держала стиль бренда
- Правка части картинки и дорисовка через FLUX Tools
Слабые стороны:
- Для надписей чаще берут Ideogram: сравни на своей задаче
- Стиль обычно менее художественный, чем у Midjourney
- Набор версий и лицензий быстро меняется
Лучше всего для: предметных фото для интернет-магазина, фото недвижимости и еды, моды, любого фотореализма в большом объёме.
Recraft V4
Сервис для дизайнеров: векторная графика и фирменный стиль. Модель V4 вышла 17 февраля 2026 года, V4.1 — 14 мая 2026; на сайте есть и быстрая V4.1 Flash. Recraft выдаёт редактируемую векторную графику (SVG), позволяет задать собственный стиль без обучения модели, делает макеты на предметах (мокапы), увеличивает изображения и убирает фон.
Цена: попробовать можно бесплатно, но на бесплатном тарифе картинки принадлежат Recraft, видны всем и не разрешены для коммерческого использования. Права на картинки и коммерческое использование дают платные тарифы. Условия (кредиты, доступ к API) смотри на странице цен: https://www.recraft.ai/pricing
Сильные стороны:
- Сразу выдаёт вектор (SVG)
- Собственный стиль бренда без обучения модели
- Хороший контроль над надписями и шрифтами
- Иконки, логотипы, инфографика
Слабые стороны:
- Фотореализм не главная его сила
- Для художественных иллюстраций чаще берут Midjourney
- Тарифы в кредитах: считай расход заранее
Лучше всего для: логотипов, иконок для интерфейса, инфографики, набора фирменного стиля, презентаций.
Ideogram
Сервис запустили бывшие исследователи Google Brain. Специализация — картинки с надписями: постеры, обложки, баннеры, упаковка. Ideogram 4.0 (3 июня 2026) — модель с открытыми весами: плотный текст на разных языках, управление тем, где встанет логотип или заголовок, через рамки (bounding boxes), картинки в 2K. Скачать веса и запустить у себя можно, но для коммерческого использования весов нужна отдельная лицензия Ideogram. 30 сентября 2026 года вышла Ideogram 4.5: модель для точной правки готовых картинок. Работает на сайте и через API.
Цена: есть бесплатный тариф (картинки на нём видны всем), платные подписки и условия API смотри на странице: https://ideogram.ai/pricing
Сильные стороны:
- Один из лучших для надписей на картинках
- Работа со шрифтами: разные начертания, стилизация букв
- Постеры, реклама, объявления для соцсетей
- Есть бесплатный тариф
Слабые стороны:
- Фотореализм не главная его сила
- Меньше художественной гибкости, чем у Midjourney
- Скрыть свои картинки от других можно только на платных тарифах
Лучше всего для: постеров с длинным текстом, рекламы в соцсетях, обложек подкастов, шрифтовых композиций.
Сравнительная таблица
| Задача | Что взять | Как платишь | Есть API? |
|---|---|---|---|
| Художественная иллюстрация | Midjourney | Подписка | Официального публичного API нет (проверь) |
| Фотореализм | Flux | За изображение у провайдера API или через сервисы-витрины | ✅ |
| Надпись на картинке | Ideogram | Бесплатный тариф, подписка или API | ✅ |
| Вектор и логотипы | Recraft | Тарифы с кредитами | ✅ |
| Фото с короткой надписью | ChatGPT Images | Входит в ChatGPT; API по токенам | ✅ |
| Быстрые наброски | Быстрые версии Flux | За изображение у провайдера | ✅ |
| Запуск на своём компьютере (любой объём) | Модели с открытыми весами (Flux, Ideogram 4.0); лицензию для коммерции проверь | Своя видеокарта | ✅ |
Конкретные цены в таблицу не вынесены, потому что они часто меняются. Считай по формулам из раздела «Реальные расходы» ниже.
Рабочие схемы для типовых задач
Один инструмент даёт один результат. Связка инструментов даёт рабочий конвейер. Вот четыре схемы, которые закрывают большинство задач того, кто делает контент или дизайн. Все четыре можно пройти вручную, на сайтах сервисов; скрипт в схеме B — необязательное дополнение.
Схема A: картинка для соцсетей (постер для Instagram или Telegram)
Задача: еженедельный постер для Telegram-канала с цитатой эксперта.
Инструменты:
- Ideogram — делаем постер с текстом цитаты
- Midjourney — делаем художественный фон, если нужен
- Photopea (бесплатный редактор в браузере, похож на Photoshop) — собираем итог
Время: 30 минут на пост. Что нужно оплатить: подписку Midjourney (тариф Basic, цену смотри на странице тарифов); у Ideogram хватит бесплатного тарифа. Стоимость одной картинки: считай по формуле из раздела «Реальные расходы».
Порядок работы:
Ideogram: «цитата на белом фоне» → файл PNG
↓
Midjourney: «абстрактный фон, глубокий синий --ar 9:16» → файл PNG
↓
Photopea: накладываем текст на фон → итоговый PNG 1080x1920Схема B: фото товаров для интернет-магазина
Задача: 100 фотографий товаров на белом фоне для интернет-магазина.
Инструменты:
- Flux — генерация предметных фото
- Photoshop или Canva — добавляем логотип и фирменные элементы
Время: около 5 минут на товар (если делать партией через скрипт). Что нужно оплатить заранее: ничего, оплата идёт за использование API. Стоимость: цена за картинку у провайдера × число картинок (с запасом на неудачные варианты).
Порядок работы (необязательно: пример для тех, кто пишет скрипты на Python; без кода те же картинки делаются по одной на сайте Krea или в песочнице bfl.ai):
# batch_products.py — упрощённый пример
# идентификатор модели в fal.ai меняется: сверь его на странице модели
import fal_client
products = ["ceramic mug", "wireless headphones", "leather wallet"]
for product in products:
result = fal_client.run(
"fal-ai/flux-pro/v1.1",
arguments={
"prompt": f"professional product photography, {product}, white background, studio lighting, soft shadow, commercial e-commerce style",
"image_size": "square_hd"
}
)
# сохраняем result["images"][0]["url"]Сравни со своей текущей ценой фотосъёмки, но помни про ограничения: AI не заменяет студию, когда нужны точная форма и цвет реального товара. Если покупатель ожидает реальное фото (карточки на маркетплейсах), проверь правила площадки: многие требуют снимки настоящего товара или пометку об AI.
Схема C: набор фирменного стиля
Задача: полный набор для нового проекта: логотип, иконки, подборка картинок-образцов, макеты на предметах.
Инструменты:
- Recraft — логотип и иконки (SVG)
- Midjourney — подборка картинок-образцов (12 художественных картинок)
- Flux — фотореалистичные макеты (визитки, упаковка)
Время: 4–8 часов на полный набор. Что нужно оплатить: подписки на время проекта (Midjourney и платный тариф Recraft, чтобы права на логотип были у тебя) и картинки у провайдера Flux; цены смотри на страницах тарифов. Стоимость набора: расход на генерации плюс твоё время.
Порядок работы:
Recraft → 10 вариантов логотипа в SVG
↓ выбираем 1–2
Recraft → 12 иконок в SVG в едином стиле
↓
Midjourney → подборка образцов (сетка 3x4) → ориентир для команды
↓
Flux → макеты: визитка, кружка, упаковка, рекламный щит
↓
Photoshop → собираем PDF с правилами фирменного стиляСхема D: обложки для блога и YouTube
Задача: 20 обложек в неделю для роликов на YouTube или картинок-шапок для статей в блоге.
Инструменты:
- Ideogram — текст для обложки
- Быстрая версия Flux — фоны (быстро и дёшево)
- Canva — итоговая сборка по шаблону канала
Время: 15 минут на обложку. Стоимость: число генераций на одну обложку × цена за картинку (мелочь в сравнении с твоим временем, но посчитай).
Порядок работы:
Быстрая версия Flux: «фон для обложки YouTube» → 4 варианта
↓ выбираем
Ideogram: «крупный текст-зацепка + мелкий подзаголовок»
↓
Canva: сборка по шаблону канала + логотип
↓ сохраняем 1920x1080Для канала с несколькими видео в неделю посчитай недельный расход на обложки и сравни с ценой фрилансера в твоём регионе.
Как писать промпты для картинок
Качество сильно зависит от промпта. Вот главные приёмы. Писать можно по-русски: ChatGPT и Gemini понимают русский. Если какой-то сервис понял русский запрос плохо, попроси своего ассистента (Claude или ChatGPT) перевести запрос на английский.
Ссылка на стиль:
«портрет мужчины в стиле фотографий Энни Лейбовиц» «пейзаж в стиле анимации студии Ghibli» «предметное фото в эстетике рекламы Apple, минимализм»
Имена живых авторов и студий в промптах — спорная территория (авторское право, этика). Безопаснее описывать стиль словами: свет, палитра, фактура, композиция.
Негативный промпт (Ideogram и часть открытых моделей):
prompt: «интерьер современного офиса» negative_prompt: «люди, текст, логотипы, беспорядок, растения»
В негативном промпте просто перечисляют лишнее, без слова «без». У Flux негативного промпта нет: описывай то, что должно быть на картинке. В Midjourney для этого есть параметр --no.
Пропорции кадра (указывай ВСЕГДА):
--ar 16:9— обложки YouTube, обои для рабочего стола--ar 9:16— TikTok, Instagram Reels, Stories--ar 1:1— посты в ленте Instagram--ar 4:5— реклама в Facebook--ar 3:2— как у зеркальной фотокамеры--ar 21:9— широкий «киношный» кадр, широкие баннеры
Так пропорции пишут в Midjourney. В ChatGPT и других сервисах их выбирают кнопкой или пишут словами: «формат 16:9».
Параметры Midjourney (для V8; набор меняется от версии к версии, полный список в документации сервиса):
--hd # картинка в 2K вместо стандартной (тратит больше времени генерации) --s 250 # средняя стилизация --s 750 # сильная стилизация (художественнее) --chaos 50 # больше различий между четырьмя вариантами
Параметр качества --q из прежних версий в V8 не работает.
Guidance scale (у открытых моделей; в ChatGPT Images такого параметра нет). Шкала у каждой модели своя, поэтому начни со значения по умолчанию (у Flux на fal.ai это 3,5) и меняй понемногу:
- ниже значения по умолчанию: модель больше импровизирует
- около значения по умолчанию: обычно лучший баланс
- заметно выше: модель жёстко следует промпту, но картинка может выглядеть неестественно
Единый вид серии через картинки-образцы:
Midjourney, стиль: --sref https://example.com/style.png Midjourney, персонаж: в V8 картинку-образец прикрепляют через Edit Model (до 4 образцов); параметр --cref остался в старых версиях Flux: возможности зависят от версии и провайдера
Как уйти от «почерка AI»
В 2024 году главными проблемами были шесть пальцев, странные глаза и «оплывшие» руки. К 2026 году в современных моделях это в основном решено.
Новые проблемы 2026 года («почерк AI»):
- Слишком гладкая кожа: нет пор и морщин
- Глянцевые поверхности с неестественными отражениями
- Типовые лица: все похожи на людей со стоковых фото
- Слишком симметричные композиции
- Везде жёлтый «закатный» свет (модели его любят)
- Всё в идеальном фокусе, нет естественного размытия фона
Что помогает — добавляй в промпт:
✅ «естественная текстура кожи, видны поры, мелкие несовершенства» ✅ «непринуждённая поза, асимметричная композиция, герой не по центру» ✅ «зерно плёнки, слегка размытый фон, малая глубина резкости» ✅ «жёсткий полуденный свет» вместо привычного закатного ✅ «пойманный момент, не постановка, лёгкий смаз движения» ✅ «неидеальная рамка кадра, как на фото с телефона»
Доработка после генерации:
- В Lightroom или Photoshop добавь зерно (в Photoshop: Filter → Noise → Add Noise, то есть Фильтр → Шум → Добавить шум, 3–5%)
- Слегка поправь цвет: тени холоднее, света теплее
- Добавь лёгкое затемнение по краям (виньетку)
- Обрежь кадр неидеально: герой не по центру
- Добавь едва заметную цветную кайму по краям (хроматическую аберрацию)
Юридические вопросы
Важная глава, которую многие пропускают. В 2026 году картина усложнилась. Это общая информация, а не юридическая консультация: законы разных стран отличаются, а в серьёзных случаях нужен юрист.
Авторское право на картинки от AI:
- США: Бюро авторского права США (US Copyright Office) в 2023 году решило и в 2025 подтвердило: изображение, целиком созданное AI, зарегистрировать как объект авторского права нельзя. Защита возможна только для того, что внёс человек: существенной переработки, отбора, компоновки
- ЕС: единого ответа нет, обсуждение продолжается
- Что это значит на практике: целиком сгенерированную картинку в США трудно защитить от копирования. Чем больше в итоговой работе твоего собственного труда, тем сильнее твоя позиция
Подробнее: https://www.copyright.gov/ai/
Коммерческое использование по сервисам: условия меняются и зависят от тарифа, поэтому в таблице в основном не готовый ответ, а то, что нужно проверить.
| Сервис | Что проверить перед коммерческим использованием |
|---|---|
| Midjourney | Условия подписки: коммерческое использование зависит от тарифа и от размера компании (страница Terms of Service) |
| ChatGPT Images / GPT Image | Условия использования OpenAI: права на результат и ограничения на содержание |
| Flux | Лицензия конкретной модели: у части версий она некоммерческая (старый Dev), у других иная; читай страницу модели |
| Recraft | На бесплатном тарифе картинки принадлежат Recraft и не разрешены для коммерции; права и коммерческое использование дают платные тарифы (на октябрь 2026) |
| Ideogram | На сайте сервиса коммерческое использование разрешено, но на бесплатном тарифе картинки видны всем; для коммерческого запуска открытых весов 4.0 у себя нужна лицензия Ideogram (на октябрь 2026) |
Изображения реальных людей:
- У сервисов свои правила про изображения реальных людей, особенно публичных
- У открытых моделей встроенных запретов может не быть: ответственность по закону на тебе
- Закон о защите данных в ЕС (GDPR) и право на собственный образ в США (right of publicity): использовать образ реального человека обычно можно только с его согласия
Водяные знаки и маркировка:
- Google (Nano Banana в Gemini): картинки помечаются невидимым водяным знаком SynthID
- У других сервисов метки разные (например, метаданные C2PA: это запись о происхождении файла); проверяй правила конкретного сервиса
- В ЕС со 2 августа 2026 года действуют требования закона об ИИ (EU AI Act, статья 50) к пометке сгенерированного контента; кого и как они касаются, проверяй по актуальным источникам
Хорошая привычка: ставь пометку «сделано с помощью AI», если используешь картинки в рекламе и продвижении. Для предметных фото в интернет-магазине уточни правила площадки.
Реальные расходы: как посчитать
Цены в этом уроке специально не вписаны в таблицы: за месяц они успевают поменяться. Вместо готовых цифр — формулы, куда ты подставляешь актуальные значения со страниц с тарифами.
Для подписки:
стоимость одной картинки = цена подписки в месяц / число картинок, которые ты реально сделал
Для API (оплата за картинку):
расход в месяц = число нужных картинок × число вариантов на одну картинку × цена за картинку
Вариантов обычно делают 4–8 и выбирают один, поэтому платишь за все сгенерированные картинки, а не только за ту, что пошла в работу.
Для запуска у себя (открытые веса):
срок окупаемости (мес) = цена видеокарты / (месячный расход на API, который ты заменяешь − электричество)
Пример с условными цифрами (подставь свои, электричество в примере не учтено): видеокарта стоит 1500, API обходится в 50 в месяц, значит окупаемость около 30 месяцев; при 200 в месяц — около 8. Запуск у себя имеет смысл, если генераций много и стабильно, а ещё нужна приватность или полный контроль.
Подписки и API сравнивай на одинаковом объёме: возьми свои 1000 изображений в месяц и посчитай по каждой формуле.
Что меняется в 2026 году
Генерация почти мгновенно:
- Быстрые версии моделей отвечают за секунды
- Есть ускоренные модели (например, LCM, Latent Consistency Models), которым хватает нескольких шагов вместо 28–50
- Где применяют: интерактивные веб-приложения, фильтры дополненной реальности, дизайн «вживую»
Один герой на многих картинках:
- Образцы персонажа (в Midjourney, у Flux через сервисы-витрины и в Nano Banana) быстро улучшаются
- Можно сделать комикс на десятки страниц с одним и тем же героем
- Истории в картинках с помощью AI становятся реальной задачей
Видео:
- Runway — Gen-4.5; Kling — VIDEO 3.0 (в конце сентября 2026 представлена 4.0); Luma — Ray 3.2
- Google Flow — студия Google для видео: в ней работают модели Gemini Omni (вышла в мае 2026) и Veo 3.1
- Sora (OpenAI) закрыта: сайт и приложение с 26 апреля 2026, API с 24 сентября 2026
- Pika — короткие клипы и набор приложений
- Отдельный урок про видео: AI видеогенерация
3D из картинки:
- Появились модели, которые превращают одно изображение в объёмную модель (например, Trellis от Microsoft, Hunyuan3D от Tencent; актуальность проверяй)
- Где применяют: разработка игр, объёмный показ товара в интернет-магазине
Правка картинок:
- FLUX Tools — точечная правка
- Adobe Firefly — встроен в Photoshop
- Ideogram 4.5 — точная правка готовых картинок по описанию
- ChatGPT Images — правки по комментариям на самой картинке (версия 2.5, в мобильном приложении)
Типичные ошибки
❌ Оставлять настройки по умолчанию — результат выходит безликим. Всегда задавай пропорции кадра и стиль.
❌ Не указывать пропорции кадра — модель сделает квадрат 1:1, а для YouTube нужно 16:9. При обрезке потеряешь часть картинки и качество.
❌ Доверять первой же картинке — ВСЕГДА делай 4–8 вариантов и выбирай лучший. Стоит недорого, экономит часы переделок.
❌ Фотореалистичные люди от AI без пометки — вопрос этики и закона. Может стоить репутации и привести к юридическим проблемам.
❌ Пропускать доработку — результат AI редко готов к публикации сразу. Заложи хотя бы 5 минут в редакторе на финальную доводку.
❌ Один инструмент на все задачи — логотип в Midjourney выйдет слабее, чем в Recraft. Каждой задаче свой инструмент.
❌ Писать каждый промпт с нуля — удачные промпты не сохраняются, и каждый раз начинаешь заново. Заведи для них заметку, документ или папку prompts/.
❌ Не читать лицензию — у части версий Flux лицензия некоммерческая, а у Recraft на бесплатном тарифе коммерческое использование не разрешено. Проверь условия модели и тарифа до того, как картинка пойдёт в работу.
Кому что брать
Цены не указаны: они меняются, считай по формулам выше и по актуальным страницам с тарифами.
Новичок (для себя, учёба):
- ChatGPT или Gemini: картинки входят в бесплатный тариф, с лимитами
- Ideogram — бесплатный тариф (картинки на нём видны всем)
- Photopea (бесплатный редактор в браузере)
- Итого: $0 в месяц
Тот, кто ведёт канал или блог (регулярный контент):
- Midjourney (стартовый тариф Basic, цену смотри на странице тарифов)
- Ideogram — бесплатный тариф
- Recraft — платный тариф, если логотипы и иконки идут в работу: на бесплатном коммерческое использование не разрешено
- Canva для итоговой сборки (платный тариф нужен не всегда)
- Итого: подписка Midjourney плюс то, что выберешь платным
Дизайнер-фрилансер (проекты для клиентов):
- Midjourney на более высоком тарифе
- Recraft на платном тарифе
- Flux через API, с оплатой по факту
- Photoshop (Creative Cloud) или аналог
- Итого: сумма подписок и API, посчитай по страницам с тарифами
Студия (большой объём, единый стиль бренда):
- Всё перечисленное выше
- Своя видеокарта для открытых моделей: разовая покупка плюс электричество (и лицензия, если модель её требует)
- Старшие тарифы Recraft и Adobe Creative Cloud
- Итого: считай отдельно по каждой статье
Практика
Задание ниже делается без кода: нужен только браузер или телефон. Шаги 1–4 после него написаны для тех, кто пишет скрипты на Python. Они необязательны: если не программируешь, пропусти их и переходи к шагу 5.
Задание без кода: картинка для твоего дела (около 30 минут)
- Открой chatgpt.com или gemini.google.com и войди в аккаунт. Картинки там входят и в бесплатный тариф, но их число в день ограничено.
- Напиши в поле сообщения, что нужно нарисовать: что на картинке, в каком стиле, какой свет и какие пропорции. Пример: «Нарисуй обложку для поста о домашней выпечке: тёплый утренний свет, деревянный стол, свежий хлеб, вид сверху, формат 4:5, без надписей».
- Дождись результата (иногда это занимает пару минут) и попроси одну правку обычными словами: «сделай свет холоднее», «убери нож», «оставь сверху пустое место под заголовок».
- Попроси ещё два варианта и выбери лучший из трёх.
- Сохрани картинку: открой её и нажми кнопку сохранения (в ChatGPT она называется Save).
- Повтори тот же запрос в Ideogram, добавив надпись: «с крупным заголовком „Хлеб за час“». Сравни, где текст получился чище. На бесплатном тарифе Ideogram картинки видны всем: не используй там личные фото и данные.
Проверь себя: у тебя сохранены минимум две картинки (без надписи и с надписью), и ты можешь сказать, какой сервис лучше справился с текстом.
Шаг 1 (необязательно, для тех, кто программирует): подключаем Flux через fal.ai
Самый быстрый старт для скриптов — Flux через fal.ai: в песочнице модель можно попробовать без кода, а для скриптов нужен ключ. Идентификаторы моделей на fal.ai меняются с выходом новых версий: перед запуском открой страницу нужной модели и подставь её актуальный идентификатор вместо тех, что в примерах ниже.
# Регистрируешься на fal.ai (вход через аккаунт Google)
# Условия пробных кредитов смотри при регистрации
# Установка библиотек Python
pip install fal-client python-dotenv pillow requests aiohttp
# Создаёшь файл .env с ключом
echo "FAL_KEY=your-fal-key-here" > .envПолучить FAL_KEY: https://fal.ai/dashboard/keys
Шаг 2 (необязательно): простой генератор на быстрой версии Flux
# flux_simple.py — минимум для старта (идентификатор модели сверь на fal.ai)
import os
import fal_client
from dotenv import load_dotenv
import requests
from pathlib import Path
load_dotenv()
os.environ["FAL_KEY"] = os.getenv("FAL_KEY")
def generate_image(prompt: str, output_path: str, aspect_ratio: str = "square"):
"""Генерируем изображение через быструю версию Flux."""
print(f"Генерируем: {prompt[:50]}...")
result = fal_client.run(
"fal-ai/flux/schnell", # сверь актуальный идентификатор на fal.ai
arguments={
"prompt": prompt,
"image_size": aspect_ratio,
"num_inference_steps": 4,
"num_images": 1,
}
)
# Сохраняем
image_url = result["images"][0]["url"]
image_data = requests.get(image_url).content
Path(output_path).parent.mkdir(parents=True, exist_ok=True)
Path(output_path).write_bytes(image_data)
print(f"Сохранено: {output_path}")
return output_path
if __name__ == "__main__":
generate_image(
prompt="professional product photography, ceramic coffee mug, white background, soft studio lighting, natural shadow",
output_path="output/mug.png",
aspect_ratio="square_hd"
)Размеры кадра для Flux на fal.ai:
square_hd— 1024x1024square— 512x512portrait_4_3— 768x1024portrait_16_9— 576x1024landscape_4_3— 1024x768landscape_16_9— 1024x576
Шаг 3 (необязательно): партия предметных фото
# batch_products.py — генерируем 10 продуктов параллельно
import os
import fal_client
import asyncio
import aiohttp
from dotenv import load_dotenv
from pathlib import Path
load_dotenv() # читает FAL_KEY из файла .env
os.environ["FAL_KEY"] = os.getenv("FAL_KEY", "your-key")
# условное значение: подставь цену за картинку со страницы цен провайдера
PRICE_PER_IMAGE = 0.05
PRODUCTS = [
"ceramic coffee mug",
"wireless bluetooth headphones",
"leather wallet brown",
"stainless steel water bottle",
"wooden cutting board",
"scented candle in glass jar",
"linen tote bag",
"minimalist desk lamp",
"ceramic plant pot",
"knit wool scarf grey",
]
PROMPT_TEMPLATE = (
"professional product photography, {product}, pure white background, "
"soft studio lighting from top-left, subtle natural shadow underneath, "
"centered composition, commercial e-commerce style, photorealistic, "
"high detail, sharp focus, no people, no text"
)
async def generate_one(session, product: str, idx: int):
"""Генерируем один продукт асинхронно."""
prompt = PROMPT_TEMPLATE.format(product=product)
# более сильная версия Flux для интернет-магазина (идентификатор сверь на fal.ai)
handler = await fal_client.submit_async(
"fal-ai/flux-pro/v1.1",
arguments={
"prompt": prompt,
"image_size": "square_hd",
"num_images": 1,
}
)
result = await handler.get()
image_url = result["images"][0]["url"]
async with session.get(image_url) as resp:
data = await resp.read()
filename = f"output/product_{idx:02d}_{product.replace(' ', '_')}.png"
Path(filename).write_bytes(data)
print(f"✅ [{idx}/10] {product}")
return filename
async def main():
Path("output").mkdir(exist_ok=True)
async with aiohttp.ClientSession() as session:
tasks = [
generate_one(session, product, i + 1)
for i, product in enumerate(PRODUCTS)
]
results = await asyncio.gather(*tasks)
print(f"\nГотово! Сгенерировано {len(results)} продуктов.")
print(f"Стоимость: ~${len(results) * PRICE_PER_IMAGE:.2f}")
if __name__ == "__main__":
asyncio.run(main())Запуск:
python batch_products.py
# Через минуту-две получаешь 10 предметных фото
# Стоимость: число картинок × цена за картинку у провайдераШаг 4 (необязательно): Flux + Ideogram для обложек YouTube
# youtube_thumbnails.py — конвейер для обложек
import os
import fal_client
import requests
from dotenv import load_dotenv
from pathlib import Path
load_dotenv() # читает FAL_KEY из файла .env
os.environ["FAL_KEY"] = os.getenv("FAL_KEY")
def generate_background(topic: str, save_path: str):
"""Быстрая версия Flux — фон."""
result = fal_client.run(
"fal-ai/flux/schnell", # сверь актуальный идентификатор на fal.ai
arguments={
"prompt": f"abstract dramatic background for YouTube thumbnail, {topic} theme, dark blue and orange tones, cinematic lighting, no text, no people, vignette",
"image_size": "landscape_16_9", # 1024x576
"num_inference_steps": 4,
}
)
url = result["images"][0]["url"]
Path(save_path).write_bytes(requests.get(url).content)
return save_path
def generate_text_overlay(hook_text: str, save_path: str):
"""Ideogram — надпись на прозрачном фоне (через fal.ai тоже доступен)."""
result = fal_client.run(
"fal-ai/ideogram/v3/generate-transparent", # сверь актуальную версию Ideogram на fal.ai
arguments={
"prompt": f"big bold text '{hook_text}', white text with red outline, condensed sans-serif font, dramatic typography for YouTube thumbnail",
"aspect_ratio": "16:9",
}
)
url = result["images"][0]["url"]
Path(save_path).write_bytes(requests.get(url).content)
return save_path
def assemble_thumbnail(bg_path: str, text_path: str, output_path: str):
"""Финальная сборка через PIL."""
from PIL import Image
bg = Image.open(bg_path).convert("RGBA")
text = Image.open(text_path).convert("RGBA")
# Подгоняем надпись под размер фона
text = text.resize(bg.size)
# Накладываем надпись на фон
combined = Image.alpha_composite(bg, text)
combined.convert("RGB").save(output_path, "PNG")
print(f"Готово: {output_path}")
if __name__ == "__main__":
Path("output").mkdir(exist_ok=True)
bg = generate_background(
topic="AI image generation tools comparison",
save_path="output/bg.png"
)
text = generate_text_overlay(
hook_text="MIDJOURNEY vs FLUX",
save_path="output/text.png"
)
assemble_thumbnail(bg, text, "output/thumbnail_final.png")Шаг 5: библиотека промптов — сохраняем удачные запросы
Без кода: заведи заметку или документ и складывай туда промпты, которые дали хороший результат. К каждому допиши, для какой задачи он подошёл и в каком сервисе. Через месяц у тебя будет собственный набор заготовок.
Тем, кто пишет скрипты, удобнее хранить промпты в папках и файлах:
mkdir -p prompts/{product,thumbnail,social,brand}# prompts/product/ecommerce-white-bg.yaml
name: "E-commerce white background"
model: "fal-ai/flux-pro/v1.1"
template: |
professional product photography, {product},
pure white background, soft studio lighting from top-left,
subtle natural shadow underneath, centered composition,
commercial e-commerce style, photorealistic, high detail,
sharp focus, empty background
params:
image_size: "square_hd"
notes: |
- 4 варианта на товар, выбираем лучший
- Доработка: слегка усилить тень в редакторе
- Стоимость: по ценам провайдераСовет (необязательно, для тех, кто работает в Claude Code): заведи .claude/agents/image-prompt-engineer.md — помощника, который читает эти YAML-файлы и собирает итоговые промпты под задачу.
Инструменты и ресурсы
- Midjourney — официальный сайт: работа в браузере, есть и бот в Discord
- ChatGPT Images (GPT Image) — встроенная генерация в ChatGPT
- OpenAI API Pricing — актуальные цены на модели gpt-image-2 и gpt-image-2.5 в API
- Black Forest Labs (Flux) — официальный сайт Flux
- fal.ai — один из провайдеров API для Flux, есть песочница для проб
- Replicate — другой провайдер API для Flux, Stable Diffusion и других моделей
- Recraft — векторная графика и фирменный стиль
- Ideogram — картинки с надписями
- Photopea — бесплатный редактор в браузере, похож на Photoshop
- Canva — итоговая сборка по шаблонам
- Lexica — поиск по промптам и стилям
- PromptHero — библиотека удачных промптов
- US Copyright Office on AI — официальная позиция США по авторскому праву на картинки от AI
- Актуальные цены и версии: Актуальное сейчас
Чек-лист перед публикацией картинки
✅ Для каждой задачи выбран свой основной инструмент (а не один на всё) ✅ Порядок работы записан: что за чем делаешь (в заметке или в файле README проекта) ✅ Библиотека промптов заведена (заметка, документ или папка prompts/) ✅ Пропорции кадра заданы под каждую площадку (16:9, 9:16, 1:1, 4:5) ✅ Доработка после генерации стала привычкой (минимум зерно и цвет) ✅ Юридическая проверка: лицензия разрешает именно твоё использование ✅ Есть запасной инструмент на случай, если основной недоступен ✅ Ты знаешь, во что обходится одна картинка ✅ Картинки от AI помечены там, где этого требуют этика или закон ✅ Исходники (файлы редактора, исходные картинки) лежат в отдельной папке для повторного использования
Ключевые выводы
Один универсальный инструмент для картинок в 2026 году — это компромисс везде. Профессионал держит в работе 2–3 модели: Flux для фотореализма, Ideogram для надписей, Recraft для вектора или Midjourney для художественных задач. Связка даёт лучший результат при разумных расходах.
Качество сильно зависит от промпта. Пропорции кадра, образцы стиля и другие настройки — не «дополнительные возможности», а обязательная часть работы (там, где сервис их поддерживает). С настройками по умолчанию результат выходит безликим.
С правом в 2026 году всё непросто. Картинку, целиком созданную AI, в США нельзя защитить авторским правом. Разрешено ли коммерческое использование, зависит от модели и тарифа. Проверяй лицензию до того, как картинка пойдёт в работу, а не после.
Доработка — это разница между «картинкой от AI» и материалом, готовым к публикации. Минимум 5 минут на зерно, цвет и мелкие несовершенства, и картинка перестаёт выглядеть машинной. Пометку «сделано с помощью AI» это не отменяет: ставь её там, где она нужна.
Следующий урок
→ AI видеогенерация — Runway, Kling, Luma и другие: как получить короткий ролик из текста или картинки.
Отметка хранится только в этом браузере и никуда не отправляется. Мой прогресс