Буква ё, кавычки‑ёлочки внутри фразы, время 18:47, номер версии v2.3.1 и многоточие: в сентябре 2026 года я собрал всё, на чём обычно спотыкается кириллица на картинке, в подписи для мемов и реплики для комикса и отдал их восьми нейросетям. Задания были такие, какие ставит обычный человек: мем с котом, комикс из четырёх кадров, мем из своей фотографии и продолжение уже нарисованной истории.
Короткий ответ, как сделать мем нейросетью в 2026 году: написать в запросе, что нарисовать, и дословно дать текст надписи. Лучшие модели справляются с этим с первого раза. Из восьми моделей пять написали все 56 слов теста без единой ошибки, у Seedream 4.5 ошибка одна, у Qwen Image 2 Pro три, у Flux 2 Max девять. Картинка стоила от 1,35 до 27,5 ₽ и приходила за 14–63 секунды.
Все прогоны я делал в агрегаторе BotHub, где эти модели собраны в одном чате и оплачиваются в рублях. Самой выгодной оказалась gpt‑image-2.5: простой мем с подписью за 1,35 ₽, комикс на четыре кадра за 11,25 ₽, ни одной ошибки в тексте. Самой дорогой и при этом самой неграмотной вышла Flux 2 Max.
Ниже пошаговая инструкция, результаты по каждому заданию и разбор того, почему нейросети путают буквы и почему все они придумывают одни и те же шутки. Дальше цены в сравнении с прайсами разработчиков моделей, шаблоны промптов и чек‑лист.
Как сделать мем нейросетью по шагам
Отдельный генератор мемов не нужен, хватает обычного чата с моделью, которая рисует картинки. Шаги ниже показаны на интерфейсе BotHub, где я гонял тест, в других сервисах логика та же. Для примера беру gpt‑image-2.5.
1. Выберите модель
Откройте выбор модели над полем ввода, вкладку «Картинка» и нужную группу. У OpenAI это GPT Image, у Google Gemini Image, у ByteDance группа Bytedance. Название можно набрать в поиске внизу окна.

2. Проверьте пропорции кадра
Шестерёнка внизу поля ввода открывает настройки чата. По умолчанию там стоит 1:1, для классического мема этого хватает. Для комикса в полосу или мема из вертикального фото пропорцию стоит поменять заранее: часть моделей подгоняет кадр под настройку и обрезает лишнее.

3. Опишите картинку и дайте текст дословно
В запросе две части. Первая про то, что нарисовать: персонаж, обстановка, эмоция, стиль шрифта. Вторая про текст. Его лучше вынести на отдельную строку и прямо написать «дословно», иначе модель может пересказать подпись своими словами.

4. Проверьте результат и цену
Картинка приходит через 14–63 секунды, в зависимости от модели. Под ней видно, сколько она стоила: мем на скриншоте обошёлся в 1,35 ₽.

5. Скачайте полный размер
В чате картинка показывается уменьшенной. Кнопка скачивания появляется в правом верхнем углу при наведении и отдаёт оригинал: у gpt‑image-2.5 это 1254×1254, у Seedream 4.5 2048×2048. Прочитать мелкий текст и найти опечатку проще на полном размере, по превью я бы мем не публиковал.

Как я проверял, пишут ли нейросети по‑русски
В тесте восемь моделей, которые рисуют картинки по тексту и умеют править готовое фото: gpt‑image-2.5, GPT Image 2, Nano Banana Pro, Nano Banana 2, Seedream 4.5, Grok Imagine Image 2.0, Flux 2 Max и Qwen Image 2 Pro. Nano Banana Pro и Nano Banana 2 это рабочие названия Gemini 3 Pro Image и Gemini 3.1 Flash Image, в меню сервисов они часто записаны именно так.
Каждая модель получила пять заданий, каждое в новом чате, чтобы прошлые картинки не подсказывали ей ответ:
Мем по тексту: кот в очках за ноутбуком и подпись в две строки.
Комикс на четыре кадра с одним героем и репликами в пузырях.
Мем «Ожидание и реальность» с мелким текстом на табличке и экране телефона.
Мем из готовой фотографии: добавить надписи и не трогать снимок.
Продолжение комикса: два новых кадра с тем же героем по приложенной картинке.
Всего в заданиях 56 слов. Я проверял каждое на полноразмерной картинке и считал слово ошибочным, если в нём пропала, лишняя или заменена хоть одна буква, включая ё. Отдельно смотрел, выполнила ли модель сам запрос: на месте ли надпись, остался ли герой тем же, не пропали ли очки.
Справится ли нейросеть с надписью на меме
Задание было такое:
Сделай мем в классическом формате: жирный белый шрифт с чёрной обводкой, одна надпись сверху и одна снизу. На картинке рыжий кот в очках сидит ночью за ноутбуком, морда освещена экраном, выражение полного ужаса. Надпись сверху, дословно: КОГДА ЗАКАЗЧИК НАПИСАЛ «ОДНА МЕЛКАЯ ПРАВКА» Надпись снизу, дословно: А ИХ ЕЩЁ 34 И СДАТЬ ДО 18:47 |
Две строки заглавными с ё, кавычками и временем не сломали ни одну модель. Все восемь написали подпись без ошибок.

Различия нашлись в остальном. «Полный ужас» на морде кота вышел у gpt‑image-2.5, GPT Image 2 и Seedream, у обеих Nano Banana кот скорее вежливо удивлён. Seedream поставила нижнюю подпись в середину кадра, прямо на кота. Flux 2 Max нарисовала серого пушистого кота вместо рыжего. У Qwen Image 2 Pro время «18:47» уехало на отдельную строку, а Grok сжала верхнюю подпись в одну длинную мелкую строку.
По цене разброс двадцатикратный. gpt‑image-2.5 взяла за этот мем 1,35 ₽, Nano Banana Pro 27,46 ₽. GPT Image 2 заодно нарисовала на ноутбуке логотип Apple, которого никто не просил, а в комиксе так же поступили Nano Banana Pro и Qwen.
Как создать комикс нейросетью по тексту
Комикс сложнее мема. Модели надо удержать одного героя в четырёх кадрах, разложить реплики по пузырям в правильном порядке и не забыть детали из описания.
Нарисуй комикс из четырёх кадров в сетке 2×2, кадры читаются слева направо и сверху вниз. Стиль: простой цветной веб‑комикс, чёткие контуры, плоские цвета. Герой во всех кадрах один и тот же: парень Лёша, короткие тёмные волосы, круглые очки, зелёное худи. Реплики в пузырях, текст дословно: Кадр 1. Лёша сидит на диване с ноутбуком: «Сегодня лягу пораньше». Кадр 2. На стене часы показывают 23:00, Лёша: «Ещё одну серию…» Кадр 3. Часы показывают 03:47, у Лёши красные глаза: «Последняя, честно!» Кадр 4. Утро, звонит будильник, Лёша спит лицом на ноутбуке, у него на спине сидит кот: «Мяу». |
Шесть моделей из восьми написали все реплики правильно, включая «Ещё» с точками над ё и многоточие. Героя тоже удержали почти все: одна причёска, круглые очки и зелёное худи во всех четырёх кадрах.

Seedream 4.5 текст не испортила, зато в третьем и четвёртом кадре Лёша остался без очков, а «красные глаза» превратились в светящиеся красные зрачки, как в фильме ужасов. Qwen Image 2 Pro написала «Ещё чдну серию…». Хуже всех Flux 2 Max: во втором кадре «Еще лнсуоно серии...», в третьем «Последная», а часы 23:00 уехали в первый кадр.
Точнее всех с часами обошлись GPT Image 2 и Seedream: они нарисовали электронные часы с цифрами 23:00 и 03:47. Остальные смешали циферблат со стрелками и цифры, а у Grok стрелки показывают одно время, подпись под часами другое. Nano Banana 2 по собственной инициативе дорисовала будильнику надпись «ДЗЫЫЫНЬ!», и это единственная вольность, которая пошла комиксу на пользу.
Если нужно не четыре кадра, а целая история, пригодится разбор из первой части про создание комикса: там про идею, сюжет и визуальный стиль.
Почему нейросеть ошибается в русских буквах
Третье задание я сделал заведомо тяжелее. Мелкий текст на табличке, уведомление на экране телефона, латиница с цифрами внутри русской фразы и один и тот же кот в двух половинах картинки.
Сделай мем из двух половин, левой и правой, с подписью над каждой половиной. Левая половина, подпись сверху: ОЖИДАНИЕ. Под ней довольный рыжий кот в очках лежит в гамаке, рядом табличка с текстом: «Проект сдан в пятницу, выходные свободны». Правая половина, подпись сверху: РЕАЛЬНОСТЬ. Тот же кот в ужасе смотрит в телефон, на экране крупно уведомление: «Суббота, 09:15. Срочно! Правки к версии v2.3.1». Весь текст пиши дословно. |
Здесь модели разошлись сильнее всего. GPT Image 2, Nano Banana Pro, Seedream и Grok написали всё верно. gpt‑image-2.5 тоже не ошиблась в буквах, но поставила точки после «ОЖИДАНИЕ» и «РЕАЛЬНОСТЬ». Nano Banana 2 перенесла в табличку и уведомление кавычки‑ёлочки из промпта, поняв «дословно» слишком буквально.

С котом вышло хуже, чем с текстом. «Тот же кот» в правой половине потерял очки у пяти моделей из восьми, их сохранили только GPT Image 2, Nano Banana Pro и Flux 2 Max. Для мема это мелочь, а для серии картинок с одним персонажем уже проблема.
Ошибки крупным планом собрал на одной картинке. Заметна закономерность: две разные модели, Seedream 4.5 и Qwen Image 2 Pro, независимо друг от друга написали «ПИЩЕТ» вместо «ПИШЕТ». Похожие буквы Ш и Щ путаются чаще остальных, а редкие сочетания вроде «одну» модель может просто собрать из случайных букв.

Первая причина в том, что модель рисует буквы как часть изображения, а не набирает их, как текстовый редактор. Вторую описали исследователи Google Research в 2023 году (Liu et al., ACL 2023). Многие генераторы читают запрос через текстовый энкодер, который видит слово целиком, одним токеном, и не знает, из каких букв оно состоит. Отсюда парадокс: такие модели хуже всего пишут самые частые слова. У энкодера T5 87% слов из самого частотного 1% английского словаря шли одним токеном. Модели, которые читают текст по буквам, обгоняли обычные на 15 с лишним пунктов точности на частых словах и на 30 с лишним на редких.
Русский в их наборе тестов WikiSpell тоже был, и авторы отдельно отмечают, что в нём много падежных и согласовательных форм слова. Как устроены энкодеры у моделей из моего теста, разработчики не раскрывают, так что это объяснение, а не диагноз. Но «ПИЩЕТ» на месте частого «ПИШЕТ» в эту картину укладывается.
Подробнее о том, как нейросети перерисовывают картинку, написано в разборе inpainting и image‑to‑image.
Как сделать мем из своего фото
Популярный сценарий: есть смешная фотография, к ней нужна подпись. Здесь удобно работать в два шага. Сначала языковая модель смотрит на фото и предлагает подписи, потом модель для картинок добавляет выбранную на снимок.
Для теста я сгенерировал фото мопса за офисным столом и отправил его трём языковым моделям с одним запросом:
Придумай пять подписей для мема по этой фотографии. Формат классический: верхняя строка и нижняя, каждая не длиннее шести слов. Тема: работа в офисе и созвоны. Без мата и без избитых шуток про понедельник. В конце скажи, какая из пяти самая сильная и почему, в одном предложении. |

Claude Opus 5.5 думал 14 секунд и взял 5,51 ₽. GPT-5.6 Sol ответил почти сразу за 1,74 ₽, Gemini 3.1 Pro Preview думал около минуты за 3,26 ₽.

Шутки у всех трёх похожие, про камеру и выключенный микрофон. Вариант «созвон мог быть письмом» предложили и Claude, и GPT, а Gemini написала «Идет» без ё.
Однообразие шуток у языковых моделей известно давно. В 2023 году Софи Йенч и Кристиан Керстинг из TU Darmstadt больше тысячи раз попросили ChatGPT рассказать анекдот: из 1008 шуток больше 90% оказались повторами одних и тех же 25 (работа на WASSA 2023). Мой маленький тест на трёх свежих моделях показывает ту же тягу к самой очевидной шутке. Поэтому подписи стоит просить пачкой и с запретом на заезженные темы, а выбирать самому. Claude в одном варианте вышел за лимит в шесть слов, но именно этот вариант я и взял, потому что в нём есть всё для проверки: кавычки, вопросительный знак, время и ё.
Сделай из этой фотографии мем: добавь надпись сверху и надпись снизу, жирный белый шрифт с чёрной обводкой. Саму фотографию не меняй, только добавь текст. Надпись сверху, дословно: НАЧАЛЬНИК ПИШЕТ «ЕСТЬ МИНУТКА?» В 17:58 Надпись снизу, дословно: МОЁ ЛИЦО: |

Бережнее всех со снимком обошлась gpt‑image-2.5: кадр 3:4 остался как был, мопс и кружка на месте, текст без ошибок, 4,32 ₽. Остальные модели подогнали фото под квадрат из настроек и обрезали верх и низ, так что для мема из вертикального снимка пропорцию надо выставлять заранее. Nano Banana Pro вместо белого текста с обводкой положила сверху белую плашку с чёрными буквами. Seedream 4.5 и Qwen Image 2 Pro написали «ПИЩЕТ», а Flux 2 Max потеряла закрывающую кавычку.
Как продолжить комикс с тем же персонажем
Последнее задание проверяет, сможет ли модель продолжить историю. Я приложил комикс про Лёшу, нарисованный gpt‑image-2.5, и попросил два новых кадра:
Продолжи этот комикс: нарисуй ещё два кадра рядом, в том же стиле и с тем же героем Лёшей (та же внешность, очки, зелёное худи). Кадр 1. Офис, Лёша засыпает над клавиатурой, коллега у его стола говорит: «Лёш, релиз через час». Кадр 2. Лёша резко выпрямился и открыл глаза: «Я не сплю, я жду сборку!» Реплики в пузырях, текст дословно. |
Ровно два кадра с тем же героем нарисовали gpt‑image-2.5, Grok и GPT Image 2, только у последней кадры встали друг под другом, а не рядом. Остальные поняли «продолжи» по‑своему.

Nano Banana Pro сделала четыре кадра вместо двух, повторила реплику «Я не сплю» дважды и оставила один кадр пустым. Nano Banana 2 и Seedream перерисовали старые кадры и добавили к ним новые, причём Seedream в перерисованном кадре снова сняла с Лёши очки. Qwen склеила коллаж, где в одном кадре два Лёши. Flux 2 Max нарисовала четыре кадра, написала «я жд сборку» и дописала от себя реплику «Лёша!».
Сколько стоит сделать мем и комикс нейросетью
Цены ниже фактические, из списаний под картинками в BotHub при оплате самым крупным пакетом. Время от отправки запроса до появления картинки.
Модель | Картинка, ₽ | Время, с | Слов с ошибкой из 56 | Что ещё пошло не так |
gpt‑image-2.5 | 1,35–13,42 | 20–31 | 0 | лишние точки, в одном задании кот потерял очки |
GPT Image 2 | 18,96–21,68 | 51–57 | 0 | самая медленная, обрезает фото под квадрат |
Nano Banana Pro | 27,42–27,53 | 25–32 | 0 | самая дорогая, лишние кадры в продолжении |
Nano Banana 2 | 16,12–16,20 | 25–38 | 0 | переносит кавычки из промпта в картинку |
Seedream 4.5 | 7,15 | 14–44 | 1 | теряет очки героя, путает Ш и Щ |
Grok Imagine Image 2.0 | 7,15 | 16–29 | 0 | мелкий шрифт в длинной подписи |
Flux 2 Max | 27,20 | 24–63 | 9 | ошибки в словах, лишние кадры |
Qwen Image 2 Pro | 20,11 | 16–23 | 3 | ошибки в словах, коллаж вместо продолжения |
У шести моделей из восьми цена картинки фиксированная, у двух моделей OpenAI она плавает. gpt‑image-2.5 взяла 1,35 ₽ за простой мем, 3,36 ₽ за «Ожидание и реальность», 4,32 ₽ за подпись на готовом фото, 11,25 ₽ за комикс и 13,42 ₽ за его продолжение. Чем больше на картинке деталей и текста, тем дороже.
Откуда разброс между моделями, видно по прайсам самих разработчиков. Google берёт за картинку Nano Banana Pro в разрешении 1K или 2K $0,134 (прайс Google Cloud), за Nano Banana 2 в 1K $0,067, вдвое меньше (прайс Gemini API). Alibaba продаёт Qwen Image 2.0 Pro по $0,075 за изображение (документация Model Studio). Black Forest Labs просит за FLUX.2 [max] от $0,07 и считает по мегапикселям (прайс BFL).
OpenAI считает не картинки, а токены. У GPT Image 2 миллион токенов готового изображения стоит $30, приложенной картинки $8, текста запроса $5 (прайс OpenAI). Поэтому цена одной картинки у моделей OpenAI и не фиксирована: она зависит от того, сколько токенов ушло на запрос, вложение и результат.
За весь тест ушло 41 генерация картинок и три ответа языковых моделей, в сумме 671,67 ₽.
Какой промпт написать для мема и комикса: шаблоны и чек‑лист
Все шаблоны ниже проверены в тесте. Квадратные скобки заменяете своим текстом.
Шаблон для мема с надписью
Сделай мем в классическом формате: жирный белый шрифт с чёрной обводкой, одна надпись сверху и одна снизу. На картинке [кто или что, где, какая эмоция]. Надпись сверху, дословно: [ТЕКСТ] Надпись снизу, дословно: [ТЕКСТ] |
Шаблон для мема из своего фото
Сделай из этой фотографии мем: добавь надпись сверху и надпись снизу, жирный белый шрифт с чёрной обводкой. Саму фотографию не меняй, только добавь текст. Надпись сверху, дословно: [ТЕКСТ] Надпись снизу, дословно: [ТЕКСТ] |
Шаблон для комикса
Нарисуй комикс из [число] кадров в сетке [2×2 или в одну полосу], кадры читаются слева направо и сверху вниз. Стиль: [например, простой цветной веб‑комикс, чёткие контуры, плоские цвета]. Герой во всех кадрах один и тот же: [имя, волосы, очки, одежда]. Реплики в пузырях, текст дословно: Кадр 1. [что происходит]: «[реплика]». Кадр 2. [что происходит]: «[реплика]». |
Шаблон, чтобы придумать подпись
Придумай пять подписей для мема по этой фотографии. Формат классический: верхняя строка и нижняя, каждая не длиннее шести слов. Тема: [тема]. Без мата и без избитых шуток про [то, что надоело]. В конце скажи, какая из пяти самая сильная и почему. |
Чек‑лист перед публикацией
Текст надписи вынесен в запросе отдельной строкой со словом «дословно».
Во внешности героя названы приметы, которые легко потерять: очки, цвет одежды, причёска. В комиксе их стоит повторить и в описании кадров.
Пропорция в настройках совпадает с фото, если делаете мем из своего снимка.
Картинка скачана и проверена в полном размере: каждое слово, буква ё, Ш и Щ, кавычки, цифры.
Если модель ошиблась в слове, перегенерация на той же модели стоит столько же. Надёжнее сменить модель: в тесте у gpt‑image-2.5, GPT Image 2, обеих Nano Banana и Grok ошибок в тексте не было.
Для продолжения комикса прикладывайте прошлые кадры и прямо пишите, сколько новых кадров нужно.
Какую нейросеть выбрать для мема и комикса
Сделать мем или комикс с русским текстом нейросетью в 2026 году можно без фотошопа и без отдельного генератора мемов. Надпись в две строки с ё, кавычками и цифрами написали правильно все восемь моделей из теста. Сложности начинаются с мелкого текста, длинных реплик и серий картинок, где герой должен оставаться собой.
Для мемов и коротких комиксов я бы взял gpt‑image-2.5: ни одной ошибки в 56 словах, бережное отношение к исходному фото и цена от 1,35 ₽. Если важен бюджет и нужны просто картинки с подписью, неплохо показала себя Grok Imagine Image 2.0 за 7,15 ₽. Flux 2 Max и Qwen Image 2 Pro для текста на русском я бы не выбирал: они дороже и ошибаются в словах.
Выбирать удобнее на своём тексте, прогнав одну и ту же подпись через несколько моделей. В BotHub я так и делал: переключался между моделями в одном чате, без отдельного аккаунта и оплаты у каждого разработчика, и сразу видел под картинкой, сколько она стоила в рублях. На восемь моделей и пять заданий ушло около полутора часов.
Частые вопросы
Кто смешнее: нейросеть или человек?
Если верить исследованию 2025 года, в среднем нейросеть. Исследователи KTH, LMU и TU Darmstadt сравнили мемы людей, ИИ и людей вместе с ИИ и представили работу на конференции IUI в 2025 году. Мемы, целиком сделанные ИИ, в среднем оценили выше. Зато самые смешные мемы сделали люди, а совместные работы выделились креативностью. Помощь ИИ дала участникам больше идей и сократила усилия, но качество мемов не подняла (статья на arXiv, пресс‑релиз). На практике это значит то же, что показал мой тест: модель хороша для черновиков, а лучшую подпись выбирает человек.
Какая нейросеть лучше всех пишет текст на русском?
В моём тесте без единой ошибки в 56 словах отработали gpt‑image-2.5, GPT Image 2, Nano Banana Pro, Nano Banana 2 и Grok Imagine Image 2.0. У Seedream 4.5 одна ошибка, у Qwen Image 2 Pro три, у Flux 2 Max девять. Короткую подпись в две строки правильно написали все восемь, различия видны на мелком тексте и длинных репликах. Сравнение этих же моделей на других задачах есть в большом обзоре нейросетей для картинок.
Как сделать комикс с одним и тем же персонажем?
Опишите героя приметами, которые легко проверить: причёска, очки, цвет одежды. В тесте по такому описанию все модели держали героя в пределах одной картинки из четырёх кадров, но пять из восьми потеряли очки у кота во второй половине мема «Ожидание и реальность». Для следующих кадров прикладывайте прошлый комикс и пишите точное число новых кадров: иначе часть моделей перерисовывает старые или добавляет лишние.
На каком языке писать промпт?
Все восемь моделей поняли запросы на русском, текст на картинке тоже шёл по‑русски. Переводить промпт на английский не пришлось ни разу.
Что делать, если нейросеть ошиблась в слове?
Сначала проверьте, что слово дано в запросе отдельной строкой со словом «дословно». Если ошибка повторяется, смените модель, а не формулировку: в тесте ошибались одни и те же модели, а пять моделей не ошиблись ни разу. Ещё один вариант для мема из фото: сгенерировать картинку без текста и наложить подпись в любом редакторе.
Можно ли сделать мем из своей фотографии?
Да, почти все современные модели для картинок принимают фото на вход, в чате оно прикрепляется скрепкой. В запросе стоит отдельно написать, что снимок менять нельзя. Лучше всего исходник сохранила gpt‑image-2.5, остальные модели подогнали кадр под квадрат из настроек. Похожую функцию превращения фото в мем добавили и в Google Фото, об этом была новость в нашем блоге.чах в блоге BotHub на Хабре.

