DEV Community

Cover image for Джимнить нейросеть: Qwen Image Edit Plus правит надписи внутри картинки
Promptra Team for Promptra

Posted on

Джимнить нейросеть: Qwen Image Edit Plus правит надписи внутри картинки

На промо-баннере красуется «СКИДКА 50%», акцию урезали до тридцати, исходник потерян, дизайнер в отпуске, фотошопа нет. Раньше это означало вечер возни со шрифтами. В 2026 году такую надпись джимнят нейросетью: загружаешь картинку, пишешь одну фразу и забираешь файл, где стоит новый текст, а фон, свет и начертание букв остались на месте.

Глагол прижился от Gemini: после выхода модели Google с прозвищем Nano Banana народ начал «джимнить» всё подряд. Кто-то говорит «джпти» - суть та же: прифотошопить деталь на готовом изображении текстовой командой, без слоёв и масок. У этой моды есть инструмент с именем и адресом: Qwen Image Edit Plus, hosted-версия открытой модели Alibaba. Ниже разбор, что она умеет, сколько стоит и где слабое место. Спойлер: с русским текстом всё сложно.

Дёрнуть Gemini из России без зарубежной карты не выйдет, а кабинет Alibaba Cloud - отдельный квест со своей оплатой. Рабочих путей по сути три: чужая зарубежная карта, реселлеры с наценкой и агрегаторы вроде provod.ai (российский OpenRouter), где Qwen живёт в одном чате с GPT и Gemini, а платить можно картой российского банка. Теперь к модели - с ценами и лимитами на июль 2026.

Что значит «джимнить» картинку и при чём тут Qwen

Коротко: «джимнить» - это править картинку текстовой командой. Слово пошло от Gemini 2.5 Flash Image, а Qwen Image Edit решает тот же класс задач с упором на текст внутри кадра.

26 августа 2025 Google выкатила Gemini 2.5 Flash Image, известную как Nano Banana: модель прославилась точными правками по одной фразе, включая надписи (по обзору Tech-Now). В ноябре 2025 вышла Nano Banana Pro на базе Gemini 3 Pro Image - с упором на рендер текста и 4K. Отсюда и запросы «хано банан нейросеть»: так часть рунета пишет прозвище транслитом. Цены на неё гуляют по вторичным источникам, подтвердить первоисточником не удалось, поэтому цифр здесь не будет.

Параллельно, 19 августа 2025, команда Qwen представила Qwen-Image-Edit - 20B-модель для редактирования (официальный блог Qwen). Входная картинка идёт двумя дорожками: в Qwen2.5-VL за смыслом сцены и в VAE-энкодер за внешним видом. Отсюда два типа правок: семантические (сменить сцену, позу, ракурс) и внешние, appearance (цвет, мелочи, надписи). Нас интересуют вторые.

Что Qwen Image Edit умеет с надписями

Коротко: добавляет, удаляет и заменяет текст внутри изображения на китайском и английском, стараясь сохранить шрифт, размер и стиль (блог Qwen, август 2025).

Механика такая: модель читает исходную надпись, стирает её и пишет новую, пытаясь воссоздать начертание - та же гарнитура, тот же наклон. Сентябрьская версия Qwen-Image-Edit-2509 пошла дальше: по карточке на Hugging Face, можно менять содержимое надписи, а вместе с ним шрифт, цвет и материал букв - плоскую печать перегнать в объёмный металл или неон. Модель может и сочинить строку с нуля, лишь бы промпт укладывался в лимиты.

Цифры из техотчёта Qwen-Image (arXiv:2508.02324, август 2025) объясняют, почему вообще речь о тексте. На LongText-Bench базовая модель рендерит длинные надписи по-китайски с точностью 94,6% против 61,9% у GPT Image 1 [High]; по-английски её результат 0,943 - максимум среди замеренных. На CVTG-2K точность английских слов 82,88%: выше 59,24% у Seedream 3.0 и ниже 85,69% у GPT Image 1. Таблицы сверены по разбору Hyper.ai. Эти результаты относятся к базовой Qwen-Image и служат лишь косвенным ориентиром для линейки; кириллицу в отчёте не проверяли. Запомни это место.

Edit, Plus, Max или 2.0 Pro: какую версию брать

Коротко: для правки надписей через API бери qwen-image-edit-plus - так линейка называется в Alibaba Cloud Model Studio. Остальные версии - под задачи поиндустриальнее или под свежую генерацию.

В Model Studio стабильный снапшот датирован 2025-10-30, в списке есть и более новый, 2025-12-15 (документация, проверено 19.07.2026). Лимиты Plus-серии: от 1 до 3 входных картинок, от 1 до 6 выходных за запрос, выходной формат PNG, ширина и высота каждая в диапазоне 512-2048 px.

Линейка растёт. 10 февраля 2026 вышла Qwen-Image-2.0, объединяющая генерацию и редактирование в одной модели (репозиторий QwenLM). Сейчас в Model Studio рекомендован qwen-image-2.0-pro со снапшотами 2026-03-03, 2026-04-22 и свежим 2026-06-22, а qwen-image-edit-max (снапшот 2026-01-16) позиционируется под промышленный дизайн, геометрическое рассуждение и консистентность персонажей.

Версия Снапшоты Для чего
qwen-image-edit-plus 2025-10-30 (стабильная), 2025-12-15 текст и объекты внутри картинки, 1-3 входа, 1-6 выходов, PNG 512-2048 px
qwen-image-edit-max 2026-01-16 промдизайн, геометрия, консистентность персонажей
qwen-image-2.0-pro 2026-03-03, 2026-04-22, 2026-06-22 генерация и редактирование в одной модели, промпт до 1300 токенов

По документации Model Studio и репозиторию QwenLM, проверено 19.07.2026.

Выбор тут простой: для надписей и мелочей хватит Plus, и именно его дальше разбираем. Свежий 2.0 Pro имеет смысл, когда картинку нужно ещё и генерировать с нуля.

Три версии Qwen Image Edit: снапшоты, лимиты и назначение

Как поменять надпись: бесплатный чат или API

Коротко: без кода - функция Image Editing в веб-приложении Qwen Chat на chat.qwen.ai. Пачками и из своих скриптов - через API.

Первый путь - для разовой задачи. Открываешь Qwen Chat, находишь Image Editing, жмёшь скрепку - так прикрепить фото к запросу проще всего - и закачать исходник можно хоть со смартфона. Дальше пишешь, что поменять. Для карточки товара хватает бытовой фразы: «изобрази ту же карточку, но с ценником 1990». Модель там актуальная, денег не просит.

Второй путь - API. У Gate.AI это OpenAI-совместимый endpoint /images/edits с multipart/form-data и параметрами n, size, response_format (по описанию Gate.AI, июль 2026). В официальном API Model Studio рамки такие: форматы JPG, JPEG, PNG, BMP, TIFF, WEBP и GIF, файл до 10 МБ, рекомендуемые стороны 384-3072 px, промпт на китайском или английском до 800 токенов, negative_prompt до 500 символов, seed и включённый по умолчанию prompt_extend - авторасширение промпта (документация, проверено 19.07.2026).

Порядок действий:

  1. Подготовь исходник: чёткая надпись, контрастный фон, до 10 МБ.
  2. Сформулируй промпт на английском: что стереть, что написать, сохранить ли шрифт.
  3. Выстави n от 2 до 6 и разрешение в диапазоне 512-2048 px; зафиксируй seed, чтобы повторять удачные варианты, и поиграем с negative_prompt против лишних элементов.
  4. Скачай результат сразу: ссылка живёт 24 часа, потом файл пропадает (документация Model Studio).

Сам вызов - несколько строк:

curl -X POST "https://api.provod.ai/v1/images/edits" \
  -H "Authorization: Bearer $PROVOD_KEY" \
  -F "model=qwen-image-edit-plus" \
  -F "image=@banner.png" \
  -F "prompt=Replace the banner text with 'SALE 30%', keep the original font" \
  -F "n=3" -F "size=1024x1024"
Enter fullscreen mode Exit fullscreen mode

Весь этот пайплайн заводится из России сменой двух строк: ключа и base_url на единый API provod.ai - он совместим с OpenAI-SDK, поэтому код под /images/edits переписывать не придётся. Текстовую часть работы, например придумать двадцать вариантов слогана для баннера, там же закрывают чат-модели с того же баланса.

Справится ли модель с русским текстом

Коротко: официально - нет. В FAQ Alibaba Cloud сказано прямо: поддерживаются упрощённый китайский и английский, другие языки можно пробовать, но качество не гарантируется (проверено 19.07.2026).

Меня эта оговорка скорее радует: вендор честно фиксирует границу вместо красивых обещаний на лендинге. Практическая тактика под кириллицу выглядит так. Проси короткие слова из двух-пяти букв - «СКИДКА», «НОВОЕ», «ОТКРЫТО». Ставь n=4 и проверяй каждый вариант глазами: модель может перепутать буквы или нарисовать похожие на них значки. Длинную надпись разбивай на два вызова. И держи запасной план: англоязычный текст модель отрисует заметно стабильнее, это следует из бенчмарков выше.

Что ещё можно поджимнить, кроме надписей

Коротко: та же модель комбинирует несколько фото, реставрирует старые снимки, красит волосы и меняет свет. Версия 2509 принимает до трёх картинок и понимает ControlNet-карты: depth, edge, keypoint.

Сценарии из реальной работы:

  • Скрестить два фото онлайн: комбинации «человек+человек», «человек+товар», «человек+сцена» - так селлер замиксит себя с товаром для карточки маркетплейса. Когда сервис скрещивает фотографии, оптимально 1-3 исходника (карточка 2509).
  • Отреставрировать древние семейные фотографии: убрать царапины, подтянуть лица, раскрасить чернобелое фото в цвет.
  • Покрасить волосы на портрете или кузов машины в объявлении: цвет меняется, фактура остаётся.
  • Состарить или омолодить лицо на фото: забавно для мемов, полезно для примерки образа до съёмки.
  • Сделать кадр светлее без потери деталей: осветлить тёмный интерьер, вытянуть вечернее фото товара.
  • Преобразить снимок под сезон: зимний фон на летний, праздничную атмосферу на будничную.
  • Ради шутки - сделать человека на фото накаченным: модель аккуратно добавит форму, если промпт прямой.

Каждый сценарий - та же механика: входная картинка плюс фраза, никаких масок руками. Здесь же честная точка, чтобы отредачить мелочь вроде ценника, не открывая графический редактор вообще.

Чего Qwen Image Edit Plus не решает

Коротко: кириллица без гарантий, файл до 10 МБ, ссылка на результат живёт сутки, а длинные надписи мелким кеглем модель путает. Проверка результата - на тебе.

Разложу по пунктам. Русский текст официально вне зоны поддержки, об этом раздел выше. Входной файл ограничен 10 МБ и форматами из списка, RAW сюда не прикрепишь. Ссылка на готовую картинку умирает через 24 часа: забыл скачать - генерируй заново и плати повторно, ведь биллинг списывает деньги за каждую успешную генерацию (документация Model Studio). Мелкий кегль и длинные строки модель переписывает с ошибками: из бенчмарков видно, что даже английские слова теряют до пятой части точности на сложных наборах. Проверяй каждый результат: в приведённых источниках нет отдельного замера деградации при повторных правках Plus.

Сколько это стоит и как дёргать модель из России

Коротко: у Gate.AI вызов qwen-image-edit-plus стоит $0,0287 за сгенерированное изображение (статус цены - июль 2026). В Model Studio списывают деньги только за успешные картинки.

С биллингом Alibaba Cloud всё прямолинейно: неуспешные вызовы не тарифицируются, успешные - поштучно (документация, проверено 19.07.2026). Вилка по рынку, по данным EvoLink на январь 2026: Alibaba Cloud напрямую примерно $0,025-0,035 за картинку, FAL около $0,028, WaveSpeed около $0,029, Replicate около $0,032. Источник вторичный, точную официальную цену подтвердить не удалось - относись к цифрам как к ориентиру, а не к прайсу.

Теперь российская часть. Платить Alibaba Cloud напрямую из РФ - отдельное приключение, кабинет Gemini - тоже. Условия доступа, оплаты и документооборота provod.ai проверяй на сайте сервиса.

Когда provod.ai не подходит

Коротко: агрегатор снимает вопрос доступа и оплаты. Фирменные кабинеты вендоров, локальный запуск и разовые правки - сценарии, где он лишний.

Если нужен фирменный интерфейс Google с его приложениями и памятью чата - понадобится прямая подписка, её никакой агрегатор не воспроизведёт. Если хочется крутить модель на своём GPU - веса Qwen-Image-Edit-2509 открыты и лежат на Hugging Face: запуск через QwenImageEditPlusPipeline в diffusers, официальный пример идёт с bf16, 40 шагами и true_cfg_scale 4.0; тут вообще платить не надо. А задача «две картинки в месяц» закрывается бесплатным Qwen Chat.

Итого: разовая правка - веб-чат, пачка карточек или автоматика - API. Второй путь из России короче всего проходит через агрегатор с рублёвым балансом.

Меняешь base URL и ключ - и тот же вызов из статьи работает без зарубежной карты, с оплатой в рублях по цене провайдера. Дальше - дело промпта.

Тот же вызов qwen-image-edit-plus через provod.ai

Актуальный список моделей и цены в рублях - на provod.ai. Один баланс: джимнишь надпись в чате, катишь пачку карточек через тот же ключ.


provod.ai — российский LLM API-агрегатор

Один OpenAI-совместимый endpoint вместо набора интеграций: подключайте модели к продукту, агентам, IDE и SDK через общий API. Во многих совместимых инструментах достаточно заменить base_url и API-ключ.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Цены 1:1 с официальными ценами провайдеров — без собственной наценки provod.ai. Оплата в рублях, единый баланс и документы для юридических лиц.

Если статья была полезной — попробуйте provod.ai: форма регистрации · цены на модели · защита данных по 152-ФЗ · API и интеграции

FAQ

Коротко: пять частых вопросов про Qwen Image Edit Plus - с прямыми ответами.

Это бесплатно? Ручная правка в Qwen Chat - да, функция Image Editing денег не просит. API платный и поштучный: списание за каждую успешную картинку, ошибки не считаются (документация Model Studio).

Модель понимает русский в надписях? Официальная поддержка - упрощённый китайский и английский. Кириллицу пробуй на свой риск: короткие слова, n=4, ручная проверка каждого варианта.

Сколько картинок можно скрестить за раз? На вход Plus-серия принимает от 1 до 3 изображений, на выход отдаёт от 1 до 6 за запрос. Больше трёх исходников - разбивай задачу на этапы.

Чем «джимнить» отличается от «жпти»? «Жпти» - про текстовый чат: спросить, обсудить, переписать текст. Для правки пикселей нужна отдельная модель редактирования изображений - она принимает картинку на вход, а не описание словами.

В каком году вообще изобрели редактирование картинок текстом? Точной даты никто не назовёт, исследования шли годами. В массовое обращение приём вышел в августе 2025, когда почти одновременно появились Qwen-Image-Edit и Nano Banana - тогда и изобрели сам глагол.

Источники

Коротко: первоисточники - блог Qwen, карточка на Hugging Face, документация Model Studio и техотчёт; обзоры и цены - вторичные, с оговорками в тексте.

Top comments (0)