Claude собирает изображения сам, когда речь идёт о схеме, графике или наглядном разборе: он делает их кодом прямо в разговоре, а присланную вами картинку читает и разбирает. Готовый кадр — фотографию или иллюстрацию — создаёт отдельная рисующая модель, и дальше показано, как эти две части сводят вместе: в обычной переписке и в работе агента Claude Code.
Что Claude рисует сам и что читает с картинки
Свой ответ Anthropic держит в справке «Может ли Claude создавать изображения?». В английской версии той же справки, Can Claude produce images? от 16 марта 2026 года, ответ дан первой строкой: «Claude doesn’t generate photos or illustrations the way image-generation tools do». Перевод наш: «Claude не создаёт фотографии и иллюстрации так, как это делают инструменты для создания изображений».
Дальше там же сказано, что он делает вместо этого: «Claude can, however, build diagrams, charts, and interactive visuals directly in your conversation to assist with your understanding. These are generated using HTML and SVG—so you can interact with them, ask follow-up questions, and have Claude adjust them as you go. This feature is in beta on Claude web and desktop». Перевод наш: «При этом Claude может собирать диаграммы, графики и интерактивные изображения прямо в вашем разговоре, чтобы помочь вам разобраться. Они собираются на HTML и SVG, поэтому с ними можно взаимодействовать, задавать уточняющие вопросы и просить Claude поправить их по ходу работы. Эта возможность находится в бета-версии в Claude в браузере и на рабочем столе».
Вторая половина ответа касается готовых файлов: «Claude can also view and analyze images you upload». Перевод наш: «Claude также может просматривать и разбирать изображения, которые вы загрузили». Из двух этих пунктов и складывается разделение работы: объяснить предмет схемой и разобрать присланный кадр Claude берёт на себя, а нарисовать фотографию или иллюстрацию — дело модели, сделанной для рисования.
Как устроены схемы, которые Claude собирает в чате
Отдельная справка Custom visuals in chat and Cowork от 22 апреля 2026 года разбирает эти схемы подробнее. Включать для них ничего не нужно: «You don’t need to turn anything on. Claude decides when a visual would help based on what you’re asking». Перевод наш: «Включать ничего не нужно. Claude сам решает, когда изображение поможет, — по тому, о чём вы спрашиваете». Попросить схему можно и прямо, фразами вроде «нарисуй это диаграммой» или «покажи, как это менялось со временем».
Из чего такая схема сделана, сказано отдельным разделом: «Custom visuals aren’t photos or illustrations. Claude builds them using HTML—the same building blocks as web pages—so they’re interactive and specific to your question rather than static images». Перевод наш: «Такие изображения — не фотографии и не иллюстрации. Claude собирает их на HTML, из тех же частей, что и веб-страницы, поэтому они интерактивны и сделаны под ваш вопрос, а не являются неподвижными картинками».
Одну особенность стоит учесть заранее: «Custom visuals are ephemeral by default. They live inline as part of Claude’s response and aren’t saved separately when the conversation moves on». Перевод наш: «По умолчанию такие изображения недолговечны. Они живут внутри ответа Claude и отдельно не сохраняются, когда разговор пошёл дальше». Способов забрать схему справка называет три: скопировать её картинкой, скачать файлом .svg или .html и превратить в артефакт, который останется в учётной записи.
Про площадки в разделе ограничений сказано: «Custom visuals are available in chats on Claude web and desktop apps only. They don’t render on Claude for iOS or Claude for Android». Перевод наш: «Такие изображения доступны в разговорах только в Claude в браузере и в настольном приложении. В приложениях Claude для iOS и Android они не показываются».
Что можно принести в разговор картинкой
Пределы загрузки Anthropic называет числами в справке Upload files to Claude от 23 июля 2026 года: «File size: 500MB per file», «Number of files: Up to 20 files per chat», «Image dimensions: Up to 8000x8000 pixels». Перевод наш: «размер файла — до 500 МБ на файл», «число файлов — до 20 на разговор», «размер изображения — до 8000×8000 точек». Форматы изображений там же перечислены четырьмя строками: JPEG, PNG, GIF и WebP.
Совет из той же справки касается качества исходника: «For images: Use images that are 1000x1000 pixels or larger. Avoid small or low-resolution images where possible». Перевод наш: «Для изображений: берите картинки от 1000×1000 точек. По возможности избегайте маленьких изображений с низким разрешением». Отсюда простое правило для разбора: скриншот с телефона подходит, а мелкий фрагмент, вырезанный из готовой страницы, разбирается хуже.
Страницы справки Anthropic, откуда взяты цитаты выше, сняты 15 сентября 2026 года.
Claude генерация изображений: чем закрывают эту задачу
Задачу закрывают парой, где у каждой стороны своя работа. Описание кадра пишут в разговоре с Claude, а рисует модель, которая для этого сделана. Разбор задачи словами — как раз то, что Claude делает хорошо: он уточнит, что должно оказаться в кадре, в какой обстановке и в каком настроении, и соберёт из ваших ответов подробное описание вместо общей фразы.
Готовое описание уходит рисующей модели. Какую взять, зависит от кадра: фотореалистичный снимок, рисунок, надпись внутри картинки и правка присланного фото даются моделям по-разному. Разбор моделей по задачам собран на странице нейросеть для картинок, а цена и примеры каждой стоят на её карточке — Nano Banana 2, Nano Banana Pro, GPT Image 2.
Порядок работы от этого остаётся прежним. Вы продолжаете вести разговор там, где начали, и получаете кадр от той модели, чья это работа. Так же разделена и работа над роликом: что Claude делает со сценарием и расшифровкой видео, а что остаётся видеомодели, показано на отдельной странице.
Как это описали со стороны
Появление схем в чате разбирали и вне Anthropic. В заметке «Claude рисует диаграммы прямо в чате — и это не генерация картинок, а кое-что круче» от 12 марта 2026 года автор под именем runaway_llm сводит разницу к одной строке: «Ключевой нюанс: это не генерация изображений. Claude строит визуализации с помощью HTML-кода и SVG-графики».
Там же названо свойство, ради которого эти схемы и делают: «Визуализации интерактивны: по элементам графиков и схем можно кликать». Из этого понятно, зачем такая схема вообще нужна вместо обычной картинки: её не рассматривают, а разбирают — щёлкают по частям, спрашивают дальше и просят переделать по ходу разговора.
Для выбора инструмента вывод простой. Когда нужно объяснить устройство, идите в разговор с Claude; когда нужен готовый кадр в проект или на страницу, идите к рисующей модели.
Картинки прямо из Claude Code
Тем, кто работает в Claude Code, обе части сводят в один разговор. Рисование GEN202 отдаёт навыком: агент настраивает его однажды, а потом обращается к нему без напоминаний, как только в работе понадобился кадр. Команда для этого не нужна: фраза подключения целиком приведена на странице подключения навыка, вы отдаёте её своему агенту, он открывает описание вызовов и настраивает по нему обращения к GEN202 API. Где взять доступ, агент выясняет сам: значение он ищет в переменной окружения GEN202_KEY, и если такой переменной в системе ещё нет, разбирает подключение вместе с вами по той же странице.
Подключённый навык добавляет агенту работу с изображением целиком. Агент рисует кадр по вашему описанию словами, переделывает картинку, которую вы ему дали, сам подбирает форму кадра и разрешение под место, где изображение будет стоять, и приносит результат ссылкой на готовый файл. Открыть эту ссылку и забрать по ней картинку к себе нужно в пределах четырнадцати суток.
В навыке собраны Nano Banana 2, Nano Banana Pro, GPT Image 2 и Grok Imagine Image 2.0. Кому из них достанется ваш кадр, агент решает сам — по тому, что вы описали. Как навык выглядит изнутри и по какому пути его кладут, подробно показано в разборе навыков Claude Code. Тем же способом навык подключают и в Codex: фраза обращена к агенту, а не к одной определённой оболочке.
Частые вопросы
Может ли Claude генерировать картинки? Диаграммы, графики и интерактивные изображения Claude создаёт сам и показывает их прямо в разговоре. Собраны они кодом, на HTML и SVG, поэтому с готовой схемой можно взаимодействовать, спрашивать по ней дальше и просить поправить её по ходу работы; эта возможность, по словам Anthropic, находится в бета-версии и открыта в Claude в браузере и на рабочем столе, а в приложениях для iOS и Android такие схемы не показываются. Фотографии и иллюстрации справка описывает иначе: их Claude создаёт не так, как инструменты для создания изображений, и за готовым кадром идут к рисующей модели. Сама справка открыта по адресу «Может ли Claude создавать изображения?».
Читает ли Claude присланное изображение? Да, загруженные изображения Claude просматривает и разбирает — Anthropic называет это отдельно, рядом с разбором про диаграммы. Числа в справке про загрузку файлов такие: до 500 МБ на файл, до 20 файлов на один разговор, до 8000×8000 точек на изображение; из форматов приняты JPEG, PNG, GIF и WebP. Практическая разница между двумя случаями простая: картинку, которая у вас уже есть, вы приносите в разговор и разбираете вместе с Claude, а картинку, которой ещё нет, в этом же разговоре описывают словами и заказывают у рисующей модели.
Сохраняется ли схема, которую Claude собрал в разговоре?
Сама по себе — нет: по умолчанию такая схема живёт внутри ответа и отдельно не сохраняется, когда разговор пошёл дальше. Забрать её можно тремя способами, и все три названы в справке: скопировать картинкой, скачать файлом .svg или .html, превратить в артефакт, который останется в учётной записи и которым можно делиться. Поэтому схему, которая понадобится позже, сохраняют сразу, а не в конце разговора.
Где взять картинку под проект? Начните с того, что за кадр вам нужен, — от этого зависит и модель. Сравнение моделей по задачам, с примерами и ценой за готовое изображение, собрано на странице нейросеть для картинок: там кадр заказывают вручную, описанием. Отдельно по задачам дизайнера — знак, фон под предмет, картинка к записи — страницы собраны в узле нейросети для дизайнеров. Когда картинки нужны в ходе работы над проектом и ходить за ними отдельно неудобно, ту же работу поручают агенту — порядок подключения описан на странице навыка для агента, после чего изображение приходит в ответ на просьбу в том же разговоре, где вы пишете код.
Сколько стоит картинка? Счёт идёт за готовый кадр, а сумма зависит от того, какая модель рисовала и в каком разрешении. Снимок в невысоком разрешении на Nano Banana 2 стоит 7,2 ₽, он же в высоком разрешении на Nano Banana Pro — 21,6 ₽. Отсюда и обычная привычка в работе: пробные варианты заказывают в низком разрешении, а высокое ставят тому кадру, который пойдёт в дело. Цены по каждой модели перечислены в таблице на странице навыка для агента.