Нейросеть для описания фото и товара
Одно описание товара у копирайтера стоит от 300 до 1 500 ₽, и это честная цена за час работы. Проблема в другом месте: снимки товара уже отсняты, а текста к ним нет. Нейросеть для описания фото берёт на вход именно снимок — и это единственный способ получить черновик описания, не пересказывая характеристики руками.
Оговорка, которая экономит деньги: мультимодальная модель читает с изображения далеко не всё. Цвет, форму и тип товара она определит, а состав, размер и комплектацию — придумает, потому что они на фотографии не написаны. Ниже — что считывается со снимка, три сценария по шагам, тринадцать инструментов с ценами и доступом из РФ и пять ошибок, которые ловят руками.
- Почему описание по фото — отдельная задача
- Что нейросеть реально считывает с фотографии товара?
- Какие характеристики нельзя получить с фото?
- Как получить черновик описания для новинки по фото?
- Как прогнать каталог партией: 200 SKU через фото?
- Как вытащить характеристики с этикетки и упаковки?
- Где модель ошибается: пять галлюцинаций на характеристиках
- Чем делать: инструменты для описания товара по фото
- Сколько стоит и что есть бесплатно?
- Как проверить описание перед загрузкой в карточку?
- Итоги: что запомнить
- Частые вопросы
Почему описание по фото — отдельная задача
Встроенные генераторы Wildberries и Ozon пишут описание по названию и характеристикам, которые вы уже заполнили: так устроена генерация описаний в справке Wildberries. Фотографию они в этот вход не берут. Поэтому на вопрос «сгенерируй описание по снимку» инструмент кабинета не отвечает — нужна внешняя модель, которая умеет принимать изображение.
Разница принципиальная. Когда вход — текст, модель пересказывает то, что вы и так знаете. Когда вход — изображение, вы получаете описание внешнего вида: то, чего в текстовом виде у вас нет.
Что нейросеть требует от вашего снимка
Источники: справка GigaChat (29.01.2026) — размер и лимит файла; требования фоторедактора Ozon.
Отсюда практический вывод: проверьте снимки до выбора модели. Студийная съёмка с товаром в кадре целиком даст модели больше признаков. Главное фото, залитое инфографикой, превратит распознавание в угадывание.
Что нейросеть реально считывает с фотографии товара?
С фотографии считываются визуальные признаки: тип и категория товара, цвет, форма, силуэт, видимый материал поверхности, фурнитура, количество предметов в кадре и фон. Плюс текст на снимке: надписи на упаковке, этикетке, ярлыке. Всё это модель переводит в связный текст описания товара.
Граница проходит там, где заканчивается изображение и начинается декларация. Наглядно это видно в таблице.
| Признак | Считывается с фото | Обязан дать продавец |
|---|---|---|
| Тип и категория товара | Да — по форме и назначению | Уточнение категории для площадки |
| Цвет и оттенок | Да — по снимку, с поправкой на свет | Название оттенка по каталогу |
| Материал | Только видимый: «похоже на кожу», «матовый пластик» | Точный состав и доля волокон |
| Размер и габариты | Нет — масштаб неизвестен без линейки в кадре | Длина, ширина, высота, вес |
| Комплектация | Только то, что попало в кадр | Полный список в коробке |
| Бренд и модель | Если логотип или шильдик видны и читаемы | Юридическое написание бренда |
| Страна и сертификаты | Нет | Данные из декларации и маркировки |
| Текст на упаковке | Да, если снимок резкий | Сверка с фактической маркировкой |
Именно поэтому задача ставится узко: «опиши, что видно на снимке, и отдельно перечисли, чего по фотографии определить нельзя». Вторая половина ответа экономит больше времени, чем первая: она сразу показывает список полей, которые вы заполняете сами.
Какие характеристики нельзя получить с фото?
С фотографии нельзя получить состав, размеры, вес, плотность, комплектацию, страну производства, сертификаты и цену. На снимке этих данных просто нет. Это декларируемые признаки: их сообщает продавец или производитель. Модель без ограничений заполнит эти поля правдоподобно — и это будет выдумка.
Для маркетплейса этот риск считают в деньгах. Покупатель получает товар, который не совпадает с описанием, оформляет возврат с формулировкой «не соответствует описанию»; карточка теряет позиции в рейтинге. Опубликованное описание — документ, за него отвечает компания.
Правило разделения, которое стоит закрепить в брифе: модель пишет только визуальную часть, декларируемые характеристики вносятся из учётной системы и не генерируются никогда. Если в описании появилась цифра размера или состав, у них должен быть источник — карточка товара, этикетка или спецификация.
Отдельная ловкость — размерная сетка. Если таблица попала на фото, снимок уже содержит масштаб, и модель даст прикидку. Но прикидка из фотографии годится только для черновика: в карточку идёт значение из спецификации. Подробный разбор полей — в статье про описание товара для маркетплейса.
Отдельное описание можно собрать в чате. Контент-завод на ИИ закрывает поток — тексты, визуал и публикации на десятки аккаунтов, от 119 ₽ за публикацию.
Посмотреть, как устроен контент-завод на ИИКак получить черновик описания для новинки по фото?
Черновик для новинки собирается за один заход: отобрать четыре-пять снимков, дать модели роль и границы, получить текст, сверить с декларацией и вычитать. Основное время уходит на отбор снимков и сверку характеристик, а не на саму генерацию — на это и стоит планировать силы, потому что генерация занимает минуты.
- Отберите 4–5 снимков вместо одного: общий план, деталь материала, упаковка, кадр с габаритом.
- Проверьте качество: для GigaChat минимум 100×100 пикселей, для фоторедактора Ozon — от 600×600, без обилия инфографики в кадре.
- Задайте роль и границы. Формулировка «опиши, что видно на фотографии, и перечисли, чего по снимку определить нельзя» работает предсказуемее, чем «напиши продающее описание».
- Получите черновик двумя версиями: короткая для поля аннотации и развёрнутая для описания.
- Сверьте с декларацией: всё, что модель назвала составом, размером и брендом, проверяется построчно.
Новинка без описания: селлер приносит партию новых позиций и комплект студийных снимков. По одному снимку сервис СеллерAI собирает вместе с описанием до 10–15 характеристик — этого хватает, чтобы заполнить черновые поля и вычитать их, а не вводить с нуля. Первые генерации бесплатны, дальше — по тарифу. На выходе — черновик описания и заполненные поля, которые остаётся сверить с спецификацией.
Как прогнать каталог партией: 200 SKU через фото?
Партия отличается от одиночной генерации тем, что правила фиксируются один раз, а дальше меняются только снимки. Ключевое требование — одинаковый стиль: если сто карточек написаны в ста интонациях, каталог выглядит собранным из чужих магазинов. Поэтому сначала утверждают шаблон: порядок блоков, длину, обращение к покупателю.
По одному снимку
- Гибко: под каждую позицию своя подача
- Контроль на каждом шаге
- Время растёт линейно с числом позиций
- Стиль расползается к сотой карточке
Партией по шаблону
- Один прогон на весь каталог
- Единый стиль и структура
- Требует подготовки шаблона и полей
- Слабые снимки портят всю партию
Партия делается двумя способами. Первый — сервис с пакетной обработкой каталога, например MPCard.AI: тариф там зависит от объёма, актуальную цену смотрите на сайте сервиса. Второй — API: у TEXTAGRAM есть публичный API и несколько стилей описания, что позволяет встроить генерацию в выгрузку.
Каталог на 200 SKU: магазин меняет поставщика и переписывает описания под новые артикулы. Шаблон утверждают один раз, дальше фото уходят пакетом. Узкое место — приёмка: 200 текстов надо проверить на выдуманные характеристики. На выходе — черновики всего каталога за один проход и понятный список полей для ручного заполнения.
Как вытащить характеристики с этикетки и упаковки?
Часть характеристик всё-таки есть на снимке — на этикетке, бирке, упаковке и вкладыше. Их снимает распознавание текста, и это отдельная задача от генерации описания: сначала фотографию превращают в текст, потом значения раскладывают по полям карточки. Автоматически сопоставить поля модель не может — это делается вручную или скриптом.
Для распознавания в российском контуре есть Yandex Vision. Он распознаёт текст с координатами и уверенностью, а модель выбирается под задачу: page — обычный текст, table — таблицы (например, размерная сетка), handwritten — рукописные записи. Ограничения: JPEG, PNG и PDF, до 10 МБ и до 20 млн пикселей. Важно: Yandex Vision текст распознаёт, но описания не пишет — для текста нужна отдельная языковая модель.
- Сфотографируйте этикетку прямо, без наклона и бликов — под углом точность падает.
- Снимайте крупно: мелкий шрифт распознаётся хуже.
- Разделяйте задачи: этикетка — распознавание, описание — генерация.
- Проверяйте распознанные числа руками: 0 и 8, 1 и 7, точку и запятую модель путает чаще всего.
- Переносите только поля, совпавшие с фактической маркировкой.
Размерная сетка: у поставщика одежды характеристики приходят фотографиями таблиц. Распознавание переводит таблицу в текст, но раскладка по полям площадки требует сверки — модель путает столбцы, если линии сетки на снимке бледные. На выходе — текст таблицы, который остаётся разложить по полям вручную.
Где модель ошибается: пять галлюцинаций на характеристиках
Мультимодальная модель достраивает правдоподобное там, где данных не хватает, и делает это уверенно. Пять типов ошибок встречаются на описаниях товара чаще всего, и все они про характеристики, которых на снимке нет. Ловятся они построчной сверкой каждого числа с источником: спецификацией, этикеткой, документом.
С фото модель даёт честно
- Внешний вид: форма, силуэт, цвет
- Тип и категорию товара
- Видимый материал поверхности — с оговоркой «похоже на»
- Читаемый текст упаковки и этикетки
С фото она додумывает
- Состав и долю волокон
- Габариты, вес и объём
- Бренд, страну и сертификаты
- Срок годности и дату производства
- Свойства вроде «гипоаллергенный», «эко», «водонепроницаемый»
Отдельно про оценочные свойства. Формулировки «натуральный», «премиальный», «экологичный» модель вставляет легко, а это утверждение, которое при проверке придётся подтверждать документом. Нет подтверждения — формулировку убирают.
Как ловить: у каждого числа в описании должен быть источник — спецификация, этикетка или документ. Если источник назвать нечем, значение убирают. Второй приём — сразу просить модель перечислить, чего по фотографии определить нельзя: этот список становится чек-листом ручного заполнения.
Контроль площадки: Wildberries с июля 2026 года тестирует отметку «Похоже на ИИ» для фотографий в отзывах, а расхождение описания с товаром бьёт по рейтингу и возвратам. Поэтому генерация описаний — процесс с обязательной вычиткой.
Чем делать: инструменты для описания товара по фото
Инструменты делятся на три группы: универсальные модели с приёмом изображений, сервисы под маркетплейсы и встроенные генераторы площадок. Первые гибче и требуют ручной настройки под задачу, вторые работают сразу под карточку и её поля, третьи бесплатны, но фотографию на вход не принимают вовсе. Выбор зависит от того, сколько позиций в каталоге и кто разбирает результат.
| Инструмент | Задача | Бесплатно / цена | Русский язык | Доступ из РФ |
|---|---|---|---|---|
| GigaChat | Универсальная модель: принимает изображение, пишет текст | Для физлиц бесплатно, бизнес через API | Да | Доступен из РФ |
| Yandex Vision | Распознавание текста и классификация изображения | Оплата по API внутри облака | Да | Доступен из РФ |
| Yandex AI Studio | Приём изображений языковой моделью в облаке | Оплата по API | Да | Доступен из РФ |
| ChatGPT | Универсальная модель: изображение плюс текст | Есть бесплатный режим | Да | Доступ из РФ ограничен, оплата российской картой недоступна |
| Claude | Универсальная модель: разбор изображения и длинного текста | Есть бесплатный режим | Да | Доступ из РФ ограничен, оплата российской картой недоступна |
| Gemini | Универсальная модель: изображение плюс текст | Есть бесплатный режим | Да | Доступ из РФ ограничен, оплата российской картой недоступна |
| TEXTAGRAM | Описания по фото под Wildberries, Ozon, Яндекс Маркет; есть API | Бесплатный пробный тариф, цены платных не опубликованы | Да | Доступен из РФ |
| СеллерAI | Карточка по фото: описание и 10–15 характеристик | Первые генерации бесплатны | Да | Доступен из РФ |
| Кардо | Карточка по фото или голосовому описанию | Есть бесплатный тариф | Да | Доступен из РФ |
| SEO Market | Описание по фото или по названию товара | Тарифы на сайте сервиса | Да | Доступен из РФ |
| MPCard.AI | Пакетная обработка каталога | Тариф зависит от объёма, цена на сайте сервиса | Да | Доступен из РФ |
| Aidentika | Пакетная генерация, карточки и инфографика | 6 стартовых искр, пакеты от 390 ₽ | Да | Доступен из РФ |
| Встроенные генераторы Wildberries и Ozon | Описание по названию и характеристикам — фото не принимают | Бесплатно в кабинете, лимиты ограничены | Да | Доступны из РФ |
Цены и лимиты меняются — проверяйте их на сайте инструмента. Цены MPCard.AI и Aidentika — по обзору Sostav от 26 июня 2026 года.
«ИИ для маркетплейсов пишет продающие описания с ключевыми словами под алгоритмы WB и Ozon, экономя часы копирайтинга».
— Sostav, 26 июня 2026 года
Три задачи часто путают, а инструменты у них разные. Описание внешнего вида пишут мультимодальные модели — те, что принимают изображение. Распознавание текста с этикетки — отдельный класс: в контуре Яндекса его закрывает Yandex Vision, а генерация текста — задача языковых моделей вроде YandexGPT. Генерация и обработка визуала — третий класс: Шедеврум и Kandinsky создают изображения, Photoroom и Canva готовят фото под карточку: фон, подложка, слайды. В кабинете Ozon «Умный ассистент» тоже построен на сторонней модели, Qwen, по обзору инструментов продавца.
Если задача — вся визуальная часть карточки, логика та же: сначала съёмка, потом обработка. Разбор этапа — в статье про нейросеть для обработки фото, общая карта инструментов — в обзоре нейросетей для фото.
Сколько стоит и что есть бесплатно?
Бесплатно закрывается разведка: встроенные генераторы площадок доступны в кабинете, у GigaChat бесплатный режим для физлиц, у сервисов под маркетплейсы есть пробные генерации. Дальше цена зависит от того, что вы считаете единицей: подписку, текст или готовую публикацию вместе с визуалом. Подписка не отвечает на главный вопрос — «сколько стоит одна карточка».
Одно описание товара: было → стало
Копирайтер — типичная цена фрилансера за один текст; цена единицы — публичный тариф пакета на 10 аккаунтов.
Что в инструментах бесплатно, а что по подписке
Источник: обзор Sostav от 26.06.2026. Лимиты и цены меняются.
Ориентир: если описаний нужны десятки, дешевле подписка. Если счёт идёт на сотни позиций и к описаниям добавляются визуал и публикации, считают единицу результата — так устроен контент-завод на ИИ: текст, обложка и выкладка — одна стоимость.
Как проверить описание перед загрузкой в карточку?
Проверка занимает меньше времени, чем правки после возвратов. Достаточно сверить характеристики с источником, убрать неподтверждённые свойства и убедиться, что описание совпадает с тем, что покупатель видит на фотографиях. Пять минут на карточку дешевле, чем разбор претензии и потерянная позиция в рейтинге.
- Состав, размер, вес и комплектация совпадают со спецификацией, а не с текстом модели.
- Бренд, страна и сертификаты внесены из документов.
- Оценочные свойства («натуральный», «премиальный», «эко») подтверждены или удалены.
- Текст не противоречит фотографиям: цвет и комплектация на снимках те же.
- Ключевые запросы стоят в начале описания, без переспама.
- Формулировку, звучащую по-канцелярски, переписывают.
Как распределять ключи по полям карточки, разобрано отдельно — в статье про нейросеть для описания товаров, а готовые формулировки для полей-фильтров собраны в подборке шаблонов описания характеристик.
Итоги: что запомнить
- Фото — это вход, а не весь источник данных. Модель считывает внешние признаки и не знает деклараций.
- Делите характеристики на две группы. Визуальные можно генерировать, декларируемые — только вносить из спецификации.
- Встроенные генераторы площадок фото не принимают. Для описания по снимку нужна внешняя модель или сервис.
- Для партии утверждайте шаблон один раз, иначе каталог из сотни карточек расползётся по стилю.
- Этикетку снимает распознавание текста, а раскладывать значения по полям всё равно приходится вручную.
- Пять минут проверки дешевле возврата с формулировкой «не соответствует описанию».
Что делать: прогоните цикл на одной позиции — четыре-пять снимков, черновик, сверка с спецификацией, вычитка. Замерьте время на карточку. Если ручная вычитка и выкладка съедают больше, чем стоит сам текст, — очередь за потоком: заявка на контент-завод на ИИ занимает пару минут.
Частые вопросы
Может ли нейросеть написать описание только по фотографии?+
Да, но только визуальную часть: тип товара, форму, цвет, видимый материал, читаемый текст упаковки. Состав, размер, вес, комплектацию и сертификаты она не знает — этих данных на снимке нет. Поэтому описание по фото всегда собирается из двух частей: сгенерированной и внесённой из спецификации.
Почему встроенный генератор Wildberries или Ozon не работает по фото?+
Потому что его вход — название и заполненные характеристики, а не изображение. Инструмент кабинета пересказывает то, что вы уже ввели. Для генерации по снимку нужна внешняя мультимодальная модель или сервис, принимающий изображение: GigaChat, Yandex AI Studio, TEXTAGRAM, СеллерAI и подобные.
Какие инструменты с распознаванием изображений доступны из РФ?+
Из российского контура — GigaChat (принимает изображение, для физлиц бесплатно), Yandex Vision (распознавание текста и классификация), Yandex AI Studio, а также сервисы под маркетплейсы: TEXTAGRAM, СеллерAI, Кардо, SEO Market, MPCard.AI, Aidentika. У ChatGPT, Claude и Gemini доступ из РФ ограничен, оплата российской картой недоступна. Подробный разбор этого этапа — в статье про нейросеть для описания товаров.
Что делать, если модель придумала характеристики?+
Не смягчать формулировку, а удалять её и вносить значение из спецификации. Выдуманные состав, габариты и свойства — прямой путь к возвратам «не соответствует описанию» и падению рейтинга. Рабочий приём — сразу просить модель перечислить, чего по фотографии определить нельзя: этот список становится чек-листом ручного заполнения.