E-commerce и бизнесAI и машинное обучение

Одинаковые описания в каталоге: сколько их в 21 фиде украинских магазинов

Замер 21 публичного фида 8 сентября 2026 года, 89 718 товаров: 19 674 из них (22 %) имеют описание, дословно одинаковое с описанием другого товара в том же фиде. Как проверить это у себя.

Восьмого сентября 2026 года мы прочитали 21 публичный YML-фид украинских интернет-магазинов — 89 718 товаров — и посчитали в них одну вещь: у скольких товаров описание дословно совпадает с описанием другого товара в том же фиде.

Ответ: 19 674 товара, 22 % прочитанных. Такие совпадения есть в 17 фидах из 21. Эти же фиды мы брали уже дважды: 5 сентября смотрели, что в них ломается под требования площадки, 8 сентября — есть ли в них украинские языковые поля. В этот раз — только описания.

Что именно мы считали

Метод простой, и его стоит понимать, потому что от него зависит, как читать цифру.

В пределах одного фида описание каждого товара нормализуется: снимаются HTML-теги и обёртка CDATA, несколько пробелов подряд сжимаются в один, регистр опускается. От того, что осталось, берётся хеш. Товар попадает в «дубликатную группу», если его нормализованное описание совпадает байт в байт с описанием другого товара того же фида. Сравнение — внутри фида; магазин с магазином мы не сверяли.

Это не то же самое, что дубли названий, которые мы считали 5 сентября (903 товара в 11 фидах). Там совпадает название, и площадка видит это сама: в справке Rozetka есть прямое требование, а позиция отклоняется. Здесь названия разные, а текст под ними один и тот же — и ни один валидатор фида на это не пожалуется.

Цифры

Показатель Значение
Товаров с описанием-копией 19 674 (22 %)
Фидов, где такие группы есть 17 из 21
Групп одинаковых описаний 6 230
Товаров на группу в среднем 3,2
Самая большая одна группа 137 товаров
Товаров совсем без описания 5 779 (6 %)
Товаров с описанием короче 200 символов 9 267
Фидов без дублей и без пустых описаний 2 из 21

Доля дублей по фидам разбросана широко: медиана 7,4 %, максимум 50,3 %. То есть в типичном фиде выборки копия попадается примерно у каждого четырнадцатого товара, а в худшем — у половины каталога.

Крайние случаи стоит назвать отдельно, потому что средние числа их прячут:

  • Фид на 19 761 товар, в котором 9 931 позиция — в дубликатных группах. Половина каталога.
  • Prom-фид на 5 088 товаров: 3 843 из них не имеют описания вообще, ещё 1 003 — копии. Собственным текстом владеют 242 товара из пяти тысяч.
  • Самая большая одна группа — 137 карточек с дословно одинаковым текстом.

Два фида из двадцати одного не имеют ни дублей, ни пустых описаний.

Как увидеть это в своём каталоге

Метод воспроизводим и не требует никаких сервисов:

  1. Выгрузите фид и возьмите из каждого товара поле описания.
  2. Нормализуйте текст: уберите HTML-теги, разверните CDATA, сожмите пробелы, опустите регистр. Без этого два одинаковых описания, отличающиеся одним <br>, посчитаются разными.
  3. Посчитайте хеш каждого нормализованного описания и сгруппируйте товары по хешу.
  4. Группы, где больше одного товара, — это ваши дубли. Пустые описания считайте отдельно: другая проблема и другое лечение.

Это десяток строк на любом языке или формула в таблице, если каталог небольшой. Важнее не инструмент, а результат: вместо ощущения «кажется, у нас много одинакового» вы получаете число.

Посмотрите ещё и на распределение групп. Одна группа на 137 товаров и 137 групп по два товара — разные задачи. Первая означает целую категорию с описанием-заглушкой, вторая — варианты одного товара, у которых отличие не попало в текст.

Откуда берутся одинаковые описания

Причин немного, и ни одна из них не про небрежность.

Описание от поставщика. Прайс приходит с текстом, модуль импорта кладёт его в карточку. Поставщик дал одно описание на серию из двадцати позиций — в каталоге появилось двадцать одинаковых карточек.

Варианты одного товара. Тот же чехол в восьми цветах, та же футболка в пяти размерах. Отличие вынесено в характеристики, а текст скопирован.

Описание категории вместо описания товара. Самая частая причина больших групп: в поле описания подставили общий текст о категории или бренде. Формально поле заполнено.

Шаблон, в котором не сработала подстановка. Описание собиралось по шаблону, переменные не подставились — и во всех товарах остался одинаковый каркас.

Что это значит для поиска

Здесь нужна точность, потому что вокруг темы много преувеличений.

Одинаковое описание у 137 товаров означает ровно одно: поисковая система видит 137 страниц с одним и тем же текстом. Дальше работает обычный механизм — среди страниц с одинаковым содержимым система выбирает одну как основную и показывает в результатах именно её, а остальные считает её вариантами. Какую именно выберет — решает она, не вы.

Мы не проверяли, произошло ли это с товарами измеренных магазинов, и не мерили ни их индексацию, ни позиции. Замер показывает состояние фидов, и только его. Обещать, что после уникализации описаний что-то вырастет, мы не будем: на выдачу влияют десятки факторов — ассортимент, цены, условия доставки, ссылки, поведение покупателей, конкуренция в категории.

Честная граница такая: уникальное описание убирает техническую потерю — то, что страница не добавляет ничего нового к уже имеющемуся в индексе. Спроса оно не создаёт и позиций само по себе не поднимает.

Как исправить на тысячах товаров

Руками это не делается. 19 674 товара из нашей выборки — это годы работы копирайтера, а в одном отдельном каталоге с половиной копий это 9 931 текст.

Задача решается конвейером: фид на входе, фид на выходе. Сам конвейер мы разбирали отдельно — как переписать каталог на уникальные описания. Порядок действий, когда цифры уже на руках:

  1. Сначала пустые описания. 5 779 товаров без текста — это не «неуникально», это «ничего нет».
  2. Затем самые большие группы. Одна группа на 137 карточек даёт больше на единицу усилий, чем сотня пар.
  3. Превью на одном товаре до запуска всего каталога: прочитать текст глазами, пока не обработаны тысячи позиций.
  4. Импорт одного товара обратно на площадку, проверка карточки — и только потом весь каталог.

В Textory, нашем продукте, описание строится из характеристик самого товара, а не выдумывается. Именно поэтому варианты одного товара получают разный текст, а не переставленные абзацы. Если нужно, чтобы описание ещё и легло в формат, удобный для цитирования в AI-поиске, это отдельный режим и отдельная логика — о ней в материале о GEO-оптимизации описаний.

Когда задача шире самого текста, AI-генерация описаний товаров как услуга агентства означает, что мы берём на себя и разбор фида, и маппинг полей, и возврат файла обратно в платформу.

Чего этот замер не показывает

Ограничений четыре, и каждое из них сужает цифру.

Сравнение между магазинами не делали. Одинаковое описание от общего поставщика, стоящее в двух разных фидах, здесь не видно вообще. А это самый распространённый вид совпадения.

Похожие, но не идентичные описания не считаются. Переставили абзацы, изменили одно слово, добавили точку — по нашей методике это уже разные тексты. Реальная доля неуникального текста выше 22 %.

Индексацию не проверяли. Мы не знаем, что случилось с этими страницами в поиске, и выводов об этом не делаем.

Выборка маленькая и не случайная. 21 фид, найденный перебором типичных путей модуля выгрузки для OpenCart. Это состояние этих конкретных публичных фидов на 8 сентября 2026 года, а не срез украинского e-commerce.

Итог

В 21 измеренном фиде 22 % товаров имеют описание, дословно одинаковое с описанием соседа по каталогу, а ещё 6 % не имеют описания совсем. Проверить то же самое у себя — это нормализовать описания, захешировать и сгруппировать: полчаса работы и одно число вместо догадок.

Посмотреть, что получится на вашем фиде, можно на textory.com.ua — модель оплаты там за объём текста, актуальные условия на сайте продукта. Остальные наши продукты — в разделе собственных продуктов. Разбор задачи бесплатный, отвечаем в течение двух часов, работаем по договору.

Теги

E-commerceSEO

Вам понравилась статья?

Ваше мнение помогает нам создавать лучший контент

Поделитесь с друзьями

Нашли что-нибудь полезное?

Помогите другим узнать это — поделитесь статьей в социальных сетях

Спасибо, что помогаете нам расти

Основатель LIONEX

Владислав Чистяков

Пишет о том, что делает руками: интернет-магазины на OpenCart, приложения на Next.js, интеграции и скорость сайтов. В статьях — замеры и проверки, которые читатель может повторить на своём проекте, а не общие советы. Коммерческая разработка с 2015 года.

Вопросы

Частые вопросы

Ответы на популярные вопросы по теме

Означает ли одинаковое описание, что товар не будет показываться в поиске?

Мы этого не мерили и такого не утверждаем. Наш замер показывает состояние фидов, а не то, что случилось с их страницами в поиске: индексацию и позиции этих магазинов мы не проверяли. Известно другое, и оно из механизма, а не из прогноза: если 137 товаров имеют дословно одинаковый текст, поисковая система видит 137 страниц с одним и тем же содержимым. Среди таких страниц она обычно выбирает одну как основную и показывает именно её, а остальные считает её вариантами. Какую именно выберет — решает она, не вы.

Сколько товаров в каталоге обычно имеют одинаковые описания?

В измеренной выборке 08.09.2026 — 19 674 товара из 89 718, то есть 22 %. Такие группы есть в 17 фидах из 21. Разброс большой: медиана по фидам 7,4 %, максимум 50,3 %. Ещё 5 779 товаров (6 %) не имеют описания вообще, а 9 267 имеют описание короче 200 символов. Выборка маленькая и не случайная — это состояние 21 конкретного публичного фида на дату замера, а не срез рынка.

Как проверить дубли описаний в собственном фиде?

Выгрузите фид, возьмите поле описания каждого товара и нормализуйте текст: уберите HTML-теги, разверните CDATA, сожмите пробелы, опустите регистр. Затем посчитайте хеш каждого описания и сгруппируйте товары по хешу — группы больше чем с одним товаром и есть дубли. Нормализация обязательна: без неё два одинаковых описания, отличающиеся одним тегом `<br>`, посчитаются разными. Пустые описания считайте отдельно.

Чем дубли описаний отличаются от дублей названий?

Дубли названий площадка видит сама: в справке Rozetka есть прямое требование не иметь двух позиций с абсолютно одинаковым названием, и такая позиция отклоняется. В замере 05.09.2026 их было 903 товара в 11 фидах из 21. Дубли описаний — другое дело: названия разные, а текст под ними один и тот же, и ни один валидатор фида на это не пожалуется. Поэтому их и не замечают, пока не посчитают специально.

Решает ли массовый рерайт проблему полностью?

Он убирает техническую потерю — то, что страница не добавляет ничего нового к уже имеющемуся в индексе. Спроса уникальное описание не создаёт и позиций само по себе не поднимает: на выдачу влияют ассортимент, цены, условия доставки, ссылки, поведение покупателей и конкуренция в категории. Порядок работы советуем такой: сначала товары совсем без описания, затем самые большие группы копий, превью на одном товаре до запуска всего каталога и проверка одной карточки на площадке перед массовым импортом.

Получайте лучшие статьи на почту

Подпишитесь на нашу рассылку и получайте полезные советы, инсайты и новости о веб-разработке, маркетинге и бизнесе.

Мы уважаем вашу конфиденциальность. Отписаться можно в любой момент.

Ещё в блоге

Похожие статьи

Healthcheck дал 60 % запросов приложения: что показали первые сутки метрикВеб-разработка

Healthcheck дал 60 % запросов приложения: что показали первые сутки метрик

21 сентября 2026 года, в первые сутки учёта запросов по маршрутам, служебный /api/health получил 13 666 запросов — 60 % трафика приложения, и каждый шёл в общую базу. Рассказываем, какие две настройки это убрали, какую цену мы за них платим и как проверить свой healthcheck.

Читать дальше
154 ошибки типов, которые выбрасывала сборка: что в них нашлосьВеб-разработка

154 ошибки типов, которые выбрасывала сборка: что в них нашлось

21 сентября 2026 года проверка типов на нашем сайте показала 154 ошибки, хотя сборка каждый раз была зелёной: результат проверки просто выбрасывался. Внутри нашлись нули в статистике ссылок и в экспорте аналитики, сортировка, которая не сортировала, и тесты, которые не запускались. Рассказываем, как разбирали, что изменили и как проверить свой проект.

Читать дальше
Сертификаты продлеваются сами: TLS на 116 сайтах и один, который не продлилсяВеб-разработка

Сертификаты продлеваются сами: TLS на 116 сайтах и один, который не продлился

22 сентября 2026 года мы проверили HTTPS-сертификаты на 116 сайтах, которые уже измеряли для рыночных исследований, и для 104 из них сравнили состояние с августовским. Все 116 прошли проверку, 108 стоят на 89- и 90-дневных бесплатных сертификатах, и только у одного сайта сертификат до сих пор не продлился, хотя при типичных настройках уже должен был. Разбираем замеры, границы метода и показываем, как проверить свой сайт одной командой.

Читать дальше