Инструмент на конструкторе Интеграм
Массовое сопоставление каталогов на сотни тысяч позиций
Один и тот же товар в вашем каталоге и в каталоге контрагента назван по-разному и имеет разные артикулы. Инструмент сопоставляет такие позиции автоматически — через токенизацию наименований и пересечение токенов, в несколько потоков и без программирования. Раньше под это разворачивали Elasticsearch и нанимали программистов; здесь всё собрано на конструкторе Интеграм.
Полный цикл сопоставления
- 1. Загрузка каталогов
- 2. Токенизация
- 3. Сопоставление
- 4. Массовый подбор
- 5. Проверка кандидатов
- 6. Выгрузка в Excel
Загрузка по сохранённой настройке
Свой каталог (SKU) и каталог контрагента (RFP) загружаются из Excel по заранее сохранённой настройке: Интеграм сам распознаёт листы и колонки и показывает, сколько строк будет загружено. Скорость — порядка 500–1000 записей в секунду.
Токенизация наименований
Один запрос разбивает наименование позиции на отдельные слова-токены и наполняет общий справочник токенов. Обе таблицы используют один и тот же справочник — именно это позволяет искать пересечения.
Рабочее место сопоставления
Для любой позиции контрагента Интеграм по токенам подбирает кандидатов из вашего каталога. Совпадение марки, модели и типа подсвечивается зелёным; под каждый тип продукции настройка задаётся запросом, без программирования.
Массовый автоматический подбор
Кнопка Start запускает автоподбор в несколько потоков: механизм сам находит лучшие пары и пишет в таблицу RFP подобранный артикул и альтернативных кандидатов. Скорость — порядка 120 сопоставлений в минуту; 22 000 позиций обрабатываются за пару-тройку часов.
Выгрузка и передача
Отдельный запрос собирает подобранный артикул и все альтернативы и выгружает результат в Excel или отдаёт через JSON API во внешнюю систему.
Доуточнение языковой моделью
Когда объём невелик, шорт-лист кандидатов можно отдать языковой модели — она выберет из коротких списков только то, что точно совпадает. Дорогое перемножение «все на все» при этом не нужно: модель работает уже по отобранным парам.
Как считается оценка совпадения
Один справочник токенов на оба каталога
Токены ваших позиций и позиций контрагента живут в одной таблице — пересечение находится одним JOIN, а не внешним поисковым движком.
Понятная и настраиваемая оценка
Точность пары считается из числа совпавших токенов и отношения их общей длины к длине наименования. Формулу видно, её можно усложнять и оттачивать.
Веса и обязательные совпадения
Частым словам — меньший вес, маркерам бренда и типа товара — флажки «обязательно совпадает». Разметку токенов помогает проставить ИИ.
Интеграм против Elasticsearch и заказной разработки
| Критерий | Elasticsearch и заказная разработка | Интеграм |
|---|---|---|
| Запуск | Развёртывание Elasticsearch, индексы, пайплайны, код разработчика | Готовые таблицы и запросы в конструкторе — без кода |
| Логика сопоставления | Алгоритмы нечёткого поиска нужно писать и сопровождать | Токены + пересечение + веса настраиваются запросом |
| Настройка под тип товара | Правки в коде и переиндексация | Меняется условие запроса, без релиза |
| Массовый прогон | Свой многопоточный обработчик | Встроенный автоподбор в несколько потоков |
| Результат | Нужно выгружать отдельно | Подобранный артикул, альтернативы, экспорт в Excel и API из коробки |
| Где хранятся данные | Зависит от инфраструктуры | Сервер в РФ — ideav.ru, данные принадлежат вам |
Кому это нужно
Дистрибьюторам и производителям, которые отвечают на запросы (RFP) крупных заказчиков своими аналогами, торговым сетям при приёмке прайсов поставщиков, маркетплейсам и агрегаторам при слиянии номенклатур — всем, у кого две таблицы «про одно и то же», но названные разными словами.
Инструмент собран на конструкторе Интеграм — без программирования, с хостингом в России, и так же легко настраивается под вашу номенклатуру.
Сопоставить ваши каталоги
Пришлите два каталога — настроим токенизацию и сопоставление под вашу номенклатуру и вернём подобранные пары. Ответим в течение 24 часов.