Разделы · Семантика и частотности
Прошу совета у тех, кто собирает регулярно и много.
Источников три, объединяю их в одно ядро. Частотности снимаю по двум регионам, дальше сравниваю.
$ kc-cli --masks masks.txt --depth 3 --threads 40 собрано фраз: 214 880 отказов: 1 204
Буду рад и короткому ответу.
Обновите список адресов и повторите.
Какая версия программы стоит?
Ответ приходит пустой или с содержимым?
Подтверждаю, у нас было ровно то же самое.
Расширение по подсказкам останавливаю, когда прирост новых фраз падает ниже пяти процентов за проход. Дальше растёт только мусор.
Уменьшите потоки вдвое и замерьте заново.
Меняйте по одному, иначе не поймёте причину.
Поправлю цифру, остальное верно.
Приводите фразы к общему виду до сравнения, иначе дубли расползаются по всему ядру и всплывают на кластеризации.
Дополню, потому что важная деталь потерялась.
Маски проверяйте до запуска. Одна кривая маска даёт десятки тысяч мусорных фраз и съедает ночь.
Наступал на это в прошлом сезоне.
Разделение коммерческих и информационных запросов надёжнее делать по выдаче. Слова-маркеры дают слишком много ошибок.
Хороший вопрос, редко разбирают.
Замерьте и сравните, догадки тут не помогут.
Разбейте прогон на части, станет ровнее.
Что показывает простой запрос из консоли?
Уточню, иначе можно уйти не в ту сторону.
Сезонность видно только на истории. Если собираете первый раз, отметьте дату сбора, через год она вам понадобится.
Жду продолжения.
Данные теряются равномерно или кусками?
Мы решили это переносом прогона на другое время.
Внутренний поиск конкурента даёт живые формулировки, которых нет в подсказках. Источник недооценённый.
Сохранил, пригодится в следующем проекте.
Сколько это длится и с какой частотой повторяется?
Какие паузы между запросами?
Набор новых участников сейчас приостановлен. Читать форум можно без учётной записи, все темы открыты.
Когда набор откроют, объявление появится в разделе с короткими вопросами.
Форма работает в браузере и никуда ничего не отправляет.