Разделы · Семантика и частотности
Собираю ядра постоянно, но этот случай выбивается.
По порядку.
Ядро около 100 тысяч фраз, нужны точные частотности по двум регионам. Держу 40 адресов, паузы ставлю случайные от секунды до трёх. Проверял на выборке в тысячу фраз, там всё гладко.
$ kc-cli --masks masks.txt --depth 3 --threads 40 собрано фраз: 214 880 отказов: 1 204
Если у кого есть цифры, покажите.
Проверьте, что настройка вообще применилась.
Сверяйте полноту после каждого прогона.
Ровно то же наблюдал, только объёмы были поменьше.
Сбор частотностей упирается в темп. Мощность машины тут не помогает. Ускорение даёт только увеличение числа адресов и аккуратные паузы.
Верно, и это не единичный случай.
По узким регионам данных мало всегда. Смотрите на порядок величины и на наличие спроса как такового. Точные числа там всё равно недостоверны.
Разделение коммерческих и информационных запросов надёжнее делать по выдаче. Слова-маркеры дают слишком много ошибок.
Прогон падает всегда в одном месте?
Что показывает простой запрос из консоли?
Набор новых участников сейчас приостановлен. Читать форум можно без учётной записи, все темы открыты.
Когда набор откроют, объявление появится в разделе с короткими вопросами.
Форма работает в браузере и никуда ничего не отправляет.