позиции · сбор данных · отчёты
реклама IPrazon Network: приватные прокси IPv4 и SOCKS5, около 12 000 адресов, безлимитный трафик, тест до 2 часов

Разделы · Семантика и частотности

Точная частотность в кавычках собирается втрое дольше обычной

11 ответов · 2 351 просмотров
знак участника Дарья Смолина
Дарья СмолинаУчастник
  • сообщений 820
  • на форуме 9 мес
Семантика и частотности

Второй раз наступаю на одни грабли, решил спросить.

Держу 40 адресов, паузы ставлю случайные от секунды до трёх. Сбор идёт вторые сутки, а прошло чуть больше половины.

$ kc-cli --masks masks.txt --depth 3 --threads 40
собрано фраз: 214 880
отказов: 1 204

Подскажите, где я ошибаюсь.

знак участника Гаврилин
ГаврилинУчастник
  • сообщений 1 330
  • на форуме 8 мес
Дарья Смолина писал: Точная частотность в кавычках собирается втр…

Так и есть, проходил через это в прошлом году.

Дубли после сбора из трёх источников это норма. Приводите фразы к одному виду до сравнения: нижний регистр, порядок слов, лишние пробелы.

Точная частотность в кавычках собирается медленнее обычной, потому что это отдельный запрос. Закладывайте на неё втрое больше времени.

Хороший разбор, добавлю в закладки.

знак участника Вадим Кучер
Вадим КучерНовичок
  • сообщений 165
  • на форуме 1 года

Пришёл к этому не сразу, сначала сделал ошибку.

По узким регионам данных мало всегда. Смотрите не на точные числа, а на порядок величины и на наличие спроса как такового.

знак участника Нина Караваева
Нина КараваеваУчастник
  • сообщений 1 025
  • на форуме 7 мес
Дарья Смолина писал: Точная частотность в кавычках собирается втр…

Подтверждаю, у нас было ровно то же самое.

Точная частотность в кавычках собирается медленнее обычной, потому что это отдельный запрос. Закладывайте на неё втрое больше времени.

Чистку делаю в два прохода: сначала стоп-слова и явный мусор, потом ручной просмотр верхушки по частотности. Низ списка руками не трогаю.

знак участника Ирина Долева
Ирина ДолеваНовичок
  • сообщений 588
  • на форуме 11 мес
Дарья Смолина писал: Точная частотность в кавычках собирается втр…

Подтверждаю, у нас было ровно то же самое.

Кластеризация по выдаче требует свежих топов. Если топам больше недели, кластеры разъезжаются, и это видно на глаз.

Сбор частотностей упирается в темп, а не в мощность машины. Ускорение даёт только увеличение числа адресов и аккуратные паузы.

знак участника Айгуль Р.
Айгуль Р.Новичок
  • сообщений 440
  • на форуме 1 года

Так и есть, проходил через это в прошлом году.

Кластеризация по выдаче требует свежих топов. Если топам больше недели, кластеры разъезжаются, и это видно на глаз.

Сбор частотностей упирается в темп, а не в мощность машины. Ускорение даёт только увеличение числа адресов и аккуратные паузы.

Отпишитесь, чем закончится, тема полезная.

знак участника Бабенко Д.
Бабенко Д.Новичок
  • сообщений 402
  • на форуме 1 года

Считайте по темпу, всё остальное вторично.

знак участника Ерохин
ЕрохинНовичок
  • сообщений 495
  • на форуме 1 года

У меня картина совпадает почти полностью.

Кластеризация по выдаче требует свежих топов. Если топам больше недели, кластеры разъезжаются, и это видно на глаз.

Расширение по подсказкам останавливаю, когда прирост новых фраз падает ниже пяти процентов за проход. Дальше растёт только мусор.

$ kc-cli --masks masks.txt --depth 3 --threads 40
собрано фраз: 214 880
отказов: 1 204
знак участника Сергей Птицын
Сергей ПтицынУчастник
  • сообщений 1 165
  • на форуме 6 мес

Уточните пару моментов, иначе гадаем.

знак участника Жигарев
ЖигаревНовичок
  • сообщений 178
  • на форуме 1 года

Тут есть тонкость, о которой обычно забывают.

Сбор частотностей упирается в темп, а не в мощность машины. Ускорение даёт только увеличение числа адресов и аккуратные паузы.

По узким регионам данных мало всегда. Смотрите не на точные числа, а на порядок величины и на наличие спроса как такового.

знак участника Марат Илюхин
Марат ИлюхинЗнаток
  • сообщений 2 295
  • на форуме 3 мес
Дарья Смолина писал: Точная частотность в кавычках собирается втр…

Начинал с того же, потом переделал.

Расширение по подсказкам останавливаю, когда прирост новых фраз падает ниже пяти процентов за проход. Дальше растёт только мусор.

$ kc-cli --masks masks.txt --depth 3 --threads 40
собрано фраз: 214 880
отказов: 1 204
Ответить в темеПодписаться

Рядом в разделе

Сеометр, форум специалистов по поиску и аналитике ПравилаУчастникиО форумеЛента 2026