Веб-версияОткрыть в Telegram

ВеткаРебята вопрос на звёздочки

11 сообщений · –
S
Ребята вопрос на звёздочки Как понять сколько мы будем сидеть в очереди Краулер посадил в ожидании новые изменения не в ходят в индекс Надо понять как посчитать сервер + Dr + бюджет краулера + лимиты это возможно?
  1. G
    Обычно время в очереди зависит от приоритета страниц и загрузки сервера. Можно посмотреть логи краулера: там часто пишут estimated wait. По расчету сервера и DR — смотрите на количество запросов в секунду и объем данных. Если лимиты по API, то нужно считать по токенам или запросам в час.
    1. R
      Чувак, выключи нейронки, отвечай для людей нормально если знаешь, гуглить умеют все
      1. S
        Ну это же не готовое решение это типа чисто подаковка кто постоянно с тобой согласен (
        1. S
          Промт не Промт уровень sinor им далеко ещё думаю
    2. S
      Чисто теоретически можно ли увеличить мощность сервере когда краулер кидаем ему запросы на данные что бы увеличить лимиты ( потому что скорость сервера мне кажется там лимит в 1 секунду или 4 ожидании ответа, если ответа нету краулер кидает в очередь , по этому скорость сервере не зависит для краулера. Скорость сервера для краулера это просто пауза ожидания подготовки. Вот между серверам и бд да там должно летать всё Или ты имеешь ввиду что краулер работает на время а не на количество полученных запросов?
  2. D
    Считать лучше не от «мощности сервера», а разложив очередь на три ограничения: rate limit краулера/API, пропускную способность воркеров и p95 ответа БД/целевого сервиса. Добавьте к каждой задаче 4 timestamp: enqueued_at, started_at, response_at, finished_at. Тогда: — ожидание = started_at − enqueued_at; — обработка = finished_at − started_at; — фактическая пропускная = completed / минуту; — прогноз времени очереди ≈ queue_size / throughput. Если входящий поток λ выше throughput μ, очередь не рассосётся вообще. CPU/RAM имеет смысл добавлять только когда воркеры упираются именно в них. При 429/Retry-After или внешнем лимите запросов/сек можно удвоить сервер — краулер быстрее не станет. Бюджет: requests/day × цена запроса + worker-hours + БД/трафик + 20–30% на ретраи. Если напишете, какой именно краулер, размер очереди, средний/p95 ответа и опубликованные лимиты, это уже можно посчитать числами.
    1. G
      Отличный подход с таймстемпами. Ещё можно добавить мониторинг через Prometheus + Grafana, чтобы видеть динамику очереди в реальном времени.
    2. S
      Фотография
      нажмите — покажем
      Ну пока на питоне быстро собрал пока не понятно это не точная инфа по краулеру на тест наверное месяц надо что бы уже подводить итоги это слогов короче если чё
Nn8n — Ai автоматизацияn8n — Ai автоматизация@n8node · группа · Технологии
3 055участников8 894сообщений в индексе
Лента площадки Открыть в Telegram

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем