Какие фильтры предпроверки SpeedyIndex отсекают 404, noindex и уже проиндексированные URL до drip-feed
Предпроверка в SpeedyIndex — опция перед Google-задачей Pay-per-Result, по умолчанию выключена. Если включить, она отсекает HTTP 404, 410 и 451, запрет в robots.txt и noindex, медиафайлы и адреса, которые Google уже хранит. Эти строки не попадают в drip-feed индексацию. На возврат индексационных токенов за недоступный URL рассчитывать нельзя: 404 — не «промах хранения». Предпроверка не ставит оценку качеству текста и не считает «AI-балл».
Вопрос «какие фильтры предпроверки SpeedyIndex отсекают 404, noindex и уже проиндексированные URL до drip-feed» имеет конкретный список классов, не творческий скоринг. Справка Google по кодам ответа HTTP разделяет «документа нет» и «документ отдан». Выборку с того же листа можно прогнать через проверку 404-ошибок, если формулировке продавца «все живые» не верите.
Включённый фильтр — настройка, не скрытая милость. Дальше календарь капает то, что выжило. Проверка не равна отправке. Оплаченный запрос — попытка обхода, не обещание включения. Search Console на чужом доноре инспекцию не откроет: задача всё равно нужна, но мёртвые URL её не заслуживают.
От ожидания возврата к отказу на входе в очередь
Миф: раз есть день 7, предпроверка не нужна. Обратный миф: предпроверка сама кладёт URL в индекс. Третий: 404 в порции drip-feed — «проблема Google», токены обязаны вернуться.
Возврат закрывает честный обход доступной страницы, которую Google не сохранил. Он не финансирует кампании из отсутствующих документов. 404 и 410 по справке о статусах обычно выпадают из индекса, их не просят «сохранить как контент». 451 закрывает документ по правовым причинам. noindex — директива издателя. Уже проиндексированный URL — Google хранит строку: 100 токенов за повторную просьбу хранить то же самое для задачи «закрыть дыры» не нужны.
Продуктово фильтр делится на доступность (404/410/451, robots/noindex, медиа) и статус в Google (уже в индексе). Drip-feed имеет смысл после обоих отсечений. Исключённые 404 обратно «для надёжности» не возвращают.
«Включайте предпроверку, если заголовки листа вы сами не снимали. 404 — не промах индексации. Лучше отсечь за минуту, чем спорить про возврат через неделю. Уже лежащие в Google URL в drip-feed не кладут. Списываем строку индекса, не клик. Сто процентов включения не продаём.»
— команда SpeedyIndex
Какие классы отсекают и зачем каждый
404, 410, 451. Страницы нет, её сняли навсегда или закрыли по закону. В очередь «сделай сниппет из отсутствия» такие ответы не кладут. Справка по кодам как раз описывает, что отсутствие не индексируют как материал. Код 403 в списке классов предпроверки отдельно не назван, зато в правилах возврата недоступные URL (404, 403, robots, noindex, петля редиректов) сидят вне автовозврата. Если донор режет бота авторизацией, не ждите, что фильтр «про 404» это обязательно поймает: снимите заголовок сами или смотрите исключения после прогона. Предпроверка закрывает названные классы, не все способы спрятать документ.
robots.txt и noindex. Издатель запретил обход пути или хранение. Индексатор директиву не перебивает. Пишите вебмастеру донора, не увеличивайте число дней календаря.
Медиа. Картинка или иной файл, если бриф покупал HTML-комментарий или статью, в Google-задаче линкбилдинга обычно лишние. Фильтр не даёт сжечь порции на объектах, которые вы не продавали клиенту как документ.
Уже проиндексированные. Точная строка уже в Google. Место этой строки — отчёт «размещение видно», не календарь. Pay-per-Result на 7-й день снова увидит хранение и спишет 100 токенов.
Фильтр не читает «уникальность», не ловит нейросеть, не ставит экспертность, не предсказывает позицию. Тонкий текст — риск алгоритма и решение редактора, не колонка предпроверки.
Почему 404 в отчёте дня 7 не обязан вернуть токены
Недоступные URL (404, 403, robots, noindex, петля редиректов) сидят вне автоматического возврата. Команда, которая выключила опцию «чтобы сэкономить», часто встречает эти строки в ошибках недели и ждёт возврата как за живой промах. Правила разные. Живой 200 без noindex, который Google не сохранил, — кандидат на возврат. Мёртвый адрес — качество списка.
Выборка кодами ответа до Create показывает, насколько продавец соврал. Она не заменяет переключатель предпроверки, но помогает решить: включить фильтр или вернуть лист поставщику. Standard и drip-feed одинаково не превращают 404 в индексируемый документ: режим меняет календарь, не физику HTTP.
Trial 200 токенов на новом аккаунте легко сжечь на грязном «комментарном» файле. Сначала класс ответа, потом очередь. Bing здесь ни при чём: индексатора Bing нет, предпроверка крутит Google-задачу и доступность, не «отправку в Microsoft».
Десять шагов: узнать фильтры и капать остаток
-
Снимите выборку кодов сами. Действие: 20–50 случайных URL из покупки. Инструмент: проверка 404 или запрос заголовков с редиректами. Настройка: финальный статус, не первый hop. Наблюдаете: сколько 404/410/451 в выборке. Когда: до 10-тысячного drip-feed. Успех: вы знаете грязность. Провал: верите слогану «все живые».
-
Включите опциональную предпроверку. Действие: переключатель при создании Google-задачи. Инструмент: кабинет. Настройка: доступность плюс статус в индексе, если половины разделены. Наблюдаете: опция не «сама по себе». Когда: лист грязный или незнакомый. Успех: фильтр включён. Провал: думали, что он всегда работает, и отправили Standard с трупами.
-
Разберите исключения по причинам. Действие: выгрузите отсечённые URL. Инструмент: отчёт предпроверки. Настройка: кучи 404/410/451, robots/
noindex, медиа, уже в индексе. Наблюдаете: четыре причины и счётчики. Когда: до старта дней календаря. Успех: причины совпадают с выборкой. Провал: пустые исключения на грязной выборке — фильтр не отработал. -
Верните 404 поставщику, не в календарь. Действие: тикет «вот список отсутствующих». Инструмент: переписка с селлером. Настройка: не просите индексатор «ещё раз попробовать отсутствие». Наблюдаете: замена URL или возврат денег за слот. Когда: сразу после кучи 404. Успех: в drip-feed этих строк нет. Провал: вручную дописали исключённые 404 «вдруг проиндексирует».
-
Разберите
noindexи robots отдельно. Действие: откройте тело и robots донора на паре примеров. Инструмент: исходник и robots.txt. Настройка: Googlebot и Googlebot Smartphone. Наблюдаете: директива на пути или в meta/x-robots-tag. Когда: после кучи robots/noindex. Успех: понимаете, это политика форума, не сбой чекера. Провал: повторно льёте тот же путь, надеясь, что фильтр «смягчится». -
Вычтите уже лежащие в Google. Действие: не добавляйте их в
.txtкалендаря. Инструмент: куча «уже проиндексировано». Настройка: точное совпадение строки. Наблюдаете: M живых промахов. Когда: до выбора числа дней. Успех: M без Google «есть». Провал: гордость «большой список» важнее фильтра, и вы платите 100 токенов за уже хранимое. -
Медиа выкиньте из брифа. Действие: оставьте HTML-документы. Инструмент: та же выгрузка. Настройка: расширения и типы, которые фильтр относит к медиа. Наблюдаете: комментарии и статьи, не файлы. Когда: до drip-feed. Успех: очередь совпадает с тем, что продали клиенту. Провал: PNG скриншотов тредов в Google-задаче.
-
Соберите выживших в один drip-feed. Действие: Pay-per-Result Google, дни 2–30, URL не меньше дней. Инструмент: календарь. Настройка: Googlebot Smartphone, без подтверждения сайта. Наблюдаете: идентификатор задачи на остатке. Когда: после куч исключений. Успех: порции по живым промахам. Провал: Standard на тысячах «потому что фильтр уже всё сделал» — фильтр чистит вход, не отменяет удар по чужим донорам за час.
-
Не ждите возврата на исключённых и на пропущенных 404. Действие: в учётке токенов разделите «предпроверка отсекла» и «задача отработала». Инструмент: отчёт. Настройка: недоступные вне автовозврата. Наблюдаете: индексационные токены не «зависли» на трупах, если фильтр сработал. Когда: день постановки и день 7. Успех: спор про 404 не начинается. Провал: выключили фильтр, 404 доехали до дня 7, ждут возврата как за живой промах.
-
Сохраните четыре кучи и финальный
.txt. Действие: датируйте причины и календарный файл. Инструмент: папка кампании. Настройка: имя закупки в файле. Наблюдаете: можно объяснить клиенту, почему из 10 000 в drip-feed ушло меньше. Когда: до статуса «готово». Успех: аудит. Провал: одна цифра «отправили 10к» без фильтров.
Иллюстративные сценарии на включённой и выключенной опции
Иллюстративный сценарий — не реальный клиент. Закупка «8 000 комментариев, все 200». Предпроверку оставили выключенной. На 7-й день сотни 404 в ошибках. Возврата индексационных токенов на отсутствующих страницах нет. Выборка из пятидесяти URL до Create показала бы ту же грязь дешевле.
Иллюстративный сценарий — не реальный клиент. Команда включила фильтр, отсекла уже лежащие в Google две тысячи строк и расстроилась, что «задача уменьшилась». На деле они не списали по 100 токенов за документы, которые Google и так хранил. Клиенту показали две цифры: сколько уже видно и сколько капают.
Иллюстративный сценарий — не реальный клиент. Селлер сдал форумные треды с noindex на старых страницах. Фильтр выкинул их как robots/noindex. Менеджер вернул URL в .txt вручную «вдруг». Директива издателя никуда не делась. Предпроверка не оценка «качества дискуссии»: она про разрешение хранить.
Что предпроверка не умеет и когда её оставляют выключенной
Она не антиплагиат. Не классификатор «написано моделью». Не прогноз топа. Не замена ручного снятия заголовков, если вы отвечаете за один дорогой гостевой URL. Не индексатор Bing. Не обещание, что выживший 200 Google обязательно сохранит: Pay-per-Result перепроверит хранение и вернёт токены на доступный промах, а решение о хранении принимает Google.
Опцию оставляют выключенной, когда список короткий и вы только что сами открыли каждый адрес: видели 200, каноникал, отсутствие noindex. Тогда фильтр дублирует работу, которую уже сделали руками. Опцию включают, когда файл пришёл от селлера, биржи или выгрузки крауда и вы не готовы поручиться за каждый hop. По умолчанию выключено как раз поэтому: сервис не навязывает платный отсев чистому хвосту из пяти URL.
Выключенный фильтр не «экономит возврат». Он пропускает в календарь то, что вы сами не отсекли. Если туда проехал 404, спор на 7-й день уже не про индексацию, а про доступность. Включённый фильтр не «штрафует качество»: тонкий комментарий с кодом 200 проходит дальше, и Google сам решает, хранить ли его. Путать эти два смысла — типичная претензия в переписке с клиентом: «фильтр пропустил слабый текст» или «фильтр должен был вернуть токены за 404». Ни то ни другое он не обещал.
Краулер задачи — Googlebot Smartphone. Чужие URL без Search Console допустимы. Фильтр как раз защищает эту свободу: вы можете вставить чужой список, но не обязаны оплачивать в нём отсутствие и запрет. После отсечения остаток всё равно капают drip-feed, если его много: чистота входа не превращает десять тысяч живых промахов в короткую пачку Standard.
Частые вопросы про фильтры до drip-feed
Предпроверка включена сразу на каждой задаче?
Нет. Опция по умолчанию выключена. Её включают на создании задачи, особенно на купленном непроверенном листе.
Какие коды и директивы отсекают фильтры?
404, 410, 451, запрет robots/noindex, медиа и уже проиндексированные в Google URL. Это доступность и факт хранения, не «балл текста».
Вернут ли индексационные токены, если 404 всё же попал в drip-feed?
На недоступные URL автоматический возврат не обещают. Именно поэтому фильтр закрывает вход, а не «лечит» день 7.
Оценивает ли предпроверка качество или следы нейросети?
Нет. Нет скоринга уникальности, экспертности и «AI». Тонкий комментарий с кодом 200 может пройти фильтр и дальше решать Google.
Нужно ли прогонять выборку 404, если фильтр и так включён?
Выборка показывает грязь до оплаты большого календаря и даёт аргумент селлеру. Фильтр на Create закрывает вход в очередь. Это соседние шаги, не дубли кнопки.
Что делать с URL, которые отсекли как уже проиндексированные?
Оставить в отчёте «уже видно». В drip-feed не возвращать. Повторная отправка списывает 100 токенов, если Google продолжает хранить строку.
Меняет ли Standard правила фильтра?
Нет. Standard и drip-feed одинаково не индексируют 404. Меняется только то, выплёскиваете вы остаток за час или растягиваете на 2–30 дней.
Когда считают день 7, если предпроверка урезала список?
Часы Google на drip-feed стартуют после последней дневной порции выживших URL, не в момент, когда фильтр отработал.
Можно ли предпроверкой «отправить в Bing» чистые URL?
Нет. Bing в SpeedyIndex только проверяют. Фильтр готовит Google-задачу.
Хватает ли 200 триальных токенов, чтобы «прощупать» фильтр?
На короткую пробу процесса — да. На десятки тысяч комментариев без отсечения 404 триал сгорает впустую и не обещает включение.
Предыдущая заметка в этой серии: Как отправить чужой URL гостевого поста в SpeedyIndex без подтверждения в Search Console. Сначала её, если пришли по соседнему хвосту.
О SpeedyIndex
SpeedyIndex ставит URL в очередь обхода Google и Яндекса по Pay-per-Result: 100 токенов за проиндексированный адрес. Доступные промахи Google возвращают токены на 7-й день, Яндекс — на 15-й. На drip-feed отсчёт Google начинают после последней дневной порции.
Standard закрывает короткий список. Drip-feed растягивает большую Google-задачу. Опциональная предпроверка отсекает 404, 410, 451, robots/noindex, медиа и уже проиндексированные адреса и по умолчанию выключена.
Краулер представляется как Googlebot Smartphone. Подтверждать сайт в Search Console не нужно. Новый аккаунт получает 200 токенов на пробу. Bing только проверяют. Проверка не равна отправке. Сервис не обещает сто процентов индексации и не продаёт оценку «качества страницы».