Со временем внешние ссылки в записях Wordpress неизбежно ломаются, страницы удаляются, домены истекают, видео становятся недоступными. Проверять сотни или тысячи ссылок вручную непрактично. Archivarix Broken Links Recovery автоматизирует этот процесс: плагин сканирует контент, находит битые ссылки и заменяет их рабочими копиями из Wayback Machine.
При поиске архивных копий плагин использует дату публикации записи как временную метку, поэтому заменённые ссылки ведут на наиболее релевантную версию оригинальной страницы.

Умная проверка ссылок
Простой проверки HTTP-статуса часто недостаточно. Ссылка может вернуть статус 200, но при этом показывать паркинг-страницу, «мягкую 404» или совершенно другой сайт. Плагин использует многоуровневую верификацию, чтобы выявлять такие случаи:
HTTP-ошибки - 4xx, 5xx, таймауты, ошибки DNS
Анализ редиректов - обнаруживает перенаправления на другой домен или на главную страницу сайта, что обычно означает, что оригинальная страница больше не существует
Обнаружение припаркованных доменов - распознаёт более 30 сигнатур паркинг-сервисов (Sedo, GoDaddy, Namecheap и других)
Детекция «мягких 404» - страницы, которые возвращают статус 200, но фактически показывают страницу ошибки
Несоответствие Content-Type - когда ссылка, которая должна вести на HTML-страницу, возвращает что-то другое
Поддержка прокси - настройте HTTP-прокси для проверки внешних ссылок, чтобы избежать блокировок от часто проверяемых доменов и соцсетей.

Видео и социальные сети
Обычные HTTP-проверки плохо работают с социальными платформами — они часто блокируют ботов или возвращают некорректные ответы. Плагин использует API самих платформ:
YouTube, Vimeo, TikTok - доступность видео проверяется через oEmbed API
Twitter/X, LinkedIn, Instagram, Facebook, Pinterest - отдельная проверка для каждой платформы
Плагин также извлекает и проверяет встроенные видео из iframe, блоков Gutenberg, шорткодов `[embed]` и обычных oEmbed URL в контенте.
Два режима работы
Во вкладке Settings можно выбрать, как плагин обрабатывает битые ссылки:
Автоматический режим подходит для больших сайтов, где проверять каждую ссылку вручную непрактично. Плагин автоматически заменяет битые ссылки копиями из Wayback Machine. Если архивная копия недоступна, гиперссылка удаляется, а текст анкора остаётся видимым.
Ручной режим даёт полный контроль. Во вкладке Broken Links можно просмотреть каждую битую ссылку и выбрать действие:
- Заменить копией из Wayback Machine
- Заменить произвольным URL
- Удалить ссылку (оставить текст анкора)
- Удалить ссылку вместе с текстом
- Добавить в белый список (пропускать при следующих сканированиях)
Проверка внутренних ссылок
Плагин также проверяет ссылки внутри вашего сайта. Используется гибридный подход: сначала быстрый поиск по базе данных WordPress, чтобы убедиться, что целевая запись/страница существует, затем HTTP-проверка как запасной вариант для URL, которые не удалось увидеть через базу данных. Это выявляет битые ссылки от удалённых страниц, некорректно работающих плагинов или реструктуризации контента.
Фоновая обработка
Всё сканирование и проверка выполняются в фоновом режиме с помощью библиотеки WP Background Processing. Можно закрыть вкладку браузера и вернуться позже, процесс продолжается на сервере. Вкладка Process показывает текущий прогресс, и вы можете поставить сканирование на паузу или остановить в любой момент.
Большие сайты с тысячами ссылок обрабатываются без таймаутов и проблем с памятью.

Что сканирует плагин
Во вкладке Settings можно выбрать, какие источники контента включить:
- Записи и страницы
- Произвольные типы записей, если они есть на вашем Wordpress
Установка
1. В админке WordPress перейдите в Плагины → Добавить новый и найдите «Archivarix Broken Links Recovery»
2. Установите и активируйте плагин
3. Перейдите в Инструменты → Broken Links Recovery
4. Во вкладке Settings выберите источники контента и режим работы
5. Перейдите во вкладку Process и нажмите Start Scan
Плагин бесплатный и с открытым исходным кодом. - https://wordpress.org/plugins/archivarix-broken-links-recovery/
Использование материалов статьи разрешается только при условии размещения ссылки на источник: https://archivarix.com/ru/blog/broken-links-recovery/
У Tube Search появился раздел бесплатных YouTube-инструментов. Это небольшие утилиты, которые решают конкретные повседневные задачи: рассмотреть видео покадрово, вытащить скрытые теги, проверить занят…
Вы нашли на YouTube нужное видео, но не хотите его смотреть целиком ради пары фраз. Или вам нужен текст лекции, чтобы перевести его, процитировать или просто прочитать по диагонали. Субтитры YouTube р…
Откройте любую статью десятилетней давности и пройдитесь по ссылкам в ней. С большой вероятностью часть из них уже никуда не ведёт. Вместо нужной страницы вас встретит ошибка 404, припаркованный домен…
Интернет постоянно осыпается. Страницы уходят в офлайн, аккаунты удаляют, статьи прячут за пейволл, проекты закрывают. Но копии чаще всего где-то остаются: Wayback Machine, archive.today, Common Crawl…
Когда вы находите удалённое видео YouTube через Tube Search, вы обычно получаете метаданные: название, описание, дату загрузки и иногда субтитры. Это уже полезно. Но чтение необработанных субтитров, ч…
Tube Search - это поисковый движок по архивным данным YouTube. Сервис агрегирует информацию из нескольких публичных источников: Wayback Machine (Internet Archive), Common Crawl и различных собранных д…
Со временем внешние ссылки в записях Wordpress неизбежно ломаются, страницы удаляются, домены истекают, видео становятся недоступными. Проверять сотни или тысячи ссылок вручную непрактично. Archivarix…
Триллион сохранённых страниц. Более 99 петабайт данных. Сотни краулов, работающих каждый день одновременно. За этими цифрами стоит вопрос, который задаёт себе каждый, кто профессионально работает с ве…
Покупка истёкшего домена с историей это один из самых эффективных способов запустить новый проект с уже существующим ссылочным профилем, трастом и даже трафиком. Вместо того чтобы продвигать голый дом…
Когда речь заходит о восстановлении сайтов из архивов, почти все думают только о Wayback Machine. Это понятно: archive.org на слуху, у него удобный интерфейс, триллион сохранённых страниц. Но Wayback …