Archivarix Tube Search - Поисковая система по удаленным видео YouTube

Опубликовано: 2026-03-24

В 2019 году мы опубликовали инструкцию о том, как вручную восстановить удаленное видео с YouTube через Wayback Machine. Это была последовательность шагов: скопировать ID видео, подставить его в специальный URL, перейти по ссылке и надеяться, что Archive.org успел сохранить файл. Процесс работал, но требовал знания внутренних механизмов веб-архивов и не масштабировался. Найти все удаленные видео канала таким способом было невозможно.

Сегодня мы запускаем Archivarix Tube Search - полноценную поисковую систему, которая автоматизирует и расширяет этот процесс до масштаба в более чем полтора миллиарда видеозаписей.

Что это такое

Tube Search - это поисковый движок по архивным данным YouTube. Сервис агрегирует информацию из нескольких публичных источников: Wayback Machine (Internet Archive), Common Crawl и различных собранных датасетов метаданных YouTube. Когда видео удаляется с YouTube, его страница перестает существовать. Но если до удаления эту страницу успел проиндексировать один из веб-архивов, метаданные видео сохраняются: название, описание, дата загрузки, количество просмотров, превью-изображения, субтитры.

Tube Search находит эти архивные копии и делает их доступными через единый поисковый интерфейс.

Что можно найти

Поиск по каналу. Введите URL канала, @handle или Channel ID - система покажет все известные видео этого канала, включая удаленные. Поддерживаются устаревшие форматы URL: /user/, /c/, /channel/, /profile?user=. Это работает даже для полностью заблокированных каналов.

Поиск по видео. Укажите URL конкретного видео или его 11-символьный ID. Система проверит все доступные архивы и соберет максимум сохранившейся информации.

Полнотекстовый поиск. Ищите по ключевым словам в названиях и описаниях видео. Полезно, когда вы помните содержание видео, но не помните канал или точное название.

Субтитры. Доступ к архивным субтитрам на более чем 240 языках. Можно скачать субтитры поштучно в формате SRT или пакетно в ZIP-архиве. Для видео, которые ещё доступны на YouTube, поддерживается получение актуальных субтитров.

Видеофайлы. Wayback Machine иногда сохраняет сами видеофайлы. Tube Search автоматически проверяет наличие архивных копий и показывает ссылку для просмотра или скачивания.

Как работает поиск

Поисковый конвейер Tube Search состоит из 15 этапов. При поиске по каналу система параллельно опрашивает CDX API Wayback Machine, индекс Common Crawl и локальную базу метаданных. Результаты стримятся в реальном времени через Server-Sent Events - вы видите найденные видео по мере их обнаружения, не дожидаясь завершения полного сканирования.

На каждом этапе происходит обогащение данных: проверка статуса видео на YouTube (живое или удаленное), поиск превью-изображений, проверка наличия видеофайлов в архиве, извлечение субтитров. Весь процесс занимает от нескольких секунд до 10 минут в зависимости от размера канала.

Для кого это

Сервис будет полезен исследователям, журналистам и всем, кто работает с историческим контентом YouTube. Типичные сценарии:

  • Исследование цензуры. Найти, какие видео были удалены с определенного канала и когда.
  • Восстановление информации. Получить название и описание видео, которое больше недоступно.
  • Работа с субтитрами. Скачать архивные субтитры удаленных видео для анализа или перевода.
  • Проверка фактов. Найти метаданные видео, на которое ссылается публикация, но которое уже удалено.

Тарифы

Tube Search можно использовать бесплатно без регистрации. Бесплатная регистрация увеличивает лимиты и открывает дополнительные возможности: скачивание субтитров и историю поисков.

Тарифы Plus и MCP+API с расширенными лимитами - экспорт в CSV, пакетная загрузка субтитров, REST API и MCP-сервер для AI-ассистентов. Цента тарифа Плюс 9$ в месяц, MCP+API 19$ в месяц.

Интерфейс и языки

Интерфейс доступен на шести языках: английский, русский, испанский, немецкий, французский и португальский. Для каждого языка подготовлены руководства с пошаговыми инструкциями и скриншотами.

Попробуйте: tube.archivarix.net

Использование материалов статьи разрешается только при условии размещения ссылки на источник: https://archivarix.com/ru/blog/tube-search/

Бесплатные YouTube-инструменты на Tube Search: покадровый просмотр, теги, проверка имени канала и авторских прав

У Tube Search появился раздел бесплатных YouTube-инструментов. Это небольшие утилиты, которые решают конкретные повседневные задачи: рассмотреть видео покадрово, вытащить скрытые теги, проверить занят…

3 недели назад
Как скачать субтитры с YouTube, даже с удалённых видео

Вы нашли на YouTube нужное видео, но не хотите его смотреть целиком ради пары фраз. Или вам нужен текст лекции, чтобы перевести его, процитировать или просто прочитать по диагонали. Субтитры YouTube р…

1 месяц назад
Сколько живёт веб-страница: что говорят исследования о link rot

Откройте любую статью десятилетней давности и пройдитесь по ссылкам в ней. С большой вероятностью часть из них уже никуда не ведёт. Вместо нужной страницы вас встретит ошибка 404, припаркованный домен…

1 месяц назад
Archivarix Echo: проверьте 200+ веб-архивов одним запросом

Интернет постоянно осыпается. Страницы уходят в офлайн, аккаунты удаляют, статьи прячут за пейволл, проекты закрывают. Но копии чаще всего где-то остаются: Wayback Machine, archive.today, Common Crawl…

1 месяц назад
AI-саммари видео в Archivarix Tube Search

Когда вы находите удалённое видео YouTube через Tube Search, вы обычно получаете метаданные: название, описание, дату загрузки и иногда субтитры. Это уже полезно. Но чтение необработанных субтитров, ч…

4 месяца назад
Archivarix Tube Search - Поисковая система по удаленным видео YouTube

Tube Search - это поисковый движок по архивным данным YouTube. Сервис агрегирует информацию из нескольких публичных источников: Wayback Machine (Internet Archive), Common Crawl и различных собранных д…

4 месяца назад
Archivarix Broken Links Recovery: бесплатный плагин WordPress для поиска и восстановления битых ссылок

Со временем внешние ссылки в записях Wordpress неизбежно ломаются, страницы удаляются, домены истекают, видео становятся недоступными. Проверять сотни или тысячи ссылок вручную непрактично. Archivarix…

5 месяцев назад
Как Internet Archive решает, что архивировать: приоритеты, частота, источники данных

Триллион сохранённых страниц. Более 99 петабайт данных. Сотни краулов, работающих каждый день одновременно. За этими цифрами стоит вопрос, который задаёт себе каждый, кто профессионально работает с ве…

5 месяцев назад
Как найти и купить истёкший домен с хорошей историей

Покупка истёкшего домена с историей это один из самых эффективных способов запустить новый проект с уже существующим ссылочным профилем, трастом и даже трафиком. Вместо того чтобы продвигать голый дом…

5 месяцев назад
Common Crawl как альтернативный источник данных для восстановления сайтов

Когда речь заходит о восстановлении сайтов из архивов, почти все думают только о Wayback Machine. Это понятно: archive.org на слуху, у него удобный интерфейс, триллион сохранённых страниц. Но Wayback …

5 месяцев назад