Статью удалили из СМИ, а копия жива: как удалить сайт из веб-архива

2026-09-06 02:11:56 Время чтения 13 мин 82

✍️ Антон Таранов — эксперт по удалению информации из интернета. Помогаю людям и бизнесу убирать с сайтов и из поиска то, что вредит репутации: негативные отзывы, утечки персональных данных, статьи и компромат. Команда — Pantera Digital.

Веб-архив (Wayback Machine на archive.org) — это независимая библиотека снимков интернет-страниц: робот сам обходит сайты и складывает копии, а любой посетитель может сохранить понравившуюся страницу вручную. Кнопки «удалить» там нет ни для кого, и на вопрос, как удалить сайт из веб-архива, ответ один: написать в архив письмо с перечнем адресов, датами снимков и основанием, по которому копию нужно закрыть.

Откуда взялась копия, если вы её не сохраняли

Копия появилась без вашего участия и без чьего-либо согласия — так устроен сам сервис. Робот архива обходит сайты по своему расписанию, а рядом работает ручное сохранение: страницу отправляет в архив любой человек, которому она показалась интересной, — конкурент, автор жалобы, бывший сотрудник, просто читатель.

Поэтому ситуация «веб-архив хранит удалённую статью, что делать» — не сбой и не чей-то злой умысел: материал был доступен в момент обхода, и копия живёт отдельно от оригинала. Удаление публикации с сайта источника на архивную копию не влияет никак: страница СМИ отдаёт ошибку, а снимок открывается по своему адресу и находится поиском.

Соберите все снимки страницы по датам

До письма нужен полный список того, что вы просите закрыть, — иначе закроют одну дату из семи. У архива на один адрес обычно приходится несколько снимков: они разложены по календарю, и список всех копий открывается адресом вида web.archive.org/web/*/адрес-страницы.

В перечень идёт не только сама публикация. Проверьте заодно:

  1. адрес статьи с параметрами в конце (метки рассылок, utm-хвосты) — для архива это отдельные адреса;
  2. мобильную версию, если у издания она жила на своём поддомене;
  3. страницу рубрики или ленты, где висел анонс с заголовком и лидом;
  4. страницу автора и теги, если материал был подписан.

Каждый найденный адрес выпишите вместе с датами снимков. Этот список — половина будущего письма, и его никто не сделает за вас: только вы знаете, как публикация выглядела и где на неё вели ссылки. Отдельно зафиксируйте, что видно в поиске: часто в выдачу попадает именно архивная копия, а не оригинал, — и тогда задача формулируется как «убрать копию сайта из интернет-архива», а не «дожать редакцию».

Из чего состоит запрос на исключение

Запрос — это обычное письмо на английском на адрес info@archive.org. Справка сервиса прямо перечисляет, что в нём должно быть: адреса материала, период, который вы просите исключить, период, в течение которого сайт или аккаунт были под вашим контролем, и любые пояснения, которые помогут понять просьбу. Так же удаляют страницу из Wayback Machine поштучно — по конкретным адресам, а не «весь сайт целиком».

Дальше письмо читает человек. Это не форма с автоматическим результатом, и архив в своей же справке пишет буквально: заранее никаких обещаний о результате он не даёт. Отдельным маршрутом идут претензии по авторским правам — их сервис отправляет в свою копирайт-политику.

Русского интерфейса и русской поддержки у archive.org нет: и справка, и переписка англоязычные. Сроков ответа сервис не публикует нигде — по описаниям чужого опыта разброс от нескольких дней до нескольких недель, а подтверждения о приёме письма не приходит вовсе. Тишина в почте первую неделю — обычное дело, а не отказ.

Где на этом застревают: в письме не хватает оснований. Просьба «удалите про нас плохое» без адресов, дат и объяснения, кто вы этому материалу, уходит в общую очередь без внятной перспективы.

Дальше — три ситуации, в которых письмо строится по-разному.

Сценарий 1: домен принадлежит вам

Собственный домен — самый простой случай: заявитель и есть тот, кого архив в правилах называет прямо, — человек или компания, контролировавшие адрес. Речь о корпоративном сайте, старом лендинге, поддомене под акцию, площадке закрытого проекта.

Ваша работа здесь — собрать подтверждение контроля и назвать период. Подойдёт то, что связывает компанию с доменом: данные о регистрации, доступ к почте на этом домене, договор с хостингом, документы на товарный знак, если имя домена совпадает с брендом. Чем точнее назван период владения, тем меньше уточняющих писем.

Домен куплен с рук — старое содержимое чужого проекта в архиве останется, и закрывать его придётся отдельным запросом со своей аргументацией.

Сценарий 2: статья выходила на чужом сайте

Подтверждать владение нечем — и вес запросу даёт не домен, а основание. Работает связка из двух вещей: страница содержит ваши персональные данные или сведения о вас как о компании, и сам источник эти сведения уже убрал. Вторая часть особенно важна: она показывает, что вопрос решён по существу и в архиве остался хвост, а не что вы обходите отказ редакции.

Что стоит приложить: перечень адресов со снимками, короткое объяснение, кем вы приходитесь материалу, и подтверждение того, что оригинал удалён, — ответ редакции, решение, соглашение сторон. Формулировка держится на фактах: что удалено, кем и когда, какие копии остались.

Типичная ошибка — просить архив «удалить негатив». Оценок сервис не рассматривает: у него нет способа проверить, справедлива публикация или нет.

В моей практике был случай: компания закрыла спорную публикацию в отраслевом издании — переговоры, юристы, месяц работы. Через полтора месяца материал вернулся в поиск: по названию бренда открывалась архивная копия с исходным заголовком. Внутри решили, что издание вернуло статью, и собирались писать претензию повторно. На деле оригинал был мёртв, а в выдаче стоял снимок годичной давности. Мы разобрали, какие копии страницы существуют, и запрос строили от того, что сведения уже удалены источником, — с адресами, датами и подтверждением от издания.

Если оригинал за границей и переписка идёт на чужом языке, разбор как убрать публикацию с зарубежного ресурса я собрал отдельно.

Именно здесь обычно и складывается объём: собрать снимки, поднять переписку с изданием, написать по-английски, дождаться ответа, при отказе аргументировать заново. Это делается самостоятельно, но занимает недели живого времени; если проще поручить, мы поможем снять публикацию с сайтов вместе с её копиями.

Сценарий 3: копию сохранил посторонний человек

Ручной снимок закрывается тем же письмом, что и роботный: для архива между ними нет разницы. Меняется только доказываемое — не контроль над сайтом, а отношение материала к вам.

Понять, что копия сделана вручную, чаще всего можно по датам: единственный снимок ровно в дни конфликта к регулярному обходу обычно отношения не имеет. Проверьте и то, не появились ли снимки уже после удаления публикации, — это признак, что её сохраняли намеренно.

Почему robots.txt больше не убирает старые снимки

Запрет в служебном файле сайта задним числом не работает. Раньше механика была другой: владелец добавлял в robots.txt запрет для архивного робота, и сервис прятал в том числе снимки, сделанные годами раньше. В апреле 2017 года Internet Archive публично объявил, что уходит от опоры на этот файл — по его же формулировке, robots.txt писался для поисковых систем и веб-архивам подходит плохо. Поводом стали жалобы на то, что новый владелец домена одним файлом прячет чужую историю сайта.

На практике это значит: файл влияет на будущие обходы, а на уже сделанные копии — нет. Планировать зачистку архива через настройки сайта бессмысленно, остаётся письмо.

Заодно стоит развести два разных результата: закрытая копия исчезает из открытого доступа, а недоступность самого archive.org у части пользователей — это про доступ к сервису, и копия жива. Чем отличаются блокировка, скрытие и настоящее удаление, я разбирал в материале про четыре разных результата работы с информацией.

Что проверять после каждого удаления статьи

Пункт «посмотреть архив» ставится в приёмку работы наравне с проверкой сайта и выдачи. Порядок простой: открыть адрес удалённой страницы в веб-архиве, посмотреть календарь снимков, проверить поиск по названию компании и заголовку материала — не стоит ли в выдаче копия вместо оригинала.

Проверять стоит не в день удаления, а через пару недель: поисковики обновляют свои копии не мгновенно, и картина первого дня ещё ничего не показывает. По практике агентства на обновление кешей уходит около двух недель после исчезновения источника.

Если публикация продолжает всплывать по имени компании, работать придётся не только с архивом: параллельно решается задача выдачи, и о том, что делать, когда ссылка живёт в поиске дольше самой страницы, есть отдельный разбор.

Ещё два вопроса, которые задают чаще всего

Как удалить страницу из веб-архива?

Только письмом: кнопки удаления нет ни в интерфейсе, ни в личном кабинете. В обращении на info@archive.org перечисляются адреса страниц, период снимков, период вашего контроля над сайтом и основание — дальше запрос рассматривает человек. Если речь о нарушении авторских прав, для этого у сервиса отдельный маршрут через копирайт-политику, а не общий запрос на исключение.

Сохраняет ли веб-архив удалённые статьи СМИ?

Да, и удаление с сайта издания на копию не влияет: снимок сделан в тот момент, когда материал был доступен, и живёт по собственному адресу. Отдельно стоит помнить, что «не открывается» и «удалено» — разные вещи: сервис бывает недоступен из-за сбоев или ограничений доступа, но копия при этом никуда не девается.

Удаление статьи без зачистки копий — работа наполовину: деньги за переговоры с изданием потрачены, а материал по-прежнему открывается за два клика. Проверка архива стоит получаса и закрывает этот хвост, а если хвост оказался длинным — со сложными случаями, где источник за границей и переписка тянется месяцами, мы помогаем вытеснить негативную публикацию из поиска вместе с её копиями.