Как удалить сохраненную копию страницы в яндексе
Перейти к содержимому

Как удалить сохраненную копию страницы в яндексе

  • автор:

Как убрать страницу из кэша yandex'а

Yandex проиндексировал страницу с данными которые никто видеть не должен. инфу со страницы удалили, но она осталась в копии поисковика и в снипите отображается как раз информация которую видеть никто не должен.

Вопрос: Как можно «повлиять» на Yandex, что бы он обновил копию этой страницы как можно скорее или выкинул ее из индекса вообще?

Вероятно, спрятать страницу можно так же как и загнать ее в индекс. Ссылками. Логично, что если робот пройдет по ссылку на страницу, а там уже не тот контент (или страница уже отсутствует), то он изменит и содержимое в базе. По логике чем больше количество таких ссылок с наиболее авторитетных ресурсов, тем быстрее данные должны исчезнуть с кеша. (ИМХО. Предположение, не имеющее практических оснований. )… но это противоречит понятию секретности, т.к. таким образом вы сами покажите информацию «которую никто не должен видеть» не только Яндексу, но и куче случайных зевак.

Возможно, еще написать в суппорт Яндекса, но они вероятнее всего скажут “закройте нужный Вам контент от индексации и в момент следующей проверки и обновления базы он исчезнет с кеша”

Или, самый оптимальный для Вас способ, удалить страницу через правило robot.txt, но тут скорость выкидывания будет зависеть от того, насколько часто робот посещает Ваш сайт. Если сайт большой и робот его любит, страница исчезнет быстро.

Вообще на эту тему можно говорить много, но точно сказать что сработает быстрее – сложно.

Работа с сохраненной копией страницы

Чтобы пользователь нашел документ в поисковой выдаче, недостаточно добавления его на сервер. Контент должен быть проиндексирован (добавлен поисковыми роботами в индекс) поисковыми системами Яндекс и Google. Поэтому, наличие сохраненной копии — показатель что поисковый бот был на странице. Рассмотрим, что можно посмотреть и какие ошибки обнаружить с помощью сохраненной копии веб-страницы.

Роботы Яндекса и Google добавляют копии найденных веб-страниц в специальное место в облаке — кеш. При этом новая копия страницы перезаписывает старую. Поэтому в кеше отображаются свежие версии веб-страниц.

Сохраненная копия — это версия веб-страницы, которая сохранена в кэше поисковой системы. Условно это бесплатная резервная копия от поисковых систем.

На самом деле веб-страницы сохраняют:

  1. Поисковые системы. В них находится находится последняя проиндексированная версия страницы. Такие «снимки» используют SEO-специалисты, чтобы увидеть какие данные обнаружил на странице поисковый бот;
  2. Специализированные сервисы. Занимаются сохранением содержимого веб-страницы. Основная задача таких сервисов сохранить страницы в конкретный момент времени. С помощью них вы можете узнать как выглядел сайт или страница несколько лет назад.

Зачем нужна сохраненная копия страницы и как её посмотреть

На сайтах регулярно происходит добавление нового и редактирование существующего контента. Периодически изменяется его дизайн, добавляются и/или удаляются графические элементы. Это трудоемкая работа в процессе, которой могут возникнуть ошибки: потеряться контент, «съехать дизайн», удалиться блок или перестать индексироваться часть материала. Выявить, как выглядела страницы до определенного момента, поможет сохраненная копия.

Пример из практики:
Есть у нас технически сложный проект, который при заполнении объема памяти перестает, корректно работать. Если по простому, то вместо работающего сайта, мы видим ошибку базы данных.

Время от времени сайт отваливается по ночам, а утром разработчики все исправляют. И тут важный момент, сохраненные копии, позволяют понять успели ли поисковые системы проиндексировать сломанный сайт или нет. А также позволяют выявить, какие именно страницы успел переобойти бот.

Как посмотреть сохраненную копию в Google

Рассмотрим на примере страницы https://discript.ru/prodvizhenie-sajtov/kolomna/. Перед url адресом пропишите оператор «site:». В сниппете (блок информации о странице веб-сайта) результата, нажмите на иконку в виде треугольника, выберите соответствующий пункт.

Сохраненная копия в Google

Откроется сохраненная копия веб-страницы. Google выведет окно с сообщением, что открылся «снимок» страницы.

Разберем представленную информацию:

  1. Дату фиксации. В данном параметре указано, когда был сделан слепок страницы. Поэтому сопоставив указанную дату с датой внесения правок, можно предположить успел ли поисковый бот обойти страницу или еще нет (Важно! данный метод не гарантирует 100% верную информацию, т.к. данные хранятся в кеше и могут отличаться в зависимости от вашего место нахождения) ;
  2. Полная версия. Отображается версия страница, как должен был ее увидеть пользователь.
  3. Текстовая версия. Позволяет просмотреть контент веб-страницы без применения стилей. Такой формат позволяет увидеть скрытые от пользователя элементы, но доступные для поисковых роботов Яндекса и Google;
  4. Исходный код. Выводит исходный код HTML-страницы. Это требуется для изучения тега Title и мета тегов, таких как Description. Данное представление позволяет изучить, как сверстана веб-страница, и нет ли на ней критических ошибок.

Просмотр версии страницы из кеша Google

Как посмотреть сохраненную копию веб-страницы в Яндекс

Рассмотрим на примере страницы https://discript.ru/site-development/. В строку поиска обязательно пропишите оператор «url:» перед url-адресом. нажмите на значок в виде трех горизонтальных точек, выберите «Сохраненная копия».

Пример поиска сохраненной страницы в Яндексе

Далее Яндекс предоставит следующие данные:

  1. Дата индексации. Данное значение информирует в какой момент выполнен слепок страницы.
  2. Полная версия страницы. Отображение страницы со всеми стилями.
  3. Текстовая версия страницы. Текстовая версия, аналогично позволяет изучить страницу без стилей и получить всю скрытую информацию. Часто именно при проверке текстовой копии обнаруживаются сквозные блоки текста на страницах. Т.к. при использовании стилей они скрыты.

Предоставление данных о копии страницы в Яндексе

Почему сохраненной страницы может не быть

Это происходит в результате:

  1. Сбой работы поисковых систем. Разработчики Яндекса даже говорят, что нет стопроцентной гарантии, что страница сохранится. Конкретная причина не указывается.
  2. HTML-код содержит мета тег мета-тег «robots» со значением «noarchive», что означает запрет на кэширование (локальное сохранение данных для получения быстрого доступа к странице при следующих запросах).

Что предпринять если в ПС нет сохраненной копии, а посмотреть содержимое нужно? Попробуйте изучить специализированные площадки и расширения.

Рассмотренными выше способами можно посмотреть:

  1. Мобильную версию веб-сайта. Пропишите url мобильной версии в Яндексе или Google. Из выдачи перейдите на нее далее, как в примере рассмотренном выше.
  2. Адаптивную версию. Перейдя в сохраненную копию (так же как в примере выше). Открываем инструменты разработчика. Клавиша F12 в обозревателе. Или нажать ПКМ на пустом месте страницы, выбрать «Посмотреть код». Переходим в раздел мобильное отображение и перезагружаем веб-страницу.

Специализированные веб-архивы

Выше мы обсуждали, что существуют сервисы, задачи которых сохранять в истории страницы сайтов. Сейчас рассмотрим их подробнее и расскажем, как с ними работать.

И начнем с самого популярного и известно.

Wayback Machine

Сервис Wayback Machine — бесплатным онлайн-архивом, задача которого является сохранить и архивировать информацию размещенную в открытых интернет‑ресурсах. Wayback Machine является частью некоммерческого проекта Интернет Архива. На его серверах хранятся копии веб-сайтов, книг, аудио, фото, видео.

Чтобы открыть копию страницы перейдите на https://archive.org/, далее откроется поисковая форма, куда пропишите URL страницы. Нажмите кнопку «GO».

Онлайн-архив Wayback Machine

Сервис отобразит имеющиеся в архиве снимки.

Далее выберите в календаре нужную дату и откройте страницы. Результатом вывода будет открытие страницы, которую зафиксировали роботы за выбранную дату.

Календарь Wayback Machine

Кроме просмотра снимков страниц, сервис поможет:

  1. Проанализировать robots.txt. Сервис будет сканировать веб-сайты вне зависимости от настроек robots.txt;
  2. Узнать данные о домене. Актуально перед покупкой. Уточните какая информация размещалась на нем. Если вы купите «заспамленный» или домен под «санкциями» (например была размещена информация для взрослых) новый контент будет плохо ранжироваться. Если же ранее на нем размещалась информация, которая подходит по тематике и качеству для вашего будущего ресурса, тогда вы сможете использовать ее на этом же домене.
  3. Найти в архивных копиях пропавшую информацию.
  4. Если, например, на веб-сайте наблюдается спад трафика, откройте сохраненную версия сайта до момента уменьшения посещаемости. Проанализируйте, какие были сделаны изменения, чтобы разобраться в причине падения посещаемости.

Archive.Today

Archive.Today — бесплатный некоммерческий севрис сохраняющий веб-страницы в оналйн режиме. Особенность — сохраняет не только статические страницы, но и генерируемые Веб 2.0-проектами страницы. Например, карты Google.

Основное отличие от Wayback Machine, что Archive.Today сохраняет веб-страницы только по запросу пользователей. При этом сервер полностью сохраняет:

  • HTML-страницы,
  • CSS файлы,
  • JS файлы,
  • PDF,
  • аудио файлы,
  • пр.

Важно, помнить, что Archive.Today игнорирует файл robots.txt поэтому в нем можно сохранить страницы недоступные для Wayback Machine.

Обратите внимание, общий в Размер заархивированной страницы со всеми изображениями не должен превышать 50 МБ.

У Archive.Today есть собственное приложение для браузера Mozilla Firefox. Ссылка на ПО https://addons.mozilla.org/en-US/firefox/addon/archive-page/

Для начала работы с Archive.Today перейдите по адресу: https://archive.md/. Чтобы получить результат укажите в форму интересующий URL-адрес.

Сервис Archive.Today

Откроется страница с сохраненными снимками и информацией о дате создания копии.

Страница с сохраненными снимками в сервисе Archive.Today

Вы можете скачать сохраненную копию виде архива. И восстановить версию страницы у себе на сервере.

Сохранение страницы в сервисе Archive.Today

Расширения для браузеров

Существуют, плагины для браузеров, позволяющие создавать и просматривать сохраненные версии страниц.

Например, расширение Web Cache Viewer позволяет:

  1. Загружать веб-страницу из локального кэша на компьютере;
  2. Автоматически находить страницу при помощи сервиса Wayback Machine.

Перейдя по ссылке, рассмотренной, выше, нажмите кнопку «Установить».

Сервис Web Cache Viewer

После инсталляции расширения в браузере, нажмите правой кнопкой мыши пустом месте страницы для просмотра версии из Google или Wayback Machine.

Просмотр версии из Google или Wayback Machine

Для пользователей Firefox существует аналогичное дополнение со схожим функционалом Web Archives.

Cached Page

Веб-сайт Cached Page ищет копии веб-страниц в поиске Google, Интернет Архиве, WebSite. Используйте площадку, если описанные выше способы не помогли найти сохраненную копию веб-сайта.

Пропишите название сайта в специальную форму. Для поиска нажмите одну из трех кнопок. Сервис предложит произвести поиск веб-страницы в:

  1. Веб-кэш Google;
  2. Интернет Архив;

Поиск в сервисе Cached Page

Например, прописав в форму адрес https://discript.ru/prodvizhenie-sajtov/lyubercy/, и нажав кнопку «Архив Интернета», произойдет переход на страницу сервиса Wayback Machine. Если страница сохранена в БД сервиса, она отобразится на странице.

 Отображение страницы в сервисе Wayback Machine

Выводы

Работая с сохраненными копиями страниц, можно выявить достаточного много полезных нюансов.

Сохраненные копии позволяют:

  • Узнать, поисковый бот успел ли обойти вашу страницу после внесенных правок.
  • Как бот воспринимает информацию со страницы. Все ли учитывает или остались места, которые ПС не видят.
  • Выявить, какие элементы пропали и когда.
  • Выявить, какие страницы успел обойти поисковый бот, после того, как сайт перестал быть доступным.
  • Создать копии страниц.
  • Восстановить копию сайта, когда забыли оплатить домен.

Сохраненная копия веб-страницы поможет определить, какая версия документа проиндексирована поисковыми роботами и участвует в ранжировании. Поэтому наличие «снимка» страницы в Яндексе и Google говорит об успешной проведенной индексации.

Два способа удалить закладку из Яндекс Браузера

Как упоминалось в одной из статей на нашем сайте, пользователи Яндекс Браузера, могут добавить понравившуюся страницу в закладки, чтобы иметь возможность открыть её в два клика в дальнейшем. Но что делать, если закладок накопилось неприлично много или часть из них – устарела? Правильно – необходимо удалить закладки, которые посчитаете лишними.

  • Удаление через «Диспетчер закладок»
  • Удаление через профиль браузера
  • Убираем «Визуальные закладки»

Способов удаления, в Яндекс Браузере, несколько, и каждый мы рассмотрим в подробностях.

Удаление через «Диспетчер закладок»

Для удобного управления, в Яндекс Браузере создан «Диспетчер закладок», отображающий в удобном виде все сохраненные страницы. Если необходимо удалить небольшое количество, нам туда.

Если вы удалите закладку – восстановить её не получится. Рекомендую, создать резервную копию, перед проведением каких-либо действий.

1. Запустите обозреватель, перейдите в меню и откройте диспетчер или нажмите комбинацию горячих клавиш «Ctrl + Shift + O».

2. Вы попали в список сохраненных страниц. Выберите запись, которую хотите удалить и нажмите на ней правой кнопкой мыши. В выпадающем меню выберите «Удалить».

Осталось повторить процедуру с другими записями, которые необходимо стереть.

Если при просмотре страницы, вы случайно сохранили её, не надо копаться в настройках. Все сохраненные страницы, в окне браузера помечаются золотистой звездой, нажмите на неё и во всплывающем окне нажмите «Удалить».

Удаление через профиль браузера

Все данные, которые сохраняются непосредственно в Яндекс Браузере (логины, пароли и т.д.), хранятся в отдельных файлах в профиле пользователя. Закладки, не исключение, файл с ними называется «Bookmarks», и если хотите удалить их за один раз – удалите этот файл, а лучше перенесите в надежное место, чтобы была возможность восстановления.

Если в обозревателе настроена автоматическая синхронизация, все данные, которые вы сотрете исчезнут и с серверов Яндекса.

1. В проводнике Windows найдите папку с названием «AppData» (путь к ней подробно описан в статье – https://hyperione.com/posmotret-zakladki-v-yandeks-brauzere/). Далее, перейдите по пути «Local – Yandex – YandexBrowser — User Data – Default».

2. Отыщите файл с названием «Bookmarks» и по желанию, перенесите или удалите его. Пустой документ, с таким же названием появится при следующем запуске Яндекс Браузера.

Есть и более простой способ – через настройки обозревателя, но при этом сотрутся логины, пароли и другая ранее сохраненная информация.

1. Перейдите в «Настройки» и найдите раздел «Профили».

2. Выберите именно тот профиль пользователя, который вы используете и нажмите на кнопку, отмеченную на скриншоте.

Я описал крайний метод, прибегать к которому можно в случае острой необходимости, предварительно создав резервную копию.

Убираем «Визуальные закладки»

В Яндекс Браузер встроен аналог расширения «Визуальные закладки» под названием «Табло». По умолчанию, в нём отображаются ссылки на самые посещаемые вами сайты или вручную добавленные адреса.

Полностью отключить «Табло» нет возможности, вы можете только убрать ненужные плитки.

1. Откройте новую вкладку и нажмите «Настроить экран».

2. На каждой «плиточке» появились значки замка, настроек и крестик. Выберите ненужную запись и нажмите на ней на серый крестик.

Если вас интересует как удалить закладку именно в расширении «Визуальные закладки», ознакомьтесь с данной статьей – https://hyperione.com/visual-yandex/.

Стоит упомянуть, что при стандартном удалении Яндекс Браузера, файлы профиля остаются на месте и при повторной установке, все закладки будут на месте.

10 инструментов, которые помогут найти удалённую страницу или сайт

10 инструментов, которые помогут найти удалённую страницу или сайт

Если, открыв нужную страницу, вы видите ошибку или сообщение о том, что её больше нет, ещё не всё потеряно. Мы собрали сервисы, которые сохраняют копии общедоступных страниц и даже целых сайтов. Возможно, в одном из них вы найдёте весь пропавший контент.

Поисковые системы

Поисковики автоматически помещают копии найденных веб‑страниц в специальный облачный резервуар — кеш. Система часто обновляет данные: каждая новая копия перезаписывает предыдущую. Поэтому в кеше отображаются хоть и не актуальные, но, как правило, довольно свежие версии страниц.

1. Кеш Google

Чтобы открыть копию страницы в кеше Google, сначала найдите ссылку на эту страницу в поисковике с помощью ключевых слов. Затем кликните на стрелку рядом с результатом поиска и выберите «Сохранённая копия».

Есть и альтернативный способ. Введите в браузерную строку следующий URL: http://webcache.googleusercontent.com/search?q=cache:lifehacker.ru . Замените lifehacker.ru на адрес нужной страницы и нажмите Enter.

2. Кеш «Яндекса»

Введите в поисковую строку адрес страницы или соответствующие ей ключевые слова. После этого кликните по стрелке рядом с результатом поиска и выберите «Сохранённая копия».

3. Кеш Bing

В поисковике Microsoft тоже можно просматривать резервные копии. Наберите в строке поиска адрес нужной страницы или соответствующие ей ключевые слова. Нажмите на стрелку рядом с результатом поиска и выберите «Кешировано».

4. Кеш Yahoo

Если вышеупомянутые поисковики вам не помогут, проверьте кеш Yahoo. Хоть эта система не очень известна в Рунете, она тоже сохраняет копии русскоязычных страниц. Процесс почти такой же, как в других поисковиках. Введите в строке Yahoo адрес страницы или ключевые слова. Затем кликните по стрелке рядом с найденным ресурсом и выберите Cached.

Специальные архивные сервисы

Указав адрес нужной веб‑страницы в любом из этих сервисов, вы можете увидеть одну или даже несколько её архивных копий, сохранённых в разное время. Таким образом вы можете просмотреть, как менялось содержимое той или иной страницы. В то же время архивные сервисы создают новые копии гораздо реже, чем поисковики, из‑за чего зачастую содержат устаревшие данные.

Чтобы проверить наличие копий в одном из этих архивов, перейдите на его сайт. Введите URL нужной страницы в текстовое поле и нажмите на кнопку поиска.

1. Wayback Machine (Web Archive)

Сервис Wayback Machine, также известный как Web Archive, является частью проекта Internet Archive. Здесь хранятся копии веб‑страниц, книг, изображений, видеофайлов и другого контента, опубликованного на открытых интернет‑ресурсах. Таким образом основатели проекта хотят сберечь культурное наследие цифровой среды.

2. Arhive.Today

Arhive.Today — аналог предыдущего сервиса. Но в его базе явно меньше ресурсов, чем у Wayback Machine. Да и отображаются сохранённые версии не всегда корректно. Зато Arhive.Today может выручить, если вдруг в Wayback Machine не окажется копий необходимой вам страницы.

3. WebCite

Ещё один архивный сервис, но довольно нишевый. В базе WebCite преобладают научные и публицистические статьи. Если вдруг вы процитируете чей‑нибудь текст, а потом обнаружите, что первоисточник исчез, можете поискать его резервные копии на этом ресурсе.

Другие полезные инструменты

Каждый из этих плагинов и сервисов позволяет искать старые копии страниц в нескольких источниках.

1. CachedView

Сервис CachedView ищет копии в базе данных Wayback Machine или кеше Google — на выбор пользователя.

2. CachedPage

Альтернатива CachedView. Выполняет поиск резервных копий по хранилищам Wayback Machine, Google и WebCite.

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *