Особый режим «Веб-архива»

Вчера я, занимаясь «Виолой», случайно узнал Полишинеля. Подозреваю, что многие знают, а для меня это новость.

Из-за своих исследований я в последнее время нехарактерно много пользуюсь «Веб-архивом». Временами мне очень мешает баннер, который «Веб-архив» вешает на каждую страницу. Из-за этого банера не работали несколько примеров с давно закрывшегося сайта «Виолы», так как «Веб-архив» добавлял свой баннер и на скриптовые страницы тоже.

Видимо из-за того, что «Виола» использует другой скриптовый язык, «Веб-архив» не распознаёт эти страницы, как содержащие скрипты и случайно портит их код.

Я пытался с этим бороться, вырезая ненужную мне вставку, но это не всегда нормально работает. Вчера я догадался погуглить есть ли какой-нибудь способ сказать «Веб-архиву», чтобы он не добавлял баннер на страницу. Оказывается существует простой способ!

В ссылку после даты надо всего лишь добавить слово id_!

Например, эта страница откроется с баннером:
https://web.archive.org/web/19971210184100/http://info.cern.ch/

А эта — без:
https://web.archive.org/web/19971210184100id_/http://info.cern.ch/

Скриншот веб-страницы с заголовком «Simple stylesheets test» и текстом о влиянии трёх стилевых таблиц на оформление документа, включая выравнивание заголовков и стилизацию секций.
1

Читайте также

Друзей не выбирают?
https://web.archive.org/web/20040814015637/http://bolk.exler.ru:80/lj/lj-020911.gif Друзей не выбирают, говорите?
2002
ЖЖ от 2006-12-14 19:11:00
Господи, какой позор: https://web.archive.org/web/20070118033423/http://www.sellersrank.com:80/web-frameworks-benchmarking-results/ Например, у нас сайт, построенный на нашем framework, без баннерки обработал за 60 секунд 5100 запросов, с баннеркой — 1408 (4 баннера на странице).
2006
ЖЖ от 2005-12-10 10:03:00
Придумал несколько удачных доменов, расхватывайте: татарстану дарю: http://tat.ar и https://web.archive.org/web/20051215132306/http://www.tatar.in:80/, албаноязычным жителям ЖЖ — https://web.archive.org/web/20070502103610/http://kg.am:80/
2005

Комментарии 11

Oleg № 1
Еще недавно обнаружил, что Wayback Machine сохраняет не только тело HTTP, но и заголовки. Они с префиксом x-archive-orig-.
curl -I -s https://web.archive.org/web/19971210184100 … o.cern.ch/ | grep x-archive-orig
Oleg № 5
У Яндекса, совсем скромненько. Словно чья-то домашняя страничка на Russian Apache. 😀
x-archive-orig-date: Sun, 06 Dec 1998 20:08:26 GMT
x-archive-orig-server: Apache/1.3.3 (Unix) mod_perl/1.16 rus/PL27.3
Евгений Степанищев автор № 8
$ curl -Is https://web.archive.org/web/20040410234318 … //adme.ru/ | fgrep orig-server
x-archive-orig-server: 0W/0.7h

хех, я помню этот сервер 🙂 у него в комплекте официально был шелл-скрипт, который его перезапускал в вечном цикле, так как он (сервер) постоянно падал!
Постоянный читатель № 11
Спасибо! Для меня это полезный хак. Веб-архивом пользуюсь регулярно, в том числе оттуда читаю книжки.
Обычно боролся с ненужным через расширение Stylus, где можно применять свои стили к элементам (это на часто используемых сайтах) или через испектор кода страницы (F12), в стилях элементу добавлял «display:none».
На разных сайтах часто ещё приходится сужать контент страницы для комфртного чтения. Например для тега делаю margin:0 20% и font-size: 1.2em, чтобы глаза не напрягать.