Просмотр каталога архивов
Все известные нам источники — фильтруйте по категории, кластеру, API или доступу, затем откройте любой архив для подробностей.
- Wayback Machine (Internet Archive) Флагманский архив веб-страниц Internet Archive и крупнейший в своём роде: более триллиона снимков URL в том виде, в каком они существовали в разное время. Введите любой веб-адрес, чтобы просмотреть историю его снимков в веб-интерфейсе; бесплатные API также позволяют проверить, заархивирована ли страница, и получить список всех снимков. Это стандартная первая остановка, когда нужна старая или удалённая версия почти любой веб-страницы. В 2026 году у сервиса случались периодические сбои, а интенсивные обращения ограничиваются, однако уже сделанные снимки остаются доступными для чтения. Веб-страницы и сайты API
- archive.today (.ph / .is / .md / .li / .vn / .fo) Архиватор по запросу, куда любой может отправить URL и получить постоянный снимок; он превращает динамические страницы в статические копии и часто обходит пейволлы, накопив десятки миллионов снимков. Существующие снимки находятся через Memento timemap и открываются прямыми ссылками на archive.ph и его зеркальных доменах; сохранение новой страницы выполняется на сайте и может потребовать прохождения CAPTCHA. Обращайтесь к нему, когда страница изменилась или исчезла слишком недавно для других архивов, либо когда нужна читаемая копия статьи из-за пейволла. Веб-страницы и сайты API капча
- Common Crawl (CDX index) Некоммерческий проект, который обходит открытый веб в петабайтных масштабах и публикует всё собранное: около 2,2 миллиарда страниц на обход, причём новые обходы выходят регулярно. У каждого обхода есть бесплатный индексный API без ключа, который сообщает, был ли URL сохранён и когда, после чего сохранённое содержимое страницы можно выгрузить из публичного набора данных. Это серия снимков обхода, а не архивация по запросу, поэтому сервис подходит для проверки того, как выглядел сайт в последних окнах обхода, или для массовых веб-исследований. Веб-страницы и сайты API
- Arquivo.pt (Portuguese Web Archive) Национальный веб-архив Португалии, сохраняющий миллиарды файлов с 1996 года, включая множество непортугальских сайтов. В отличие от большинства веб-архивов он предлагает полнотекстовый поиск по сохранённым страницам наряду с поиском по URL — и через сайт, и через бесплатные API. Обращайтесь к нему, когда нужно искать внутри текста заархивированных страниц, а не только получить известный адрес, либо когда вы исследуете историю португальского и европейского веба. Веб-страницы и сайты API
- Library of Congress Web Archives Программа курируемой веб-архивации Библиотеки Конгресса: более сотни тематических коллекций сайтов, отобранных её библиотекарями, петабайтного масштаба. Коллекции просматриваются на loc.gov, а страницы коллекций и объектов можно также получить в формате JSON. Архив хорош, когда ваша тема совпадает с одной из курируемых рубрик — выборы, события, организации, — а не для поиска произвольных URL. Веб-страницы и сайты API
- Perma.cc Сервис постоянного архивирования от Library Innovation Lab Гарвардского университета, созданный для того, чтобы ссылки в юридических и научных текстах не переставали работать; в нём хранятся миллионы постоянных ссылок. Каждая заархивированная страница получает короткий код perma.cc, воспроизводящий снимок, а бесплатный публичный API позволяет находить существующие записи. Наиболее полезен, когда вы переходите по ссылке Perma из судебного документа или научной статьи либо проверяете, была ли страница сохранена как источник цитирования. Веб-страницы и сайты API
- Archive-It (Internet Archive) Подписной сервис архивации от Internet Archive, которым пользуются более тысячи библиотек, государственных органов и университетов для создания курируемых веб-коллекций, вместе содержащих десятки миллиардов документов. Снимки открываются по ссылкам воспроизведения на wayback.archive-it.org и организованы по коллекциям. Он оправдывает себя, когда коллекция конкретного учреждения покрывает вашу тему; охват формируется коллекция за коллекцией, поэтому искать здесь произвольные URL не стоит. Веб-страницы и сайты
- UK Government Web Archive (The National Archives) Публичный архив сайтов центрального правительства Великобритании, который ведут Национальные архивы: миллиарды записей примерно с 2003 года. Заархивированные страницы открываются по ссылкам воспроизведения в средстве просмотра в стиле Wayback на webarchive.nationalarchives.gov.uk. Здесь стоит искать старые версии gov.uk и сайтов министерств, особенно пока основной UK Web Archive недоступен. Сервер отклонил наши автоматические проверки, поэтому поведение может быть непоследовательным; пользуйтесь сайтом напрямую. Веб-страницы и сайты
- Vefsafn.is (Icelandic Web Archive) Национальный веб-архив Исландии, который ведёт Национальная и университетская библиотека: с 2004 года он собирает весь домен .is примерно три раза в год и хранит связанные с Исландией сайты начиная с 1996 года. Списки снимков берутся из его Memento timemap, а отдельные снимки открываются по ссылкам воспроизведения на vefsafn.is, где средство просмотра может попросить пройти CAPTCHA. Естественный источник по истории исландских сайтов. Веб-страницы и сайты API капча
- Trove / Australian Web Archive (NLA) Веб-архив Национальной библиотеки Австралии. PANDORA, Australian Government Web Archive и обходы домена .au вместе содержат миллиарды файлов, а поиск по ним ведётся через портал Trove. Снимки открываются по ссылкам воспроизведения на webarchive.nla.gov.au; API Trove не охватывает заархивированные сайты, поэтому поиск выполняется на самом сайте. Основной источник по истории австралийских сайтов. Веб-страницы и сайты
- DNB Webarchiv (German National Library) Выборочный веб-архив Немецкой национальной библиотеки, собирающий тематические снимки немецких сайтов с 2012 года. Поискового API нет: тематические коллекции просматриваются через портал и свободно доступны по всему миру, тогда как более глубокий доступ к содержимому ограничен читальными залами библиотеки. Стоит заглянуть, когда вы изучаете немецкие сайты или темы, попадающие в его коллекции.
- Ghostarchive Небольшой независимый архиватор по запросу, примечательный тем, что работает с видео с YouTube и записями из Twitter наряду с обычными веб-страницами. Снимки открываются по прямым ссылкам на отдельные архивные страницы; поискового API нет. Загляните сюда, когда ищете сохранённые копии контента из социальных сетей, который основные веб-архивы обычно сохраняют плохо. Веб-страницы и сайты
- Conifer (Rhizome, ex-Webrecorder.io) Размещённый сервис записи от Rhizome (ранее Webrecorder.io) для высокоточных интерактивных записей веб-страниц, собранных в тысячи созданных пользователями коллекций. Коллекции просматриваются, а отдельные записи открываются на сайте; публичного поискового API нет. Учтите, что сервис сворачивается: запись и редактирование прекращаются в мае 2026 года, а с июня 2026 года он переходит в режим только для чтения, хотя существующие коллекции остаются доступными для просмотра.
- Webrecorder / Browsertrix Создатель Browsertrix и инструментария-преемника Conifer: программное обеспечение для обхода, размещаемое самостоятельно или предоставляемое как услуга, которое формирует файлы веб-архивов WACZ/WARC. Централизованного публичного корпуса для поиска нет — каждое развёртывание хранит собственные снимки. Актуально, когда вы хотите сами создавать высокоточные архивы сайтов, а не искать уже существующие.
- Stanford Web Archive Portal (SWAP) Портал доступа библиотек Стэнфорда к их курируемым коллекциям веб-архивов, которые хранятся в сервисе Archive-It. Поискового API на портале нет; коллекции просматриваются, а снимки открываются на сайте. Полезен главным образом тогда, когда стэнфордские курируемые коллекции покрывают вашу тему; те же материалы доступны и через Archive-It.
- EU Web Archive (Publications Office) Архив сайтов институтов, агентств и органов ЕС, который Управление публикаций ЕС ведёт с 2018 года. Работа идёт через портал, документированного поискового API нет. Здесь стоит искать более ранние версии europa.eu и других институциональных сайтов; учтите, что из некоторых сетей доступ заблокирован, поэтому сайт открывается не при любом подключении. блокировка по IP
- KB Netherlands Web Archive Веб-архив Королевской библиотеки Нидерландов («Websites van Nederland»), хранящий около 25 000 курируемых нидерландских сайтов, несколько тысяч из которых уже исчезли из живого веба. Публичного поискового API нет, а более глубокий доступ к заархивированному содержимому в основном ограничен читальными залами библиотеки. Лучше всего использовать его как указание на то, что исчезнувший нидерландский сайт может быть сохранён, а полноценную работу с материалом вести уже на месте. блокировка по IP
- US NARA Web Harvests (webharvest.gov) Собрание периодических веб-сборов сайтов Конгресса и президентских администраций, которое ведёт Национальное управление архивов США. На webharvest.gov доступен только просмотр, поискового API нет. Обращайтесь к нему, когда нужно увидеть, как выглядели официальные сайты правительства США на момент завершения созыва Конгресса или президентской администрации.
- Kiwix / Zimit Скорее экосистема офлайн-архивов, чем сервис поиска: Kiwix упаковывает целые сайты — Wikipedia, StackExchange и тысячи других — в загружаемые файлы ZIM, а Zimit позволяет преобразовать в тот же формат другие сайты. Вы просматриваете библиотеку пакетов и скачиваете полные копии сайтов для чтения офлайн; поиска снимков по отдельным URL нет. Полезен, когда нужна полноценная рабочая копия сайта, а не датированный снимок одной страницы.
- PADICAT (Catalonia) Национальный веб-архив Каталонии, сочетающий курируемые подборки с обходами домена .cat. Вся работа ведётся через собственный веб-портал — подтверждённого API нет, — поэтому поиск и просмотр снимков выполняются на padicat.cat. Основной источник по истории каталонских сайтов, хотя сайт может отвечать медленно.
- Croatian Web Archive (HAW) Хорватский национальный веб-архив, который ведёт Национальная и университетская библиотека в Загребе; сохраняет сайты в зоне .hr посредством курируемого отбора и ежегодных обходов домена. Доступ — через просмотр сайта HAW; API не документирован. Архив охватывает историю хорватского веба, однако при наших недавних проверках сайт был недоступен, поэтому его работоспособность сейчас под вопросом.
- Bibliotheca Alexandrina Web Archive Веб-архивное подразделение Александрийской библиотеки в Египте, которое исторически размещало зеркало коллекции Internet Archive за период до 2007 года наряду с региональными материалами. Доступ — через просмотр сайта; API нет. Нынешний состав фондов неясен: страница загружается, однако свежих подтверждений того, что зеркало ещё работает, нет, поэтому перед тем как полагаться на него, проверьте содержимое.
- Yandex (cache / SERP) Российская поисковая система, включённая в каталог потому, что это последний крупный поисковик, который ещё показывает сохранённые копии веб-страниц. Стабильного API нет: вы выполняете обычный поиск на yandex.com и ищете ссылку «сохранённая копия» рядом с результатом. Стоит попробовать, когда страница исчезла слишком недавно, чтобы веб-архивы успели её сохранить. Будьте готовы к антибот-проверкам: сайт часто требует их пройти, прежде чем показать результаты. Полнотекстовый поиск по вебу капча
- Crossref REST API Авторитетный реестр метаданных DOI в научном издательском деле, охватывающий примерно 165 миллионов записей. Найдите любой DOI, чтобы получить его библиографическую запись, или выполните поиск по заглавию и автору — на сайте либо через бесплатный открытый API. Это опорный справочник для проверки цитирований и выяснения того, что именно обозначает конкретный DOI. Научные статьи API
- Unpaywall База данных, сопоставляющая DOI с легальными копиями статей в открытом доступе; охватывает статус OA примерно для 150 млн DOI. По переданному DOI она сообщает, существует ли бесплатная легальная копия полного текста и где она размещена, — через простой бесплатный API. Стандартный способ ответить на вопрос «можно ли где-нибудь легально и бесплатно прочитать эту статью, закрытую пейволлом?» API
- OpenAlex Открытый индекс мирового исследовательского ландшафта: около 480 млн научных работ, связанных с авторами, организациями и темами. Его можно изучать на openalex.org или запрашивать через API, который с февраля 2026 года требует бесплатного ключа учётной записи (с солидным бесплатным суточным лимитом). Силён в широком картировании литературы: работы, авторы и публикационная активность организаций собраны в одном месте. Доступ без ключа теперь ограничен небольшой суточной демонстрационной квотой. Научные статьи API · key
- Semantic Scholar (Academic Graph) Академическая поисковая система и граф цитирования от Allen Institute for AI, охватывающие около 220 млн статей с контекстом цитирования. Искать можно на сайте либо через бесплатный Graph API, которому не нужен ключ, но который работает на общем, сильно ограниченном по частоте анонимном пуле. Особенно удобен для отслеживания цепочек цитирования и понимания того, как статьи связаны между собой. Под нагрузкой безключевой API часто упирается в ограничение частоты запросов, поэтому сайт — более надёжный путь. Научные статьи API
- DataCite REST API Реестр DOI для результатов исследований помимо журнальных статей — наборов данных, программного обеспечения и препринтов, — охватывающий десятки миллионов DOI. Записи можно запрашивать или искать через бесплатный API, не требующий ключа. Это дополнение к Crossref в тех случаях, когда прослеживаемый объект — набор данных или исследовательская программа, а не статья. Научные статьи API
- OpenCitations Открытый индекс научных связей цитирования: более двух миллиардов связей вида DOI-DOI по состоянию на обновление за февраль 2026 года. Число цитирований, входящие ссылки и списки литературы для любого DOI доступны через бесплатный API; страница поиска на сайте закрыта CAPTCHA, но API отвечает без помех. Используйте его, чтобы увидеть, кто цитирует статью, или выстроить цепочки цитирования на полностью открытых данных. API
- dblp (CS bibliography) Курируемая библиография по компьютерным наукам, индексирующая около семи миллионов публикаций из журналов и конференций этой области с тщательно выверенными записями об авторах. Искать можно на dblp.org или через бесплатный API. Охват строго ограничен компьютерными науками, но внутри этой области это часто самый чистый и надёжный источник сведений о том, кто, что, где и когда опубликовал. Научные статьи API
- arXiv (export API) Сервер препринтов по физике, математике, компьютерным наукам и смежным областям, где размещено около 2,5 млн статей с бесплатным полным текстом. Искать и просматривать можно на arxiv.org либо через бесплатный export API. Это первое место, куда стоит заглянуть за новыми исследованиями до журнальной публикации — или вместо неё. С начала 2026 года автоматические запросы ограничиваются жёстче, поэтому машинному доступу может потребоваться снизить темп. Научные статьи API
- bioRxiv Сервер препринтов по биологии, поддерживаемый Cold Spring Harbor Laboratory: более 300 000 препринтов с бесплатным полным текстом. Поиск и чтение — на biorxiv.org; иногда сайт показывает короткую проверку Cloudflare перед загрузкой, а сведения об отдельных статьях доступны также через бесплатный API. Здесь можно найти биологические исследования за месяцы до их появления в журналах. Научные статьи API капча
- medRxiv Родственный bioRxiv сервер препринтов по медицине и наукам о здоровье: более 60 000 свободно доступных для чтения препринтов. Для поиска и чтения используйте сайт medrxiv.org (перед загрузкой возможна короткая проверка браузера); сведения о статьях также доступны через общий API bioRxiv. Обращайтесь к нему, когда отслеживаете клинические исследования и работы по общественному здравоохранению до рецензирования. Научные статьи API капча
- PubMed / PMC (NCBI E-utilities) Индекс биомедицинской литературы Национальных институтов здравоохранения США, охватывающий примерно 37 млн библиографических записей и около 10 млн полнотекстовых статей в PubMed Central. Поиск по корпусу выполняется через E-utilities от NCBI, которые возвращают результаты без ключа API. Это стандартная первая остановка для медицинской, клинической литературы и литературы по наукам о жизни. Научные статьи API
- Europe PMC Собрание литературы по наукам о жизни, поддерживаемое EMBL-EBI и охватывающее около 43 млн публикаций вместе с открытым полнотекстовым содержимым. Единый безключевой поисковый интерфейс возвращает и метаданные, и — где это возможно — полный текст статьи. Обращайтесь к нему, когда нужны биомедицинские статьи и требуется сам текст статьи, а не только библиографическая ссылка. Научные статьи API
- DOAJ Каталог проверенных журналов открытого доступа вместе с метаданными на уровне статей: около 21 000 журналов и более 10 млн статей. Поиск идёт через безключевой интерфейс по метаданным с открытой лицензией; каталог можно и просто просматривать на сайте. Используйте его, чтобы убедиться, что журнал действительно относится к открытому доступу, или чтобы найти свободно читаемые статьи. Научные статьи API
- DOAB (Open Access Books) Книжный аналог DOAJ: каталог рецензируемых научных книг открытого доступа, насчитывающий около 95 000 наименований. Каталог доступен для поиска через безключевой интерфейс, а также для просмотра в вебе. Обращайтесь к нему, когда нужны научные монографии и сборники, которые можно читать бесплатно. Книги API
- OpenAIRE Graph Европейский граф знаний открытой науки, связывающий сотни миллионов исследовательских объектов: публикации, наборы данных, программное обеспечение и записи о финансировании. Его можно запрашивать через API или просматривать через портал Explore в вебе. Хороший выбор для отслеживания связей между статьёй и лежащими в её основе данными, программным обеспечением или грантом, хотя в 2026 году сервис находится в процессе перехода на новый графовый API, а прежние поисковые точки доступа постепенно выводятся из эксплуатации. Научные статьи API
- CORE (core.ac.uk) Агрегатор исследований открытого доступа, собирающий полные тексты и метаданные из более чем 10 000 репозиториев: около 300 млн записей, из них свыше 40 млн полнотекстовых объектов. Доступ осуществляется через поисковый API, которому нужен бесплатный ключ, поскольку анонимное использование сильно ограничено по частоте запросов. Обращайтесь к нему, когда нужен максимально широкий охват полных текстов открытого доступа, а не отдельный репозиторий. API · key
- BASE (Bielefeld) Академическая поисковая система Билефельдского университета, индексирующая более 400 млн документов, собранных от более чем 12 000 поставщиков контента. Веб-портал открыт для свободного просмотра и поиска по этим материалам. Программный интерфейс ограничен заранее зарегистрированными IP-адресами, поэтому на практике сервисом пользуются через сайт. блокировка по IP
- The Lens Платформа объединённого поиска и аналитики, охватывающая научные работы наряду с патентами: более 270 млн записей. Веб-интерфейс позволяет искать и сопоставлять научную и патентную литературу в одном месте. API выдаётся по заявке и в основном платный, поэтому практичный путь — сайт; он полезен, когда вопрос охватывает и научные публикации, и патенты.
- Dimensions (Digital Science) Связанная база исследовательских данных, объединяющая публикации, гранты, патенты, клинические испытания и документы политики; более 140 млн публикаций. Поиск ведётся через веб-приложение. Программный доступ выдаётся по подписке и по заявке, поэтому обращайтесь напрямую к сайту, когда нужно проследить тему не только по статьям, но и по финансированию, испытаниям и политике.
- Scite.ai Сервис анализа цитирования, классифицирующий примерно 1,6 млрд цитирований по тому, поддерживают ли они утверждение, противоречат ему или просто упоминают его. Отчёт о цитировании статьи открывается по глубоким ссылкам на сайт сервиса. API тарифицируется по корпоративным расценкам, поэтому доступ строится на ссылках; это полезно, когда важно знать не только кто цитирует статью, но и как. капча
- Connected Papers Инструмент, строящий визуальный граф статей, связанных с заданной работой по сходству, на основе корпуса из десятков миллионов статей. Пользоваться им можно, открыв представление графа для статьи на сайте сервиса. Открытого интерфейса запросов нет, поэтому сервис выступает в роли глубокой ссылки; обращайтесь к нему, чтобы обнаружить смежную литературу вокруг уже известной вам статьи.
- Open Library Открытый редактируемый каталог книг, изданий и авторов, поддерживаемый Internet Archive: более 40 млн записей об изданиях и произведениях со ссылками на копии, доступные для выдачи во временное пользование. Искать можно по названию или запрашивать конкретный ISBN через безключевой API либо просматривать каталог в вебе. Надёжная универсальная точка входа для библиографических сведений и для поиска того, где книгу можно прочитать или взять во временное пользование. Книги API
- Internet Archive Texts Собрание текстов и книг на archive.org, насчитывающее более 40 млн оцифрованных объектов, часть которых доступна только через контролируемую выдачу. Безключевой интерфейс поиска и метаданных позволяет находить объекты и открывать их в читалке. Используйте его, чтобы убедиться в существовании книги или документа и читать материалы из общественного достояния, учитывая, что полные тексты произведений под авторским правом выдаются только во временное пользование, а сервис может ограничивать частоту запросов при высокой нагрузке. Книги API
- scholar.archive.org / fatcat Научный каталог Internet Archive (fatcat), предлагающий полнотекстовый поиск по более чем 25 млн статей открытого доступа, включая сохранённые копии статей. Поиск ведётся через сайт scholar.archive.org. Пока к нему лучше обращаться через веб-интерфейс, поскольку его API для запросов при последней проверке работал нестабильно. Научные статьи
- HathiTrust Крупная совместная электронная библиотека из более чем 18 млн оцифрованных томов, собранных исследовательскими библиотеками. Безключевой библиографический интерфейс возвращает каталожные записи с глубокими ссылками в читалку; тома из общественного достояния доступны для чтения, а полные тексты произведений под авторским правом открыты только участникам аффилированных организаций. Обращайтесь к нему, чтобы проверить наличие изданий и получить доступ к отсканированным томам, учитывая, что его поисковый интерфейс из некоторых сетей может показывать страницу проверки. Книги API капча
- Google Books API Индекс книжных изданий Google, охватывающий десятки миллионов наименований с метаданными и — там, где это разрешено, — предпросмотром. Искать можно по названию или ISBN через API, а бесплатный ключ повышает в остальном довольно жёсткую квоту запросов. Он даёт широкий охват для подтверждения существования книги и сведений об издании, а также для поиска страниц предпросмотра. Книги API
- Project Gutenberg (Gutendex) Классическое собрание примерно из 75 000 бесплатных электронных книг из общественного достояния; сервис Gutendex открывает его каталог в формате JSON для поиска по названию или автору. Просматривать и скачивать книги можно и напрямую с сайта Gutenberg. Это основной адрес для полных бесплатных текстов книг, вышедших из-под действия авторского права, хотя запрос к каталогу бывает медленным и иногда завершается по тайм-ауту. Книги API
- Standard Ebooks Небольшое, тщательно подготовленное собрание примерно из 900 электронных книг из общественного достояния, вычитанных и оформленных на высоком уровне, с лентой OPDS. Издания можно просматривать и скачивать с сайта проекта. Обращайтесь к нему, когда нужно чистое, хорошо свёрстанное издание классики, а не сырой скан. Книги блокировка по IP
- Wikisource Библиотека свободных первоисточников от Wikimedia: расшифрованные книги, документы, речи и исторические материалы общим объёмом в миллионы страниц. Искать можно через стандартный API MediaWiki или на сайте. Ресурс полезен для поиска расшифрованных, пригодных для цитирования полных текстов документов из общественного достояния и первоисточников. Книги API
- WorldCat / OCLC Крупнейший в мире сводный каталог библиотечных фондов, объединяющий более 550 млн записей и показывающий, в каких библиотеках хранится тот или иной документ. Поиск ведётся через веб-интерфейс на search.worldcat.org. Бесплатного API больше нет, поэтому пользуйтесь сайтом; он остаётся эталонным ресурсом для поиска печатного экземпляра в библиотеке.
- Trove books (NLA) Поисковый сервис Национальной библиотеки Австралии по книгам, газетам, изображениям и австралийским материалам, охватывающий миллиарды объектов. Искать можно на сайте Trove или через его API с бесплатным ключом. Это главный ресурс по австралийским печатным и историческим материалам; учтите, что речь идёт о книгах и каталожных записях, а не о снимках веб-архива. API · key
- Anna's Archive Метапоисковый индекс по нескольким теневым библиотекам: LibGen, Sci-Hub, Z-Library, а также собранные скрейпингом коллекции — примерно 64 млн книг и 96 млн статей. Он ведёт к копиям произведений, размещённым на внешних ресурсах, многие из которых защищены авторским правом, то есть работает как каталог ссылок, а не как хранилище файлов. Исследователи используют его как единый поиск по нескольким теневым источникам, однако домены сервиса часто меняются, и рабочее зеркало приходится определять в момент запроса. Книги капча
- Library Genesis (LibGen) Давно работающая теневая библиотека книг, учебников и статей, исчисляемых миллионами. Она индексирует защищённые авторским правом материалы, размещённые в других местах, то есть выступает источником ссылок, а не хранилищем контента. Домены её зеркал часто меняются и требуют определения в момент запроса, из-за чего доступ бывает нестабильным. Книги блокировка по IP
- Sci-Hub Сервис, выдающий полнотекстовые PDF журнальных статей из-за пейволла по запросу через DOI; корпус насчитывает около 88 млн статей. Он ссылается на защищённые авторским правом материалы, размещённые в других местах, а не отдаёт их напрямую. Собрание в основном заморожено примерно на 2021 годе, поэтому это вариант «по мере возможности» для более старых DOI, а домены его зеркал меняются. Научные статьи капча
- Z-Library Крупная теневая библиотека электронных книг и статей, хранящая десятки миллионов объектов за формой входа. Она индексирует защищённые авторским правом материалы, размещённые в других местах, то есть работает как каталог ссылок, и её имитируют многочисленные фишинговые клоны. Доступ ненадёжен из-за обязательной авторизации и часто меняющихся доменов. капча
- Bluesky public AppView (AT Protocol) Открытый, не требующий ключа интерфейс ко всей социальной сети Bluesky: профили, посты и ленты десятков миллионов аккаунтов. Публичное чтение профилей и лент работает через её API без входа и ключа. Это самый удобный способ подтягивать актуальные социальные посты и профили прямо в результаты поиска. API
- Telegram public preview (t.me/s/) Собственный серверный веб-просмотр Telegram для любого публичного канала, показывающий недавние посты без приложения и входа. Достаточно открыть страницу предпросмотра канала на t.me. Это самый простой способ читать и выгружать посты из публичных каналов Telegram. API
- Wayback, twitter/x URLs Wayback Machine применительно к URL twitter.com и x.com: возвращает архивные снимки твитов и профилей там, где они были обойдены. Вы можете проверить, был ли сохранён конкретный твит, и открыть сохранённую копию по ссылкам воспроизведения. Это один из наиболее надёжных способов восстановить удалённые твиты, хотя охват фрагментарен и наиболее полон для заметных аккаунтов. Соцсети API
- Wayback Tweets (claromes) Инструмент, который обращается к индексу снимков Wayback Machine и перечисляет все архивные твиты для заданного хендла. Он опирается на те же данные снимков Wayback, но в разрезе одного аккаунта за раз. Обращайтесь к нему, чтобы перечислить сохранившиеся архивные твиты пользователя, хотя само размещённое приложение часто «спит» или отваливается по тайм-ауту. Соцсети API
- archive.today. X / Facebook archive.today в применении именно к страницам X и Facebook, до которых обходчик Wayback зачастую не добирается; содержит десятки миллионов снимков, сделанных по запросу. Наличие снимка проверяется через его timemap по протоколу Memento, а сохранённая копия открывается по прямой ссылке. Ресурс ценен для страниц соцсетей, которые пропускают другие архивы, хотя страницы снимков могут ограничивать частоту запросов, а в 2026 году сервис столкнулся с региональными блокировками. Соцсети API капча
- Wayback, facebook.com Wayback Machine применительно к URL facebook.com: показывает архивные снимки публичных страниц и постов Facebook там, где они были зафиксированы. Наличие снимков проверяется, а сохранённые копии открываются по ссылкам воспроизведения. Охват скудный, поскольку Facebook блокирует обходчиков, и многие снимки представляют собой лишь промежуточную страницу входа, поэтому лучшие результаты дают публичные Страницы. Соцсети API
- Wayback, reddit.com Wayback Machine применительно к URL reddit.com: содержит архивные снимки тредов и профилей с хорошим охватом популярных обсуждений. Вы проверяете, был ли зафиксирован тред, и открываете сохранённую копию по ссылкам воспроизведения. Поскольку сервис не зависит от собственного API Reddit, это один из наиболее надёжных способов восстановить снятый или удалённый контент Reddit. Соцсети API
- IA Twitter Stream Grab Набор массовых выгрузок Internet Archive из старого публичного выборочного потока Twitter, хранящихся в виде помесячных файлов JSON и охватывающих миллиарды твитов примерно с 2011 по 2023 год. Доступ осуществляется скачиванием файлов набора данных, перечень которых доступен через API метаданных объекта. Он предназначен для массового офлайн-анализа исторических данных Twitter, а не для поиска отдельного твита; набор данных заморожен, поскольку исходного потока больше не существует. Соцсети API
- PullPush.io Открытый преемник Pushshift, предлагающий полнотекстовый поиск без ключа по комментариям и публикациям Reddit, включая контент, впоследствии снятый или удалённый. Запросы выполняются через его JSON API по сабреддиту или ключевому слову. Это основной практический инструмент для поиска по истории Reddit и восстановления снятых постов. Соцсети API
- Arctic Shift Сервис данных Reddit, предоставляющий API без ключа, доступные для скачивания массовые выгрузки и веб-интерфейс, с более щедрыми лимитами, чем у PullPush. Его полнотекстовый поиск ограничен конкретным пользователем или сабреддитом, а не всем сайтом. Обращайтесь к нему как к дополнению к PullPush, когда нужны архивные данные Reddit в пределах определённого сообщества или аккаунта. Соцсети API
- Reddit Data API (official) Собственный API данных Reddit: добавление .json к URL страницы возвращает её содержимое без аутентификации, а OAuth открывает больше возможностей. Он отдаёт актуальные данные Reddit — посты, комментарии и профили, — но не предлагает глубокого исторического поиска. Используйте его для сегодняшнего контента Reddit и дополняйте PullPush или Arctic Shift, когда нужно прошлое. API
- Desuarchive (4chan archive) Архив на движке FoolFuuka для отдельных досок 4chan (/a/, /int/, /k/, /tg/, /wsg/ и других) с большой глубиной истории. Он хранит копии тредов с полнотекстовым поиском, поэтому старые посты 4chan можно найти уже после того, как они исчезли с самого 4chan, — либо на сайте, либо через его JSON API без ключа. Ключевой источник для исследования форумов на охватываемых досках; учтите, что часть досок содержит NSFW или шокирующий контент. Соцсети API
- Mastodon per-instance API Каждый сервер Mastodon предоставляет встроенный REST API, и публичное чтение — поиск аккаунтов и публичные ленты — обычно работает без токена. Глобального поиска нет: каждый запрос адресован одному конкретному инстансу, федерация даёт лишь частичный межинстансный охват, а полнотекстовый поиск на большинстве серверов требует токена. Обращайтесь к нему, чтобы проверить конкретный аккаунт Mastodon или просмотреть публичные посты инстанса. API
- Fediverse Observer Каталог и монитор доступности, охватывающий тысячи серверов Fediverse/Mastodon, с конечной точкой GraphQL под капотом. Используйте сайт, чтобы узнать, какие инстансы существуют и какие из них сейчас работают. Сам он не хранит постов — это естественная первая остановка перед погружением в конкретный сервер Mastodon.
- Nitter (xcancel.com et al.) Приватные фронтенды для X/Twitter (xcancel.com и подобные инстансы Nitter), показывающие профили и ленты без входа, включая RSS-ленты по пользователям. Они отображают только актуальные данные X и архивом не являются, а экосистема в основном развалилась — держатся лишь несколько инстансов. Полезно, чтобы читать аккаунт X без собственной учётной записи, но будьте готовы к блокировкам и сбоям; сначала подберите работающий инстанс по трекеру состояния Nitter. блокировка по IP
- Nitter health tracker Страница состояния в реальном времени, отслеживающая, какие из оставшихся инстансов Nitter сейчас доступны. Собственного контента она не содержит — это служебный ресурс, который открывают первым, чтобы выбрать рабочее зеркало Nitter перед просмотром профилей X/Twitter через него. Просто откройте её в браузере; искать здесь нечего.
- Thread Reader App Разворачивает треды X/Twitter в единые читаемые страницы, и после разворачивания страница сохраняется, даже если исходные твиты удалены. Миллионы развёрнутых тредов доступны для чтения без входа по предсказуемым адресам вида /thread/<tweetid>.html. Удобно для восстановления удалённого треда, который кто-то развернул, пока тот был доступен; для создания новых разворачиваний нужна учётная запись X, чтобы упомянуть бота.
- Politwoops (ProPublica) Архив ProPublica с твитами, удалёнными политиками; содержит около миллиона удалений, собранных с 2012 по 2023 год. Просмотр ведётся в вебе, API нет: вы находите политика и смотрите, что он снял. Собрание заморожено — отслеживание прекратилось в 2023 году, поэтому это строго исторический срез того периода.
- Telegago (Google CSE) Настраиваемый поиск Google, сконфигурированный для просмотра публичных страниц Telegram (t.me) — каналов, постов и профилей, проиндексированных Google. Пользоваться им можно как обычной поисковой строкой в браузере; охват равен тому, что Google успел обойти на t.me. Быстрый и бесплатный способ найти каналы Telegram по теме, когда неясно, с чего начать.
- TGStat Крупнейший каталог и аналитический сервис по Telegram, охватывающий более 2,5 млн публичных каналов и групп с поиском по постам и статистикой аудитории. Используйте сайт, чтобы находить каналы по теме или ключевому слову и оценивать их охват; API платный и требует токена. Основной инструмент, когда нужно составить карту экосистемы Telegram вокруг темы или исследовать конкретный канал. капча
- Telemetr.io Крупный аналитический индекс по Telegram, близкий по назначению к TGStat: статистика каналов и данные о постах публичной сферы Telegram. Полные данные закрыты входом и платной подпиской, поэтому воспринимайте его как сайт, который вы открываете и изучаете, а не как источник для свободных запросов. При нашей последней проверке доступности он был недоступен, так что возможны перебои в работе.
- SocialData API Коммерческий API, который возвращает данные X/Twitter: поиск, профили пользователей и твиты, — минуя официальный API X. Работа только программная: запросы требуют платного API-ключа с оплатой за каждый полученный твит, бесплатного интерфейса для просмотра нет. Актуален, когда нужны надёжные результаты поиска по X в больших объёмах и есть бюджет на это. API · key
- X API v2 (official) Официальный интерфейс разработчика для X (Twitter), охватывающий всю платформу. С начала 2026 года он работает по кредитной модели с оплатой по факту использования, бесплатный тариф упразднён, а поиск по полному архиву закрыт дорогими старшими тарифами. Для архивных исследований это теперь крайняя мера, практичная лишь если вы готовы платить за каждый запрос; наш сайт даёт ссылку на него, а не отправляет к нему запросы.
- Meta Content Library Исследовательский инструмент Meta для изучения публичного контента Facebook и Instagram, преемник CrowdTangle, раскрывающий посты более чем в 100 полях данных. Доступ открыт только проверенным академическим и некоммерческим исследователям, которые после проверки в ICPSR работают внутри защищённой среды Meta; публичного сайта или открытого API нет. Включён в каталог, чтобы исследователи знали об официальном пути к данным Facebook/Instagram; если вы соответствуете требованиям, подайте заявку через ICPSR. блокировка по IP
- Reveddit Показывает контент Reddit, удалённый модераторами или AutoModerator, для заданного пользователя или треда. Пользоваться им нужно через веб-интерфейс, вводя имя пользователя или ссылку на тред; стабильного API у него нет. После потери источника данных Pushshift его глубина сильно снизилась — это в основном удалённое модераторами, — а сам сайт закрыт антибот-проверкой, поэтому рассчитывать на полноту результатов не стоит. капча
- redditsearch.io Более старый интерфейс поиска по Reddit, работавший на архиве Pushshift. После закрытия публичного доступа к Pushshift он фактически неработоспособен для поиска, хотя страница по-прежнему открывается. Сохранён только для полноты картины; для поиска по историческому контенту Reddit используйте PullPush или Arctic Shift.
- twstalker / Sotwe (X viewers) Сторонние просмотрщики (twstalker, Sotwe и подобные), которые скрапят X/Twitter и заново показывают недавние твиты профиля без входа в аккаунт. Охват — только отдельный профиль и недавние посты, доступ — через открытие сайта в браузере. Такие скраперы хрупки и часто блокируются: наши проверки натыкались на ошибки и антибот-проверки, поэтому относитесь к ним как к эпизодическому запасному варианту, а не как к надёжному источнику. капча
- Picuki (IG viewer) Анонимный просмотрщик Instagram для публичных профилей, постов и историй без учётной записи. Работает исключительно как веб-сайт, без API, в постоянном противостоянии с защитой Instagram. Полезен, чтобы быстро взглянуть на публичный аккаунт IG без входа, но закрыт антибот-проверками и периодически перестаёт работать. капча
- Imginn (IG viewer) Просмотрщик и загрузчик публичных постов и историй Instagram без входа в аккаунт. Работает только через браузер, без API, и, как и другие просмотрщики IG, основан на скрапинге и хрупок. Наши проверки доступности обнаружили блокировку или защитную проверку, поэтому держите наготове альтернативы на случай, если он не загрузится. капча
- AnonyIG (IG story viewer) Один из целого класса анонимных просмотрщиков историй и актуальных историй Instagram, не требующих входа в аккаунт. Используется прямо в браузере для просмотра историй публичного аккаунта; API нет. Instagram активно ломает такие сервисы — наши проверки столкнулись с юридическими блокировками и ошибками, — так что будьте готовы перебрать несколько похожих просмотрщиков, прежде чем один заработает. блокировка по IP
- Bluesky Firehose / Jetstream Поток событий Bluesky в реальном времени, охватывающий всю сеть по мере происходящего; Jetstream — сопутствующий сервис, отдающий тот же поток в виде более простого JSON. Это WebSocket-канал для разработчиков без ключа, рассчитанный на живой мониторинг и сбор данных, а не на поиск старых постов. Актуален, когда нужно захватывать или наблюдать активность Bluesky в реальном времени. API
- 4plebs (4chan archive) Давно работающий архив нескольких бордов 4chan (/pol/, /x/, /tv/, /adv/ и других), хранящий годы истории с полнотекстовым поиском. Искать нужно через сайт; JSON API существует, но антискрапинговая защита блокирует его во многих сетях, поэтому автоматический доступ ненадёжен. Ключевой источник для поиска старых или удалённых тредов 4chan на этих бордах; учтите, что там встречаются NSFW-материалы и крайне жёсткий контент. Соцсети блокировка по IP
- archived.moe (4chan) Архив 4chan, примечательный необычайно широким охватом бордов и большим объёмом истории. Рассчитывайте работать напрямую через сайт: API формально существует, но антибот-защита блокирует автоматических клиентов и на страницах, и на API. Стоит проверить, если треда нет на Desuarchive или 4plebs, хотя антискраперная защита может создавать помехи и обычным посетителям; не путать с давно закрытым archive.moe. капча
- Software Heritage Универсальный архив исходного кода, «Александрийская библиотека кода», сохраняющий более 20 миллиардов уникальных файлов исходного кода из более чем 350 миллионов проектов. Можно искать проекты, находить файлы по хэшу (sha1/sha256/git) и разрешать постоянные идентификаторы SWHID — на сайте или через REST API без ключа. Место, куда стоит обратиться, когда репозиторий исчез с исходного хостинга или когда нужно опознать файл по его хэшу. Программы и пакеты API
- Wikimedia Commons Крупнейшее хранилище медиафайлов под свободными лицензиями — более 110 миллионов файлов, — стоящее за Wikipedia и родственными проектами. Всё доступно для поиска на сайте, а стандартный API MediaWiki отдаёт тот же поиск без ключа. Обращайтесь к нему, когда нужны изображения и другие медиа под открытыми лицензиями с задокументированными источниками и лицензированием. Изображения API
- Openverse Поисковая система от проекта WordPress, охватывающая более 800 миллионов изображений и аудиофайлов под открытыми лицензиями и в общественном достоянии из множества коллекций-источников. Поиск доступен на сайте или через API без ключа. Лучше всего подходит, когда нужны пригодные для повторного использования медиа и один запрос по многим открытым коллекциям вместо обхода каждой по отдельности. Изображения API
- Internet Archive (Video) Видеофонды Internet Archive: миллионы объектов — фильмы, телевидение и эфемера. Поиск и метаданные доступны через сайт или поисковый API archive.org без ключа. Первоочередной источник для старых, малоизвестных или иным образом исчезнувших кадров; на него распространяются периодические сбои и ограничения частоты запросов Internet Archive в 2026 году, поэтому иногда придётся повторять попытки. Видео, аудио, музыка API
- Internet Archive (Audio) / Live Music Миллионы открытых аудиообъектов в Internet Archive, включая Live Music Archive с более чем 250 000 легально записанных концертов. Поиск доступен на сайте, с тем же поисковым API и API метаданных без ключа, что и у остального archive.org. Первое место, куда стоит обратиться за живыми записями, старыми эфирами и другим аудио, которое трудно найти где-либо ещё. Видео, аудио, музыка API
- YouTube via Wayback Machine Скорее приём восстановления, чем отдельный сайт: поиск старых снимков страниц просмотра YouTube в Wayback Machine, чтобы получить метаданные, названия и превью удалённых или изменённых видео. Сначала вы проверяете наличие снимка через API доступности Wayback, затем открываете саму архивную страницу. Покрытие ограничено теми URL просмотра, которые Wayback Machine успел сохранить, и обычно вы восстанавливаете страницу, а не воспроизводимый поток; в поисках утраченного видео сочетайте этот приём с Filmot или Ghostarchive. API
- Dailymotion Крупный западный видеохостинг с сотнями миллионов видео и заметно стабильным поиском через публичный Graph API без ключа. В нашем исследовании того, где всплывают исчезнувшие видео с YouTube, он оказался лучшим открыто доступным источником перезаливов. Ищите здесь, когда охотитесь за копией видео, пропавшего с YouTube; сейчас он предлагается как ссылка на внешний сайт. Видео, аудио, музыка
- RuTube Главный видеохостинг России с десятками миллионов видео; наше исследование выявило примерно 4-процентное пересечение с перезаливами YouTube. Поиск работает на сайте, хотя его неофициальный поисковый эндпоинт ограничивает частоту запросов и показывает капчу при всплесках автоматического трафика. Стоит проверить, когда русскоязычное или связанное с Россией видео пропало с YouTube. Видео, аудио, музыка капча
- VK Video Видеонаправление «ВКонтакте», где хранятся миллиарды роликов и высоки шансы найти русскоязычные перезаливы. Бо́льшая часть закрыта авторизацией: веб-поиск требует учётной записи, а официальному API нужны зарегистрированное приложение и токен доступа. Проверяйте его, когда ищете видеоконтент русскоязычного сегмента, но учтите, что для поиска придётся войти в аккаунт. блокировка по IP
- Odysee Видеоплатформа на протоколе LBRY с десятками миллионов объектов и заметно открытым доступом: в нашем исследовании не встретилось ни капчи, ни обязательной авторизации. Искать можно прямо на сайте. Надёжный кандидат для поиска перезаливов, когда видео удалили с основных платформ. Видео, аудио, музыка
- Rumble Американский видеохостинг с сотнями миллионов объектов. Стабильного публичного API у него нет, а трафик дата-центров он блокирует, поэтому искать нужно прямо на сайте с обычного соединения. Стоит включать в обход видеохостингов при поиске перезаливов контента, исчезнувшего в других местах. Видео, аудио, музыка блокировка по IP
- BitChute Независимый видеохостинг с миллионами видео. Стабильного публичного API нет, а страница поиска закрыта проверкой hCaptcha от автоматических посетителей, поэтому искать нужно вручную в браузере. Стандартная остановка при обходе альтернативных видеоплатформ в поисках копий удалённых или труднонаходимых кадров. Видео, аудио, музыка капча
- OK.ru Video Видеонаправление «Одноклассников», крупной российской социальной сети, где размещены сотни миллионов роликов. Интересен главным образом как место, где могут сохраниться русскоязычные кадры или перезаливы исчезнувших видео. Открытого маршрута для запросов нет — официальному API нужны зарегистрированное приложение и ключ, — поэтому используется поиск на самом сайте по прямой ссылке. Сейчас работает с ограничениями: автоматическим соединениям сайт возвращает пустые результаты, так что ищите вручную в браузере. блокировка по IP
- Bilibili Крупнейшая видеоплатформа Китая с сотнями миллионов видео. Для исследователя архивов она важна как возможное пристанище перезаливов и китайскоязычных материалов, которых больше нигде нет. Англоязычного API без ключа не существует, а поиск извне Китая закрыт геопроверками и капчей, так что это ресурс формата «перейти по ссылке»: откройте сайт и ищите там. Видео, аудио, музыка капча
- Torrents-CSV Открытая торрент-поисковая система на основе поддерживаемого сообществом набора данных CSV, индексирующая миллионы торрентов; сервис целиком можно развернуть у себя. Он предоставляет простой JSON API без ключа, поэтому поиск выполняется автоматически и возвращает аккуратные результаты. Полезен, чтобы проверить, циркулирует ли ещё в BitTorrent файл или релиз, исчезнувший из веба. Сервис выдаёт только ссылки на торренты, поэтому оценивайте законность всего, что вы загружаете. Торренты API
- Academic Torrents Платформа для распространения исследовательских наборов данных и научных материалов через BitTorrent — петабайты легально предоставленного материала. Поиск и просмотр коллекций свободны, а для чтения не нужны ни ключ, ни учётная запись. Обращайтесь к ней, когда большой публичный набор данных проще получить торрентом, чем с медленного или ненадёжного институционального сервера. Торренты API
- The Pirate Bay (apibay) Старейший из ныне работающих универсальных торрент-индексов с очень большим каталогом по всем типам контента. Практический способ входа — apibay.org, его JSON-бэкенд поиска без ключа, поскольку основной сайт широко блокируется провайдерами. Исследователи используют его, чтобы проверить, циркулируют ли ещё торрентами исчезнувшие программы, медиа или документы. Результаты в основном ведут к материалам, защищённым авторским правом, поэтому рассматривайте их только как ссылки. Торренты API
- Nyaa Ведущий торрент-индекс аниме и восточноазиатских медиа. Его RSS-лента работает и как простой поисковый API без ключа, а результаты ведут на страницы торрентов. Место, где стоит искать старые фансабы, снятые с печати релизы и японские медиа, которые так и не получили западного издания. Как и в случае с любым торрент-индексом, рассматривайте результаты как ссылки разной степени законности. Торренты API
- SauceNAO Фактический стандарт обратного поиска по изображениям для аниме, манги и фан-арта, индексирующий миллиарды изображений из таких источников, как Pixiv и Danbooru. Отправьте изображение или его URL — и сервис определит, откуда взялась работа; JSON API есть, но требует бесплатного зарегистрированного ключа. Незаменим, когда нужно проследить иллюстрацию до её автора или первой публикации. Изображения API · key
- VirusTotal Канонический сервис поиска файлов по хешу: он агрегирует вердикты антивирусов и анализы в песочнице для миллиардов файлов, URL и доменов. Вставьте хеш или URL на сайте, чтобы получить сводный отчёт, либо используйте его JSON API с бесплатным ключом для автоматизированных запросов. Исследователи архивов обращаются к нему, чтобы опознать загадочный файл или проверить, не совпадает ли хеш с известным вредоносным ПО, прежде чем работать с файлом. Файл по хэшу API · key
- MalwareBazaar (abuse.ch) Бесплатный репозиторий образцов вредоносного ПО от abuse.ch, хранящий миллионы образцов с поиском по хешу, метке или сигнатуре вредоносного ПО. Запросы идут через API, который теперь требует бесплатный Auth-Key от abuse.ch (один ключ покрывает все их смежные сервисы). Используйте его, когда у вас есть хеш подозрительного файла и вы хотите узнать, является ли он каталогизированным образцом, либо когда сам образец нужен для анализа. API · key
- URLhaus (abuse.ch) База данных abuse.ch с URL, распространяющими вредоносное ПО: миллионы вредоносных ссылок с поиском по URL, хосту или хешу полезной нагрузки. Запросы выполняются через простой API с тем же бесплатным Auth-Key от abuse.ch, что и в остальных их сервисах. Проверьте здесь, если хотите узнать, был ли URL, найденный в архивной странице или старом наборе данных, известен как раздающий вредоносное ПО. API · key
- ThreatFox (abuse.ch) Открытая платформа обмена индикаторами компрометации от abuse.ch, каталогизирующая миллионы IP-адресов, доменов, хешей и URL, связанных с именованным вредоносным ПО. Запросы выполняются через API с бесплатным Auth-Key от abuse.ch. Полезна, чтобы поместить артефакт в контекст: найдите хеш или домен и узнайте, с каким семейством вредоносного ПО или кампанией он связывался. API · key
- Triage (tria.ge) Автоматизированная песочница для вредоносного ПО под управлением Recorded Future с большим публичным корпусом проанализированных образцов. Публичные отчёты доступны для поиска по хешу файла, а доступ к API использует токен из бесплатной учётной записи Researcher. Хороший следующий шаг после проверки хеша в другом месте, когда нужно увидеть, что образец реально делает при запуске. API · key
- MalShare Публичный репозиторий вредоносного ПО, поддерживаемый сообществом, с миллионами образцов, поиском по хешу и загрузкой образцов. Его простой API требует ключа, но ключ бесплатный: самостоятельная регистрация даёт 2000 вызовов в сутки. Альтернатива с более низким порогом входа по сравнению с репозиториями по приглашениям, когда нужно проверить или получить образец по хешу. API · key
- Maltiverse Агрегатор threat intelligence для проверки IP-адресов, доменов, URL и хешей файлов по большому объединённому набору IOC. Запросы идут через его JSON API, ключи доступны на бесплатном тарифе. Используйте его, чтобы обогатить артефакт из вашего исследования — скажем, хеш или домен, извлечённый из архивной страницы, — тем, что о нём совокупно знают ленты угроз. API · key
- Flickr Один из крупнейших фотоархивов в сети, хранящий миллиарды фотографий, — глубокий источник исторической и любительской фотографии. Поиск работает на сайте, а для доступа по ключу существует зрелый REST API. Стоит поискать здесь, если вы ищете оригинальные фотографии мест, событий или сообществ раннего веба. Ограничен для новых интеграций: свежие ключи API теперь требуют платной подписки Flickr Pro (существующие ключи продолжают работать), так что рассчитывайте на веб-интерфейс. API · key
- Imgur Крупный хостинг изображений, который долгое время был бэкендом для картинок Reddit и бесчисленных форумов. Старые загрузки можно получить по идентификатору изображения — на сайте или через API, требующий бесплатного Client-ID. Он важен прежде всего для восстановления ссылок на imgur, найденных в архивных обсуждениях. Учтите, что его архивная ценность снизилась после чистки анонимного контента в 2023 году: многие старые идентификаторы теперь ничего не возвращают, поэтому проверяйте, открывается ли ссылка, прежде чем на неё полагаться. API · key
- DeviantArt Давно существующее онлайн-сообщество художников, размещающее сотни миллионов работ. Искать и просматривать на сайте можно свободно, а API на основе OAuth покрывает публичный просмотр и поиск для зарегистрированных приложений. Исследователи приходят сюда, чтобы проследить происхождение работы, восстановить публичную галерею художника или датировать фан-арт. API · key
- Freesound Совместная база более чем из 650 000 звуковых сэмплов и эффектов под лицензиями Creative Commons. Поиск работает на сайте, а аккуратный JSON API доступен с бесплатным токеном. Естественная точка обращения, когда нужен звуковой фрагмент с однозначной лицензией или требуется проследить происхождение широко переиспользуемого сэмпла. API · key
- Yandex Images Обратный поиск по изображениям от Yandex, считающийся лучшим в своём классе для лиц и визуально похожих изображений, опирающийся на многомиллиардный индекс изображений. Вы отправляете URL изображения и просматриваете совпадения в веб-интерфейсе; официального API нет, а автоматизированное использование вызывает капчу, поэтому сервис работает как переходная ссылка. Стандартная точка OSINT-поиска, когда обратный поиск Google не дал результата, особенно для фотографий людей. Изображения капча
- Google Images / Lens Крупнейший в мире обратный и визуальный поиск по изображениям, а Lens добавляет распознавание объектов и текста. Он работает только через веб, публичного API нет, поэтому изображение вы загружаете или вставляете URL самостоятельно. По-прежнему первый ход по умолчанию, когда нужно определить происхождение изображения, его сюжет или другие места, где оно встречается в сети. Изображения капча
- TinEye Старейший специализированный движок обратного поиска по изображениям, индексирующий более 70 миллиардов изображений и специализирующийся на точных и отредактированных копиях, включая самое раннее проиндексированное появление изображения. Веб-поиск бесплатен при ручном использовании; API платный, поэтому автоматизированного пути здесь нет. Особенно ценен, когда нужно датировать изображение или установить, где оно впервые появилось. Изображения
- Bing Visual Search Визуальный и обратный поиск по изображениям от Microsoft. Веб-интерфейс по-прежнему позволяет сопоставить изображение с индексом Bing, но использование возможно только вручную. Он служит вторым мнением наряду с Google и Yandex при обратном поиске изображения. Ограничен: программный API был закрыт в августе 2025 года вместе с остальными поисковыми API Bing. Изображения
- IQDB Сводный обратный поиск по изображениям во всех основных имиджбордах формата booru: Danbooru, Gelbooru, Zerochan и других, охватывающих десятки миллионов размеченных изображений в аниме-стилистике. Вы даёте изображение или URL, и сервис проверяет все площадки разом; вывод — обычный HTML, API нет. Самый быстрый способ найти каталогизированный размеченный источник аниме-изображения, когда SauceNAO оставляет сомнения. Изображения
- ascii2d Японский движок обратного поиска по изображениям, сопоставляющий по цветовым и признаковым сигнатурам, особенно сильный по работам с Pixiv и Twitter. Работает только через веб, API нет. Стоит попробовать для японского фан-арта, когда основные движки обратного поиска не справились. Статус неопределённый: при тестировании сервис был недоступен с нашей инфраструктуры, соединения извне Японии часто блокируются, поэтому ожидайте проблем с доступом. блокировка по IP
- Karma Decay Обратный поиск по изображениям строго в пределах Reddit: вы даёте изображение, и сервис показывает предыдущие публикации той же картинки по всему сайту. Это обычный сайт без API. Удобен, чтобы проследить, когда и где изображение впервые разошлось по Reddit. Сейчас работает с ограничениями: при наших проверках сайт не отвечал по тайм-ауту, а его актуальность ограничена, поскольку Reddit закрыл доступ к данным, — так что рассматривайте его как вариант с малыми шансами.
- PimEyes Поисковая система с распознаванием лиц, охватывающая примерно 3,5 миллиарда изображений лиц из открытого веба: загрузите фотографию лица, и она найдёт другие изображения того же человека. Работает только через сайт, а для фактического просмотра результатов требуется платная подписка; публичного API нет. Применяется в исследованиях по идентификации людей, когда обычный обратный поиск по изображениям недостаточно чувствителен к лицам. капча
- Photobucket Устаревший хостинг изображений, хранящий миллиарды картинок раннего веба, когда он стоял за бесчисленными сообщениями форумов и блогами. API нет, и значительная часть архива труднодоступна: хотлинкованные изображения часто показывают заглушки, а старые альбомы закрыты пейволом. И всё же он иногда оказывается единственным сохранившимся пристанищем старой форумной картинки, так что ручная проверка может окупиться. Работает с ограничениями: часто ожидайте нерабочего или закрытого контента.
- Pinterest Сервис визуального поиска с миллиардами закреплённых изображений, которые нередко сохраняют копии картинок с исчезнувшими первоисточниками. Публичного API поиска по изображениям нет — официальный закрыт OAuth и доступен только одобренным бизнес-приложениям, — а обычный просмотр упирается в форму входа, поэтому пользуйтесь прямой ссылкой. Иногда полезен, чтобы найти сохранившуюся копию изображения, утраченного на исходном сайте. блокировка по IP
- Google Arts & Culture Портал Google к произведениям искусства и культурным экспозициям в высоком разрешении, предлагающий миллионы объектов из более чем 2000 музеев и организаций. Всё работает через веб-интерфейс; публичного API нет. Полезен при исследовании произведений искусства, артефактов или выставок, особенно когда важны изображения высокого разрешения с масштабированием. Ограничен только в программном смысле: инструменты для разработчиков были закрыты, поэтому остаётся ручной просмотр.
- Tube Archivarix Собственный поисковик Archivarix по удалённым видео с YouTube и родственный сервис этого сайта. По ID видео он ищет доступные перезаливки удалённого ролика на зеркальных хостингах, показывает архивные метаданные видео и поддерживает поиск по заголовкам в своём индексе метаданных YouTube. Как собственный сервис он полностью интегрирован здесь и не требует ключа или настройки. Первое, к чему стоит обратиться, если ссылка на YouTube не работает, а вам нужны сведения о видео или уцелевшая копия. Видео, аудио, музыка
- Filmot Поисковый индекс метаданных и субтитров YouTube, охватывающий сотни миллионов видео, включая уже удалённые или скрытые. Через бесплатный веб-интерфейс можно искать по метаданным видео и даже по словам, произнесённым в субтитрах; неофициальному API нужен ключ, выдаваемый владельцем сервиса. Его уникальная ценность — сведения об удалённых видео с YouTube, которые часто больше нигде не сохранились. Сейчас работает с ограничениями: страницы видео закрыты фильтром Cloudflare от автоматических подключений, поэтому рассчитывайте на ручной просмотр. Видео, аудио, музыка капча
- Ghostarchive (video) Архиватор по запросу, пополняемый пользователями и примечательный тем, что сохраняет видео с YouTube и Twitter, а не только обычные страницы. Поискового API нет: архивные страницы открывают напрямую по ID либо просматривают раздел YouTube. Стоит проверить при любом поиске удалённого видео наряду с Filmot и Wayback Machine, поскольку здесь иногда есть настоящая воспроизводимая копия, а не только метаданные. Видео, аудио, музыка
- ANY.RUN Интерактивная онлайн-песочница для вредоносного ПО, публичная лента отчётов которой открывает свободный доступ к большому корпусу разборов. Поиск и чтение публичных отчётов ведутся на сайте; API доступен только на платных тарифах. Пригодится, когда нужно увидеть, как ведёт себя подозрительный файл при запуске, не запуская его самостоятельно.
- Hybrid Analysis Общественный портал песочницы Falcon Sandbox компании CrowdStrike с большим публичным корпусом разборов вредоносного ПО, доступных для поиска по хешу файла. Сам сайт защищён капчей, поэтому рабочий путь — его API с ключом от бесплатной учётной записи. Надёжное место, чтобы проверить, анализировался ли уже такой хеш и что зафиксировала песочница. API · key капча
- VirusShare Репозиторий с доступом по приглашениям, хранящий десятки миллионов образцов вредоносного ПО, с поиском по хешу и загрузкой образцов для участников. Чтобы попасть внутрь, нужно написать оператору письмо с запросом учётной записи; API также требует ключ участника. Исследователи обращаются сюда, когда нужен сам образец, стоящий за известным хешем, а в открытых репозиториях его нет. капча
- BTDigg (btdig.com) Торрент-поисковик, который сам обходит сеть BitTorrent DHT, индексирует сотни миллионов торрентов и выдаёт только magnet-ссылки. Это простой HTML-сайт без API, продвигаемый прежде всего как сервис в Tor. Хорош для поиска материалов, которые ещё раздаются, но не значатся ни в одном обычном торрент-индексе. Работает с ограничениями: адрес в обычном интернете нестабилен, поэтому доступность будет прерывистой, а результаты, как всегда с торрентами, представляют собой только ссылки. Торренты блокировка по IP
- SolidTorrents Поисковик на основе DHT по десяткам миллионов торрентов и их метаданным. Работает только через веб, официального API нет, а домен периодически меняется. Ещё один запасной вариант, чтобы проверить, циркулирует ли что-то в BitTorrent, когда крупные индексы ничего не дали. Состояние неопределённое: при наших проверках сайт отвечал только через прокси, поэтому текущий рабочий домен стоит проверить, прежде чем на него полагаться. Торренты блокировка по IP
- Snowfl Инструмент метапоиска по торрентам: вместо собственного индекса он одновременно опрашивает несколько торрент-индексаторов и агрегирует результаты. API нет, поэтому пользоваться придётся веб-интерфейсом напрямую — отсюда сервис доступен только как внешняя ссылка. Стоит заглянуть, когда хочется одним запросом охватить несколько торрент-индексов вместо ручной проверки каждого, хотя сервис блокирует часть диапазонов IP, а сайт сильно завязан на JavaScript. блокировка по IP
- TorrentGalaxy Универсальный торрент-индекс с сообществом при нём, охватывающий большой каталог торрентов. Официального API нет: поиск ведётся на самом сайте, на который мы даём ссылку, а не отправляем запросы. Исследователям, отслеживающим файлы, распространяемые через BitTorrent, он пригодится как один из нескольких индексов для проверки. Сейчас работает с ограничениями: с 2025 года сайт сталкивается с нестабильностью и давлением блокировок, поэтому перед использованием стоит проверить, какой домен работает. блокировка по IP
- 1337x Один из самых посещаемых общих торрент-индексов в сети с очень большим каталогом. Официального API не существует, поэтому поиск идёт на самом сайте; мы даём только внешнюю ссылку. Часто это первое место, куда обращаются за торрентом почти любого рода, но учтите, что во многих регионах он заблокирован провайдерами, так что для доступа может понадобиться зеркало или прокси. Торренты блокировка по IP
- Bitmagnet (self-host) В отличие от прочих торрент-записей, это программа, которую вы запускаете сами: самостоятельно размещаемый краулер, слушающий сеть BitTorrent DHT и строящий ваш собственный торрент-индекс. Его содержимое целиком зависит от вашего обхода, публичного сайта или общей базы для поиска не существует. После запуска он открывает локальные интерфейсы GraphQL и torznab на вашей машине. Пригодится, если нужен независимый, полностью подконтрольный вам взгляд на то, что циркулирует в DHT, вместо опоры на публичные сайты-индексы.
- GH Archive Непрерывная летопись публичной активности на GitHub: публичная лента событий архивируется почасово с 2011 года и насчитывает миллиарды событий. Это массив данных, а не поисковый сайт: вы скачиваете сжатые gzip файлы JSON за каждый час либо обращаетесь к публичному набору данных в BigQuery; поискового API по отдельным записям и веб-формы поиска нет. Исследователи используют его, чтобы анализировать или восстанавливать историческую активность GitHub в офлайне.
- Sourcegraph (public code search) Поиск по коду в миллионах публичных репозиториев, позволяющий найти, где встречается фрагмент, идентификатор или строка в любом месте открытого кода. Поиск ведётся через веб-интерфейс; конечная точка GraphQL также отвечает на публичные запросы без токена. Полезен всякий раз, когда вопрос охватывает множество кодовых баз сразу, а не один проект. После перехода компании к закрытому коду будущее бесплатного публичного доступа неопределённо, поэтому относитесь к нему как к удобству, которое может измениться.
- ccMixter Сайт сообщества с музыкой, ремиксами, сэмплами и а капеллами под лицензиями Creative Commons — порядка десятков тысяч CC-треков. Поиск и просмотр происходят на самом сайте; устаревший API запросов существует, но наши проверки не прошёл. Здесь ищут переиспользуемые музыкальные дорожки и ремиксы под открытыми лицензиями. Состояние сейчас неопределённое: при повторных проверках сайт был недоступен и, возможно, не работает, поэтому если он не открывается, зайдите позже.
- GifCities (GeoCities GIFs) Специализированный поисковик по анимированным GIF, спасённым с GeoCities, перестроенный в 2025 году с семантическим поиском. Введите запрос — и он вернёт подходящие GIF из спасённого корпуса; его открытая поисковая конечная точка позволяет этому сайту обращаться к нему напрямую. Пригодится при изучении веб-эстетики 1990-х или в поисках конкретного образца графики раннего веба. Изображения API
- OoCities Зеркало и восстановление страниц GeoCities, сохранённых до закрытия сервиса, с навигацией по исходным путям «районов». API нет: вы просматриваете сайт или пользуетесь его формой поиска, на которую мы даём ссылку. Пригодится, когда нужно вернуться к конкретной домашней странице GeoCities или побродить по старой структуре «районов» в её прежнем виде.
- GeoCities.ws Ещё одно зеркало GeoCities в связке с бесплатным ретро-хостингом, так что архивные страницы соседствуют с недавно размещёнными. API у него нет — пользуйтесь просмотром и формой поиска на сайте по предоставленной ссылке. Удобно как второе место для проверки, когда страницы GeoCities нет в других зеркалах. Сейчас работает с ограничениями и может показать CAPTCHA перед входом. капча
- ReoCities Одно из первых спасательных зеркал, созданных при закрытии GeoCities в 2009 году; хранит страницы, сохранённые в ходе той операции. Просмотр и поиск ведутся на самом сайте; API нет, поэтому мы даём ссылку на его форму поиска. Как один из нескольких независимых спасательных проектов он может хранить страницы, пропущенные другими зеркалами, поэтому его стоит проверить, когда страницу не удаётся найти больше нигде.
- IA GeoCities Collection Отдельный обход GeoCities силами Internet Archive — тот самый корпус, на котором работает GifCities. Доступ к нему идёт через индекс CDX Wayback Machine, ограниченный доменом geocities.com, поэтому этот сайт может обращаться к нему напрямую и возвращать списки снимков с временными метками. Самый систематичный способ найти архивные копии конкретного URL из GeoCities, хотя запросы бывают медленными. API
- Cameron's World Не поисковый инструмент, а произведение веб-арта: кураторский интерактивный коллаж, собранный из графики и GIF с GeoCities. Достаточно зайти и прокручивать страницу; API и функции поиска нет, поэтому он указан как ссылка. Стоит заглянуть, чтобы почувствовать визуальную культуру эпохи GeoCities, или как отправная точка для знакомства с тем, как выглядел любительский веб 1990-х.
- ProtoWeb Сервис для винтажных вычислений: HTTP-прокси, отдающий восстановленные сайты 1990-х старым браузерам соответствующей эпохи. Вы направляете винтажный браузер или эмулятор на этот прокси и просматриваете ранний веб из его кеша восстановленных сайтов; API нет, и мы даём только ссылку. Интересен, когда хочется увидеть старые сайты на программном обеспечении их времени. Сейчас работает с ограничениями и может показать CAPTCHA. капча
- oldweb.today Позволяет открывать архивные веб-страницы в эмулируемых винтажных браузерах, работающих прямо в вашем современном браузере, а содержимое подтягивается из Wayback и других архивов Memento. Работа полностью интерактивна и ведётся на сайте: выберите браузер и дату, введите URL; API нет. Исследователи обращаются к нему, когда то, как отображалась страница, важно не меньше того, что на ней было написано.
- Marginalia Search Независимый поисковик с собственным краулером, ориентированный на маленький, старый, насыщенный текстом некоммерческий веб. Искать можно на самом сайте, а его открытый публичный API позволяет этому сайту обращаться к нему напрямую. Пригодится в поисках личных домашних страниц, любительских сайтов и развёрнутых текстов из тихих уголков веба, которые массовые поисковики обычно прячут. Полнотекстовый поиск по вебу API
- Wiby Поисковик, посвящённый любительским страницам и раннему вебу, с кнопкой «surprise me», которая выдаёт случайную старую страницу. Искать можно на самом сайте или через его простую поисковую конечную точку JSON, к которой этот сайт может обращаться напрямую. Хорош для случайных находок в классическом вебе и для поиска маленьких страниц ручной работы по нужной теме. Полнотекстовый поиск по вебу API
- Mojeek Независимый британский поисковик, который использует собственный краулер, а не перепродаёт результаты Bing или Google. Поиск ведётся через обычный веб-интерфейс; платный коммерческий API существует, но здесь не используется, поэтому мы даём внешнюю ссылку на сайт. Полезен, когда нужен индекс, который не просто повторяет взгляд на веб крупных поисковиков.
- Stract Поисковик с открытым исходным кодом, финансируемый NLnet и задуманный настраиваемым и пригодным для самостоятельного развёртывания. Поиск ведётся на его сайте; публичный API не документирован, поэтому мы даём ссылку на форму поиска, а не отправляем запросы. Вариант для тех, кому нужен независимый прозрачный индекс или собственный его экземпляр.
- Million Short Поисковик с изюминкой: он намеренно убирает из выдачи самые популярные сайты, чтобы на поверхность вышли малоизвестные страницы. Пользоваться нужно его веб-формой поиска напрямую, API нет. Помогает пробиться сквозь привычные доминирующие домены при исследовании темы. Сейчас работает с ограничениями, и вы можете столкнуться с CAPTCHA. капча
- Teclis Некоммерческий поисковый индекс «творческого веба» — небольших независимых сайтов, — который сегодня служит внутренним индексом Kagi. Поиск ведётся на его собственном сайте; программный доступ существует только через платный API Kagi, поэтому здесь приводится ссылка, а не запрос. Попробуйте его, когда массовые поисковики заглушают те самые небольшие сайты, которые вам нужны.
- Google Groups Usenet Архив новостных групп Usenet от Google, построенный на коллекции DejaNews, с обсуждениями начиная с 1981 года. С 2024 года он заморожен и доступен только для чтения, API нет — поиск и чтение идут через веб-интерфейс Google Groups, на который мы даём ссылку. По-прежнему одно из самых глубоких мест для поиска многолетних тредов из новостных групп и исторических онлайн-обсуждений. Нишевые тексты
- Usenet Archives Независимый бесплатный веб-архив, содержащий сотни миллионов исторических сообщений Usenet. Поиск и чтение происходят на самом сайте; API нет, поэтому сервис представлен здесь ссылкой. Полезная альтернатива или дополнение к Google Groups при розыске старых обсуждений в новостных группах.
- Narkive Давно работающий веб-архив Usenet, позволяющий искать и читать исторические сообщения новостных групп. API нет; вы пользуетесь формой поиска на сайте, на который мы даём ссылку. Стоит проверять наряду с другими архивами Usenet, поскольку каждый охватывает и показывает материал немного по-своему.
- textfiles.com Курируемый Джейсоном Скоттом архив эпохи BBS: текстовые файлы, зины, документы о фрикинге и списки BBS из доинтернетного онлайн-мира. Это простой сайт для просмотра без API — вы изучаете его напрямую по приведённой ссылке. Опорная точка для исследования культуры BBS и ранних онлайн-текстов.
- DiscMaster (files inside old discs) Выдающийся инструмент, который ищет внутри файлов: полнотекстовый и файловый поиск по миллионам винтажных файлов, содержащихся в старых образах дисков на archive.org. У него есть рабочая точка поиска, поэтому наш сайт может как обращаться к нему напрямую, так и просто дать ссылку. Обращайтесь к нему, когда разыскиваете конкретную старую шареварную программу, документ или изображение, поставлявшиеся на CD или дискете, — обычному веб-поиску такой контент не виден. Нишевые тексты API
- MobyGames Исчерпывающий каталог истории видеоигр, охватывающий игры на всех платформах. Поиск выполняется на сайте; API существует, но требует ключа. Это эталонный справочник, когда нужна каталожная запись о конкретной игре. Сейчас работает с перебоями: сайт может выдать CAPTCHA. капча
- IA MS-DOS / Software Library Библиотека игр для MS-DOS и исторического ПО на Internet Archive, запускаемых в браузере через эмуляцию. Поиск доступен через интерфейс advancedsearch у IA, к которому наш сайт обращается напрямую, а сами материалы запускаются прямо в браузере на archive.org. Самый быстрый способ найти и действительно запустить винтажную программу, ничего не устанавливая. Программы и пакеты API
- My Abandonware Большая база abandonware — игр 1980–90-х годов для DOS, Windows, Amiga и консолей, где рядом с каталожными записями лежат загрузки. API нет; поиск и просмотр идут на самом сайте по приведённой ссылке. Практичный вариант, когда нужно опознать или добыть старую игру, которая больше не продаётся. Программы и пакеты
- Europeana Агрегатор культурного наследия Европы, объединяющий более 50 миллионов оцифрованных объектов из европейских галерей, библиотек, архивов и музеев. Поиск ведётся на его сайте; доступен также API с бесплатным ключом. Естественная первая остановка при поиске оцифрованных европейских культурных материалов сразу по многим учреждениям.
- DPLA Digital Public Library of America сводит оцифрованные объекты из библиотек, архивов и музеев по всем Соединённым Штатам в единый поисковый индекс. Поиск выполняется на её сайте; доступен также API с бесплатным ключом. Обращайтесь к ней при поиске американских исторических материалов, когда неизвестно, какое учреждение их хранит.
- Smithsonian Open Access Записи Open Access из всех музеев Smithsonian, объединяющие метаданные коллекций с медиафайлами под CC0, которые можно свободно использовать повторно. Поиск происходит на сайте Smithsonian; API существует и работает через ключ api.data.gov. Ценен для поиска пригодных к повторному использованию музейных изображений и записей об объектах в одном месте. Сейчас работает с перебоями: возможны прерывания из-за CAPTCHA. капча
- Met Museum API Полные записи коллекции Metropolitan Museum of Art с метаданными объектов и изображениями открытого доступа. Музей предоставляет публичный API без ключа, поэтому данные коллекции можно искать прямо с этого сайта без какой-либо учётной записи. Полезен для искусствоведческих исследований и для подбора музейных изображений под открытыми лицензиями. Наши проверки сейчас оценивают его состояние как ухудшенное, поэтому отклики могут быть нестабильными. Культурное наследие API
- Rijksmuseum API Онлайн-коллекция нидерландского национального музея с метаданными объектов и изображениями высокого разрешения. Поиск по коллекции ведётся на сайте музея; доступен также API с бесплатным ключом. Первоисточник при исследовании нидерландского искусства и истории или при поиске качественных изображений музейных предметов.
- Chronicling America (LoC) Собрание Библиотеки Конгресса, включающее страницы исторических газет США с 1700-х по 1960-е годы с полным текстом OCR, благодаря которому сами страницы доступны для поиска. Поиск ведётся через сайт loc.gov, который может также возвращать простой JSON без ключа. Незаменим для поиска газетных публикаций своего времени, имён и событий в американской прессе. Учтите, что устаревший адрес chroniclingamerica.loc.gov объявлен нерекомендуемым — используйте loc.gov. API
- crt.sh (Cert Transparency) Окно с возможностью запросов в журналы Certificate Transparency — публичный реестр TLS-сертификатов, — что делает его способом обнаружить исторические сертификаты и поддомены домена. Запрос выполняется на сайте, и тот же запрос может вернуть JSON без ключа. Исследователи используют его, чтобы восстановить историю инфраструктуры домена. Сервис часто перегружен и под нагрузкой выдаёт ошибки, поэтому при сбое запрос стоит повторить. Веб-страницы и сайты
- Censys Search Индекс общеинтернетного сканирования хостов и сертификатов, близкий по назначению к Shodan. Поиск ведётся через его веб-интерфейс; API с бесплатным тарифом существует, но требует ключа, поэтому здесь приводится ссылка, а не запрос. Актуален при выяснении того, что хост или домен выставляет в интернет, и каков его сертификатный след. Сейчас работает с перебоями: сайт может выставить CAPTCHA. капча
- Shodan Поисковая система по подключённым к интернету устройствам и сервисам, которая к тому же хранит исторические баннеры сервисов. Запросы выполняются через её собственный веб-интерфейс, на который мы даём ссылку; официальный API существует, но требует ключа и в основном платный. Исследователи обращаются к нему, чтобы проследить, какие сервисы или программы хост выставлял со временем, — в рамках работы с историей доменов и инфраструктуры.
- Intelligence X Intelligence X — поисковый OSINT-сервис, охватывающий пасты, содержимое даркнета, утечки данных и записи whois, с «машиной времени» для материалов, которые с тех пор были удалены. Вы пользуетесь им на его собственном сайте по нашей ссылке; его API требует ключа, а более глубокие данные доступны на платных тарифах. Стоит заглянуть, когда вы разыскиваете удалённые пасты или слитые материалы, которые обычные веб-архивы так и не захватили.
- Have I Been Pwned (pwned passwords) Индекс учётных записей и учётных данных, которые появлялись в известных утечках данных. Диапазонная точка Pwned Passwords работает без ключа, поэтому наш поиск может обращаться к ней напрямую, тогда как более полный API поиска по утечкам платный, а проверка отдельных учётных записей выполняется на самом сайте. Используйте его, чтобы подтвердить, всплывали ли учётные данные в утечке. По нашим последним проверкам сервис помечен как работающий с перебоями, поэтому сайт может быть доступен нестабильно. API
- Ahmia (Tor index) Поисковая система в обычном вебе, индексирующая скрытые сервисы .onion в сети Tor, с фильтрацией противоправного контента в результатах. API нет; запросы выполняются в её собственной форме поиска, на которую мы даём ссылку. Это практичный способ находить содержимое onion-сайтов из обычного веба, что делает её отправной точкой для исследований, связанных с даркнетом.
- APKMirror Архив исторических версий Android APK, где размещаются подписанные и проверенные пакеты. API нет, поэтому просмотр и поиск идут на самом сайте по нашей ссылке. Обращайтесь к нему, когда нужен прежний выпуск Android-приложения, которого текущие магазины приложений больше не предлагают. Программы и пакеты
- F-Droid Репозиторий свободных Android-приложений с открытым исходным кодом, который хранит полный архив версий и собирает пакеты воспроизводимо. Его индекс пакетов публикуется как JSON без ключа, поэтому наш поиск может обращаться к нему напрямую и одновременно давать ссылку на сайт. То место, где стоит искать текущие и прежние версии свободных Android-приложений. Программы и пакеты API
- PyPI Индекс пакетов сообщества Python, содержащий все опубликованные версии каждого пакета вместе со структурированными метаданными. Искать можно на сайте, а его JSON API без ключа позволяет нашему поиску получать сведения о пакетах напрямую. Полезен для программной археологии: получения старого выпуска библиотеки или проверки истории версий пакета. Программы и пакеты API
- npm registry Реестр пакетов, на котором держится экосистема Node.js, с полной историей версий и загружаемыми tarball-архивами для каждого пакета. Базовый API реестра работает без ключа, и наш поиск обращается к нему напрямую. Обращайтесь к нему, чтобы проследить историю выпусков JavaScript-пакета или получить старую версию. Учтите, что сам сайт npmjs.com сейчас проверяет трафик из сетей центров обработки данных, поэтому прямые ссылки на страницы пакетов могут сначала показывать шаг проверки. Программы и пакеты API капча
- OldMapsOnline Портал для поиска географически привязанных исторических карт, хранящихся в учреждениях по всему миру, который указывает на собрание, где находится каждая карта. Он предлагает географический API поиска (по ограничивающему прямоугольнику) и точки доступа IIIF, но мы показываем его как ссылку на его собственную форму поиска. Сейчас помечен как работающий с перебоями: сайт может выдать CAPTCHA перед тем, как впустить вас. Культурное наследие капча
- David Rumsey Maps Одно из ведущих оцифрованных собраний исторических карт, предлагающее сканы высокого разрешения, многие из которых географически привязаны, на платформе Luna. Существуют частичные API Luna и IIIF, но практичный путь — собственный поисковый интерфейс сайта, на который мы даём ссылку. Первая остановка, когда нужен качественный скан старой карты.
- OSM / Overpass OpenStreetMap — карта мира, создаваемая совместными усилиями участников; Overpass API предоставляет структурированные запросы только на чтение к её данным, а полные дампы истории сохраняют прошлые состояния карты. Overpass не требует ключа (действуют ограничения вежливого использования), и наш поиск может обращаться к нему напрямую. Полезен, когда нужно узнать, какие объекты нанесены на карту в определённом месте, или изучить историю правок карты. API
- GDELT Проект глобального мониторинга новостей, отслеживающий события и тональность в мировых СМИ, включая телевизионные новости. Его API документов не требует ключа, поэтому наш поиск обращается к нему напрямую в дополнение к ссылке на сайт проекта. Используйте его, чтобы найти освещение события сразу во многих странах и изданиях. API
- IA TV News Archive Коллекция TV News от Internet Archive делает американские и зарубежные телевизионные новости с 2009 года доступными для поиска по тексту скрытых субтитров. Обращение к ней идёт через поисковый API Internet Archive, не требующий ключа, которым наш сайт пользуется напрямую. Незаменима, когда нужно установить, когда и где что-то прозвучало в телеэфире. Видео, аудио, музыка API
- Radio Garden Интерактивный глобус для настройки на тысячи радиостанций прямого эфира по всему миру. Существует неофициальный API без ключа, к которому наш поиск может обращаться наряду со ссылкой на сам интерфейс-глобус. Это скорее инструмент прослушивания в прямом эфире, чем архив, но он удобен для поиска станций по месту. API
- IA Live Music (etree) Коллекция живой музыки Internet Archive (etree) содержит легальные любительские записи концертов. Она доступна для поиска через поисковый API Архива, не требующий ключа, поэтому результаты появляются прямо в нашем поиске, а также на archive.org. Место, где стоит искать записи прошлых выступлений группы. Видео, аудио, музыка API
- Zenodo Универсальный репозиторий CERN для исследовательских данных и программного обеспечения, где каждый депозит получает DOI. У него есть API для чтения без ключа, но сервис заблокировал адреса, с которых мы вели проверку, поэтому пока мы даём ссылку на его собственный поиск вместо прямых запросов. Обращайтесь к нему в поисках наборов данных, релизов программ или дополнительных материалов к опубликованным исследованиям. Его статус неопределён только с нашей точки наблюдения; известно, что в остальном сервис работает, поэтому у вас ссылка должна открыться. Наборы данных
- Figshare Репозиторий, куда исследователи размещают наборы данных, иллюстрации, постеры и другие дополнительные материалы. Его API для чтения не требует ключа, и наш поиск обращается к нему напрямую; кроме того, материалы можно просматривать на сайте. Полезен, когда данные, лежащие в основе статьи, опубликованы отдельно от неё. Наборы данных API
- Harvard Dataverse Гарвардский экземпляр платформы Dataverse — крупный репозиторий исследовательских данных. Поисковый API не требует ключа, и наш поиск обращается к нему напрямую; на сайте доступен тот же поиск для просмотра. Стандартная точка обращения при поиске академических наборов данных. Наборы данных API
- OSF Open Science Framework — платформа для научного сотрудничества, на которой размещаются материалы проектов, данные и реестр препринтов. Её API для чтения не требует ключа, что позволяет нашему поиску обращаться к ней напрямую. Полезна для поиска препринтов и материалов исследовательских проектов, никогда не выходивших в журналах. Наборы данных API
- Hugging Face Datasets Крупнейший хаб наборов данных (и моделей) для машинного обучения, каждый из которых снабжён подробными метаданными. Результаты поиска отдаёт API без ключа, к которому наш сайт обращается напрямую, а всё содержимое доступно для просмотра на сайте. Место, куда стоит обращаться в первую очередь за опубликованным набором данных для машинного обучения или его документацией. Наборы данных API
- Archive of Our Own Archive of Our Own, который ведёт Organization for Transformative Works, — крупнейший архив фанфикшена. Официального API у него нет из принципиальных соображений, поэтому мы даём ссылку на его собственный интерфейс поиска и фильтрации. Незаменим для любых исследований фанатского творчества. Сейчас помечен как работающий с перебоями: ожидайте этап проверки браузера перед загрузкой сайта. Нишевые тексты капча
- FanFiction.Net Ветеран среди сайтов фанфикшена, чьи собрания относятся к эпохе до появления AO3. API нет, а сайт закрыт защитой Cloudflare, поэтому он представлен ссылкой на форму поиска. Стоит проверить в поисках старых фанатских работ того раннего периода. Помечен как работающий с перебоями: возможно, потребуется пройти проверку, чтобы попасть на сайт. капча
- Fanlore Вики, которую ведёт Organization for Transformative Works, документирующая историю фандомов, сами фандомы и фанатскую терминологию. Как сайт на MediaWiki она имеет стандартный API без ключа, но сейчас мы представляем её ссылкой на собственный поиск. Это справочное издание для понимания фандомного контекста вокруг заархивированных фанатских работ. Помечена как работающая с перебоями: сайт может потребовать проверки браузера перед загрузкой. капча
- WikiTeam dumps Сохранённые дампы более 600 000 вики, включая сообщества Fandom/Wikia и нишевые сайты на MediaWiki, размещённые в Internet Archive. Коллекция доступна для поиска через поисковый API Архива без ключа, которым наш сайт пользуется напрямую. Место, куда стоит обратиться, когда вики исчезла, а её содержимое нужно вернуть. Нишевые тексты API
- Discogs Краудсорсинговая база музыкальных изданий и физических тиражей вместе с торговой площадкой. Её поисковый API требует токена, поэтому мы представляем сервис ссылкой на собственный поиск сайта. Стандартный справочник по дискографиям и по определению конкретного тиража издания. Помечен как работающий с перебоями: между вами и сайтом может встать CAPTCHA. капча
- MusicBrainz Открытая музыкальная энциклопедия, присваивающая канонические идентификаторы (MBID) исполнителям и изданиям. Её веб-сервисный API не требует ключа, ограничен одним запросом в секунду, и наш поиск обращается к нему напрямую. Основной источник чистых структурированных музыкальных метаданных. Видео, аудио, музыка API
- Genius База текстов песен вместе с аннотациями к ним. Её поисковый API требует токена OAuth, поэтому вместо прямых запросов мы даём ссылку на собственный поиск сайта. Полезна для уточнения текстов и аннотированного контекста вокруг них.
- CourtListener / RECAP Бесплатный архив прецедентного права США, судебных документов, собранных из PACER силами проекта RECAP, и аудиозаписей устных слушаний. Его поисковый REST API работает без ключа (токен повышает лимиты запросов), и наш поиск обращается к нему напрямую. Первое, к чему стоит обратиться при бесплатном поиске американских судебных материалов. Культурное наследие API
- PatentsView (USPTO) Сервис патентных данных USPTO, отличительная черта которого — записи об изобретателях и правообладателях с разрешённой неоднозначностью. Поисковый API требует бесплатного ключа и структурированных запросов, поэтому пока мы даём ссылку на его поисковый интерфейс вместо прямых обращений. Полезен, когда нужно проследить патенты конкретного изобретателя или компании, а не просто найти документы по совпадению ключевых слов.
- Google Patents Полнотекстовый поиск патентов, охватывающий патентные ведомства всего мира, а также непатентную литературу. Официального API нет (данные отдельно доступны как публичный набор данных BigQuery), поэтому поиск вы выполняете на самом сайте по нашей ссылке. Один из самых удобных единых интерфейсов для глобального поиска патентов. Научные статьи
- Espacenet / EPO OPS Всемирный патентный поиск Европейского патентного ведомства вместе с REST API Open Patent Services. API требует ключа OAuth (существует бесплатный тариф), поэтому сейчас мы вместо этого даём ссылку на поисковый интерфейс Espacenet. Используйте его для поиска по всемирной патентной базе EPO. Помечен как работающий с перебоями: сайт может выводить проверку перед загрузкой. капча
- FamilySearch Крупнейший в мире бесплатный архив генеалогических документов, который ведёт Церковь Иисуса Христа Святых последних дней (LDS Church). Его REST API требует одобренного ключа и входа в систему, поэтому мы даём ссылку на собственный поиск по документам на сайте. Стандартная бесплатная отправная точка для генеалогических исследований.
- pouet.net (demoscene) Каноническая база данных демосцены, документирующая работы, пати и группы начиная с 1990-х годов. Её данные публикуются в виде периодических дампов JSON (data.pouet.net), которыми может пользоваться наш поиск, наряду с собственным просмотром и поиском на сайте. Справочный источник при изучении релизов демосцены или истории групп. API
- 16colo.rs (ANSI/ASCII art) Архив артпаков ANSI и ASCII из BBS-артсцены с материалами, восходящими к началу 1990-х. Заявлен API без ключа, но наша проверка его не подтвердила, поэтому мы даём ссылку на собственный просмотр и поиск на сайте. Основное хранилище сохранённой графики эпохи BBS; обращайтесь к нему при изучении артсцены или поиске конкретного артпака.
- ASCII Art Archive Большая тематически упорядоченная библиотека классического ASCII-арта в виде отдельных изображений. API нет; рубрики вы просматриваете на самом сайте по нашей ссылке. Удобна, когда нужны примеры традиционной графики ASCII, упорядоченные по темам.
- CyberLeninka (КиберЛенинка) Крупнейшая русскоязычная научная библиотека открытого доступа: полные тексты журнальных статей по всем дисциплинам, бесплатные для чтения без регистрации. Поиск по названию, автору или теме ведётся в веб-интерфейсе; официального публичного API нет, поэтому этот сайт отдаётся вам в виде поисковой ссылки. Первое, к чему стоит обратиться за русскоязычными статьями, которые западные указатели (Crossref, OpenAlex) часто упускают. Научные статьи
- НЭБ. National Electronic Library (rusneb.ru) Национальная электронная библиотека России объединяет оцифрованные книги, периодику и диссертации из Российской государственной библиотеки и учреждений-партнёров. Сканы, перешедшие в общественное достояние, можно читать прямо в веб-просмотрщике; произведения, защищённые авторским правом, доступны только в читальных залах. Поиск по собранию ведётся на сайте; библиотека полезна для дореволюционной и советской русской печати, которой больше нигде в сети нет. Во время нашей последней проверки сайт был недоступен, поэтому доступность может различаться.
- End of Term Web Archive Совместный проект Internet Archive, Library of Congress и университетов-партнёров, который обходит сайты федерального правительства США при каждой смене президентской администрации. Он сохраняет содержимое зон .gov и .mil, регулярно исчезающее при смене администраций, — страницы, отчёты и наборы данных, удалённые с действующих сайтов. Через портал проекта вы попадаете к обходам за каждый срок, которые воспроизводятся в wayback-экземплярах партнёров. Обращайтесь к нему, когда государственная страница пропала где-то около выборов.