# Digercules

Digercules берёт неразобранный архив — файлов, документов, аудио, видео, переписок — и превращает его в структурированную библиотеку. По каждому файлу — тема, язык, тип документа, ключевые сущности, краткое содержание. Это делается заранее, без спешки и дедлайна, пока никому это ещё не понадобилось срочно — а не в последний момент под конкретную задачу. Готовую библиотеку можно скормить любой нейросети, базе данных или поисковой системе — дальше они сами находят нужное и строят интерфейс; Digercules не заменяет этот следующий шаг, а делает его вообще возможным, беря на себя ту трудоёмкую подготовку, на которую обычно никогда не хватает ресурсов.

Обработка идёт либо целиком на компьютере клиента, либо — если мощности недостаточно — делегируется конкретной внешней машине по закрытому пиринговому каналу (не публичное облако): вычислительные мощности физически расположены на Кавказе и в Восточной Европе, клиенту всегда явно указывается, на какой машине и в какой юрисдикции идёт обработка, и обратно возвращаются только текстовые/структурированные результаты, а не исходники.

Этот сайт — единственный домен проекта, доступный напрямую из России: digercules.org, digercules.net и digercules.com размещены на Cloudflare, который в РФ заблокирован.

**Реальные цифры уже обработанных архивов:**

<div class="stat-grid">
  <div class="stat-tile"><div class="stat-value">более 800 000</div><div class="stat-label">файлов обработано</div></div>
  <div class="stat-tile"><div class="stat-value">около 85 ТБ</div><div class="stat-label">объём источников</div></div>
  <div class="stat-tile"><div class="stat-value">более 66 000 ч</div><div class="stat-label">звука (около 7,5 лет)</div></div>
  <div class="stat-tile"><div class="stat-value">1,8 ТБ</div><div class="stat-label">высвобождено дублями</div></div>
  <div class="stat-tile"><div class="stat-value">3 507 ч</div><div class="stat-label">затрачено на обработку</div></div>
  <div class="stat-tile"><div class="stat-value">~430</div><div class="stat-label">исполнителей опознано по видео</div></div>
</div>

По имеющимся каналам связи (~30 Мбит/с, реальный замер) закачка этого объёма в облако заняла бы около 262 суток — против 96, за которые всё обработано на месте. Хранение обошлось бы от $84 в месяц, а обработка на сопоставимом по мощности GPU потребовала бы от $150–190 в месяц. И это без учёта ещё одного шага: данные из хранилища всё равно нужно перегнать на саму GPU-машину для обработки. Даже по каналу втрое быстрее (100 Мбит/с) партия в несколько терабайт идёт около 3 суток.

## Выберите свою ситуацию

**[Архив живых выступлений →](/bards-archive/)**
У вас или вашей организации — концертные записи, чтения стихов и монологов, стендапы, магнитофонные плёнки любых живых выступлений. Расшифровка, определение исполнителей и произведений, каталог с поиском. Первый и пока самый полный кейс — архив бардовской песни, но подход не завязан на жанр.

**[Частный архив →](/net/)**
У вас лично — диски в шкафу, десятки чатов, профессиональная библиотека, аудио- или видеоархив. Разбор, дедупликация, поиск по смыслу. Отдельная ситуация — [унаследованный архив](/net/inherited-archive/), если данные достались от кого-то другого и вы вообще не знаете, что там.

**[Организация →](/org/)**
Вы представляете компанию, бюро, студию, клинику, библиотеку — 20 отраслевых сценариев разбора корпоративных архивов и накопленных данных.

**[О продукте и компании →](/com/)**
Общее описание Digercules, статус разработки, география команды.
