На 1 януари 2026 г. изследователският екип на Cybernews откри огромен отворен Elasticsearch клъстър, съдържащ над 160 индекса и приблизително 8,73 милиарда записа, предимно от Китай. Данните варират от национални идентификационни номера на граждани до корпоративни документи и записи от социални платформи.
Според експертите това е един от най-големите случаи на изтичане на данни в Elasticsearch, регистрирани някога.
Видове изтекла информация
Експертите категоризират изтеклите данни в четири основни групи:
1. Лична идентифицираща информация (PII):
-
Пълни имена
-
Национални идентификационни номера
-
Адреси и дати на раждане
-
Телефонни номера
-
Пол и демографски данни
2. Данни за акаунти и платформи:
-
Идентификатори от социални мрежи и мессенджъри
-
Имейл адреси
-
Потребителски имена и препратки към специфични платформи
3. Данни за автентикация:
-
Плейнтекстови и слабо защитени пароли
-
Креденшъли за множество акаунти
4. Корпоративни и бизнес записи:
-
Данни за регистрация на компании
-
Легални представители и контактна информация
-
Адреси за регистрация и лицензиране
Структура и начин на събиране
Клъстърът е високо организиран и тематично сегментиран, с индекси, фокусирани върху телефони, идентификатори и акаунти. Метаданните показват, че данните са събирани през 2025 г., като присъстват времеви марки и дати на импорт, което подсказва продължителна, целенасочена агрегация, а не единична историческа пробивна атака.
Инфраструктурата е хоствана на bulletproof hosting доставчик, обичайно асоцииран с високорискови или некоректни операции с данни, което предполага умишлено събиране, а не случайна експозиция.
Рискове за милиони хора
Въпреки че клъстърът е бил достъпен само около три седмици, мащабът на данните означава, че автоматизирано извличане би могло да доведе до масово разпространение.
Някои от основните рискове включват:
-
Кражба на идентичност: комбинацията от PII и национални идентификатори позволява създаване на фалшиви акаунти и измами.
-
Account takeover: плейнтекстови пароли позволяват атаки чрез credential stuffing, тъй като потребителите често използват една и съща парола на множество платформи.
-
Финансови измами: корпоративните записи и контактните данни могат да бъдат използвани за измами или социално инженерство.
Китайският контекст: повторение на тенденции
Това изтичане е поредното в серия от крупни китайски пробиви на данни:
-
Септември 2025 г.: над 500 GB документи от програмата за интернет цензура на Китай (Great Firewall) станаха публични.
-
Май 2025 г.: над 4 милиарда записа с финансови и лични данни от WeChat и Alipay.
-
2024 г.: COMB база данни с над 1,2 милиарда записа, включваща QQ, Weibo и куриерски услуги.
-
2022 г.: 23 TB база данни, покриваща информация за около един милиард китайски граждани, предполагаемо открадната от полицията в Шанхай.
Откритието подчертава системен риск за поверителността и потенциално засяга стотици милиони индивиди. Масивната агрегация на лични и корпоративни данни извън регулаторен контрол показва колко лесно подобни системи могат да се превърнат в инструмент за злоупотреби, включително кражба на идентичност, финансови измами и акаунт хаквания.









