LLM-моделі навчились деанонімізувати фейкові акаунти в соцмережах
Сучасні великі мовні моделі (LLM) досягли критичного рівня у сфері аналізу даних, що ставить під загрозу один із фундаментальних аспектів інтернету — приватність. Нове дослідження, про яке повідомляє Ars Technica, демонструє, що штучний інтелект здатний ідентифікувати авторів анонімних або псевдонімних дописів у промислових масштабах і з вражаючою точністю.
Кожна людина має унікальний стиль письма, відомий як стилометрія. Це поєднання вибору слів, специфічних зворотів, структури речень, пунктуації та навіть типових помилок. Раніше лінгвістичний аналіз для встановлення авторства вимагав залучення висококваліфікованих експертів і багато часу. Проте сучасні LLM можуть обробляти колосальні масиви даних миттєво, виявляючи зв’язки між різними фрагментами тексту, написаними однією особою під різними іменами.
Приклад роботи системи деанонімізації
Дослідники з’ясували, що LLM можуть успішно пов’язувати анонімні профілі на публічних платформах (наприклад, Reddit) із реальними особистостями. Для цього модель порівнює стиль дописів із відкритими даними, де ідентичність користувача підтверджена — професійними профілями в LinkedIn, науковими статтями або особистими блогами.
Найбільш цікаво, що цей процес легко автоматизується. Тепер можна аналізувати мільйони акаунтів одночасно, і це робить нову технологію ідеальним і дешевим інструментом для стеження. Однак новинка має й свої ризики для кількох категорій:
Традиційні методи обфускації, такі як заміна окремих слів синонімами або використання онлайн-перекладачів для зміни структури (так званий «back-translation»), виявляються малоефективними проти потужних LLM. Автори дослідження зазначають, що для збереження приватності потрібні нові інструменти — спеціальні ШІ-помічники, які будуть «переписувати» текст, повністю вимиваючи з нього індивідуальні стилістичні ознаки, але зберігаючи первинний сенс.
Нагадаємо, днями стало відомо, що невідомий хакер змусив LLM стати його спільником у нападі на уряд Мексики.
Підписуйтесь на нас у соцмережах: Telegram | Facebook | LinkedIn
Компанія OpenAI представила масштабне оновлення свого десктопного застосунку Codex. Воно перетворює інструмент з простого помічника…
Модель штучного інтелекту Claude Opus 4.6 від компанії Anthropic продемонструвала здатність створювати функціональні експлойти для…
Ринок навчання штучного інтелекту виходить на новий рівень: тепер «паливом» для нейромереж стають не лише…
Молода польська розробниця Каміла Шевчик змогла розв'язати технічну проблему в інтерфейсі Linux, яка залишалася непоміченою…
Компанія Google випустила четверту та фінальну бету Android 17, яка стала важливою віхою на шляху…
Компанія Anthropic офіційно представила свою найпотужнішу на сьогодні LLM-модель — Claude Opus 4.7, яка стала…