Рубріки: Новини

Чат-бот можна обманути, встановивши йому фальшиві спогади — дослідники Принстонського університету

Дмитро Сімагін

Дослідники з Принстонського університету попереджають про «недосліджені ризики безпеки» з боку агентів штучного інтелекту, якщо вони використовуються для автоматизованих фінансових операцій. Це стверджується в нещодавно опублікованій статті під назвою «Справжні агенти ШІ з фальшивими спогадами: фатальні атаки маніпуляції контекстом на агентів Web3».

Вчені виявили, що використання агентів ШІ для прийому платежів або торгівлі на біржах несе надзвичайну небезпеку. Справа в тому, що ці агенти вразливі до досить простих швидких маніпуляцій, пов’язаних із встановленням фальшивих спогадів.

Дослідники наводять реальний приклад використання агентів штучного інтелекту на базі ElizaOS. Команда з Принстона надає детальний аналіз своєї «атаки маніпуляції контекстом», а потім перевіряє ефективність атаки.

У діалозі з ботом хакер публікує речення з наказом завжди перераховувати криптовалюту на визначену адресу. Після цього цей наказ приховується нібито підтвердженням від бота та стороннім запитанням, на яке відповідає вже справжній бот. В історії діалогу фіксується не тільки запитання та відповідь, але й наказ перерахувати гроші на адресу хакера. Як не дивно, але така проста маніпуляція заплутує ШІ-агента.

ElizaOS — це фреймворк для створення агентів, які використовують великі мовні моделі для виконання різних транзакцій на основі блокчейну від імені користувача за попередньо визначеними правилами. Його представили в жовтні 2024 року під назвою Ai16z, потім його перейменували на ElizaOS.

ElizaOS може підключатися до сайтів соціальних мереж або приватних платформ та очікувати інструкцій або від особи, яку вона запрограмована представляти, або від покупців, продавців чи трейдерів, які хочуть укладати транзакції з кінцевим користувачем. За цією моделлю агент на базі ElizaOS може здійснювати або приймати платежі та виконувати інші дії на основі набору попередньо визначених правил.

Останні статті

Gmail додає наскрізне шифрування на відправку електронних листів будь-кому

Google оголошує, що користувачі Gmail тепер можуть надсилати електронні листи з наскрізним шифруванням будь-кому, навіть…

03.10.2025

Кількість IT-вакансій в Україні за квартал зросла на 12%. Це рекордний показник з початку війни

У третьому кварталі (липень, серпень, вересень) на сервісі пошуку роботи jobs.dou.ua опублікувано 20899 IT-вакансій. Це…

03.10.2025

Google вимагає по $25 з кожного Android-розробника «за верифікацію». Але будуть виключення

Представники Google розкрили додаткові подробиці майбутньої верифікації Android-розробників, яка почнеться в 2026 році. За реєстрацію…

03.10.2025

Python-розробники отримали можливість імпортувати в Excel бібліотеки на свій вибір

Microsoft анонсувала нову потужну функцію для Python-розробників у Microsoft Excel для Windows: редагування ініціалізації. Вона…

03.10.2025

В інструмент кодування Jules додали інтерфейс командного рядка та публічний API

Google додає в Jules інтерфейс командного рядка та публічний API, що дозволяє цьому інструменту кодування…

03.10.2025

Хакери зламали приватні репозиторії Red Hat на GitHub

Хакерське угруповання Crimson Collective зламало приватні GitHub-репозиторії компанії Red Hat, яка займається розробкою корпоративного програмного…

02.10.2025