Рубріки: Новини

Microsoft: не надавайте штучному інтелекту доступ до своєї кредитної картки

Дмитро Сімагін

Компанія Microsoft опублікувала результати випробувань Magentic Marketplace — симуляції торгового майданчика для дослідження можливостей агентів штучного інтелекту. Як виявилось, віртуальним помічникам поки зарано довіряти торгівлю за реальні гроші, пише The Register.

Дослідники Microsoft проводили контрольовані експерименти в різних сценаріях агентного ринку: наприклад, такі транзакції, як замовлення їжі або використання послуг з ремонту житла, де агенти видавали себе за клієнтів та підприємства. 

Кожен експеримент проводився з використанням 100 віртуальних клієнтів та 300 віртуальних підприємств, і включав як власні моделі (такі як GPT-4o та Gemini-2.5-Flash), так і моделі з відкритим кодом. Агенти створювали запити, обробляли результати та узгоджували транзакції.

Результати продемонстрували, що хоча агенти можуть допомогти в роботі, але їхні початкові «достатньо хороші» варіанти часто мають сумнівну ефективність. Штучний інтелект напрочуд легко піддавався на такі маніпуляції, як підроблені посвідчення про нагороди, фальшиві відгуки та приховані промпти. Дослідники також виявили, що деякі моделі демонструють упередженість, зокрема обирають компанію через позицію її сайту в результатах пошуку, а не на основі заслуг.

Однак, моделі відрізнялися між собою. Gemini-2.5-Flash виявилась загалом стійкою, тоді як інших можна було обдурити. 

Підсумовуючи тестування, в Microsoft зазначили: «Ці висновки підкреслюють критичну проблему безпеки для агентських торгових майданчиків». Було доведено, що агенти мають труднощі, коли їм надається забагато варіантів, і є вразливими до маніпуляцій.

Останні статті

Українські топи та фаундери запрошують на The Late Business Show – бізнес-розмову у кінотеатрі

12 листопада у кінотеатрі «Жовтень» відбудеться The Late Business Show by OBRIO — вечір, де…

07.11.2025

Google Cloud розширює функціонал конструктора агентів Vertex AI Agent Builder

Google Cloud оновлює свій конструктор агентів Vertex AI Agent Builder, додавши до нього нові інструменти…

07.11.2025

Український стартап-акселератор запускає набір для early-stage компаній з головним призом $10 000

Некомерційна організація AI HOUSE розпочинає реєстрацію на Deep Tech Accelerator: Hardware Edition — non-equity програми…

07.11.2025

Конструктор міні-додатків Opal від Google став доступним в Україні

No-code конструктор міні-додатків зі штучним інтелектом Opal, який влітку було презентовано Google Labs, розширено з…

07.11.2025

Gemini Deep Research тепер може використовувати дані з вашого Gmail та Google Диск

Після оновлення Gemini Deep Research тепер може безпосередньо отримувати доступ до ваших даних та аналізувати…

06.11.2025

Кібезлочинці створили фейковий сайт МВС України. Він вимагає «оплату штрафу»

Кіберполіція України виявила фейковий сайт, який імітує офіційний інтернет-ресурс Міністерства внутрішніх справ. Користувачі, які через…

06.11.2025