Рубріки: Новини

Microsoft: не надавайте штучному інтелекту доступ до своєї кредитної картки

Дмитро Сімагін

07.11.2025 11:57

Компанія Microsoft опублікувала результати випробувань Magentic Marketplace — симуляції торгового майданчика для дослідження можливостей агентів штучного інтелекту. Як виявилось, віртуальним помічникам поки зарано довіряти торгівлю за реальні гроші, пише The Register.

Дослідники Microsoft проводили контрольовані експерименти в різних сценаріях агентного ринку: наприклад, такі транзакції, як замовлення їжі або використання послуг з ремонту житла, де агенти видавали себе за клієнтів та підприємства.

Кожен експеримент проводився з використанням 100 віртуальних клієнтів та 300 віртуальних підприємств, і включав як власні моделі (такі як GPT-4o та Gemini-2.5-Flash), так і моделі з відкритим кодом. Агенти створювали запити, обробляли результати та узгоджували транзакції.

Результати продемонстрували, що хоча агенти можуть допомогти в роботі, але їхні початкові «достатньо хороші» варіанти часто мають сумнівну ефективність. Штучний інтелект напрочуд легко піддавався на такі маніпуляції, як підроблені посвідчення про нагороди, фальшиві відгуки та приховані промпти. Дослідники також виявили, що деякі моделі демонструють упередженість, зокрема обирають компанію через позицію її сайту в результатах пошуку, а не на основі заслуг.

Однак, моделі відрізнялися між собою. Gemini-2.5-Flash виявилась загалом стійкою, тоді як інших можна було обдурити.

Підсумовуючи тестування, в Microsoft зазначили: «Ці висновки підкреслюють критичну проблему безпеки для агентських торгових майданчиків». Було доведено, що агенти мають труднощі, коли їм надається забагато варіантів, і є вразливими до маніпуляцій.

Наступна стаття Google Cloud розширює функціонал конструктора агентів Vertex AI Agent Builder »

попередня стаття « Український стартап-акселератор запускає набір для early-stage компаній з головним призом $10 000

Дмитро Сімагін

Теги: microsoftагентимаркетплейсштучний інтелект

07.11.2025 11:57

Останні статті

Новини

Співзасновник Apple Стів Возняк пояснив, чому не любить штучний інтелект

Стів Возняк, який 50 років тому разом із Стівом Джобсом стояв біля витоків компанії Apple,…

24.03.2026

Новини

Стейблкоїни на службі тіньової економіки: розбір звіту Chainalysis про китайські схеми

Звіт The 2026 Crypto Crime Report від компанії Chainalysis розкриває масштабну схему легалізації капіталу, де…

24.03.2026

Новини

Скандальний генератор відео Seedance 2.0 став публічно доступним

Генератор відео Seedance 2.0 від китайської компанії ByteDance став доступним у версії для CapCut. На…

24.03.2026

Новини

DarkSword опублікували на GitHub: атаки на українців можуть почастішати

Небезпечний набір експлойтів під назвою DarkSword став публічно доступним. Невідомий опублікував код його нової версії…

24.03.2026

Новини

Майбутнє вже тут: Claude отримав повний контроль над комп’ютером

Компанія Anthropic навчила агента на базі LLM Claude керувати комп'ютером Mac замість користувача. У Claude…

24.03.2026

Новини

Марк Цукерберг тестує персонального ШІ-агента: хоче автоматизувати управління компанією

Марк Цукерберг вирішив особисто протестувати концепцію AI-native, яку він просуває в Meta, почавши розробку власного…

24.03.2026

Microsoft: не надавайте штучному інтелекту доступ до своєї кредитної картки

Схожі статті

Останні статті

Співзасновник Apple Стів Возняк пояснив, чому не любить штучний інтелект

Стейблкоїни на службі тіньової економіки: розбір звіту Chainalysis про китайські схеми

Скандальний генератор відео Seedance 2.0 став публічно доступним

DarkSword опублікували на GitHub: атаки на українців можуть почастішати

Майбутнє вже тут: Claude отримав повний контроль над комп’ютером

Марк Цукерберг тестує персонального ШІ-агента: хоче автоматизувати управління компанією