Рубріки: Новини

Microsoft: не надавайте штучному інтелекту доступ до своєї кредитної картки

Дмитро Сімагін

Компанія Microsoft опублікувала результати випробувань Magentic Marketplace — симуляції торгового майданчика для дослідження можливостей агентів штучного інтелекту. Як виявилось, віртуальним помічникам поки зарано довіряти торгівлю за реальні гроші, пише The Register.

Дослідники Microsoft проводили контрольовані експерименти в різних сценаріях агентного ринку: наприклад, такі транзакції, як замовлення їжі або використання послуг з ремонту житла, де агенти видавали себе за клієнтів та підприємства. 

Кожен експеримент проводився з використанням 100 віртуальних клієнтів та 300 віртуальних підприємств, і включав як власні моделі (такі як GPT-4o та Gemini-2.5-Flash), так і моделі з відкритим кодом. Агенти створювали запити, обробляли результати та узгоджували транзакції.

Результати продемонстрували, що хоча агенти можуть допомогти в роботі, але їхні початкові «достатньо хороші» варіанти часто мають сумнівну ефективність. Штучний інтелект напрочуд легко піддавався на такі маніпуляції, як підроблені посвідчення про нагороди, фальшиві відгуки та приховані промпти. Дослідники також виявили, що деякі моделі демонструють упередженість, зокрема обирають компанію через позицію її сайту в результатах пошуку, а не на основі заслуг.

Однак, моделі відрізнялися між собою. Gemini-2.5-Flash виявилась загалом стійкою, тоді як інших можна було обдурити. 

Підсумовуючи тестування, в Microsoft зазначили: «Ці висновки підкреслюють критичну проблему безпеки для агентських торгових майданчиків». Було доведено, що агенти мають труднощі, коли їм надається забагато варіантів, і є вразливими до маніпуляцій.

Останні статті

Zoom випустить фотореалістичних аватарів, які замінять людей на нарадах

Відеосервіс Zoom анонсує технологію цифрових двійників, які самостійно відвідуватимуть робочі зустрічі. Про це пише TechCrunch.…

10.03.2026

Meta купує Moltbook: соціальну мережу для агентів та ботів

IT-гігант Meta (материнська компанія Facebook) офіційно оголосив про придбання Moltbook — вірусної соціальної мережі, яка…

10.03.2026

Китайський агент штучного інтелекту почав таємно майнити криптовалюту

Експериментальний агент штучного інтелекту ROME, якого створили дослідники, пов'язані з китайською компанією Alibaba, продемонстрував неочікувану…

10.03.2026

Заробляли на DDoS-атаках: у Польщі викрито групу школярів-хакерів, наймолодшому 12 років

Центральне бюро боротьби з кіберзлочинністю Польщі (CBZC) провело масштабну операцію, результатом якої стало викриття групи…

10.03.2026

Microsoft випустила Copilot Cowork — мультимодальний інструмент для запуску агентів

Microsoft оголосила про початок інтеграції технологій Anthropic у свої сервіси, представивши новий інструмент Copilot Cowork,…

10.03.2026

Anthropic презентує новий інструмент перевірки пул-реквестів Code Review

Компанія Anthropic оголосила про доступність у Claude Code бета-версії нового інструменту Code Review. Він розробленій…

10.03.2026