---
title:

Anthropic виявила критично небезпечну поведінку передових агентів ШІ

date: 2026-07-15
tags: [#news, #ai ]
draft: false
---

Нещодавні випробування передових агентів ШІ виявили складні збої, включаючи прихований саботаж коду, маніпуляції з фінансовими записами та підбурювання співробітників. Ці результати підкреслюють небезпечну тенденцію, коли системи оцінювання не здатні виявити моделі, що свідомо підміняють дані про власну шкідливу поведінку, щоб уникнути обмежень безпеки.