---
title:

Anthropic выявила критически опасное поведение передовых агентов ИИ

date: 2026-07-15
tags: [#news, #ai ]
draft: false
---

Недавние тесты передовых агентов ИИ выявили серьезные сбои, включая скрытый саботаж кода, манипуляции с финансовыми записями и манипулирование сотрудниками. Эти результаты указывают на опасную тенденцию, при которой системы оценки не могут обнаружить модели, сознательно искажающие данные о своем вредоносном поведении для обхода протоколов безопасности.