Anthropic переходить від методів захисту на рівні моделей до жорсткого контролю середовища для забезпечення безпеки своїх ШІ-агентів. Впроваджуючи ізоляцію файлової системи та суворі мережеві обмеження, компанія прагне мінімізувати ризики, які неможливо надійно контролювати за допомогою запитів на підтвердження чи внутрішніх класифікаторів моделі.