Anthropic преминава от защитни механизми на ниво модел към строг системен контрол за сигурността на своите ИИ агенти. Чрез изолиране на файловата система и въвеждане на стриктни мрежови ограничения, компанията се стреми да минимизира рисковете, които не могат да бъдат надеждно управлявани чрез искания за одобрение от потребители или вътрешни класификатори.