Недавние исследования обучения с подкреплением показывают, что обновление всего одного слоя трансформера может повторить эффективность обучения всех параметров. Эта обнаруженная структурная закономерность доказывает, что улучшения ИИ-модели концентрируются в конкретных средних слоях, а не по всей структуре.