Anthropic Academy Courses My Profile Sign Out

Управляемость

Чему вы научитесь

Ориентировочное время: 30 минут

К концу этого урока вы сможете:

  • Объяснить, почему управляемость работает (файнтюнинг научил модель следованию инструкциям) и почему у неё есть лимиты (инструкции выполняются через сопоставление паттернов, а не понимание)
  • Предсказать, где контроль плотнее всего (короткие, конкретные, проверяемые инструкции) против самого слабого (длинные цепочки рассуждений, абстрактные просьбы, задачи на нативную точность)
  • Определить дрейф рассуждений, букву-вместо-духа и хрупкую арифметику как характерные сбои управляемости
  • Распознать системные промпты, выполнение кода, видимые рассуждения и структурированные выводы как продуктовые функции, работающие с этим ограничением

Как управляемость влияет на выводы генеративного ИИ

Модель следует вашим инструкциям так же, как делает всё остальное: продолжая паттерн. Это делает её замечательно управляемой. Это также значит, что всегда есть разрыв между тем, что вы задумывали, и тем, что получилось, и большинство интересных сбоев живёт в этом разрыве.

Насколько вы реально контролируете?

Прежде чем читать: вы просите ИИ написать ровно 100 слов, не больше. Насколько внимательно нужно проверять результат? Выберите точку на континууме, затем зафиксируйте догадку.

Свойства модели:

  • Предсказание следующего токена. Зона возможностей: проторённые пути — резюмирование, переформатирование, объяснение распространённых концептов. Зона ограничений: новая территория, разреженные паттерны, «правда против похожего на правду». Возможности: беглый естественный текст практически в любом стиле; быстрый синтез идей из далёких областей; сильная работа на задачах, похожих на виденные. Сбои: галлюцинации, конфабуляции, нестабильность сэмплирования, неуместная уверенность. Продукты: цитаты и привязка к источникам, сигнализация неопределённости, ограниченная генерация и навыки.
  • Знания. Зона возможностей: частое, недавнее в обучении, последовательное: мейнстримные темы, популярные языки. Зона ограничений: редкие, после границы знаний, нишевые, локальные или спорные темы. Возможности: чрезвычайно широкие общие знания, глубокая компетенция в хорошо представленных областях, связи между областями. Сбои: граница знаний, устаревание, неравномерное покрытие, унаследованное смещение, амнезия источников. Продукты: веб-поиск, ретривал (RAG) и MCP, использование инструментов, явное указание границы знаний.
  • Рабочая память. Зона возможностей: материал удобно помещается, сессия текущая, вы поставляете релевантный контекст. Зона ограничений: очень длинные документы и беседы, ожидание непрерывности между сессиями (обрыв). Возможности: быстрая адаптация в сессии, работа с вашим материалом, точность через конкретику. Сбои: жёсткие лимиты длины с тихой обрезкой, потерянное в середине, нет постоянной памяти по умолчанию, нет обучения от вас. Продукты: память, компактизация и суммаризация, проекты и рабочие пространства, навыки, большие контекстные окна.
  • Управляемость. Зона возможностей: короткие, конкретные, проверяемые инструкции («respond as a table», «under 100 words»). Зона ограничений: длинные цепочки рассуждений, абстрактные просьбы, нативная точность. Возможности: точный контроль формата, стиля, длины и тона; задание ролей; многошаговое выполнение задач по ясному процессу; итеративное уточнение («make it shorter», «more specific here»). Сбои: дрейф рассуждений (малые ошибки накапливаются по длинным цепочкам), буква вместо духа (инструкция выполнена буквально, намерение упущено), инъекции в промпт (нежелательные и небезопасные инструкции в документах тоже могут выполняться). Продукты: системные промпты и кастомные инструкции (постоянные указания, которые не разбавляются), выполнение кода (передача математики на реальный интерпретатор), видимые рассуждения (ловите дрейф на шаге два, а не в финальном ответе), режимы структурированного вывода (сокращают блуждание буквы-вместо-духа).

Ключевые тезисы:

  • Управляемость значит, что модель следует инструкциям через предсказание следующего токена.
  • Зона возможностей: короткие, конкретные, проверяемые инструкции. Спецификации формата, лимиты длины, явные роли.
  • Зона ограничений: длинные цепочки рассуждений, абстрактные или двусмысленные инструкции, всё, требующее нативной числовой или логической точности.
  • Характерные сбои: дрейф рассуждений (малые ошибки накапливаются) и буква-вместо-духа (инструкция выполнена, но intent — нет).
  • Системные промпты, выполнение кода, видимые рассуждения и режимы структурированного вывода существуют, чтобы удерживать ваше намерение от разбавления.
  • Когда инструкция выполнена буквально, но бесполезно, переформулируйте цель. Повторение инструкции с большей силой не закроет разрыв.
  • Связь с 4D: управляемость — это то, что делает Описание мощным и что его ограничивает. Понимание разрыва между словами и намерением меняет то, как вы пишете промпты и куда ставите контрольные точки.

Упражнение: Переписывание цели

Зачем? Разрыв между тем, что вы говорите, и тем, что имеете в виду, — там живёт большинство сбоев управляемости. Это упражнение учит вас строить промпты от намерения, а не только от инструкции.

Выберите задачу из вашего списка урока 1, включающую несколько шагов или конкретный формат вывода. Запишите цель одним предложением: чего вы реально пытаетесь достичь, а не только как должен выглядеть вывод. («Convince my team this timeline is realistic» — это цель. «Three bullet points» — это формат.)

  • Зонд 1: Плотный контроль. Дайте короткую, конкретную, проверяемую инструкцию, связанную с вашей задачей: «respond as a three-column table», «exactly five bullet points», «second person throughout». Проверьте, держалась ли она точно. Это зона возможностей: инструкция достаточно проста, чтобы идеально сработать через сопоставление паттернов.
  • Зонд 2: Дрейф рассуждений. Попросите версию вашей задачи, требующую 4–5 зависимых шагов. Проверьте вывод шаг за шагом. Протянулась ли малая ошибка из начала до конца? Теперь попробуйте снова, но попросите ИИ остановиться и показать результат шага 2, прежде чем продолжать. Сравните то, что получаете, когда вставляете контрольную точку, против того, когда даёте прогнать без остановок.
  • Зонд 3: Буква против духа. Дайте инструкцию, которую можно выполнить буквально, но бесполезно. «Make this shorter» на черновике, где реальная проблема — структура. «Make this more professional» на письме, где реальная проблема в том, что оно закапывает просьбу. Посмотрите, что получите. Затем переформулируйте запрос с явно указанной целью рядом с инструкцией: «Make this shorter. My goal is to keep the executive's attention through the key finding on page two.» Сравните.

Вернитесь к списку задач. Для любых многошаговых задач отметьте, куда вставили бы контрольную точку. Для любых задач, где вы промптили только форматом, составьте формулировку цели, которую добавите в следующий раз.

  • Как часто вы указывали формат, но не цель? Что меняется, когда включаете оба?
  • Какая одна повторяющаяся задача, куда вы добавите checkpoint в середине процесса начиная с этой недели?

Вы теперь встретили все четыре свойства по отдельности. В следующем уроке посмотрим, как они взаимодействуют, потому что большинство сбоев реального мира — это встреча двух свойств.

Обратная связь

По мере прохождения курса нам будет приятно услышать, как вы используете концепции курса в своей работе, а также любые ваши отзывы. Поделитесь отзывом здесь.

Благодарности и лицензия

Copyright 2026 Anthropic. Оригинальная работа на основе фреймворка ИИ-грамотности, разработанного проф. Риком Даканом (Ringling College of Art and Design) и проф. Джозефом Феллером (University College Cork). Выпущено под лицензией CC BY-NC-SA 4.0.