Чему вы научитесь
Ориентировочное время: 30 минут
К концу этого урока вы сможете:
- Объяснить, почему управляемость работает (файнтюнинг научил модель следованию инструкциям) и почему у неё есть лимиты (инструкции выполняются через сопоставление паттернов, а не понимание)
- Предсказать, где контроль плотнее всего (короткие, конкретные, проверяемые инструкции) против самого слабого (длинные цепочки рассуждений, абстрактные просьбы, задачи на нативную точность)
- Определить дрейф рассуждений, букву-вместо-духа и хрупкую арифметику как характерные сбои управляемости
- Распознать системные промпты, выполнение кода, видимые рассуждения и структурированные выводы как продуктовые функции, работающие с этим ограничением
Как управляемость влияет на выводы генеративного ИИ
Модель следует вашим инструкциям так же, как делает всё остальное: продолжая паттерн. Это делает её замечательно управляемой. Это также значит, что всегда есть разрыв между тем, что вы задумывали, и тем, что получилось, и большинство интересных сбоев живёт в этом разрыве.
Насколько вы реально контролируете?
Прежде чем читать: вы просите ИИ написать ровно 100 слов, не больше. Насколько внимательно нужно проверять результат? Выберите точку на континууме, затем зафиксируйте догадку.
Свойства модели:
- Предсказание следующего токена. Зона возможностей: проторённые пути — резюмирование, переформатирование, объяснение распространённых концептов. Зона ограничений: новая территория, разреженные паттерны, «правда против похожего на правду». Возможности: беглый естественный текст практически в любом стиле; быстрый синтез идей из далёких областей; сильная работа на задачах, похожих на виденные. Сбои: галлюцинации, конфабуляции, нестабильность сэмплирования, неуместная уверенность. Продукты: цитаты и привязка к источникам, сигнализация неопределённости, ограниченная генерация и навыки.
- Знания. Зона возможностей: частое, недавнее в обучении, последовательное: мейнстримные темы, популярные языки. Зона ограничений: редкие, после границы знаний, нишевые, локальные или спорные темы. Возможности: чрезвычайно широкие общие знания, глубокая компетенция в хорошо представленных областях, связи между областями. Сбои: граница знаний, устаревание, неравномерное покрытие, унаследованное смещение, амнезия источников. Продукты: веб-поиск, ретривал (RAG) и MCP, использование инструментов, явное указание границы знаний.
- Рабочая память. Зона возможностей: материал удобно помещается, сессия текущая, вы поставляете релевантный контекст. Зона ограничений: очень длинные документы и беседы, ожидание непрерывности между сессиями (обрыв). Возможности: быстрая адаптация в сессии, работа с вашим материалом, точность через конкретику. Сбои: жёсткие лимиты длины с тихой обрезкой, потерянное в середине, нет постоянной памяти по умолчанию, нет обучения от вас. Продукты: память, компактизация и суммаризация, проекты и рабочие пространства, навыки, большие контекстные окна.
- Управляемость. Зона возможностей: короткие, конкретные, проверяемые инструкции («respond as a table», «under 100 words»). Зона ограничений: длинные цепочки рассуждений, абстрактные просьбы, нативная точность. Возможности: точный контроль формата, стиля, длины и тона; задание ролей; многошаговое выполнение задач по ясному процессу; итеративное уточнение («make it shorter», «more specific here»). Сбои: дрейф рассуждений (малые ошибки накапливаются по длинным цепочкам), буква вместо духа (инструкция выполнена буквально, намерение упущено), инъекции в промпт (нежелательные и небезопасные инструкции в документах тоже могут выполняться). Продукты: системные промпты и кастомные инструкции (постоянные указания, которые не разбавляются), выполнение кода (передача математики на реальный интерпретатор), видимые рассуждения (ловите дрейф на шаге два, а не в финальном ответе), режимы структурированного вывода (сокращают блуждание буквы-вместо-духа).
Ключевые тезисы:
- Управляемость значит, что модель следует инструкциям через предсказание следующего токена.
- Зона возможностей: короткие, конкретные, проверяемые инструкции. Спецификации формата, лимиты длины, явные роли.
- Зона ограничений: длинные цепочки рассуждений, абстрактные или двусмысленные инструкции, всё, требующее нативной числовой или логической точности.
- Характерные сбои: дрейф рассуждений (малые ошибки накапливаются) и буква-вместо-духа (инструкция выполнена, но intent — нет).
- Системные промпты, выполнение кода, видимые рассуждения и режимы структурированного вывода существуют, чтобы удерживать ваше намерение от разбавления.
- Когда инструкция выполнена буквально, но бесполезно, переформулируйте цель. Повторение инструкции с большей силой не закроет разрыв.
- Связь с 4D: управляемость — это то, что делает Описание мощным и что его ограничивает. Понимание разрыва между словами и намерением меняет то, как вы пишете промпты и куда ставите контрольные точки.
Упражнение: Переписывание цели
Зачем? Разрыв между тем, что вы говорите, и тем, что имеете в виду, — там живёт большинство сбоев управляемости. Это упражнение учит вас строить промпты от намерения, а не только от инструкции.
Выберите задачу из вашего списка урока 1, включающую несколько шагов или конкретный формат вывода. Запишите цель одним предложением: чего вы реально пытаетесь достичь, а не только как должен выглядеть вывод. («Convince my team this timeline is realistic» — это цель. «Three bullet points» — это формат.)
- Зонд 1: Плотный контроль. Дайте короткую, конкретную, проверяемую инструкцию, связанную с вашей задачей: «respond as a three-column table», «exactly five bullet points», «second person throughout». Проверьте, держалась ли она точно. Это зона возможностей: инструкция достаточно проста, чтобы идеально сработать через сопоставление паттернов.
- Зонд 2: Дрейф рассуждений. Попросите версию вашей задачи, требующую 4–5 зависимых шагов. Проверьте вывод шаг за шагом. Протянулась ли малая ошибка из начала до конца? Теперь попробуйте снова, но попросите ИИ остановиться и показать результат шага 2, прежде чем продолжать. Сравните то, что получаете, когда вставляете контрольную точку, против того, когда даёте прогнать без остановок.
- Зонд 3: Буква против духа. Дайте инструкцию, которую можно выполнить буквально, но бесполезно. «Make this shorter» на черновике, где реальная проблема — структура. «Make this more professional» на письме, где реальная проблема в том, что оно закапывает просьбу. Посмотрите, что получите. Затем переформулируйте запрос с явно указанной целью рядом с инструкцией: «Make this shorter. My goal is to keep the executive's attention through the key finding on page two.» Сравните.
Вернитесь к списку задач. Для любых многошаговых задач отметьте, куда вставили бы контрольную точку. Для любых задач, где вы промптили только форматом, составьте формулировку цели, которую добавите в следующий раз.
- Как часто вы указывали формат, но не цель? Что меняется, когда включаете оба?
- Какая одна повторяющаяся задача, куда вы добавите checkpoint в середине процесса начиная с этой недели?
Вы теперь встретили все четыре свойства по отдельности. В следующем уроке посмотрим, как они взаимодействуют, потому что большинство сбоев реального мира — это встреча двух свойств.
Обратная связь
По мере прохождения курса нам будет приятно услышать, как вы используете концепции курса в своей работе, а также любые ваши отзывы. Поделитесь отзывом здесь.
Благодарности и лицензия
Copyright 2026 Anthropic. Оригинальная работа на основе фреймворка ИИ-грамотности, разработанного проф. Риком Даканом (Ringling College of Art and Design) и проф. Джозефом Феллером (University College Cork). Выпущено под лицензией CC BY-NC-SA 4.0.