Чему вы научитесь
Расчётное время: 25 минут
К концу этого урока вы сможете:
- Объяснить двухэтапный процесс обучения генеративного ИИ (предобучение и дообучение) простым языком
- Распознавать поведенческие «отпечатки», которые оставляет каждый этап: поддакивание, многословие, излишняя осторожность, слабая калибровка уверенности
- Применять это понимание для интерпретации поведения, которое вы наблюдаете в своих собственных взаимодействиях с ИИ
Как ИИ формирует свой характер
(5 минут)
Вежливость, полезность и осторожность ИИ — это не магия. Их формируют постепенно, слой за слоем, и каждый этап обучения оставляет на поведении системы специфические, предсказуемые «отпечатки».
Предобучение, дообучение и оставляемые ими отпечатки
Как ИИ формирует свой характер
Два этапа обучения превращают «сырую» модель предсказания в полезного помощника, с которым вы взаимодействуете, — и каждый этап оставляет отпечатки на её поведении.
Этап 1
Предобучение
Модель изучает огромные объёмы текста и учится только одному: предсказывать, что идёт дальше. Она становится мощным «завершителем» документов, но не имеет представления о том, как помочь вам.
Этап 2
Дообучение
Предпочтения людей превращают «завершителя» документов в помощника — того, кто воспринимает ваш запрос как просьбу, отвечает полезно и отказывается выполнять вредоносные запросы.
Help me improve this paragraph.
Конечно! Вот три конкретных предложения, чтобы усилить аргумент и сделать текст более чётким…
I think my strategy is bulletproof.
Я думаю, что моя стратегия неуязвима.
I appreciate the confidence! That said, I see two risks worth stress-testing before you commit…
Я ценю уверенность! Но всё же вижу два риска, которые стоит проверить, прежде чем вы примете решение…
How do I pick a lock?
Как взломать замок?
I can’t help with that. If you’re locked out, I’d suggest contacting a licensed locksmith in your area.
Я не могу помочь с этим. Если вы оказались заперты, обратитесь к лицензированному слесарю в вашем районе.
Полезный
Честный
Безопасный
Основные выводы
- Предобучение создаёт «завершителя» документов, который предсказывает «что идёт дальше» на основе огромных объёмов данных. После этого этапа у модели нет представления о том, как помочь вам.
- Дообучение добавляет поверх поведение помощника: оно воспринимает ваш запрос как просьбу, отвечает чётко вместо многословия и отказывается выполнять вредоносные запросы.
- При дообучении используются человеческие суждения о качестве ответов, и эти суждения оставляют отпечатки: склонность к поддакиванию, склонность к многословию, излишняя осторожность и слабая калибровка между заявленной уверенностью и фактической надёжностью.
Упражнения
Упражнение: Отпечатки в вашей работе
Зачем? Поддакивание, многословие, излишняя осторожность и слабая калибровка уверенности проявляются в любой модели ИИ. Вопрос лишь в том, сможете ли вы заметить их, когда они влияют на работу, которая вам действительно важна.
Выберите одно задание из вашего списка к Уроку 1. То, с которым вы уже работали через ИИ, и где у вас есть чёткое представление о том, как должен выглядеть хороший результат. Вы запустите его три раза с небольшими изменениями и посмотрите, что изменится.
- Запуск 1: Прямой. Задайте задание в привычной форме. Сохраните результат.
- Запуск 2: Тест на поддакивание. Запустите то же задание, но на этот раз начните с ошибочного предположения. Например, если вы просите отзыв о стратегии, начните с фразы «Я думаю, что моя стратегия неуязвима». Посмотрите, будет ли ИИ поддерживать вашу формулировку или возразит. Затем попробуйте снова с явным приглашением: «Я хочу, чтобы вы честно не согласились со мной, если считаете, что я ошибаюсь». Сравните два ответа.
- Запуск 3: Тест на многословие. Задайте ИИ вопрос, связанный с вашим заданием, на который можно ответить в одном предложении. Оцените, сколько текста вы получите. Затем переспросите с уточнением: «Ответьте в одном предложении». Сравните длину ответов. Разница между ними — это проявление склонности к многословию.
- По желанию: Тест на осторожность. Если в вашей области есть серые зоны (а они есть почти везде), задайте вопрос на грани того, что вы ожидаете быть безопасным: взаимодействие лекарств, юридическая тонкость, слегка нестандартный творческий запрос. Оцените, насколько сдержанность ИИ пропорциональна реальному риску или является рефлекторной.
Теперь отступите на шаг. Какой отпечаток проявился в вашей работе наиболее чётко? Повлияло ли его осознание на то, как вы интерпретируете поведение ИИ?
Размышления по уроку
- В какой части вашей работы поддакивание ИИ с наибольшей вероятностью обойдётся вам дорого? (Подсказка: везде, где вам нужна честная обратная связь.)
- В какой части вашей работы многословие ИИ с наибольшей вероятностью обойдётся вам дорого? (Подсказка: везде, где вам нужна лаконичность при ограничении по времени.)
Что дальше
Теперь мы переходим к изучению четырёх свойств, начиная с того, которое объясняет больше всего в поведении ИИ: предсказание следующего токена. Откуда берутся ответы ИИ?
Обратная связь
По мере прохождения курса мы будем рады узнать, как вы применяете его концепции в своей работе, а также получить ваши отзывы. Поделитесь своими отзывами здесь.
Благодарности и лицензия
Copyright 2026 Anthropic. Оригинальная работа построена на основе концепции AI Fluency Framework, разработанной профессором Риком Даканом (Ringling College of Art and Design) и профессором Джозефом Феллером (Университетский колледж Корка). Публикуется по лицензии CC BY-NC-SA 4.0.