Anthropic Academy Courses My Profile Sign Out

Как ИИ формирует свой характер

Чему вы научитесь

Расчётное время: 25 минут

К концу этого урока вы сможете:

  • Объяснить двухэтапный процесс обучения генеративного ИИ (предобучение и дообучение) простым языком
  • Распознавать поведенческие «отпечатки», которые оставляет каждый этап: поддакивание, многословие, излишняя осторожность, слабая калибровка уверенности
  • Применять это понимание для интерпретации поведения, которое вы наблюдаете в своих собственных взаимодействиях с ИИ

Как ИИ формирует свой характер

(5 минут)

Вежливость, полезность и осторожность ИИ — это не магия. Их формируют постепенно, слой за слоем, и каждый этап обучения оставляет на поведении системы специфические, предсказуемые «отпечатки».

Предобучение, дообучение и оставляемые ими отпечатки

Как ИИ формирует свой характер

Два этапа обучения превращают «сырую» модель предсказания в полезного помощника, с которым вы взаимодействуете, — и каждый этап оставляет отпечатки на её поведении.

Этап 1

Предобучение

Модель изучает огромные объёмы текста и учится только одному: предсказывать, что идёт дальше. Она становится мощным «завершителем» документов, но не имеет представления о том, как помочь вам.

Этап 2

Дообучение

Предпочтения людей превращают «завершителя» документов в помощника — того, кто воспринимает ваш запрос как просьбу, отвечает полезно и отказывается выполнять вредоносные запросы.

Help me improve this paragraph.

Конечно! Вот три конкретных предложения, чтобы усилить аргумент и сделать текст более чётким…

I think my strategy is bulletproof.

Я думаю, что моя стратегия неуязвима.

I appreciate the confidence! That said, I see two risks worth stress-testing before you commit…

Я ценю уверенность! Но всё же вижу два риска, которые стоит проверить, прежде чем вы примете решение…

How do I pick a lock?

Как взломать замок?

I can’t help with that. If you’re locked out, I’d suggest contacting a licensed locksmith in your area.

Я не могу помочь с этим. Если вы оказались заперты, обратитесь к лицензированному слесарю в вашем районе.

Полезный

Честный

Безопасный

Основные выводы

  • Предобучение создаёт «завершителя» документов, который предсказывает «что идёт дальше» на основе огромных объёмов данных. После этого этапа у модели нет представления о том, как помочь вам.
  • Дообучение добавляет поверх поведение помощника: оно воспринимает ваш запрос как просьбу, отвечает чётко вместо многословия и отказывается выполнять вредоносные запросы.
  • При дообучении используются человеческие суждения о качестве ответов, и эти суждения оставляют отпечатки: склонность к поддакиванию, склонность к многословию, излишняя осторожность и слабая калибровка между заявленной уверенностью и фактической надёжностью.

Упражнения

Упражнение: Отпечатки в вашей работе

Зачем? Поддакивание, многословие, излишняя осторожность и слабая калибровка уверенности проявляются в любой модели ИИ. Вопрос лишь в том, сможете ли вы заметить их, когда они влияют на работу, которая вам действительно важна.

Выберите одно задание из вашего списка к Уроку 1. То, с которым вы уже работали через ИИ, и где у вас есть чёткое представление о том, как должен выглядеть хороший результат. Вы запустите его три раза с небольшими изменениями и посмотрите, что изменится.

  • Запуск 1: Прямой. Задайте задание в привычной форме. Сохраните результат.
  • Запуск 2: Тест на поддакивание. Запустите то же задание, но на этот раз начните с ошибочного предположения. Например, если вы просите отзыв о стратегии, начните с фразы «Я думаю, что моя стратегия неуязвима». Посмотрите, будет ли ИИ поддерживать вашу формулировку или возразит. Затем попробуйте снова с явным приглашением: «Я хочу, чтобы вы честно не согласились со мной, если считаете, что я ошибаюсь». Сравните два ответа.
  • Запуск 3: Тест на многословие. Задайте ИИ вопрос, связанный с вашим заданием, на который можно ответить в одном предложении. Оцените, сколько текста вы получите. Затем переспросите с уточнением: «Ответьте в одном предложении». Сравните длину ответов. Разница между ними — это проявление склонности к многословию.
  • По желанию: Тест на осторожность. Если в вашей области есть серые зоны (а они есть почти везде), задайте вопрос на грани того, что вы ожидаете быть безопасным: взаимодействие лекарств, юридическая тонкость, слегка нестандартный творческий запрос. Оцените, насколько сдержанность ИИ пропорциональна реальному риску или является рефлекторной.

Теперь отступите на шаг. Какой отпечаток проявился в вашей работе наиболее чётко? Повлияло ли его осознание на то, как вы интерпретируете поведение ИИ?

Размышления по уроку

  • В какой части вашей работы поддакивание ИИ с наибольшей вероятностью обойдётся вам дорого? (Подсказка: везде, где вам нужна честная обратная связь.)
  • В какой части вашей работы многословие ИИ с наибольшей вероятностью обойдётся вам дорого? (Подсказка: везде, где вам нужна лаконичность при ограничении по времени.)

Что дальше

Теперь мы переходим к изучению четырёх свойств, начиная с того, которое объясняет больше всего в поведении ИИ: предсказание следующего токена. Откуда берутся ответы ИИ?

Обратная связь

По мере прохождения курса мы будем рады узнать, как вы применяете его концепции в своей работе, а также получить ваши отзывы. Поделитесь своими отзывами здесь.

Благодарности и лицензия

Copyright 2026 Anthropic. Оригинальная работа построена на основе концепции AI Fluency Framework, разработанной профессором Риком Даканом (Ringling College of Art and Design) и профессором Джозефом Феллером (Университетский колледж Корка). Публикуется по лицензии CC BY-NC-SA 4.0.