ЦУ Чёрные ящики и цифровые агенты · Блок 3 · Неделя 7 Все материалы курса

Лонгрид к неделе 7 · без формул

Как работает GPT внутри

Шесть страниц о том, что модель делает на самом деле, почему уверенный тон ничего не говорит о достоверности и почему показанное «рассуждение» — не протокол мышления, а ещё один сгенерированный текст.

≈ 21 минвремя чтения
6 стр.объём
Нед. 7к семинару
1 строканайти в распечатке
Как читать этот текст

Цель — не разобраться в устройстве нейросети, а получить словарь для разбора записи. На неделе 8 вы будете читать распечатку сессии и объяснять, почему агент сделал не то. Объяснение «модель тупая» не принимается; объяснения из этого текста — принимаются.

01Что модель делает на самом деле

Языковая модель решает одну задачу: по имеющемуся тексту предсказать, каким фрагментом он продолжится. Потом присоединяет предсказанный фрагмент к тексту и предсказывает следующий. И так до конца ответа.

Всё, что вы видите — объяснение, план, извинение, ссылка, — получено этим способом. Модель не «сначала думает, а потом формулирует». Формулирование и есть процесс.

Определение

Токен — кусок текста, которым модель оперирует.

Не буква и не слово, а фрагмент между ними: частое слово может быть одним токеном, редкое — разбиться на несколько. Для нас важно лишь одно следствие: модель работает с кусками текста, а не со смыслами, и длина «памяти» измеряется в этих кусках.

Отсюда первое практическое следствие, которое объясняет половину странностей. Модель может уверенно сообщить количество букв в слове и ошибиться — она видит не буквы, а куски. Может перепутать похожие названия — потому что в тексте они выглядят похоже.

02Откуда она это умеет

Обучение обычно идёт в три захода, и разница между ними объясняет разное поведение.

Предобучение

Модель прогоняют по огромному объёму текста и заставляют угадывать продолжение. Так она набирает статистику языка: что за чем обычно идёт, как устроены рассуждения, какие факты часто соседствуют. Здесь нет никакой проверки на истинность — только на правдоподобие продолжения.

Дообучение на инструкциях

Дальше её учат отвечать на просьбы, а не просто продолжать текст. Показывают примеры: вот запрос — вот хороший ответ. Отсюда привычка отвечать по делу, структурировать, извиняться.

Настройка по человеческим оценкам

Наконец, люди сравнивают варианты ответов и отмечают, какой лучше. Модель подстраивается под эти предпочтения. Здесь она и приобретает свой тон: вежливый, уверенный, готовый помочь.

Уверенный тон — результат того, что людям больше нравились уверенные ответы. К достоверности он отношения не имеет.

Это ключевой вывод третьего этапа и прямая связь с ловушкой эмпатии из недели 6. Модель звучит убедительно не потому, что знает, а потому что убедительность оценивали выше.

Остановка 1

Вспомните случай, когда вы поверили ответу модели из-за формы, а не из-за содержания: длинный, структурный, со ссылками. Что заставило вас поверить и что стоило проверить?

03Почему возникают выдуманные факты

Слово «галлюцинация» неудачное: оно намекает на болезнь и на то, что нормальное состояние — знание. Точнее сказать иначе.

Модель всегда порождает правдоподобное продолжение. Когда в её статистике есть устойчивый факт, правдоподобное совпадает с верным. Когда факта нет — редкое имя, свежее событие, точный номер, конкретная страница — правдоподобное продолжение всё равно порождается. Оно выглядит ровно так же уверенно, потому что механизм тот же.

Отсюда практическое правило: риск выдумки выше там, где требуется точность в деталях. Цитата, номер статьи, дата, автор, ссылка, статистика. Именно эти элементы и придают тексту вид достоверности — и именно они чаще всего оказываются собранными по правдоподобию.

04Память, которой нет

Определение

Контекстное окно — всё, что модель держит перед глазами прямо сейчас.

Ваш текст, история беседы, системная инструкция, результаты вызванных инструментов. Того, что за пределами окна, для модели не существует. Закрыли вкладку — содержимое исчезло.

Ещё одно неочевидное обстоятельство: ваш запрос почти никогда не равен тому, что вы напечатали. Перед вашим текстом обычно стоит невидимая системная инструкция — правила поведения, ограничения, роль. Её написали разработчики продукта, и вы её не видите. Часть отказов и странных поворотов объясняется именно ею, а не «характером» модели.

Практический вывод для длинных сессий: если важное условие названо один раз в начале, его надо повторить. Это не суеверие, а следствие устройства.

05Что означает режим «рассуждения»

Многие продукты показывают, как модель «думает»: перед ответом появляется текст с разбором задачи. Соблазнительно принять его за протокол внутренних вычислений. Это не так.

Показанное рассуждение — тоже сгенерированный текст. Он порождается тем же способом, что и ответ, и может расходиться с тем, что фактически повлияло на результат. Модель способна написать убедительный ход мысли и прийти к выводу, полученному иначе.

Отсюда осторожная формулировка, которую стоит использовать в работах: не «модель рассуждала так-то», а «модель показала такой ход рассуждения». Различение выглядит педантичным, но это ровно та дисциплина, которую проверяет норма 2 курса — отделять факт от гипотезы.

При этом польза от показанного рассуждения есть, и она практическая: в нём часто видны ошибки, которых не заметить в гладком ответе. Это и есть парадокс прозрачности недели 9 — объяснение снижает доверие, делая его точнее.

Остановка 2

Откройте любую свою беседу с моделью в режиме рассуждения. Найдите место, где показанный ход и итоговый ответ расходятся или где в рассуждении видна ошибка, не попавшая в ответ.

06Как из модели получается агент

Сама по себе модель только порождает текст. Агентом её делает обвязка: набор инструментов и правило, по которому текст модели превращается в действие.

ШагЧто происходитЧто видит пользователь
ЗапросВаш текст плюс системная инструкция плюс история беседыТолько свой текст
РассуждениеПорождается разбор задачиИногда — сокращённую версию
Выбор инструментаПорождается запрос к поиску, файлу, программеИногда — название инструмента
ДействиеОбвязка выполняет запрос и возвращает результат в окноОбычно ничего
ОтветПорождается итог для человекаВсё

Третий столбец — то, ради чего вся неделя. Пользователь наблюдает последний шаг и делает выводы обо всей цепочке. Это чёрный ящик в миниатюре, и разбирать его придётся по следам.

07Чего модель не делает

Последний пункт объясняет, почему нельзя просто попросить модель оценить собственную уверенность и поверить числу. Оценка уверенности порождается тем же способом, что и всё остальное.

08Границы этого объяснения

Текст намеренно упрощён и опускает всё, что требует математики. Он не объясняет, почему предсказание следующего фрагмента даёт связный текст, — на этот вопрос честного короткого ответа нет ни у кого.

Для курса важно другое: у нас теперь есть словарь, которым можно описать сбой, не приписывая модели ни глупости, ни намерений. «Опёрся на статистику вместо вызова поиска», «условие вышло за пределы окна», «системная инструкция весила больше просьбы пользователя» — это проверяемые гипотезы. «Модель не поняла» — нет.

09Словарь

ТокенКусок текста, которым оперирует модель
Контекстное окноВсё, что модель держит перед глазами в текущей сессии
Системная инструкцияНевидимый пользователю текст, задающий агенту рамки поведения
Выдуманный фактПравдоподобное продолжение там, где устойчивого факта в статистике нет
Показанное рассуждениеСгенерированный разбор задачи; не протокол вычислений
ОбвязкаСлой, превращающий текст модели в действие; именно он делает её агентом

10Вопросы после чтения

Почему уверенный тон модели ничего не говорит о достоверности ответа?

В каких элементах текста риск выдумки выше всего и почему именно в них?

Чем «модель рассуждала» отличается от «модель показала ход рассуждения»?

Почему запрос агента почти никогда не равен тому, что вы напечатали?

Что именно делает модель агентом?

Почему нельзя просто спросить у модели, насколько она уверена?

Домашняя работа

В выданной распечатке найдите одно место с точным номером строки, где агент сделал не то, о чём его просили, и объясните одним предложением, почему так вышло. Формат: «В строке 14 пользователь просил X, а агент сделал Y — похоже, опёрся на …». Ответ «агент в целом не понял задачу» не засчитывается.

Что дальше

Неделя 8 — практикум «Аутопсия агента». Придите с распечаткой: без неё работать не с чем. Прочитайте также подборку типовых сбоев — она подготовит вас к третьему шагу протокола.