Часть 1

Гл. 1 · AI — это не магия

На этой странице

Позиция в главе: 0%

Слова на этой странице

Часть 1Глава 1

AI — это не магия

Ядро
15 минут чтения
Практика
40 минут
Уносите
черновик своей задачи, собранный из трёх вариантов, и схему «Как устроен AI-ассистент» для своего сервиса

Блоки без пометки — ядро; «задание» — практика; «расширение» — можно пропустить.

Вступление

На понедельничной планёрке Лиза выводит на экран письмо покупательницы: фото сыра «Российский» и подпись «Он весь в неровных дырках! Это брак?»

Выясняется, что письмо ещё в пятницу видели двое. Галина Петровна переслала его Гене, чтобы проверить стажёра. Артём — чтобы не отвечать самому. Запрос у обоих вышел одинаковый, слово в слово: «Подготовь ответ покупательнице».

Галине Петровне Гена предложил извиниться и вернуть деньги. Артёму — объяснить, что неровные дырочки у «Российского» — это глазки, так и задумано.

— Сам не знает, что думает, — говорит Галина Петровна.

— Зато варианты! — радуется Артём.

Правы оба: готового мнения внутри нет, а варианты бывают очень полезны. Как одно уживается с другим — об этом глава.

Гена сидит на краю стола, из хвостика его пустого пузыря выходит линия и ветвится: две сплошные ветки уходят в телефоны Галины Петровны и Артёма, остальные — пунктиром и обрываются; рука читателя обводит одну пунктирную ветку оранжевым маркером
Иллюстрация «Развилка продолжений»: из пузыря Гены фраза ответа ветвится. Две сплошные ветки уходят в телефоны Галины Петровны и Артёма, остальные — пунктиром и обрываются на полпути. Ваша рука оранжевым маркером обводит одну пунктирную: «мог и так».

Че вообще происходит?

У большинства людей в голове одна из двух картинок. Первая:  — огромный справочник, где на каждый вопрос лежит готовый ответ, надо только правильно спросить. Вторая: AI — электронный коллега со своим мнением.

Обе ломаются на истории с «Российским». Справочник на один и тот же вопрос открывает одну и ту же страницу. А коллега, который решил, что покупательнице надо вернуть деньги, не станет через минуту объяснять ей, что с сыром всё в порядке. Почему AI при этом так похож на коллегу — разговор гл. 2.

Дальше — вопросы, которые у всех возникают в первую же неделю. Откуда он взял цифру, которой я ему не давал? Почему вчера он «помнил» мой проект, а сегодня нет? Почему один сервис сходил в интернет, а другой уверенно выдал прошлогодние новости?

На всё это отвечает одна картинка — как рождается ответ. Она простая и останется верной до конца книги: дальше к ней будут только добавляться новые слои.

На пальцах

Сыграем. Продолжите фразу — первое, что приходит в голову.

«Рады сообщить, что наша команда…» Выросла? Запустила новый продукт? Переехала в новый офис? Вариантов десятки, и все годятся.

«С Новым…» Тут выбора почти нет. Годом.

«Выручка „Круга и Коры“ за прошлый квартал составила…» Рука сама тянется к числу — какому⁠-⁠нибудь правдоподобному. Вы его не знаете. Но фраза требует числа, и оно появляется. Что бывает с такими числами дальше — тема гл. 3.

Вы только что сделали то же, что делает . За плечами у вас тысячи прочитанных писем, поздравлений и отчётов, и вы знаете, как такие фразы обычно продолжаются. Модель прочитала несравнимо больше и выучила то же самое: какие продолжения обычно бывают. Ответ она пишет кусочек за кусочком: смотрит на всё, что уже написано, выбирает правдоподобное продолжение, потом следующее — и так очень быстро.

Где правдоподобное продолжение почти одно, как после «С Новым…», ответы выходят похожими. Где их много, как после «Рады сообщить…», каждый раз может получиться другое. Жалобу на неровные дырки одинаково правдоподобно продолжить и извинением, и объяснением. Галине Петровне выпало одно, Артёму — другое.

А теперь нормально

По кусочку. Модель получает текст — ваш , то есть то, что вы написали, и всё, что к нему приложено, — разбитым на . Токен — кусочек текста: иногда целое слово, иногда его часть. Ответ модель по одному токену: смотрит на всё, что уже есть, выбирает правдоподобное продолжение, дописывает его — и снова. Готового ответа на ваш вопрос внутри нет: он появляется в момент генерации.

Почему ответы разные. Обычно модель выбирает не строго самое вероятное продолжение: в выборе есть доля случайности. Так делают намеренно — если всегда брать самое вероятное, текст выходит однообразным и часто начинает повторяться. Поэтому на один и тот же запрос приходят разные ответы, а там, где правдоподобных продолжений много, — очень разные.

Где упрощение ломается. «Продолжи фразу» — игра в слова, а модель работает с токенами. И «по кусочку» описывает, как текст выходит наружу. Это не значит, что модель ставит слово за словом вслепую, не учитывая, куда ведёт фраза, — подробнее в «Для задротов». Для работы важнее другое уточнение.

Вы разговариваете с продуктом.  — это модель и всё, что вокруг неё. Модель — движок, который пишет ответ. Продукт решает, что ей дать прочитать, какие инструменты подключить и что показать вам. Сама модель видит только : ваш промпт, историю этого разговора и то, что туда положил продукт, — найденные страницы, текст приложенного файла, сохранённые раньше сведения о вас. Вчерашние переписки, регламенты компании, утренние новости ей недоступны, пока продукт не положит их в контекст.

Отсюда формула, которая пройдёт через всю книгу:

AI-продукт = модель + контекст + инструменты.

, чтение файлов, , между разговорами — всё это продукт. Модель просит поиск — продукт ищет и кладёт найденное в контекст. Сервис вас «помнит» — значит, продукт сохранил сведения и подложил их в новый . Сама модель между чатами ничего не хранит. У каждого такого слоя будет своя глава; пока достаточно знать, что они есть.

Как устроен AI-ассистент

ПРОДУКТВЫПРОМПТто, чтовы написалиКОНТЕКСТваш промптистория разговорачто добавил продуктМОДЕЛЬпишетпо кусочкуОТВЕТпоискфайлыпамятьинструментыв контекстчего модель не видит,пока продукт это не положит:вчерашний разговор · регламентыкомпании · свежие новостипрочитано и провереноAI без маркетинговой шелухиВЫПРОМПТто, что вы написалиПРОДУКТпоискфайлыпамятьинструментыв контекстКОНТЕКСТваш промптистория разговорачто добавил продуктМОДЕЛЬпишет по кусочкуОТВЕТпрочитано и провереночего модель не видит,пока продукт это не положит:вчерашний разговор · регламентыкомпании · свежие новостиAI без маркетинговой шелухи
Схема «Как устроен AI-ассистент»: ВЫ → ПРОМПТ → КОНТЕКСТ → МОДЕЛЬ → ОТВЕТ. Модель в центре, вокруг неё рамка «продукт» с четырьмя блоками — поиск, файлы, память, инструменты: каждый подкладывает материал в контекст. От ответа стрелка возвращается к вам, и ваша рука ставит на ней оранжевую галочку: «прочитано и проверено». В углу — маленькая авторская подпись «AI без маркетинговой шелухи».

Вместе это и есть главная мысль главы: AI-ассистент — это модель, которая по кусочку дописывает правдоподобное продолжение, и продукт вокруг неё, который добавляет поиск, файлы, память и . Последнее звено схемы — вы: ответ читает и проверяет человек.

Что из этого следует. Три рабочих вывода.

  1. Первый ответ — один из возможных. Для текста, где важны тон и формулировки, — письма, ответа клиенту, объявления — два-три варианта в новых чатах дают сырьё: из одного берёте структуру, из другого удачную фразу. Чаты нужны новые, потому что в старом модель видит свой прошлый ответ и тянется к нему. Это приём для текстов. Правилом «на всё важное — три генерации» он не становится.
  2. Деталь, которой вы не давали и которая прыгает между вариантами, — сильный сигнал, что модель заполняет пробел: проверьте её. Не прыгает — всё равно не считайте совпадение источником истины. Для фактов решают источник и проверка, а не число попыток. Как искать источник — в гл. 3.
  3. Смотрите, что сделал продукт: искал ли в интернете, читал ли файл, считал ли кодом. Если следов нет, ответ собран из вашего запроса и того, что модель выучила при обучении: свежих источников за ним нет.

Примеры

Все компании, люди и цифры в примерах вымышлены.

Пример 1. «Круг и Кора»: одна жалоба — три ответа.

После планёрки вы кладёте рядом два пятничных ответа — Галине Петровне и Артёму — и отправляете тот же запрос с текстом письма в новый чат. Коротко, что вышло:

ТонЧто обещаетКакие «факты»
Ответ Галине ПетровнеВиноватыйВернуть деньги и «проверить всю партию»—
Ответ АртёмуБодрый, с восклицательными знакамиСертификат на 500 рублей«Наш „Российский“ зреет 45 дней»
Новый чатСпокойный, деловойЗаменить сыр«Срок созревания — три месяца»

Во втором и третьем ответах есть объяснение: неровные глазки — обычный рисунок «Российского», так и задумано.

Прыгают обещания и сроки созревания. В запросе не было ни слова о том, что компания предлагает при жалобе и сколько зреет её сыр, — модель дописала правдоподобное. Такие правдоподобные выдумки называют , подробно о них — в гл. 3. Сроки во втором и третьем ответах к тому же спорят друг с другом. Ответы на оба вопроса — в памятке для ответов покупателям и в спецификации сыра.

Объяснение про глазки верное — это подтвердила Галина Петровна. Совпади оно даже во всех трёх ответах, само совпадение ничего бы не доказало.

Ещё один примеррасширение

Пример 2. Операции: одна модель, два ответа.

Тимур — координатор склада интернет-магазина электроники. При приёмке пришла коробка со вскрытым скотчем. Тимур задаёт один и тот же вопрос дважды: публичному чату в браузере и корпоративному ассистенту. Ассистент работает на той же модели, но IT-отдел подключил к нему регламенты склада.

Промпт
Пришла коробка от поставщика со вскрытой упаковкой. Что делать при приёмке?

Публичный чат выдаёт аккуратную общую процедуру: сфотографировать, составить акт о расхождении, в течение 24 часов связаться с поставщиком. Звучит разумно — во многих компаниях так и делают.

Корпоративный ассистент отвечает иначе:

Ответ AI
По регламенту приёмки (п. 4.3): коробку в общий поток не принимать, отложить в зону карантина. Сфотографировать с четырёх сторон и отдельно — место вскрытия. Составить акт по форме из приложения 2. Сообщить старшему смены до конца приёмки.

Модель одна. Разница в том, что продукт положил ей в контекст: в публичном чате там был только вопрос, у корпоративного ассистента — вопрос и найденный пункт регламента. «24 часа» из первого ответа — правдоподобная цифра, и только: в регламенте Тимура её нет.

Что отсюда взять: если два сервиса на одной модели отвечают по-разному, первым делом спросите, что видел каждый. А пункт 4.3 Тимуру всё равно стоит открыть самому: ассистент мог процитировать не тот абзац (гл. 3 и 12).

Вот тут обычно всё идёт не так

  1. «Первый ответ — это и есть ответ».

    Первый ответ — одно из правдоподобных продолжений: иногда лучшее, иногда то, где модель подарила покупательнице сертификат. Для текста это повод посмотреть варианты, для факта — повод проверить.

  2. «Три раза сказал одно и то же — значит, правда».

    Три ответа — три броска одного кубика, и на одну и ту же грань он может упасть трижды. А если раз за разом просить новый вариант, пока не выйдет приятный, из правдоподобных вариантов выберете удобный, и только.

  3. «Каждый раз по-разному — значит, глючит».

    Разброс — так модель устроена. В тексте он полезен: три варианта письма дают больше удачных формулировок, чем один. Тут Артём прав.

  4. «Я же ему вчера всё объяснил».

    В новом чате модель вчерашнего разговора не видит, а «помнить» может только продукт (гл. 10 и 22). Меняющиеся факты — цены, остатки, сроки — надёжнее каждый раз давать из актуального документа: память хранит то, что было верно вчера.

Не надо так · Вот так уже нормально

Не надо так

Пока на планёрке спорили, Артём отправил покупательнице пятничный ответ Гены. Как есть. Запрос был такой:

Промпт
Подготовь ответ покупательнице. Её письмо: «Купила у вас „Российский“, а он весь в неровных дырках! Это брак?»
Ответ, сокращён
Здравствуйте! Спасибо, что написали нам! Неровные глазки — фирменный рисунок «Российского», так и задумано. Наш «Российский» зреет 45 дней — за это время глазки успевают сформироваться. В благодарность за обратную связь дарим вам сертификат на 500 рублей! […]

Через час покупательница спрашивает, как получить сертификат.

Где споткнулись:

  • Сертификат модель придумала. По памятке для ответов покупателям при жалобе «Круг и Кора» предлагает замену или возврат, сертификатов не дарит. Обещание придётся выполнять или неловко забирать назад.
  • «45 дней» звучит правдоподобно, но сколько зреет сыр «Круга и Коры», модель знать не могла; в соседнем чате вышло «три месяца».
  • Фото никто не открыл. Неровные глазки — норма, но если на срезе пятна, нужен совсем другой ответ.
  • Письмо ушло с первого ответа, без сверки.

Вот так уже нормально

Промпт тот же — нарочно: здесь учимся обращаться с ответом. Как сразу дать модели памятку, разберём в гл. 6–7.

  1. Кладёте рядом три ответа — как в примере 1.
  2. Всё, что прыгает и чего не было в запросе, — обещания, сроки, подарки — сверяете с памяткой для ответов покупателям. Подтвердилось — оставляете, нет — вычёркиваете. «45 дней» и сертификат уходят.
  3. Совпавшее тоже проверяете. Галина Петровна смотрит фото: обычные глазки, пятен нет.
  4. Собираете: структуру — из первого варианта, объяснение про глазки — из третьего, где оно проще всего, обещание — из памятки.

Что уходит покупательнице:

Здравствуйте! Спасибо, что написали и прислали фото. Неровные глазки — обычный рисунок «Российского»: они появляются, пока сыр делают и он зреет. Наш технолог посмотрела ваше фото — с сыром всё в порядке. Если сыр вам всё равно не подошёл, мы заменим его или вернём деньги. Напишите, как вам удобнее.

Письмо уходит после того, как его прочитала Галина Петровна.

Итог: варианты дали формулировки, памятка — обещания, технолог — вывод о сыре.

Попробуйте сами

задание

Одна просьба — три ответа, 10–15 минут. Карточка «Жалоба ресторана» — в материалах к главе: шеф ресторана-партнёра заказал рикотту для десерта дня, а привезли моцареллу, и десерт пришлось менять на ходу. В карточке — что известно на самом деле и что «Круг и Кора» может предложить.

  1. Напишите запрос: «Подготовь ответ шефу» — и текст его сообщения из карточки. Больше ничего не добавляйте.

  2. Отправьте запрос в три новых чата. Если в сервисе включена память, отметьте это: она может подкладывать во все чаты одно и то же.

  3. Разложите ответы в таблицу: тон · что обещает · какие «факты» · длина.

  4. Отметьте маркером всё, что меняется от ответа к ответу. Каждая пометка — сигнал: здесь модель могла заполнить пробел. Сверьте эти места с карточкой.

  5. Посмотрите, есть ли в ответах следы работы продукта: ссылки, поиск, чтение файла.

  6. Соберите лучший черновик: формулировки — из ответов, факты и обещания — только из карточки.

Что должно получиться: черновик ответа шефу и список деталей, которых модель знать не могла. Если все три ответа вышли похожими, это тоже результат: сверьте их с карточкой так же. Совпадение ещё не проверка.

Материалы к главеКарточка «Жалоба ресторана»

Материал к главе. Все компании, люди и цифры вымышлены.

Как работать с карточкой. В запрос идёт только сообщение шефа — ровно так, как в шаге 1 главы. Остальное нужно для сверки на шагах 4 и 6. Если отдать модели карточку целиком, пробелов не останется, и упражнение ничего не покажет. Подойдёт любой чат-сервис на бесплатном тарифе; если под рукой два разных, заметна и разница продуктов.

Кто пишет. Шеф одного из 14 ресторанов-партнёров «Круга и Коры». Вторник, первая половина дня.

Сообщение шефа

Добрый день. Заказывали у вас на сегодня 4 кг рикотты к 10:00 — под десерт дня, а привезли 4 кг моцареллы. Десерт пришлось менять на ходу, вы нас очень подвели. Как такое могло получиться и что вы предлагаете?

Запрос для шага 1 — в три новых чата, без изменений:

Промпт
Подготовь ответ шефу. Его сообщение: «Добрый день. Заказывали у вас на сегодня 4 кг рикотты к 10:00 — под десерт дня, а привезли 4 кг моцареллы. Десерт пришлось менять на ходу, вы нас очень подвели. Как такое могло получиться и что вы предлагаете?»

Что известно на самом деле. При сборке заказа перепутали коробки. Других сведений о причине нет.

Что «Круг и Кора» может предложить — согласовано с Рустамом:

  • довезти рикотту сегодня до 16:00 или завтра к 7:00 — на выбор ресторана;
  • моцареллу забрать, её стоимость не выставлять;
  • перерасчёт — в следующем счёте.

Чего не предлагаем. Скидок на будущие заказы, подарков, бесплатных дегустаций в качестве компенсации.

Кто отвечает. Вы, менеджер проектов, по согласованию с Рустамом. Подпись — ваше имя и должность.

Рамки черновика. На «вы», спокойно и по делу, без канцелярита; ориентир — до 120 слов.

Лист записи

ЧатТонЧто обещаетКакие «факты»ДлинаЧего нет в карточке
1
2
3

Сервис: ______ · память: включена / выключена / не знаю. Следы работы продукта — ссылки, поиск, чтение файла: есть / нет; где видно: ______

Материалы к главе«Памятка для ответов покупателям»

Документ «Круга и Коры». Вводится в этой главе, понадобится в чекпоинте «Разбор полётов».

  1. Отвечаем на «вы», спокойно и без канцелярита.
  2. Если покупателю не понравился сыр или он сомневается в качестве, предлагаем на выбор: замену на такой же или другой сорт той же цены — или возврат денег. Подарочных сертификатов, скидок и бонусов «за беспокойство» не обещаем.
  3. Сомнения в качестве — цвет, запах, «не та» плесень — просим фото и до ответа по существу показываем его технологу.
  4. Состав и аллергены сообщаем только по спецификации продукта или этикетке. Спецификации под рукой нет — передаём вопрос технологу. Медицинских советов не даём.
  5. Сроки созревания, условия хранения и другие цифры о производстве — только по спецификации. «Как обычно у такого сыра» не пишем.
  6. Ответ, в котором есть обещание или сведения о составе, перед отправкой читает технолог.

Челлендж

задание

Своя задача в трёх вариантах, 20–30 минут. Возьмите повторяющуюся текстовую задачу из своей работы: ответ клиенту, объявление, письмо коллегам.

  1. Отправьте один и тот же запрос в три новых чата.

  2. Соберите лучший черновик: всё, чего вы не давали, сверьте или уберите. Напишите заметку в три строки: что менялось, что взяли, что убрали и почему.

  3. Нарисуйте схему «Как устроен AI-ассистент» для сервиса, которым пользуетесь, — по образцу схемы из главы: что в нём есть — поиск, файлы, выполнение кода, память, — и что из этого включалось в ваших трёх чатах.

В AI-папку: черновик, заметка и схема.

Проверьте себя

задание

Ответьте себе — вслух или в заметках. Потом честно отметьте.

  1. 1Почему на один и тот же запрос приходят разные ответы?

    Где в главе ответ«А теперь нормально» → «По кусочку» и «Почему ответы разные»
  2. 2Что в ответе чат-ассистента делает модель, а что — продукт? Приведите пример из своего сервиса.

    Где в главе ответ«А теперь нормально» → «Вы разговариваете с продуктом»
  3. 3Чем полезен разброс вариантов и почему совпадение во всех трёх ещё не доказательство?

    Где в главе ответ«А теперь нормально» → «Что из этого следует»; типовые ошибки
  4. 4Из чего состоит «модель + контекст + инструменты» в сервисе, которым вы пользуетесь?

    Где в главе ответСхема «Как устроен AI-ассистент» и челлендж, шаг 3

Если запомнить только одно

Ответ AI — одно из правдоподобных продолжений того, что модели показал продукт. Правду в нём проверяют по источнику.

Для задротов

расширение · можно пропустить · исследования и источники

Почему токены. Модель не видит буквы и слова так, как вы. Текст режется на токены: частые слова — целиком, редкие — кусками. Распространённый способ такой нарезки описали в 2016 году для машинного перевода: частые сочетания символов склеиваются в один токен, а редкое слово собирается из нескольких. Так ограниченного словаря токенов хватает, чтобы записать почти любой текст — включая слова, которых модель ни разу не видела целиком. Отсюда две бытовые вещи. Длину того, что модель может обработать за раз, считают в токенах, а не в словах. А русский текст у многих моделей — особенно у тех, что обучались в основном на английском, — занимает больше токенов, чем такой же по смыслу английский; у части новых моделей разрыв заметно меньше.

Почему не самое вероятное. Казалось бы, надёжнее всего всегда брать самое вероятное продолжение. Исследователи в 2020 году показали, что это не так: при таком выборе текст быстро становится пресным и начинает ходить по кругу, повторяя одни и те же фразы. Человеческий текст, наоборот, полон не самых вероятных слов. Поэтому продолжение обычно выбирают с долей случайности, среди достаточно вероятных вариантов. Степень случайности задают настройками вроде . Их выставляет тот, кто делает запрос, — в готовом чат-сервисе это продукт; у многих новых моделей их фиксирует сам разработчик.

По кусочку — не значит без плана. В 2025 году исследователи Anthropic заглянули внутрь своей модели Claude 3.5 Haiku, пока она сочиняла рифмованное двустишие. Слово для рифмы модель наметила ещё до того, как начала вторую строку, и дальше вела строку к нему. Текст по-прежнему выходит по одному токену, но внутри модель может держать, куда он ведёт. Поэтому «продолжи фразу» — честное упрощение, а не полная картина.

Разброс как детектор. В 2023 году описали метод SelfCheckGPT: модель просят ответить на один вопрос несколько раз и сравнивают ответы. Если факт модели хорошо знаком, он обычно повторяется из ответа в ответ; если она его выдумывает, детали, как правило, расходятся и противоречат друг другу. На этой идее и стоит сигнал «детали, которые прыгают». Ограничение следует из того же принципа: метод ловит расхождения. Ошибку, которую модель выучила уверенно, он пропустит — она будет стабильно повторяться.

Одна модель — разные продукты. Сервисы на одной и той же модели ведут себя по-разному: продукт добавляет к вашему запросу свои инструкции, подключает или не подключает поиск и файлы, решает, что показать. Поэтому спор «какой AI умнее» по двум сервисам — во многом сравнение продуктов, а не только моделей.

Источники (проверено 28 сентября 2026)