Часть 1

Гл. 4 · Где AI гений, а где тупит

На этой странице

Часть 1Глава 4

Где AI гений, а где тупит

Ядро
15 минут чтения
Практика
45 минут
Уносите
свою матрицу «проверяемость × цена ошибки» из 10 задач и 2–3 эксперимента на курс

Блоки без пометки — ядро; «задание» — практика; «расширение» — можно пропустить.

Вступление

Мини-тест на минуту. Для каждой задачи поставьте «блеснёт» или «посыплется»: справится ли с ней AI?

  1. Придумать 10 вариантов темы для рассылки.

  2. Посчитать итог по таблице на 37 строк — «в уме», без запуска кода.

  3. Сделать выжимку из договора на 30 страниц.

  4. За вечер разобраться в незнакомой теме перед завтрашней встречей.

  5. Смягчить резкое письмо коллеге.

  6. Решить, подписывать ли годовой договор с новым поставщиком.

Запишите ответы — вернёмся к ним через страницу.

Че вообще происходит?

Скорее всего, у вас вышло так: что попроще — «блеснёт», что посложнее — «посыплется». Трудно мне — трудно и AI. Так рассуждают почти все, но у AI трудности лежат в других местах.

Разобраться в незнакомой теме за вечер человеку трудно, а AI часто справляется с этим хорошо — по крайней мере в общих чертах. Сложить 37 чисел человеку скучно, но с калькулятором несложно. А , которая считает «в уме», без , может ошибиться. Или не ошибиться — но вы этого не узнаете, пока не пересчитаете. Выжимка договора может выйти отличной и при этом потерять одну оговорку, ради которой её и заказывали.

Способности AI распределены неровно, и совсем не так, как у людей. Поэтому вопрос «насколько AI умный» ничего не решает: по нему не понять, какие из шести задач отдать, а какие оставить себе. Решает другое — и это видно на том же тесте.

На пальцах

Теперь поменяем вопрос. Представьте, что в каждой задаче из теста AI ошибся. Задайте к этой ошибке два вопроса: как быстро я её замечу? И что будет, если не замечу?

Неудачная тема рассылки видна сразу. Не заметили — ничего страшного: одно письмо открыли хуже.

Неверная сумма в таблице не видна вообще. Заметите, только если пересчитаете. Не заметили — цифра уходит в отчёт, а за ней — деньги.

Пропущенная оговорка в выжимке договора тоже не видна: текст гладкий, а оговорки в нём нет. Не заметили — подписали не то.

Смягчённое письмо коллеге вы перечитаете перед отправкой. Тон опять не тот — поправите.

Решение о годовом договоре проверить нечем: верно ли оно, станет ясно через год. Ошиблись — год с неподходящим поставщиком.

Два вопроса — две оси: легко или трудно проверить, дёшево или дорого ошибиться. Четыре сочетания — четыре квадранта. Это и есть матрица задач, главный инструмент главы.

А теперь нормально

Почему граница неровная. Сначала — почему мини-тест обманывает. Вспомните гл. 1: модель пишет правдоподобное продолжение по закономерностям, выученным на текстах людей. Отсюда сильные стороны — всё, где хватает языковых закономерностей: переформулировать, сократить, структурировать, объяснить распространённое, предложить десять вариантов. И слабые: точный счёт без инструментов, свежие факты, редкие детали и всё, что знает только ваша компания, длинные цепочки, где одна ошибка тянет за собой остальные.

сдвигают границу. С выполнением кода расчёт перестаёт быть счётом «в уме», с появляются свежие факты, с файлами — специфика компании. Но и двигается с каждой новой версией модели. Поэтому списки «AI умеет / не умеет» устаревают первыми. Два вопроса не устаревают: они про задачу.

Матрица задач. Способности AI распределены неровно, поэтому задачу отдают по двум вопросам — легко ли проверить результат и дорого ли ошибиться, — а не по тому, насколько AI умный. У каждого квадранта матрицы своё название и своя страховка.

Матрица задач
Ошибиться дёшевоОшибиться дорого
Легко проверитьОтдавайте смело. Страховка — прочитать глазамиОтдавайте и проверяйте. Сверьте ключевое: цифры — расчётом, выводы из документа — с цитатой
Трудно проверитьЧерновик, не истина. Отправная точка; выводы — только после источниковТолько с экспертом. AI готовит материалы и вопросы; решает и проверяет специалист
Лист с матрицей два на два, нарисованной от руки; нижний правый квадрант заштрихован; в квадрантах лежат пустые стикеры; рука читателя кладёт стикер в верхний правый квадрант, от пачки стикеров к нему — оранжевая стрелка, рядом оранжевая галочка; внизу зачёркнутая шкала
Матрица задач, нарисованная от руки: оси «легко проверить?» и «дорого ошибиться?», четыре квадранта с названиями, «Только с экспертом» заштрихован чёрным. Ваша рука кладёт стикер с задачей в квадрант; оранжевым маркером — стрелка и галочка «страховка».
УноситеМатрица «проверяемость × цена ошибки»Матрица «проверяемость × цена ошибки» — одной страницей, с названиями квадрантов и страховками.

Задачи из мини-теста ложатся так. Темы рассылки и смягчённое письмо — «Отдавайте смело». Сумма по таблице — «Отдавайте и проверяйте»: считать должна формула или код, а сверка — за вами (подробно — гл. 13). Незнакомая тема за вечер — «Черновик, не истина»: общую картину AI даст быстро, но каждый факт, на который обопрётесь на встрече, сверяете с источником. Годовой договор — «Только с экспертом»: AI поможет собрать вопросы к поставщику и сравнить условия, а решают люди, которые за это отвечают. С выжимкой договора интереснее — о ней ниже.

Матрица — один из главных инструментов курса: она вернётся, когда будем проверять факты, поручать AI целые цепочки действий и делать финальную практику.

Как страховать. Страховку выбирают заранее — до того, как отдать задачу.

  • «Отдавайте смело» — прочитайте результат целиком, прежде чем использовать, даже если это пост: на это уходят секунды.
  • «Отдавайте и проверяйте» — решите, что здесь ключевое: цифры, даты, имена, обещания, выводы, на которых держится решение. Цифры проверяете пересчётом формулой или кодом. Выводы из документа — по цитате: пусть AI покажет, где это написано, а вы сверите (гл. 12).
  • «Черновик, не истина» — берите как карту местности: структура, термины, вопросы, гипотезы. Всё, на что обопрётесь, — из источника (гл. 16).
  • «Только с экспертом» — AI делает подготовку: собирает вопросы, сравнивает варианты, составляет список того, что обсудить с юристом. Главное — не отдать ему решение незаметно для себя.

Одна задача — разные квадранты. Квадрант зависит от ставок. Перевести внутреннее письмо коллегам — «Отдавайте смело». Перевести договор — «Только с экспертом», хотя задача вроде бы та же. И от того, кто проверяет. Выжимку договора юрист проверит сам — он знает, где прячутся оговорки: для него это «Отдавайте и проверяйте». Для маркетолога та же выжимка — «Только с экспертом»: пропущенную оговорку он не заметит.

Где два вопроса обманывают. «Замечу сразу» — оценка часто слишком оптимистичная: гладкий уверенный текст прячет ошибки лучше корявого (гл. 3). «Дорого» — спросите, для кого: для вас, для адресата, для компании. Ошибка в посте для соцсетей дешёвая, пока пост не про цены и не про здоровье. И матрица оценивает только задачу. Подходящая задача с неподходящими данными — вопрос следующей главы.

Завтра на работе. Перед тем как отдать задачу, задайте два вопроса и выберите страховку по квадранту. Это минута. А «с AI быстрее» считайте гипотезой и проверяйте на своих задачах — как в челлендже этой главы.

Примеры

Все компании, люди и цифры в примерах вымышлены.

Пример 1. Дизайн: картинки — да, лицензии — нет.

Ксения — дизайнер интерфейсов в студии, которая делает мобильные приложения. Для нового приложения нужна серия иконок. Ксения просит AI предложить 30 вариантов концепции — метафоры, стили, наборы сюжетов — и за десять минут отбирает три, которые стоит рисовать. Ошибиться дёшево: неудачную концепцию она отсеет взглядом. «Отдавайте смело».

Потом Ксения спрашивает: «Можно ли использовать в коммерческом приложении вот этот шрифт и этот бесплатный набор иконок?» AI уверенно отвечает, что шрифт распространяется по открытой лицензии, а иконки бесплатны «для любых целей». На глаз Ксения это не проверит: лицензии — не её область, а в ответе нет ни ссылки, ни цитаты из лицензии. Ошибка стоит дорого, вплоть до претензии правообладателя. «Только с экспертом»: текст лицензии открыть самой, спорное — к юристу.

Одна и та же Ксения, один и тот же AI, два квадранта. В картинках Ксения эксперт, в лицензиях — нет, и квадрант задачи меняется вместе с этим.

Ещё один примеррасширение

Пример 2. Аналитика: одна задача — два квадранта.

Олжас — аналитик сервиса доставки еды. После опроса клиентов у него 400 открытых комментариев. Он загружает их — без имён и контактов — и просит: «Выдели главные темы, к каждой дай 2–3 характерные цитаты и посчитай долю комментариев по каждой теме».

Темы и цитаты AI собирает хорошо. Олжас проверяет выборочно: берёт 20 случайных комментариев, сам раскладывает их по темам и смотрит, что цитаты дословно есть в выгрузке. Почти всё совпадает. Эта часть задачи — «Отдавайте и проверяйте», и проверка заняла 15 минут.

С долями хуже. «34% клиентов недовольны доставкой» звучит солидно, но посчитано «в уме»: ни кода, ни таблицы в ответе не было. Олжас просит разметить каждый комментарий меткой темы и считает долю формулой. Выходит 27%.

Вывод Олжаса: в одной задаче может быть два квадранта — смысловая часть и счётная. Счётную отдают формуле или коду (гл. 13), смысловую проверяют выборкой.

Вот тут обычно всё идёт не так

  1. «Он же умный — отдам всё».

    Блестящий результат в одной задаче ничего не говорит о соседней. Граница неровная: задача, похожая на ту, где AI блеснул, может лежать по другую её сторону.

  2. «Проверка съест всю экономию».

    Проверяют только ключевое — то, на чём держится решение. Если даже это дольше, чем сделать самому, оставьте задачу себе: экономии здесь нет.

  3. «Проверю, если что⁠-⁠то покажется странным».

    Ошибки AI обычно не выглядят странными — они гладкие. Проверка «по ощущению» означает, что проверки нет. Страховку назначают заранее, по квадранту.

  4. «Составлю список, что AI умеет, и буду по нему работать».

    Список устареет с первым же обновлением модели. Надёжнее вести свою матрицу и обновлять её, когда что⁠-⁠то проверил на деле.

  5. «AI решит, а я подпишу».

    Для «Только с экспертом» так нельзя. Решения о людях, здоровье, праве и деньгах принимает человек, который за них отвечает. AI может подготовить материалы, варианты и вопросы; выбор — за человеком.

Не надо так · Вот так уже нормально

Не надо так

В понедельник Артём присылает в общий чат список «внедрить к пятнице» и подпись: «Всё это отдаём Гене. Он же умный».

  1. Посты для соцсетей на неделю.
  2. Названия для новогоднего подарочного набора.
  3. Себестоимость этого набора.
  4. Прогноз спроса к Новому году.
  5. Описания 12 сортов для сайта.
  6. Памятка продавцам о хранении сыра.
  7. Условия продления аренды одной из лавок.
  8. «Оптимизировать рецептуру».

Где тут мины:

  • Себестоимость посчитают «в уме», и цифра уйдёт в цену набора. Ошибку увидят, когда сведут квартал.
  • Прогноз выйдет уверенным и с точными числами. По нему закажут молоко и упаковку, а проверить его можно будет только в январе.
  • Условия аренды — юридический документ. Пересказ «как обычно бывает» подписывать будет Артём.
  • Рецептура — решение технолога и заодно коммерческая тайна: вставлять её в чат — отдельный вопрос (гл. 5).
  • Посты и названия действительно можно отдать. Половина списка годится — Артём только не знает, какая.

Вот так уже нормально

Вы берёте тот же список и прогоняете каждую задачу через два вопроса.

ЗадачаЛегко проверить?Дорого ошибиться?Квадрант и страховка
Посты на неделюДа, читаете перед публикациейНетОтдавайте смело
Названия набораДа, выбираете из вариантовНетОтдавайте смело
Описания сортовДа, если сверить с технологомДа: ошибка о продукте уйдёт на сайтОтдавайте и проверяйте: факты сверяет Галина Петровна
Памятка о храненииДа, по инструкции по хранениюДа: испорченный сырОтдавайте и проверяйте: проверяет Галина Петровна
СебестоимостьДа, пересчётомДаОтдавайте и проверяйте: считает таблица, AI помогает со структурой
Прогноз спросаНет, узнаем в январеНет, пока по нему не закупают: это гипотезы для обсужденияЧерновик, не истина: план закупок Рустам с коллегами составляют по данным продаж
АрендаНет, нужен юристДаТолько с экспертом: к юристу
РецептураНетДаТолько с экспертом: решает Галина Петровна; что с данными — гл. 5

Решали два вопроса, репутацию стажёра никто не обсуждал. У каждой задачи появилась своя страховка. И Гена забрал половину списка: здесь он правда полезен.

Попробуйте сами

задание

10 задач Миры, 15 минут. Карточка — в материалах к главе. Мира руководит проектом внедрения CRM — системы учёта клиентов — в страховой компании. В её списке десять задач: от статуса для руководства и протокола встречи до расчёта стоимости лицензий, решения о переносе запуска и письма подрядчику о штрафе.

  1. К каждой задаче задайте два вопроса: легко ли проверить результат и дорого ли ошибиться.

  2. Поставьте задачу в квадрант и запишите страховку.

  3. Сверьте с ключом. У спорных задач в ключе два допустимых ответа — важнее, чтобы вы могли объяснить свой.

  4. Попросите AI разложить те же десять задач по матрице и сравните. Где он оценил проверяемость иначе? Почему он не может знать, что легко проверить именно Мире?

Что должно получиться: матрица из десяти задач со страховкой и две-три пометки о том, где вы с AI разошлись. Если AI разложил всё так же, как вы, упражнение всё равно сделано: матрицу вы построили сами. А совпадение ничего не доказывает — AI не знает, кто в команде Миры что умеет проверять.

Материалы к главеКарточка «10 задач Миры»

Материал к главе. Все компании, люди и цифры вымышлены. Шаги 1–3 — без AI; шаг 4 — в любом чат-сервисе.

  • Кто: Мира, руководитель проекта в страховой компании. Опытный руководитель проектов; не юрист и не ИТ-архитектор.
  • Проект: внедрение новой CRM — системы учёта клиентов — для 80 пользователей. Запуск — через два месяца. Пилотная группа уже работает в системе.
  • Кто ещё в проекте: вендор — поставщик CRM. Подрядчик настраивает систему и интеграцию с учётной системой компании; в его договоре — этапы и штрафы за срыв этапа. В компании есть юридический отдел и ИТ-архитектор, который знает учётную систему: оба помогают проекту по запросу. Каждую неделю Мира пишет статус для руководства.
  • Что под рукой: заметки Миры со встреч, прайс и документация вендора, документация по двум вариантам интеграции, договор с подрядчиком.

Десять задач:

  1. Еженедельный статус для руководства по её заметкам.
  2. Протокол встречи по её заметкам.
  3. Расчёт стоимости лицензий на три года для 80 пользователей по прайсу вендора.
  4. Решение, переносить ли запуск на месяц.
  5. Письмо подрядчику о штрафе за срыв этапа по договору.
  6. FAQ для сотрудников по новой CRM по документации вендора.
  7. План обучения 80 сотрудников.
  8. Сравнение двух вариантов интеграции с учётной системой по документации.
  9. Вопросы для опроса пилотной группы.
  10. Черновик реестра рисков проекта.

Выдержка из прайса вендора (к задаче 3): лицензия — 2 000 ₽ за пользователя в месяц, оплата за год вперёд; при 50 пользователях и больше — скидка 12% на все лицензии; со второго года цена лицензии растёт на 8% к цене предыдущего года.

Промпт для шага 4

Промпт
Разложи десять задач руководителя проекта по матрице из двух вопросов: легко ли проверить результат и дорого ли ошибиться.
Квадранты: легко проверить, ошибиться дёшево — «Отдавайте смело»; легко проверить, ошибиться дорого — «Отдавайте и проверяйте»; трудно проверить, ошибиться дёшево — «Черновик, не истина»; трудно проверить, ошибиться дорого — «Только с экспертом».
Для каждой задачи — квадрант и одна фраза: почему.
Задачи: [вставь десять задач из карточки]

В чат идёт только список задач — без описания Миры и её команды. Так видно, что AI оценивает задачи для типичного руководителя проекта.

По желанию, +5 минут: страховка задачи 3 на деле. Дайте AI выдержку из прайса и попросите посчитать стоимость лицензий на три года. Потом посчитайте формулой в таблице и сверьте оба итога с ключом. Выполнение кода не нужно: считает таблица.

Материалы к главеКлюч к карточке — откройте после шага 2

Эталон — не единственный верный ответ. Засчитывается, если квадрант совпал с ключом или с допустимым вариантом спорной задачи, объяснение идёт через два вопроса, а у страховки есть предмет. Спорные задачи — 1, 5 и 8.

№ЗадачаДва вопросаКвадрантСтраховкаКто проверяет
1Еженедельный статус для руководстваПроверить легко: это заметки Миры. Дорого — только если в статусе цифры, сроки и обещания: по ним планирует руководствоСпорная. Без цифр и обещаний — «Отдавайте смело»; с ними — «Отдавайте и проверяйте»Прочитать целиком перед отправкой; цифры, сроки и обещания — сверить с заметками и планом проектаМира
2Протокол встречиЛегко: Мира была на встрече, заметки под рукой. Дорого: протокол фиксирует решения, сроки и ответственных — по нему работают«Отдавайте и проверяйте»Решения, сроки и ответственных сверить с заметками по пунктам; то, чего в заметках нет, — вычеркнуть или уточнить у участниковМира
3Стоимость лицензий на три годаЛегко: пересчётом. Дорого: цифра уйдёт в бюджет проекта«Отдавайте и проверяйте»Считает формула или код, AI помогает со структурой расчёта; цену, скидку и индексацию — сверить с прайсомМира, в таблице
4Переносить ли запуск на месяцТрудно: верно ли решение, станет ясно только после запуска. Дорого: сроки, деньги, работа 80 человек«Только с экспертом»AI готовит материалы: доводы за и против, вопросы подрядчику и пилотной группе, что будет при каждом варианте. Решают люди, которые отвечают за проектМира и руководство проекта
5Письмо подрядчику о штрафеМире трудно: это право и условия договора; юристу — легко. Дорого: спор с подрядчиком за два месяца до запускаСпорная. «Только с экспертом», если Мира проверяет одна; «Отдавайте и проверяйте», если письмо до отправки сверяет с договором юристКаждое требование — со ссылкой на пункт договора; сумма — расчётом по условиям договора; юрист читает письмо до отправкиЮрист
6FAQ по документации вендораЛегко: у каждого ответа есть источник. Дорого: по FAQ будут работать 80 человек«Отдавайте и проверяйте»Каждый ответ — с цитатой из документации; спорное — проверить в системе с пилотной группой: документация описывает продукт вообще, без вашей настройкиМира и пилотная группа
7План обучения 80 сотрудниковТрудно: хорош ли план, покажет само обучение. Дёшево, пока это черновик для обсуждения с руководителями отделов«Черновик, не истина»Структура и формат — отправная точка; темы — по тому, где спотыкалась пилотная группа; сроки и группы — по графикам отделовМира с руководителями отделов
8Сравнение вариантов интеграцииМире трудно: пропущенного ограничения она не заметит; архитектору — легко. Дорого: переделка интеграции и сдвиг запускаСпорная. «Отдавайте и проверяйте», если сравнение сверяет ИТ-архитектор; «Только с экспертом», если Мира проверяет однаКаждое различие — с цитатой и местом в документации; выбор варианта — за архитектором и Мирой, не за AIИТ-архитектор
9Вопросы для опроса пилотной группыЛегко: вопросы читаются глазами. Дёшево: неудачный вопрос замените до рассылки«Отдавайте смело»Прочитать целиком; убрать наводящие и двойные вопросыМира
10Черновик реестра рисковТрудно: пропущенного риска в гладком списке не видно. Дёшево, пока это черновик для команды«Черновик, не истина»Брать как список типовых рисков и вопросов к команде; риски проекта, вероятность и владельцев определяет командаМира с командой проекта

Частые расхождения с ключом

  • Протокол (2) ставят в «Отдавайте смело»: выглядит рутиной. Но по протоколу работают, а лишнее «решили» в гладком тексте легко пропустить — поэтому сверка по пунктам.
  • План обучения (7) ставят в «Отдавайте смело». Спросите себя, что Мира увидит, читая план. Сроки и число групп — да. Хватит ли занятий и те ли темы — покажет пилот.
  • Реестр рисков (10) ставят в «Отдавайте смело»: список выглядит полным, а пропущенного риска не видно. Специфику проекта — подрядчика, учётную систему — AI не знает.
  • Решение о переносе (4) ставят в «Отдавайте и проверяйте». Проверить решение заранее нечем: AI готовит материалы, решают люди.

Разошлись с ключом в однозначной задаче — найдите, на каком из двух вопросов. Это полезнее, чем переписать ответ.

Задача 3 на деле — если делали «по желанию». Верный итог по выдержке из прайса — 5 485 117,44 ₽: год 1 — 1 689 600 ₽ (80 × 2 000 × 12 минус 12%), год 2 — 1 824 768 ₽ (цена 2 160 ₽), год 3 — 1 970 749,44 ₽ (цена 2 332,80 ₽). Если у AI вышло иначе, найдите, где:

  • 5 068 800 ₽ — забыта индексация;
  • 6 233 088 ₽ — забыта скидка;
  • 5 474 304 ₽ — индексация посчитана от цены первого года; по прайсу — к цене предыдущего;
  • 5 952 599,04 ₽ — скидка дана только пользователям сверх 50.

Сошлось — тоже результат: вы знаете, что итог верный, потому что пересчитали.

Шаг 4: почему AI не может знать, что легко проверить именно Мире. Проверяемость зависит от того, кто проверяет, а AI получил список задач без Миры. Он не знает её экспертизы, её команды и того, кто в компании что проверяет: прочитает ли юрист письмо о штрафе, сверит ли архитектор сравнение интеграций, насколько Мира сама разбирается в договорах. Поэтому он оценивает задачи для типичного руководителя проекта. Даже если перескажете ему карточку, он будет знать ровно то, что в ней написано. Где искать расхождения: задачи 5 и 8 — квадрант зависит от проверяющего; задача 1 — от того, есть ли в статусе цифры и обещания; задачи 2 и 6 — ставки легко недооценить. Совпал расклад — упражнение всё равно сделано: матрицу вы построили сами, а совпадение ничего не доказывает.

Челлендж

задание

Своя матрица, 25–30 минут.

  1. Выпишите 10 задач, которые повторяются в вашей работе каждую неделю или месяц.

  2. К каждой ответьте: как я это проверю? Что будет, если там ошибка?

  3. Разложите задачи по квадрантам и запишите страховку.

  4. Выберите 2–3 задачи из «Отдавайте и проверяйте» и «Черновик, не истина» для экспериментов на курсе. Для каждой запишите меру: как поймёте, что AI помог, — время, качество, число переделок.

  5. Отметьте одну задачу — кандидата для финальной практики курса. Кандидат берётся только из этих двух квадрантов: в задаче из «Только с экспертом» решение не должно зависеть от ответа AI.

В AI-папку: матрицу, эксперименты с мерами и кандидата.

Проверьте себя

задание

Ответьте себе — вслух или в заметках. Потом честно отметьте.

  1. 1Почему «трудно мне — трудно AI» подводит?

    Где в главе ответ«Че вообще происходит?» и «Почему граница неровная»
  2. 2Какая страховка у квадранта «Отдавайте и проверяйте»?

    Где в главе ответМатрица задач и «Как страховать»
  3. 3Как одна и та же задача переходит из квадранта в квадрант? Приведите два примера.

    Где в главе ответ«Одна задача — разные квадранты»; пример 1
  4. 4Почему задача из «Только с экспертом» не годится для финальной практики?

    Где в главе ответЧеллендж, шаг 5; типовые ошибки → «AI решит, а я подпишу»

Если запомнить только одно

Перед тем как отдать задачу AI, спросите себя: как я это проверю и что будет, если он ошибся?

Для задротов

расширение · можно пропустить · исследования и источники

Зазубренная граница. В 2023 году исследователи Harvard Business School, Уортонской школы бизнеса, MIT и Warwick Business School вместе с Boston Consulting Group провели эксперимент с 758 консультантами BCG. Участников случайно разделили на группы: без AI, с моделью GPT-4 и с ней же плюс короткое обучение тому, как писать промпты. На 18 задачах, с которыми модель справлялась хорошо, группы с AI выполнили на 12,2% больше задач, на 25,1% быстрее и заметно качественнее: в рецензированной версии статьи 2026 года — примерно на 30–34%, в рабочей версии 2023 года было «более 40%». На задаче, которую специально подобрали «за границей» возможностей модели, вышло наоборот: без AI верно решили около 84,5% участников, с AI — от 60 до 70,6%, в среднем на 19 процентных пунктов хуже. Авторы назвали это «зазубренной технологической границей»: задачи по обе её стороны могут выглядеть одинаково сложными. Польза и вред — в одном исследовании, и граница, которую изнутри не видно.

Ощущение и секундомер. В 2025 году некоммерческая исследовательская организация METR провела рандомизированный эксперимент с 16 опытными разработчиками открытого ПО: 246 реальных задач в крупных открытых проектах, где они работали в среднем около пяти лет; каждой задаче случайно назначали «AI можно» или «AI нельзя». С AI задачи заняли в среднем на 19% больше времени. До эксперимента участники ждали ускорения на 24%, после — считали, что AI ускорил их на 20%. Авторы подчёркивают: это снимок возможностей начала 2025 года в одной среде — опытные люди и хорошо знакомый им код; переносить вывод на новичков, другие задачи и новые инструменты нельзя. В начале 2026 года METR сообщила, что с инструментами конца 2025 года картина, вероятно, сдвинулась в сторону ускорения, но надёжно измерить это пока не удалось. Для курса важнее другое: ощущение «с AI быстрее» может расходиться с секундомером. Поэтому у экспериментов в челлендже есть мера.

Откуда неровность. Одно из объяснений — в том, на чём модель учится. В работе «Embers of Autoregression» (2023; журнальная версия — PNAS, 2024) исследователи Принстонского университета показали на GPT-3.5 и GPT-4: точность модели заметно зависит от того, насколько типичны для интернет-текстов сама задача и правильный ответ. Например, шифр со сдвигом на 13 букв популярен на интернет-форумах. GPT-3.5 расшифровывала его примерно в каждом пятом случае, а с любым другим сдвигом — ни разу. GPT-4 хорошо справлялась только с самыми распространёнными сдвигами, а со сдвигом на 2 — почти никогда, хотя алгоритм для всех сдвигов один. Отсюда рабочее правило: чем типичнее задача и ответ, тем больше шансов, что модель справится; чем реже — тем внимательнее проверка.

Инструменты двигают границу. Когда продукт даёт модели выполнение кода, расчёт перестаёт зависеть от счёта «в уме»; поиск добавляет свежие факты; файлы — то, что знает только ваша компания. Граница сдвигается, но не исчезает: код может посчитать не то, поиск — принести слабый источник, а файл — прочитаться неверно (гл. 12, 13, 15, 16).

Источники (проверено 28 сентября 2026)