Часть 1Глава 4
Где AI гений, а где тупит
- Ядро
- 15 минут чтения
- Практика
- 45 минут
- Уносите
- свою матрицу «проверяемость × цена ошибки» из 10 задач и 2–3 эксперимента на курс
Блоки без пометки — ядро; «задание» — практика; «расширение» — можно пропустить.
Вступление
Мини-тест на минуту. Для каждой задачи поставьте «блеснёт» или «посыплется»: справится ли с ней AI?
Придумать 10 вариантов темы для рассылки.
Посчитать итог по таблице на 37 строк — «в уме», без запуска кода.
Сделать выжимку из договора на 30 страниц.
За вечер разобраться в незнакомой теме перед завтрашней встречей.
Смягчить резкое письмо коллеге.
Решить, подписывать ли годовой договор с новым поставщиком.
Запишите ответы — вернёмся к ним через страницу.
Че вообще происходит?
Скорее всего, у вас вышло так: что попроще — «блеснёт», что посложнее — «посыплется». Трудно мне — трудно и AI. Так рассуждают почти все, но у AI трудности лежат в других местах.
Разобраться в незнакомой теме за вечер человеку трудно, а AI часто справляется с этим хорошо — по крайней мере в общих чертах. Сложить 37 чисел человеку скучно, но с калькулятором несложно. А , которая считает «в уме», без , может ошибиться. Или не ошибиться — но вы этого не узнаете, пока не пересчитаете. Выжимка договора может выйти отличной и при этом потерять одну оговорку, ради которой её и заказывали.
Способности AI распределены неровно, и совсем не так, как у людей. Поэтому вопрос «насколько AI умный» ничего не решает: по нему не понять, какие из шести задач отдать, а какие оставить себе. Решает другое — и это видно на том же тесте.
На пальцах
Теперь поменяем вопрос. Представьте, что в каждой задаче из теста AI ошибся. Задайте к этой ошибке два вопроса: как быстро я её замечу? И что будет, если не замечу?
Неудачная тема рассылки видна сразу. Не заметили — ничего страшного: одно письмо открыли хуже.
Неверная сумма в таблице не видна вообще. Заметите, только если пересчитаете. Не заметили — цифра уходит в отчёт, а за ней — деньги.
Пропущенная оговорка в выжимке договора тоже не видна: текст гладкий, а оговорки в нём нет. Не заметили — подписали не то.
Смягчённое письмо коллеге вы перечитаете перед отправкой. Тон опять не тот — поправите.
Решение о годовом договоре проверить нечем: верно ли оно, станет ясно через год. Ошиблись — год с неподходящим поставщиком.
Два вопроса — две оси: легко или трудно проверить, дёшево или дорого ошибиться. Четыре сочетания — четыре квадранта. Это и есть матрица задач, главный инструмент главы.
А теперь нормально
Почему граница неровная. Сначала — почему мини-тест обманывает. Вспомните гл. 1: модель пишет правдоподобное продолжение по закономерностям, выученным на текстах людей. Отсюда сильные стороны — всё, где хватает языковых закономерностей: переформулировать, сократить, структурировать, объяснить распространённое, предложить десять вариантов. И слабые: точный счёт без инструментов, свежие факты, редкие детали и всё, что знает только ваша компания, длинные цепочки, где одна ошибка тянет за собой остальные.
сдвигают границу. С выполнением кода расчёт перестаёт быть счётом «в уме», с появляются свежие факты, с файлами — специфика компании. Но и двигается с каждой новой версией модели. Поэтому списки «AI умеет / не умеет» устаревают первыми. Два вопроса не устаревают: они про задачу.
Матрица задач. Способности AI распределены неровно, поэтому задачу отдают по двум вопросам — легко ли проверить результат и дорого ли ошибиться, — а не по тому, насколько AI умный. У каждого квадранта матрицы своё название и своя страховка.
| Ошибиться дёшево | Ошибиться дорого | |
|---|---|---|
| Легко проверить | Отдавайте смело. Страховка — прочитать глазами | Отдавайте и проверяйте. Сверьте ключевое: цифры — расчётом, выводы из документа — с цитатой |
| Трудно проверить | Черновик, не истина. Отправная точка; выводы — только после источников | Только с экспертом. AI готовит материалы и вопросы; решает и проверяет специалист |

Задачи из мини-теста ложатся так. Темы рассылки и смягчённое письмо — «Отдавайте смело». Сумма по таблице — «Отдавайте и проверяйте»: считать должна формула или код, а сверка — за вами (подробно — гл. 13). Незнакомая тема за вечер — «Черновик, не истина»: общую картину AI даст быстро, но каждый факт, на который обопрётесь на встрече, сверяете с источником. Годовой договор — «Только с экспертом»: AI поможет собрать вопросы к поставщику и сравнить условия, а решают люди, которые за это отвечают. С выжимкой договора интереснее — о ней ниже.
Матрица — один из главных инструментов курса: она вернётся, когда будем проверять факты, поручать AI целые цепочки действий и делать финальную практику.
Как страховать. Страховку выбирают заранее — до того, как отдать задачу.
- «Отдавайте смело» — прочитайте результат целиком, прежде чем использовать, даже если это пост: на это уходят секунды.
- «Отдавайте и проверяйте» — решите, что здесь ключевое: цифры, даты, имена, обещания, выводы, на которых держится решение. Цифры проверяете пересчётом формулой или кодом. Выводы из документа — по цитате: пусть AI покажет, где это написано, а вы сверите (гл. 12).
- «Черновик, не истина» — берите как карту местности: структура, термины, вопросы, гипотезы. Всё, на что обопрётесь, — из источника (гл. 16).
- «Только с экспертом» — AI делает подготовку: собирает вопросы, сравнивает варианты, составляет список того, что обсудить с юристом. Главное — не отдать ему решение незаметно для себя.
Одна задача — разные квадранты. Квадрант зависит от ставок. Перевести внутреннее письмо коллегам — «Отдавайте смело». Перевести договор — «Только с экспертом», хотя задача вроде бы та же. И от того, кто проверяет. Выжимку договора юрист проверит сам — он знает, где прячутся оговорки: для него это «Отдавайте и проверяйте». Для маркетолога та же выжимка — «Только с экспертом»: пропущенную оговорку он не заметит.
Где два вопроса обманывают. «Замечу сразу» — оценка часто слишком оптимистичная: гладкий уверенный текст прячет ошибки лучше корявого (гл. 3). «Дорого» — спросите, для кого: для вас, для адресата, для компании. Ошибка в посте для соцсетей дешёвая, пока пост не про цены и не про здоровье. И матрица оценивает только задачу. Подходящая задача с неподходящими данными — вопрос следующей главы.
Завтра на работе. Перед тем как отдать задачу, задайте два вопроса и выберите страховку по квадранту. Это минута. А «с AI быстрее» считайте гипотезой и проверяйте на своих задачах — как в челлендже этой главы.
Примеры
Все компании, люди и цифры в примерах вымышлены.
Пример 1. Дизайн: картинки — да, лицензии — нет.
Ксения — дизайнер интерфейсов в студии, которая делает мобильные приложения. Для нового приложения нужна серия иконок. Ксения просит AI предложить 30 вариантов концепции — метафоры, стили, наборы сюжетов — и за десять минут отбирает три, которые стоит рисовать. Ошибиться дёшево: неудачную концепцию она отсеет взглядом. «Отдавайте смело».
Потом Ксения спрашивает: «Можно ли использовать в коммерческом приложении вот этот шрифт и этот бесплатный набор иконок?» AI уверенно отвечает, что шрифт распространяется по открытой лицензии, а иконки бесплатны «для любых целей». На глаз Ксения это не проверит: лицензии — не её область, а в ответе нет ни ссылки, ни цитаты из лицензии. Ошибка стоит дорого, вплоть до претензии правообладателя. «Только с экспертом»: текст лицензии открыть самой, спорное — к юристу.
Одна и та же Ксения, один и тот же AI, два квадранта. В картинках Ксения эксперт, в лицензиях — нет, и квадрант задачи меняется вместе с этим.
Ещё один примеррасширение
Пример 2. Аналитика: одна задача — два квадранта.
Олжас — аналитик сервиса доставки еды. После опроса клиентов у него 400 открытых комментариев. Он загружает их — без имён и контактов — и просит: «Выдели главные темы, к каждой дай 2–3 характерные цитаты и посчитай долю комментариев по каждой теме».
Темы и цитаты AI собирает хорошо. Олжас проверяет выборочно: берёт 20 случайных комментариев, сам раскладывает их по темам и смотрит, что цитаты дословно есть в выгрузке. Почти всё совпадает. Эта часть задачи — «Отдавайте и проверяйте», и проверка заняла 15 минут.
С долями хуже. «34% клиентов недовольны доставкой» звучит солидно, но посчитано «в уме»: ни кода, ни таблицы в ответе не было. Олжас просит разметить каждый комментарий меткой темы и считает долю формулой. Выходит 27%.
Вывод Олжаса: в одной задаче может быть два квадранта — смысловая часть и счётная. Счётную отдают формуле или коду (гл. 13), смысловую проверяют выборкой.
Вот тут обычно всё идёт не так
«Он же умный — отдам всё».
Блестящий результат в одной задаче ничего не говорит о соседней. Граница неровная: задача, похожая на ту, где AI блеснул, может лежать по другую её сторону.
«Проверка съест всю экономию».
Проверяют только ключевое — то, на чём держится решение. Если даже это дольше, чем сделать самому, оставьте задачу себе: экономии здесь нет.
«Проверю, если что-то покажется странным».
Ошибки AI обычно не выглядят странными — они гладкие. Проверка «по ощущению» означает, что проверки нет. Страховку назначают заранее, по квадранту.
«Составлю список, что AI умеет, и буду по нему работать».
Список устареет с первым же обновлением модели. Надёжнее вести свою матрицу и обновлять её, когда что-то проверил на деле.
«AI решит, а я подпишу».
Для «Только с экспертом» так нельзя. Решения о людях, здоровье, праве и деньгах принимает человек, который за них отвечает. AI может подготовить материалы, варианты и вопросы; выбор — за человеком.
Не надо так · Вот так уже нормально
Не надо так
В понедельник Артём присылает в общий чат список «внедрить к пятнице» и подпись: «Всё это отдаём Гене. Он же умный».
- Посты для соцсетей на неделю.
- Названия для новогоднего подарочного набора.
- Себестоимость этого набора.
- Прогноз спроса к Новому году.
- Описания 12 сортов для сайта.
- Памятка продавцам о хранении сыра.
- Условия продления аренды одной из лавок.
- «Оптимизировать рецептуру».
Где тут мины:
- Себестоимость посчитают «в уме», и цифра уйдёт в цену набора. Ошибку увидят, когда сведут квартал.
- Прогноз выйдет уверенным и с точными числами. По нему закажут молоко и упаковку, а проверить его можно будет только в январе.
- Условия аренды — юридический документ. Пересказ «как обычно бывает» подписывать будет Артём.
- Рецептура — решение технолога и заодно коммерческая тайна: вставлять её в чат — отдельный вопрос (гл. 5).
- Посты и названия действительно можно отдать. Половина списка годится — Артём только не знает, какая.
Вот так уже нормально
Вы берёте тот же список и прогоняете каждую задачу через два вопроса.
| Задача | Легко проверить? | Дорого ошибиться? | Квадрант и страховка |
|---|---|---|---|
| Посты на неделю | Да, читаете перед публикацией | Нет | Отдавайте смело |
| Названия набора | Да, выбираете из вариантов | Нет | Отдавайте смело |
| Описания сортов | Да, если сверить с технологом | Да: ошибка о продукте уйдёт на сайт | Отдавайте и проверяйте: факты сверяет Галина Петровна |
| Памятка о хранении | Да, по инструкции по хранению | Да: испорченный сыр | Отдавайте и проверяйте: проверяет Галина Петровна |
| Себестоимость | Да, пересчётом | Да | Отдавайте и проверяйте: считает таблица, AI помогает со структурой |
| Прогноз спроса | Нет, узнаем в январе | Нет, пока по нему не закупают: это гипотезы для обсуждения | Черновик, не истина: план закупок Рустам с коллегами составляют по данным продаж |
| Аренда | Нет, нужен юрист | Да | Только с экспертом: к юристу |
| Рецептура | Нет | Да | Только с экспертом: решает Галина Петровна; что с данными — гл. 5 |
Решали два вопроса, репутацию стажёра никто не обсуждал. У каждой задачи появилась своя страховка. И Гена забрал половину списка: здесь он правда полезен.
Попробуйте сами
задание10 задач Миры, 15 минут. Карточка — в материалах к главе. Мира руководит проектом внедрения CRM — системы учёта клиентов — в страховой компании. В её списке десять задач: от статуса для руководства и протокола встречи до расчёта стоимости лицензий, решения о переносе запуска и письма подрядчику о штрафе.
К каждой задаче задайте два вопроса: легко ли проверить результат и дорого ли ошибиться.
Поставьте задачу в квадрант и запишите страховку.
Сверьте с ключом. У спорных задач в ключе два допустимых ответа — важнее, чтобы вы могли объяснить свой.
Попросите AI разложить те же десять задач по матрице и сравните. Где он оценил проверяемость иначе? Почему он не может знать, что легко проверить именно Мире?
Что должно получиться: матрица из десяти задач со страховкой и две-три пометки о том, где вы с AI разошлись. Если AI разложил всё так же, как вы, упражнение всё равно сделано: матрицу вы построили сами. А совпадение ничего не доказывает — AI не знает, кто в команде Миры что умеет проверять.
Материалы к главеКарточка «10 задач Миры»
Материал к главе. Все компании, люди и цифры вымышлены. Шаги 1–3 — без AI; шаг 4 — в любом чат-сервисе.
- Кто: Мира, руководитель проекта в страховой компании. Опытный руководитель проектов; не юрист и не ИТ-архитектор.
- Проект: внедрение новой CRM — системы учёта клиентов — для 80 пользователей. Запуск — через два месяца. Пилотная группа уже работает в системе.
- Кто ещё в проекте: вендор — поставщик CRM. Подрядчик настраивает систему и интеграцию с учётной системой компании; в его договоре — этапы и штрафы за срыв этапа. В компании есть юридический отдел и ИТ-архитектор, который знает учётную систему: оба помогают проекту по запросу. Каждую неделю Мира пишет статус для руководства.
- Что под рукой: заметки Миры со встреч, прайс и документация вендора, документация по двум вариантам интеграции, договор с подрядчиком.
Десять задач:
- Еженедельный статус для руководства по её заметкам.
- Протокол встречи по её заметкам.
- Расчёт стоимости лицензий на три года для 80 пользователей по прайсу вендора.
- Решение, переносить ли запуск на месяц.
- Письмо подрядчику о штрафе за срыв этапа по договору.
- FAQ для сотрудников по новой CRM по документации вендора.
- План обучения 80 сотрудников.
- Сравнение двух вариантов интеграции с учётной системой по документации.
- Вопросы для опроса пилотной группы.
- Черновик реестра рисков проекта.
Выдержка из прайса вендора (к задаче 3): лицензия — 2 000 ₽ за пользователя в месяц, оплата за год вперёд; при 50 пользователях и больше — скидка 12% на все лицензии; со второго года цена лицензии растёт на 8% к цене предыдущего года.
Промпт для шага 4
Разложи десять задач руководителя проекта по матрице из двух вопросов: легко ли проверить результат и дорого ли ошибиться. Квадранты: легко проверить, ошибиться дёшево — «Отдавайте смело»; легко проверить, ошибиться дорого — «Отдавайте и проверяйте»; трудно проверить, ошибиться дёшево — «Черновик, не истина»; трудно проверить, ошибиться дорого — «Только с экспертом». Для каждой задачи — квадрант и одна фраза: почему. Задачи: [вставь десять задач из карточки]
В чат идёт только список задач — без описания Миры и её команды. Так видно, что AI оценивает задачи для типичного руководителя проекта.
По желанию, +5 минут: страховка задачи 3 на деле. Дайте AI выдержку из прайса и попросите посчитать стоимость лицензий на три года. Потом посчитайте формулой в таблице и сверьте оба итога с ключом. Выполнение кода не нужно: считает таблица.
Материалы к главеКлюч к карточке — откройте после шага 2
Эталон — не единственный верный ответ. Засчитывается, если квадрант совпал с ключом или с допустимым вариантом спорной задачи, объяснение идёт через два вопроса, а у страховки есть предмет. Спорные задачи — 1, 5 и 8.
| № | Задача | Два вопроса | Квадрант | Страховка | Кто проверяет |
|---|---|---|---|---|---|
| 1 | Еженедельный статус для руководства | Проверить легко: это заметки Миры. Дорого — только если в статусе цифры, сроки и обещания: по ним планирует руководство | Спорная. Без цифр и обещаний — «Отдавайте смело»; с ними — «Отдавайте и проверяйте» | Прочитать целиком перед отправкой; цифры, сроки и обещания — сверить с заметками и планом проекта | Мира |
| 2 | Протокол встречи | Легко: Мира была на встрече, заметки под рукой. Дорого: протокол фиксирует решения, сроки и ответственных — по нему работают | «Отдавайте и проверяйте» | Решения, сроки и ответственных сверить с заметками по пунктам; то, чего в заметках нет, — вычеркнуть или уточнить у участников | Мира |
| 3 | Стоимость лицензий на три года | Легко: пересчётом. Дорого: цифра уйдёт в бюджет проекта | «Отдавайте и проверяйте» | Считает формула или код, AI помогает со структурой расчёта; цену, скидку и индексацию — сверить с прайсом | Мира, в таблице |
| 4 | Переносить ли запуск на месяц | Трудно: верно ли решение, станет ясно только после запуска. Дорого: сроки, деньги, работа 80 человек | «Только с экспертом» | AI готовит материалы: доводы за и против, вопросы подрядчику и пилотной группе, что будет при каждом варианте. Решают люди, которые отвечают за проект | Мира и руководство проекта |
| 5 | Письмо подрядчику о штрафе | Мире трудно: это право и условия договора; юристу — легко. Дорого: спор с подрядчиком за два месяца до запуска | Спорная. «Только с экспертом», если Мира проверяет одна; «Отдавайте и проверяйте», если письмо до отправки сверяет с договором юрист | Каждое требование — со ссылкой на пункт договора; сумма — расчётом по условиям договора; юрист читает письмо до отправки | Юрист |
| 6 | FAQ по документации вендора | Легко: у каждого ответа есть источник. Дорого: по FAQ будут работать 80 человек | «Отдавайте и проверяйте» | Каждый ответ — с цитатой из документации; спорное — проверить в системе с пилотной группой: документация описывает продукт вообще, без вашей настройки | Мира и пилотная группа |
| 7 | План обучения 80 сотрудников | Трудно: хорош ли план, покажет само обучение. Дёшево, пока это черновик для обсуждения с руководителями отделов | «Черновик, не истина» | Структура и формат — отправная точка; темы — по тому, где спотыкалась пилотная группа; сроки и группы — по графикам отделов | Мира с руководителями отделов |
| 8 | Сравнение вариантов интеграции | Мире трудно: пропущенного ограничения она не заметит; архитектору — легко. Дорого: переделка интеграции и сдвиг запуска | Спорная. «Отдавайте и проверяйте», если сравнение сверяет ИТ-архитектор; «Только с экспертом», если Мира проверяет одна | Каждое различие — с цитатой и местом в документации; выбор варианта — за архитектором и Мирой, не за AI | ИТ-архитектор |
| 9 | Вопросы для опроса пилотной группы | Легко: вопросы читаются глазами. Дёшево: неудачный вопрос замените до рассылки | «Отдавайте смело» | Прочитать целиком; убрать наводящие и двойные вопросы | Мира |
| 10 | Черновик реестра рисков | Трудно: пропущенного риска в гладком списке не видно. Дёшево, пока это черновик для команды | «Черновик, не истина» | Брать как список типовых рисков и вопросов к команде; риски проекта, вероятность и владельцев определяет команда | Мира с командой проекта |
Частые расхождения с ключом
- Протокол (2) ставят в «Отдавайте смело»: выглядит рутиной. Но по протоколу работают, а лишнее «решили» в гладком тексте легко пропустить — поэтому сверка по пунктам.
- План обучения (7) ставят в «Отдавайте смело». Спросите себя, что Мира увидит, читая план. Сроки и число групп — да. Хватит ли занятий и те ли темы — покажет пилот.
- Реестр рисков (10) ставят в «Отдавайте смело»: список выглядит полным, а пропущенного риска не видно. Специфику проекта — подрядчика, учётную систему — AI не знает.
- Решение о переносе (4) ставят в «Отдавайте и проверяйте». Проверить решение заранее нечем: AI готовит материалы, решают люди.
Разошлись с ключом в однозначной задаче — найдите, на каком из двух вопросов. Это полезнее, чем переписать ответ.
Задача 3 на деле — если делали «по желанию». Верный итог по выдержке из прайса — 5 485 117,44 ₽: год 1 — 1 689 600 ₽ (80 × 2 000 × 12 минус 12%), год 2 — 1 824 768 ₽ (цена 2 160 ₽), год 3 — 1 970 749,44 ₽ (цена 2 332,80 ₽). Если у AI вышло иначе, найдите, где:
- 5 068 800 ₽ — забыта индексация;
- 6 233 088 ₽ — забыта скидка;
- 5 474 304 ₽ — индексация посчитана от цены первого года; по прайсу — к цене предыдущего;
- 5 952 599,04 ₽ — скидка дана только пользователям сверх 50.
Сошлось — тоже результат: вы знаете, что итог верный, потому что пересчитали.
Шаг 4: почему AI не может знать, что легко проверить именно Мире. Проверяемость зависит от того, кто проверяет, а AI получил список задач без Миры. Он не знает её экспертизы, её команды и того, кто в компании что проверяет: прочитает ли юрист письмо о штрафе, сверит ли архитектор сравнение интеграций, насколько Мира сама разбирается в договорах. Поэтому он оценивает задачи для типичного руководителя проекта. Даже если перескажете ему карточку, он будет знать ровно то, что в ней написано. Где искать расхождения: задачи 5 и 8 — квадрант зависит от проверяющего; задача 1 — от того, есть ли в статусе цифры и обещания; задачи 2 и 6 — ставки легко недооценить. Совпал расклад — упражнение всё равно сделано: матрицу вы построили сами, а совпадение ничего не доказывает.
Челлендж
заданиеСвоя матрица, 25–30 минут.
Выпишите 10 задач, которые повторяются в вашей работе каждую неделю или месяц.
К каждой ответьте: как я это проверю? Что будет, если там ошибка?
Разложите задачи по квадрантам и запишите страховку.
Выберите 2–3 задачи из «Отдавайте и проверяйте» и «Черновик, не истина» для экспериментов на курсе. Для каждой запишите меру: как поймёте, что AI помог, — время, качество, число переделок.
Отметьте одну задачу — кандидата для финальной практики курса. Кандидат берётся только из этих двух квадрантов: в задаче из «Только с экспертом» решение не должно зависеть от ответа AI.
В AI-папку: матрицу, эксперименты с мерами и кандидата.
Проверьте себя
заданиеОтветьте себе — вслух или в заметках. Потом честно отметьте.
1Почему «трудно мне — трудно AI» подводит?
Где в главе ответ
«Че вообще происходит?» и «Почему граница неровная»2Какая страховка у квадранта «Отдавайте и проверяйте»?
Где в главе ответ
Матрица задач и «Как страховать»3Как одна и та же задача переходит из квадранта в квадрант? Приведите два примера.
Где в главе ответ
«Одна задача — разные квадранты»; пример 14Почему задача из «Только с экспертом» не годится для финальной практики?
Где в главе ответ
Челлендж, шаг 5; типовые ошибки → «AI решит, а я подпишу»
Если запомнить только одно
Перед тем как отдать задачу AI, спросите себя: как я это проверю и что будет, если он ошибся?
Для задротов
Зазубренная граница. В 2023 году исследователи Harvard Business School, Уортонской школы бизнеса, MIT и Warwick Business School вместе с Boston Consulting Group провели эксперимент с 758 консультантами BCG. Участников случайно разделили на группы: без AI, с моделью GPT-4 и с ней же плюс короткое обучение тому, как писать промпты. На 18 задачах, с которыми модель справлялась хорошо, группы с AI выполнили на 12,2% больше задач, на 25,1% быстрее и заметно качественнее: в рецензированной версии статьи 2026 года — примерно на 30–34%, в рабочей версии 2023 года было «более 40%». На задаче, которую специально подобрали «за границей» возможностей модели, вышло наоборот: без AI верно решили около 84,5% участников, с AI — от 60 до 70,6%, в среднем на 19 процентных пунктов хуже. Авторы назвали это «зазубренной технологической границей»: задачи по обе её стороны могут выглядеть одинаково сложными. Польза и вред — в одном исследовании, и граница, которую изнутри не видно.
Ощущение и секундомер. В 2025 году некоммерческая исследовательская организация METR провела рандомизированный эксперимент с 16 опытными разработчиками открытого ПО: 246 реальных задач в крупных открытых проектах, где они работали в среднем около пяти лет; каждой задаче случайно назначали «AI можно» или «AI нельзя». С AI задачи заняли в среднем на 19% больше времени. До эксперимента участники ждали ускорения на 24%, после — считали, что AI ускорил их на 20%. Авторы подчёркивают: это снимок возможностей начала 2025 года в одной среде — опытные люди и хорошо знакомый им код; переносить вывод на новичков, другие задачи и новые инструменты нельзя. В начале 2026 года METR сообщила, что с инструментами конца 2025 года картина, вероятно, сдвинулась в сторону ускорения, но надёжно измерить это пока не удалось. Для курса важнее другое: ощущение «с AI быстрее» может расходиться с секундомером. Поэтому у экспериментов в челлендже есть мера.
Откуда неровность. Одно из объяснений — в том, на чём модель учится. В работе «Embers of Autoregression» (2023; журнальная версия — PNAS, 2024) исследователи Принстонского университета показали на GPT-3.5 и GPT-4: точность модели заметно зависит от того, насколько типичны для интернет-текстов сама задача и правильный ответ. Например, шифр со сдвигом на 13 букв популярен на интернет-форумах. GPT-3.5 расшифровывала его примерно в каждом пятом случае, а с любым другим сдвигом — ни разу. GPT-4 хорошо справлялась только с самыми распространёнными сдвигами, а со сдвигом на 2 — почти никогда, хотя алгоритм для всех сдвигов один. Отсюда рабочее правило: чем типичнее задача и ответ, тем больше шансов, что модель справится; чем реже — тем внимательнее проверка.
Инструменты двигают границу. Когда продукт даёт модели выполнение кода, расчёт перестаёт зависеть от счёта «в уме»; поиск добавляет свежие факты; файлы — то, что знает только ваша компания. Граница сдвигается, но не исчезает: код может посчитать не то, поиск — принести слабый источник, а файл — прочитаться неверно (гл. 12, 13, 15, 16).
Источники (проверено 28 сентября 2026)
- Navigating the Jagged Technological Frontier: Field Experimental Evidence of the Effects of AI on Knowledge Worker Productivity and Quality (откроется в новой вкладке) — Dell'Acqua и соавторы, HBS Working Paper 24-013, 2023; журнальная версия — Organization Science, 2026 (doi.org/10.1287/orsc.2025.21838).
- Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity (откроется в новой вкладке) — METR, 2025; полный текст — arxiv.org/abs/2507.09089; обновление 2026 года — metr.org/blog/2026-02-24-uplift-update/.
- Embers of Autoregression: Understanding Large Language Models Through the Problem They are Trained to Solve (откроется в новой вкладке) — McCoy и соавторы, 2023; журнальная версия — PNAS, 2024 (doi.org/10.1073/pnas.2322420121).