Конспект доклада Лорен Тан: как собрать команду ИИ-агентов, которой можно доверять

Это конспект часового доклада Лорен Тан о том, как собрать команду ИИ-агентов, которой можно доверить работу без ручной перепроверки. Сверху ссылка на сам доклад и тайм-коды, ниже пять шагов из него, переложенные так, чтобы ты мог повторить их у себя в Claude Code или Cursor уже сегодня. По каждому шагу готовый промпт или правило, которое копируешь одной кнопкой. Главная мысль доклада простая: агенту верят тогда, когда он сам умеет доказать, что задача сделана, и твоя работа в том, чтобы дать ему для этого инструменты.

Читается за 12 минут. Внутри ссылка на доклад с тайм-кодами, лестница доверия к агенту, пять шагов с готовыми промптами и правилами под копирование, шаблон карты функций и блок правил целиком для CLAUDE.md.

Сначала пройди конспект целиком, это 12 минут. Потом открой доклад и смотри куски по тайм-кодам, которые тебе нужнее. Внедряй по одному шагу за раз и проверяй на реальной задаче: начни с первого шага про проверку результата, без него остальные не работают. Блок правил в конце вставляется в CLAUDE.md целиком, если хочешь включить всё сразу.

Где смотреть доклад

Доклад называется «How Cursor Turned AI Agents Into Better Engineers», записан 12 августа 2026 года на платформе Maven, длина 60 минут. В описании Лорен указана как инженер Cursor, в сети она известна под ником poteto. Урок бесплатный, но Maven попросит зарегистрироваться по почте. Язык английский: включи автоперевод субтитров или смотри с переводчиком в браузере.

Открыть доклад на Maven

Тайм-коды, чтобы смотреть кусками

  • 00:04 вступление и её опыт руководителя разработки
  • 03:58 лестница доверия к агенту: от контроля каждого шага до автоматического принятия правок
  • 08:35 навыки проверки и карты функций
  • 16:20 набор pstack и как он гасит выдумки агента
  • 20:04 как поддерживать навыки агента в рабочем состоянии через проверочные тесты
  • 26:34 как перенести проверку с компьютера на облачных агентов
  • 32:34 переделка кода и ограничители
  • 38:38 размер правок и как нарезать работу
  • 41:00 ограничения в автоматической сборке
  • 50:38 расход токенов, окупаемость и цена
  • 55:58 как отдавать агентов продуктовой команде

Лестница доверия: где ты сейчас

Лорен описывает агента как талантливого новичка с короткой памятью. Он умный, быстрый и каждый раз приходит без вчерашнего контекста. Доверие к такому сотруднику растёт ступенями, и перепрыгнуть ступень нельзя. Посмотри на список и честно найди свою.

  1. Ты смотришь каждый шаг агента и правишь руками.
  2. Агент делает задачу целиком, ты перепроверяешь результат сам.
  3. Агент сам проверяет результат и приносит доказательство: скриншот, прогон, лог.
  4. Агенты работают параллельно, ты читаешь только их доказательства.
  5. Проверенные правки принимаются автоматически, ты разбираешь исключения.
Большинство застревает на второй ступени и думает, что упёрлось в ум модели. Переход на третью ступень делает шаг 1 ниже, и это самый дорогой по пользе шаг во всём докладе.

Шаг 1. Научи агента проверять свою работу

Ключевая фраза доклада: агент должен уметь сделать задачу, сам зайти в продукт, посмотреть на результат, увидеть ошибку, попробовать снова и продолжать, пока не сможет показать, что всё работает. Для этого агенту нужен инструмент проверки под твой проект: команда, которая открывает страницу, нажимает кнопки, делает скриншот и сверяет результат. Лорен называет это принципом «построй рычаг»: всё, что ты повторяешь руками, превращается в инструмент, который агент вызывает сам.

Промпт: собрать навык проверки для своего проекта
Изучи этот проект и собери навык проверки, которым ты будешь доказывать, что задача сделана. Сначала перечисли, какими способами можно наблюдать результат в этом проекте: запуск, страницы, команды, логи, тесты. Затем создай файл навыка с пошаговой инструкцией: как запустить проект, как открыть нужное место, как сделать скриншот или снять вывод, как понять, что результат верный, и что делать при ошибке. После каждой следующей задачи ты обязан прогнать этот навык и приложить доказательство: скриншот, вывод команды или лог. Без доказательства задача считается не сделанной.
Проверь себя простым вопросом: может ли агент прямо сейчас сам увидеть результат своей работы? Если он видит только код, он будет уверенно отчитываться о том, чего не проверял.

Шаг 2. Заведи карту функций

Агент приходит без памяти, и каждый раз объяснять ему весь продукт дорого. Лорен держит короткие карты функций: по одной на каждую функцию, которую видит пользователь. В карте написано, как до функции дойти, как ей управлять и где агент обычно спотыкается. Такую карту агент читает за секунды вместо того, чтобы заново изучать весь проект. В докладе она советует обновлять карты каждый день, чтобы представление агента о продукте не расходилось с реальностью.

Шаблон карты функции
Функция: [название, как её видит пользователь] Где находится: [путь в интерфейсе или команда] Как дойти: [шаги от входа до функции] Как управлять: [кнопки, поля, параметры, флаги] Как понять, что работает: [что должно появиться на экране или в выводе] Ловушки для агента: [где он ошибался раньше и почему] Связанные файлы: [где лежит код этой функции]
Промпт: собрать карты по проекту
Пройди по проекту и составь карты функций по шаблону выше: по одной карте на каждую функцию, которую видит пользователь. Сохрани их в папку feature-maps, одна функция в одном файле. Если в какой-то карте не можешь заполнить поле «Как понять, что работает», отметь это: значит, для этой функции нужен инструмент проверки из шага 1. Каждый раз, когда меняешь функцию, обновляй её карту в том же изменении.

Шаг 3. Пусть агент сначала перескажет задачу

Самая дешёвая проверка в докладе. Прежде чем трогать код, агент пересказывает задачу своими словами. Непонимание всплывает в пересказе за минуту, а в готовом коде за час. Лорен формулирует роль человека так: держать весь код в голове больше не нужно, нужно следить, чтобы у агента были верные данные.

Правило для CLAUDE.md
Перед началом любой задачи перескажи её своими словами в трёх пунктах: что нужно получить, как ты поймёшь, что задача сделана, и чего ты не знаешь. Если в третьем пункте есть что-то важное, задай вопрос и жди ответа до начала работы.

Шаг 4. Планируй через черновой код

В докладе звучит мысль, что прототип и есть план, только написанный кодом. Длинные документы с планом агент пишет легко и так же легко им не следует. Лорен идёт от конкретного: сигнатуры функций, типы данных, скриншот, замер скорости, работающий черновик. Для архитектурных решений она просит несколько агентов независимо предложить свои варианты, сравнивает их и оставляет за реализацией право отменить план, если в коде полезли некрасивые обходные пути.

Промпт: три независимых варианта перед большой задачей
Перед реализацией предложи три независимых варианта решения этой задачи. Для каждого покажи: структуру данных, сигнатуры главных функций, какие файлы изменятся и где вариант может сломаться. Не смешивай варианты между собой. Потом сравни их таблицей по простоте, риску и объёму правок и порекомендуй один. Если при реализации выбранного варианта понадобятся обходные костыли, остановись и вернись к сравнению.

Шаг 5. Параллель только после доверия

Обычно показывают десять агентов сразу. Лорен делает наоборот и держит строгий порядок, пропускать шаги в нём нельзя.

  1. Один агент надёжно работает с продуктом и умеет его проверять.
  2. У агента достаточно контекста: карты функций и правила.
  3. Агент приносит доказательство по каждой задаче.
  4. Только после этого задачу режут на куски и раздают нескольким агентам параллельно.

Параллельная команда агентов умножает то, что уже есть. Один проверяющий себя агент превращается в десять, а один непроверяющий в десять источников уверенных ошибок, которые тебе придётся разбирать руками.

Сколько это стоит

Такая строгость ест токены: несколько вариантов решения, проверка разными моделями, тесты и прогоны стоят дороже одного быстрого ответа. Правило из разбора доклада: тратить больше вычислений там, где ошибка дорогая.

Где включать всю строгость

  • функции, от которых зависят деньги и клиенты
  • большие переделки кода
  • ошибки в работающем продукте
  • решения по архитектуре
  • длинные запуски агента без присмотра, например на ночь

Где хватит быстрого режима

  • мелкие правки текста и стилей
  • разовые скрипты
  • черновики и прототипы, которые ты выбросишь

Готовый набор Лорен: pstack

Всё, о чём она рассказывает, собрано в открытый набор pstack для Cursor: 23 сценария работы, 23 принципа и набор команд. Ставится одной командой в чате Cursor, потом настраиваешь модели и работаешь через основной режим. Если ты в Claude Code, сам набор не поставится, но его принципы переносятся блоком правил ниже.

Установка в Cursor
/add-plugin pstack /setup-pstack /poteto-mode
  • /poteto-mode основной вход для любой нетривиальной задачи, сам подбирает сценарий
  • /architect согласует структуру данных до написания кода
  • /arena запускает несколько попыток решения и сравнивает их
  • /swarm раздаёт куски задачи параллельным агентам
  • /interrogate отдаёт готовую правку на разбор нескольким моделям
  • /tdd начинает с падающего теста
  • /blast-radius показывает, что может сломать правка
  • /automate-me собирает твой личный режим по истории твоих чатов
pstack на GitHub

Все пять шагов одним блоком для CLAUDE.md

Для тех, кто работает в Claude Code. Вставь блок в файл CLAUDE.md в корне проекта, и агент подхватит правила в следующем чате. Навык проверки из шага 1 и карты из шага 2 собери отдельно промптами выше, правила на них ссылаются.

Блок правил
## Как я работаю 1. Перед задачей пересказываю её в трёх пунктах: что получить, как пойму, что сделано, чего не знаю. Важное незнание сначала спрашиваю. 2. Перед работой с функцией читаю её карту в папке feature-maps. Меняю функцию, обновляю карту в том же изменении. 3. Перед большой задачей предлагаю три независимых варианта и сравниваю их. Если в реализации полезли костыли, возвращаюсь к сравнению. 4. Задача считается сделанной только с доказательством: прогоняю навык проверки и прикладываю скриншот, вывод команды или лог. 5. Параллельных агентов запускаю только на задачах, где каждый умеет проверить свой кусок сам. 6. Полную строгость включаю там, где ошибка дорогая. Мелкие правки делаю быстрым режимом.
Следующий шаг
Хочешь так же, но под свой блог и продукт?

Я собрал систему, по которой обычный человек запускает блог с нуля и набирает аудиторию без съёмок, монтажа и команды. Внутри разбор, с которого стартовал сам.

Открыть разбор: с чего начать→