Статус материала

Архивный материал. Перенесён без новой редакционной проверки; факты и продуктовые условия относятся к дате исходной публикации.

Warp, AI-терминал для разработчиков: как фидбек меняет поведение агентов

26 августа Anthropic выпустила разбор Warp, AI-терминала для разработчиков По данным самой компании, Warp используют 800 тысяч разработчиков в месяц

Что рассказывают?

Агент не становится лучше оттого, что вы его поправили Ваша правка живёт до конца сессии и исчезает вместе с ней Завтра он повторит ту же глупость, и вы напишете тот же комментарий

И как будто бы ничего нового в этом нет? Есть Agent-memory, есть кристализация фидбеков - короче говоря есть инструменты которые работают.

Но да ладно - давайте глянем, как это пытаются чинить в Warp. Схема проще, чем я ожидал.

Есть рабочий skill. Агент по нему делает ревью PR.

Инженер оставляет комментарий прямо под PR Не в отдельной форме, не в трекере, там же, где уже идёт работа.

Потом по расписанию запускается второй skill, наблюдатель Он собирает накопленные замечания, сравнивает ответы агента с реакцией людей и открывает маленький PR к рабочему skill Пишет, какие сигналы увидел и что меняет Человек смотрит, одобряет, вливает.

Следующий запуск наследует правку.

И вот тут важная штука, которую легко потерять: skill не равен памяти.

Память агента хранит прошлые случаи, решения, предпочтения, исключения Она нужна, чтобы опыт вообще пережил сессию Но память не гарантирует поведения Агент может не достать нужный случай, достать не тот или просто не понять, что с ним делать.

Skill задаёт регламент работы. В нём уже лежит то, что мы решили сделать правилом.

Поэтому фидбек важнее всего. Он связывает память, реальную работу и изменение поведения Один комментарий может остаться случаем в памяти Десять похожих комментариев могут стать правкой skill Наблюдатель нужен именно для этой разницы.

С их правилом «пишите принципы, а не правила» я согласен не до конца.

Принципы нужны Агенту надо объяснять, зачем он что-то делает, иначе он тупо исполняет формулировку и не переносит её на соседний случай.

Но конкретные алгоритмы тоже нужны Если условие повторяемо и цена ошибки высокая, «будь умным» не работает Нужны вещи уровня: проверь эти поля, не ставь метку без двух условий, сначала запусти тест. Принципы без алгоритмов дают красивую инструкцию Алгоритмы без принципов дают туннельный эффект. Нужны оба.

Ещё два правила у Warp я бы забрал без споров.

Собирать фидбек там, где люди уже работают Отдельный шаг убивает поток сигнала.

И считать, что фидбек будет неверным «Может быть неверным» здесь мягко: будет

Поэтому человек в контуре обязателен Кто-то должен решить, что этот комментарий отражает реальную проблему, а не плохое настроение автора.

Никакого волшебства. Собрать фидбек, найти повтор, сжать до изменения, дать человеку утвердить - в целом даже без цифр от Warp могу сказать что методология рабочая, протестирована не один десяток раз с февраля 2026

Источники и след

  1. 01 Оригинал в канале Under the Hood Происхождение / Telegram / сообщение 849