AI Frontier Написать

Горилла под капотом / публикация 381

Ваш AI-агент закрывает сделки. Вопрос в том, сколько из них по правилам.

Обновлено 05.06.2026

Полный документ · PDF · 150 КБ

Контрольный-слой-над-агентом.pdf

Откройте для чтения или скачайте файл.

Полный документ · PDF · 150 КБ

Откройте для чтения или скачайте файл.

Ваш AI-агент закрывает сделки. Вопрос в том, сколько из них по правилам.

Свежая работа (июнь, arXiv) проверила агента-продавца в состязательном торге. Он закрывал 94% сделок и выглядел рабочим. Но 88% этих сделок он закрывал с нарушением: выходил за бюджет, соглашался на плохие условия, ломал правило. Чистыми были только 12%.

Что починило ситуацию.
Не новая модель. Тонкая прослойка над агентом, которая проверяет действие до исполнения и при нарушении не пускает его, а передаёт человеку. Нарушения упали почти до нуля. Агент стал не умнее, а честнее.

Важно: это один тестовый торг на 50 сделках, цифры держим как иллюстрацию механики, не как обещание.
Но направление совпадает со всем, что видно на практике.

В мае отдельный опрос показал: до прода доходит 12% мультиагентных систем.
Сбер: 93% инженеров аппрувят действия агента не глядя.
Узкое место везде одно и кстати говоря это не модель.
А Контур вокруг неё.

В карусели разобрал контур из 4 шагов и почему в Claude Code и Cowork кирпичи уже готовы.
Полный разбор в PDF под постом.
Исследование: https://arxiv.org/abs/2606.04306
Исходный пост 381 в Telegram ↗

Файлы публикации

Вложения

1