/ research
Как AI-агент выполняет чужую инструкцию из интернета
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
Тематический маршрут / 48 материалов
Пилоты, экономика, процессы, команда и цена ошибки после красивого демо.
С чего начать и какие понятия не смешивать.
Этот этап пока пуст: пробел остаётся пустым, пока не появится подходящий материал.
Данные, эксперименты и места, где доказательство заканчивается.
/ research
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
/ guide
Разговор о серверах и цене модели начинается слишком рано, если ещё не измерены нагрузка, повторяемость задачи, кэш и цена ошибки.
/ research
Отчёт Ramp за август: за первый месяц после релиза Fable 5 собрала 6% от всех токенов, которые бизнес купил у Anthropic Флагман OpenAI за тот же период забрал 25% внутри своей компании
/ case
Невидимая инструкция в документе показывает, почему любой внешний вход AI-агента должен проходить отдельный программный и человеческий контроль.
/ guide
Почему гладкий ответ поверх битых данных опаснее явной чуши и какие четыре вопроса нужно задать до делегирования процесса AI.
/ research
Сегодня все напишут, что ИИ вышел из-под контроля. Новость в том как он это сделал и почему его никто не поймал.
/ research
В пересказе новость звучит так: «в Москве уволили за китайскую нейросеть». Удобно. Тут и страх перед ИИ, и Китай, и потеря работы. Всё для заголовка.
/ research
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
/ research
Одни взяли веса. Другие взяли архитектуру. И теперь спорят, кто честнее.
/ research
В мае я писал про методичку Сбера AI-Disrupt PDLC. Там была почти исповедальная цифра: по телеметрии самого Сбера инженеры одобряют действия ИИ, не вчитываясь, в 93% случаев. В целом исходя из своего опыта я могу...
/ research
Bridgewater выложил разбор вместе с лабораторией Миры Мурати (это экс-CTO OpenAI). Самое интересное - опять не фронтир модель.
/ research
Anthropic посмотрел на реальные логи 9 700 человек, опросами дело не ограничилось. И там видно, кого ИИ тянет вверх, а кого просто оставляет позади
/ research
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
/ research
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
/ research
MIT проверил, что происходит с мозгом людей, которые постоянно используют LLM.
/ research
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
/ research
$2.5 млрд в год приносит agentic AI банку JPMorgan. $60 млн сэкономила Klarna на замене саппорта AI-ботом.
/ research
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
/ research
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
Код, методички и конструкции, которые можно забрать.
/ research
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
/ guide
Память сохраняет случаи, skill задаёт регламент, а повторяющийся человеческий фидбек связывает реальную работу с изменением поведения.
/ system
Разбор промышленной AI-системы, которая различает паспортные данные, типовой baseline и отсутствие основания для ответа.
/ article
Прилетела ссылка на Wan2GP с формулировкой «прикольная штука, попробуй у себя». Полез смотреть. Штука правда прикольная, но самое интересное оказалось не в том, что она умеет.
/ case
Невидимая инструкция в документе показывает, почему любой внешний вход AI-агента должен проходить отдельный программный и человеческий контроль.
/ research
Сегодня все напишут, что ИИ вышел из-под контроля. Новость в том как он это сделал и почему его никто не поймал.
/ guide
Moonshot AI открыла веса Kimi K3. Сейчас начнётся привычный праздник фантазии: "Всё, ChatGPT больше не нужен", "скачаем себе", "теперь у каждого будет свой ИИ".
/ guide
Ночью игрался с Opus 5, разбирался как с ним правильно работать и что я могу выжать в сравнение с Kimi K3.
/ research
В мае я писал про методичку Сбера AI-Disrupt PDLC. Там была почти исповедальная цифра: по телеметрии самого Сбера инженеры одобряют действия ИИ, не вчитываясь, в 93% случаев. В целом исходя из своего опыта я могу...
/ research
Anthropic посмотрел на реальные логи 9 700 человек, опросами дело не ограничилось. И там видно, кого ИИ тянет вверх, а кого просто оставляет позади
/ case
Помните заметку месяц назад, про безопасность и вайб кодеров? Пора ее опубликовать, обезличенно, без реальных людей и данных
/ article
Сбер выпустил документ AI-Disrupt PDLC, методичку про ИИ в разработке. Её хвалят и пересылают. Внутри почти исповедальная цифра: по их телеметрии, инженеры одобряют результат ИИ не вчитываясь в 93% случаев.
/ case
Законопроект о госрегулировании искусственного интеллекта прошёл межведомственное согласование с 20 ведомствами. ЦБ, Москва, Минобороны, ФСБ - все согласовали. Закон вводит понятия «суверенной», «национальной» и...
/ research
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
/ case
На Хабре разобрали кейс оркестрации AI-агентов в российском бизнесе (habr.com/ru/articles/1008598).
Как перенести подход в продукт, процесс или бизнес.
/ article
Пилот доказывает полезность на коротком контуре, но масштабирование требует другой механики прав, проверки, отката и владения ошибкой.
/ case
Судебный документ с выдуманными ссылками показывает простую границу: AI может готовить черновик, но ответственность остаётся у отправителя.
/ article
В мае 2025 в пользовательском договоре Anthropic было написано: «мы не будем обучать модели на ваших материалах, кроме публично доступных».
/ article
Логи дают наблюдаемость, но не превращают неизвестное внутреннее состояние модели в доказанный факт и не заменяют внешний контроль.
/ guide
Разговор о серверах и цене модели начинается слишком рано, если ещё не измерены нагрузка, повторяемость задачи, кэш и цена ошибки.
/ case
Второго мая авиакомпания Spirit закрылась и уволила около семнадцати тысяч человек
/ course
Разбор курса CS329A с отделением слов лектора, авторского объяснения и мест, где доказательство заканчивается.
/ research
Отчёт Ramp за август: за первый месяц после релиза Fable 5 собрала 6% от всех токенов, которые бизнес купил у Anthropic Флагман OpenAI за тот же период забрал 25% внутри своей компании
/ guide
Почему гладкий ответ поверх битых данных опаснее явной чуши и какие четыре вопроса нужно задать до делегирования процесса AI.
/ article
OpenAI показали следующую модель, Astra, и представила её десятью результатами по открытым задачам вместо бенчмарка По каждой из них не было продвижения по главному результату минимум десять лет, в большинстве...
/ research
В пересказе новость звучит так: «в Москве уволили за китайскую нейросеть». Удобно. Тут и страх перед ИИ, и Китай, и потеря работы. Всё для заголовка.
/ case
За этим столом сидят трое тяжёлых. Американцы: Anthropic, OpenAI, Google. Китайцы: Moonshot, DeepSeek, Qwen, Z.ai. И арбитр, Вашингтон, который весь кон делал вид, что просто следит за порядком, а тут вдруг полез в...
/ research
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
/ research
Одни взяли веса. Другие взяли архитектуру. И теперь спорят, кто честнее.
/ research
Bridgewater выложил разбор вместе с лабораторией Миры Мурати (это экс-CTO OpenAI). Самое интересное - опять не фронтир модель.
/ article
Проверили счета компаний за AI на 34 миллиона долларов и нашли 1,7 миллиона лишнего.
/ case
Сегодня читаю анонс Claude Tag. Anthropic посадила Claude прямо в рабочий чат: он сам разбивает задачу на этапы, сам напоминает о забытых тредах, и, по словам компании, через него проходит 65% кода одной из их команд....
/ case
За три месяца три большие компании назвали свой AI-продукт одним словом. Это не совпадение.
/ case
Фундамент Python для AI-агентов вчера утёк через один символ в HTTP-заголовке.
/ research
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
/ research
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
/ article
Anthropic с Goldman Sachs, Blackstone и Hellman & Friedman учредили новую компанию на $1.5 млрд.
/ article
Anthropic продолжает сыпать банами направо и налево. И вроде бы да ожидаемо - ведь Россия в гео блоке. Но прикол в том что дело не в гео политике. Я и мои ребята давно пользуемся продуктами Claude и в целом мы не...
/ guide
24,000 поддельных аккаунтов. 16 миллионов запросов к Claude. Меморандум Белого дома про adversarial distillation. Goldman Sachs прочитал и убрал Claude у банкиров в Гонконге. Эта история не про один банк. Это первое...
/ research
MIT проверил, что происходит с мозгом людей, которые постоянно используют LLM.
/ research
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
/ research
$2.5 млрд в год приносит agentic AI банку JPMorgan. $60 млн сэкономила Klarna на замене саппорта AI-ботом.
/ article
Вчера на Lovable, AI-vibe-coding платформе с 8M регистраций, утекла история чатов пользователей с AI-агентом. Вместе со Stripe-идентификаторами, внутренней логикой бизнесов и API-ключами. Причина, одна из самых...
/ guide
Если вы работали с Claude Code до 14 апреля, у вас накопились привычки, которые теперь работают против вас. Разбираю по пунктам.
/ research
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
/ article
C.H. Robinson, логистический гигант, $19 млрд выручки. У них была тупая проблема: сбои в доставке. Перевозчик не забрал груз, повёз не туда, опоздал на два дня. Каждый раз оператор берёт трубку, звонит, выясняет,...
/ guide
Индустрия строит AI-агентов всё сложнее. Память, планирование, мульти-агенты, MCP, оркестрация. Каждый месяц новый фреймворк.
/ article
Я пользуюсь Claude Code каждый день. Это мой основной рабочий инструмент. Поэтому когда в сеть утёк его исходный код, я не прошёл мимо, полез смотреть, что он отправляет наружу. Нашли три канала телеметрии.