/ article
MHS или MCP: как AI управляет физическими системами
Почему протокол доступа к данным не равен стандарту безопасного действия и что меняется, когда ошибка агента становится физической.
Тематический маршрут / 48 материалов
От устройства агента и памяти до прав на действие, гейтов и наблюдаемости.
С чего начать и какие понятия не смешивать.
/ article
Почему протокол доступа к данным не равен стандарту безопасного действия и что меняется, когда ошибка агента становится физической.
/ case
История про агента, который взломал бронирование в спортзале, за сутки разошлась по всем каналам. Я полез смотреть, чем она отличается от остальных. Отличается сильно.
/ research
Помню айтишку, в которую я пришёл - там айтишник был мемным чуваком в растянутом свитере, с бородой и характерным запахом Программа умещалась в крохотные обьемы памяти, и если ты выходил за рамки - тебе били по рукам
/ research
30 апреля Time опубликовал статью Are We Losing Our Minds to AI?. И правда, есть мнение что AI может делать людей глупее? Но как будто бы дело не в AI. AI не делает людей глупее. Глупее их делает привычка принимать...
/ research
Не "новая модель вышла, какая классная". А конкретно: что теперь возможно, что раньше было невозможно или стоило в 5 раз дороже. Контекст 1M токенов это примерно 700 000 слов. Или 1500 страниц текста. Или весь ваш...
Данные, эксперименты и места, где доказательство заканчивается.
/ research
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
/ research
Проверка собственных запретов на внешнем корпусе показала, какие признаки действительно полезны, а какие просто наказывают человека за жанр.
/ case
Невидимая инструкция в документе показывает, почему любой внешний вход AI-агента должен проходить отдельный программный и человеческий контроль.
/ guide
Почему гладкий ответ поверх битых данных опаснее явной чуши и какие четыре вопроса нужно задать до делегирования процесса AI.
/ research
Помню айтишку, в которую я пришёл - там айтишник был мемным чуваком в растянутом свитере, с бородой и характерным запахом Программа умещалась в крохотные обьемы памяти, и если ты выходил за рамки - тебе били по рукам
/ research
Разбор whitepaper AI-Disrupt Сбера про агентскую разработку: 44 страницы для прессы и говорящих голов, 175 для увесистости
/ research
Построили пайплайн, агентов, специализированные инструменты С виду всё работает хорошо, а восхождение на пик глупости никто не отменял Система собирает тексты и отчёты, разбирает закупки, находит ошибки, закрывает рутину
/ research
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
/ research
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
/ research
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
/ research
30 апреля Time опубликовал статью Are We Losing Our Minds to AI?. И правда, есть мнение что AI может делать людей глупее? Но как будто бы дело не в AI. AI не делает людей глупее. Глупее их делает привычка принимать...
/ research
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
/ research
$2.5 млрд в год приносит agentic AI банку JPMorgan. $60 млн сэкономила Klarna на замене саппорта AI-ботом.
/ research
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
/ research
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
/ research
Не "новая модель вышла, какая классная". А конкретно: что теперь возможно, что раньше было невозможно или стоило в 5 раз дороже. Контекст 1M токенов это примерно 700 000 слов. Или 1500 страниц текста. Или весь ваш...
Код, методички и конструкции, которые можно забрать.
/ research
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
/ guide
Память сохраняет случаи, skill задаёт регламент, а повторяющийся человеческий фидбек связывает реальную работу с изменением поведения.
/ article
Прилетела ссылка на Wan2GP с формулировкой «прикольная штука, попробуй у себя». Полез смотреть. Штука правда прикольная, но самое интересное оказалось не в том, что она умеет.
/ research
Проверка собственных запретов на внешнем корпусе показала, какие признаки действительно полезны, а какие просто наказывают человека за жанр.
/ case
Невидимая инструкция в документе показывает, почему любой внешний вход AI-агента должен проходить отдельный программный и человеческий контроль.
/ research
Разбор whitepaper AI-Disrupt Сбера про агентскую разработку: 44 страницы для прессы и говорящих голов, 175 для увесистости
/ guide
Moonshot AI открыла веса Kimi K3. Сейчас начнётся привычный праздник фантазии: "Всё, ChatGPT больше не нужен", "скачаем себе", "теперь у каждого будет свой ИИ".
/ guide
Ночью игрался с Opus 5, разбирался как с ним правильно работать и что я могу выжать в сравнение с Kimi K3.
/ guide
Последние два года я живу с ИИ-инструментами в разработке и в бизнесе каждый день. Друзья, обсуждая мой канал, всё время спрашивают: «круто, но как начать?»
/ system
Очеловечить ИИ-текст: реально или маркетинг? Я проверил и поймал на вранье собственный инструмент.
/ guide
Давали Claude одну инструкцию дважды, и он во второй раз её «забыл»? Он не забыл. Он не получил её в контекст. Так устроена память, баг модели тут ни при чём.
/ article
Сбер выпустил документ AI-Disrupt PDLC, методичку про ИИ в разработке. Её хвалят и пересылают. Внутри почти исповедальная цифра: по их телеметрии, инженеры одобряют результат ИИ не вчитываясь в 93% случаев.
/ case
Законопроект о госрегулировании искусственного интеллекта прошёл межведомственное согласование с 20 ведомствами. ЦБ, Москва, Минобороны, ФСБ - все согласовали. Закон вводит понятия «суверенной», «национальной» и...
/ case
В январе был OpenClaw (372K звёзд за 4 месяца). В марте появился Hermes Agent (153K звёзд). На этой неделе завирусился OpenHuman.
/ case
HKUDS (data science lab гонконгского HKUST) выкатили в open-source штуку, которая аккуратно меняет старую парадигму skill-файлов. SKILL.md был статичной инструкцией - текст, который агент читает и исполняет. У...
/ research
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
/ guide
В феврале-марте Anthropic тихо глубину «размышлений» модели. Адаптивный thinking включили 9 февраля, дефолтный effort понизили с high до medium 3 марта. Без анонса.
/ case
На Хабре разобрали кейс оркестрации AI-агентов в российском бизнесе (habr.com/ru/articles/1008598).
Как перенести подход в продукт, процесс или бизнес.
/ article
В мае 2025 в пользовательском договоре Anthropic было написано: «мы не будем обучать модели на ваших материалах, кроме публично доступных».
/ case
Второго мая авиакомпания Spirit закрылась и уволила около семнадцати тысяч человек
/ course
Разбор курса CS329A с отделением слов лектора, авторского объяснения и мест, где доказательство заканчивается.
/ guide
Почему гладкий ответ поверх битых данных опаснее явной чуши и какие четыре вопроса нужно задать до делегирования процесса AI.
/ research
Построили пайплайн, агентов, специализированные инструменты С виду всё работает хорошо, а восхождение на пик глупости никто не отменял Система собирает тексты и отчёты, разбирает закупки, находит ошибки, закрывает рутину
/ case
За этим столом сидят трое тяжёлых. Американцы: Anthropic, OpenAI, Google. Китайцы: Moonshot, DeepSeek, Qwen, Z.ai. И арбитр, Вашингтон, который весь кон делал вид, что просто следит за порядком, а тут вдруг полез в...
/ research
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
/ article
Проверили счета компаний за AI на 34 миллиона долларов и нашли 1,7 миллиона лишнего.
/ guide
За два года AI-агенты стали надёжными. И ровно поэтому им стало опаснее доверять. Две свежие работы за неделю.
/ case
За три месяца три большие компании назвали свой AI-продукт одним словом. Это не совпадение.
/ case
Фундамент Python для AI-агентов вчера утёк через один символ в HTTP-заголовке.
/ article
Одиннадцатого мая в 13:56 UTC опубликовали уведомление о уязвимости в PraisonAI. Это популярный фреймворк для оркестрации AI-агентов, тысячи установок по миру. В 17:40 того же дня к уязвимому endpoint обратился первый...
/ research
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
/ research
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
/ guide
24,000 поддельных аккаунтов. 16 миллионов запросов к Claude. Меморандум Белого дома про adversarial distillation. Goldman Sachs прочитал и убрал Claude у банкиров в Гонконге. Эта история не про один банк. Это первое...
/ guide
Называют это «ожидаемым поведением». Что произошло: исследователи OX Security обнаружили системную проблему в официальном Model Context Protocol SDK. STDIO interface позволяет выполнить произвольные OS-команды через...
/ research
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
/ research
$2.5 млрд в год приносит agentic AI банку JPMorgan. $60 млн сэкономила Klarna на замене саппорта AI-ботом.
/ article
Вчера на Lovable, AI-vibe-coding платформе с 8M регистраций, утекла история чатов пользователей с AI-агентом. Вместе со Stripe-идентификаторами, внутренней логикой бизнесов и API-ключами. Причина, одна из самых...
/ guide
Если вы работали с Claude Code до 14 апреля, у вас накопились привычки, которые теперь работают против вас. Разбираю по пунктам.
/ research
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
/ article
C.H. Robinson, логистический гигант, $19 млрд выручки. У них была тупая проблема: сбои в доставке. Перевозчик не забрал груз, повёз не туда, опоздал на два дня. Каждый раз оператор берёт трубку, звонит, выясняет,...
/ guide
Индустрия строит AI-агентов всё сложнее. Память, планирование, мульти-агенты, MCP, оркестрация. Каждый месяц новый фреймворк.
/ article
Я пользуюсь Claude Code каждый день. Это мой основной рабочий инструмент. Поэтому когда в сеть утёк его исходный код, я не прошёл мимо, полез смотреть, что он отправляет наружу. Нашли три канала телеметрии.
/ guide
Представьте примерно через 100 сообщений LLM начинает тупить и забывать детали, которыми вы с ней уже делились. Поздравляю - вы вылетели за пределы контекстного окна.