/ article
MHS или MCP: как AI управляет физическими системами
Почему протокол доступа к данным не равен стандарту безопасного действия и что меняется, когда ошибка агента становится физической.
Тематический маршрут / 57 материалов
Что меняется между релизами моделей, открытыми весами, инференсом и данными.
С чего начать и какие понятия не смешивать.
/ article
Почему протокол доступа к данным не равен стандарту безопасного действия и что меняется, когда ошибка агента становится физической.
/ case
История про агента, который взломал бронирование в спортзале, за сутки разошлась по всем каналам. Я полез смотреть, чем она отличается от остальных. Отличается сильно.
/ research
Помню айтишку, в которую я пришёл - там айтишник был мемным чуваком в растянутом свитере, с бородой и характерным запахом Программа умещалась в крохотные обьемы памяти, и если ты выходил за рамки - тебе били по рукам
/ research
Claude убрал чужие чаты из Google. Но это ещё не значит, что проблему починили.
/ case
Вбил в Google поисковый оператор site по страницам шеринга DeepSeek. Получил живой адрес, открыл. Без логина, без пароля загрузился чужой диалог с плашкой Shared Conversation. Просто ссылка, просто открылась.
/ article
С утра уже несколько раз прислали одно и то же: Anthropic вводит верификацию, теперь всех заблокируют Иногда даже с пруфами на офф статью и документы.
/ research
Уязвимость в Ollama: три API-вызова без авторизации позволяют злоумышленнику выгрузить много чего интересного переменные окружения, апи ключи, фрагменты чатов.
/ research
30 апреля Time опубликовал статью Are We Losing Our Minds to AI?. И правда, есть мнение что AI может делать людей глупее? Но как будто бы дело не в AI. AI не делает людей глупее. Глупее их делает привычка принимать...
/ article
Приватный консультант Александр Ханфф на днях обнаружил: Claude Desktop на Mac без спроса кладёт Native Messaging manifest в папки Chrome, Edge, Brave, Arc, Vivaldi, Opera, Chromium. В том числе в те браузеры, которые...
/ research
Не "новая модель вышла, какая классная". А конкретно: что теперь возможно, что раньше было невозможно или стоило в 5 раз дороже. Контекст 1M токенов это примерно 700 000 слов. Или 1500 страниц текста. Или весь ваш...
/ article
Ключевая причина - токенизация. Для человека логическая единица - слово. Для модели - токен.
Данные, эксперименты и места, где доказательство заканчивается.
/ guide
Разговор о серверах и цене модели начинается слишком рано, если ещё не измерены нагрузка, повторяемость задачи, кэш и цена ошибки.
/ research
Проверка собственных запретов на внешнем корпусе показала, какие признаки действительно полезны, а какие просто наказывают человека за жанр.
/ research
Отчёт Ramp за август: за первый месяц после релиза Fable 5 собрала 6% от всех токенов, которые бизнес купил у Anthropic Флагман OpenAI за тот же период забрал 25% внутри своей компании
/ research
Помню айтишку, в которую я пришёл - там айтишник был мемным чуваком в растянутом свитере, с бородой и характерным запахом Программа умещалась в крохотные обьемы памяти, и если ты выходил за рамки - тебе били по рукам
/ research
Сегодня все напишут, что ИИ вышел из-под контроля. Новость в том как он это сделал и почему его никто не поймал.
/ research
Построили пайплайн, агентов, специализированные инструменты С виду всё работает хорошо, а восхождение на пик глупости никто не отменял Система собирает тексты и отчёты, разбирает закупки, находит ошибки, закрывает рутину
/ research
Claude убрал чужие чаты из Google. Но это ещё не значит, что проблему починили.
/ research
В пересказе новость звучит так: «в Москве уволили за китайскую нейросеть». Удобно. Тут и страх перед ИИ, и Китай, и потеря работы. Всё для заголовка.
/ research
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
/ research
Одни взяли веса. Другие взяли архитектуру. И теперь спорят, кто честнее.
/ research
Bridgewater выложил разбор вместе с лабораторией Миры Мурати (это экс-CTO OpenAI). Самое интересное - опять не фронтир модель.
/ research
Anthropic посмотрел на реальные логи 9 700 человек, опросами дело не ограничилось. И там видно, кого ИИ тянет вверх, а кого просто оставляет позади
/ research
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
/ research
Уязвимость в Ollama: три API-вызова без авторизации позволяют злоумышленнику выгрузить много чего интересного переменные окружения, апи ключи, фрагменты чатов.
/ research
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
/ research
30 апреля Time опубликовал статью Are We Losing Our Minds to AI?. И правда, есть мнение что AI может делать людей глупее? Но как будто бы дело не в AI. AI не делает людей глупее. Глупее их делает привычка принимать...
/ research
MIT проверил, что происходит с мозгом людей, которые постоянно используют LLM.
/ research
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
/ research
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
/ research
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
/ research
Не "новая модель вышла, какая классная". А конкретно: что теперь возможно, что раньше было невозможно или стоило в 5 раз дороже. Контекст 1M токенов это примерно 700 000 слов. Или 1500 страниц текста. Или весь ваш...
Код, методички и конструкции, которые можно забрать.
/ article
Прилетела ссылка на Wan2GP с формулировкой «прикольная штука, попробуй у себя». Полез смотреть. Штука правда прикольная, но самое интересное оказалось не в том, что она умеет.
/ research
Проверка собственных запретов на внешнем корпусе показала, какие признаки действительно полезны, а какие просто наказывают человека за жанр.
/ research
Сегодня все напишут, что ИИ вышел из-под контроля. Новость в том как он это сделал и почему его никто не поймал.
/ guide
Moonshot AI открыла веса Kimi K3. Сейчас начнётся привычный праздник фантазии: "Всё, ChatGPT больше не нужен", "скачаем себе", "теперь у каждого будет свой ИИ".
/ guide
Ночью игрался с Opus 5, разбирался как с ним правильно работать и что я могу выжать в сравнение с Kimi K3.
/ guide
Последние два года я живу с ИИ-инструментами в разработке и в бизнесе каждый день. Друзья, обсуждая мой канал, всё время спрашивают: «круто, но как начать?»
/ research
Anthropic посмотрел на реальные логи 9 700 человек, опросами дело не ограничилось. И там видно, кого ИИ тянет вверх, а кого просто оставляет позади
/ system
Очеловечить ИИ-текст: реально или маркетинг? Я проверил и поймал на вранье собственный инструмент.
/ guide
Давали Claude одну инструкцию дважды, и он во второй раз её «забыл»? Он не забыл. Он не получил её в контекст. Так устроена память, баг модели тут ни при чём.
/ case
Законопроект о госрегулировании искусственного интеллекта прошёл межведомственное согласование с 20 ведомствами. ЦБ, Москва, Минобороны, ФСБ - все согласовали. Закон вводит понятия «суверенной», «национальной» и...
/ case
В январе был OpenClaw (372K звёзд за 4 месяца). В марте появился Hermes Agent (153K звёзд). На этой неделе завирусился OpenHuman.
/ case
HKUDS (data science lab гонконгского HKUST) выкатили в open-source штуку, которая аккуратно меняет старую парадигму skill-файлов. SKILL.md был статичной инструкцией - текст, который агент читает и исполняет. У...
/ research
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
/ guide
В феврале-марте Anthropic тихо глубину «размышлений» модели. Адаптивный thinking включили 9 февраля, дефолтный effort понизили с high до medium 3 марта. Без анонса.
/ case
На Хабре разобрали кейс оркестрации AI-агентов в российском бизнесе (habr.com/ru/articles/1008598).
Как перенести подход в продукт, процесс или бизнес.
/ article
Пилот доказывает полезность на коротком контуре, но масштабирование требует другой механики прав, проверки, отката и владения ошибкой.
/ article
В мае 2025 в пользовательском договоре Anthropic было написано: «мы не будем обучать модели на ваших материалах, кроме публично доступных».
/ article
Логи дают наблюдаемость, но не превращают неизвестное внутреннее состояние модели в доказанный факт и не заменяют внешний контроль.
/ guide
Разговор о серверах и цене модели начинается слишком рано, если ещё не измерены нагрузка, повторяемость задачи, кэш и цена ошибки.
/ case
Второго мая авиакомпания Spirit закрылась и уволила около семнадцати тысяч человек
/ research
Отчёт Ramp за август: за первый месяц после релиза Fable 5 собрала 6% от всех токенов, которые бизнес купил у Anthropic Флагман OpenAI за тот же период забрал 25% внутри своей компании
/ article
OpenAI показали следующую модель, Astra, и представила её десятью результатами по открытым задачам вместо бенчмарка По каждой из них не было продвижения по главному результату минимум десять лет, в большинстве...
/ research
Построили пайплайн, агентов, специализированные инструменты С виду всё работает хорошо, а восхождение на пик глупости никто не отменял Система собирает тексты и отчёты, разбирает закупки, находит ошибки, закрывает рутину
/ research
В пересказе новость звучит так: «в Москве уволили за китайскую нейросеть». Удобно. Тут и страх перед ИИ, и Китай, и потеря работы. Всё для заголовка.
/ case
За этим столом сидят трое тяжёлых. Американцы: Anthropic, OpenAI, Google. Китайцы: Moonshot, DeepSeek, Qwen, Z.ai. И арбитр, Вашингтон, который весь кон делал вид, что просто следит за порядком, а тут вдруг полез в...
/ research
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
/ research
Одни взяли веса. Другие взяли архитектуру. И теперь спорят, кто честнее.
/ research
Bridgewater выложил разбор вместе с лабораторией Миры Мурати (это экс-CTO OpenAI). Самое интересное - опять не фронтир модель.
/ article
Проверили счета компаний за AI на 34 миллиона долларов и нашли 1,7 миллиона лишнего.
/ case
Сегодня читаю анонс Claude Tag. Anthropic посадила Claude прямо в рабочий чат: он сам разбивает задачу на этапы, сам напоминает о забытых тредах, и, по словам компании, через него проходит 65% кода одной из их команд....
/ guide
За два года AI-агенты стали надёжными. И ровно поэтому им стало опаснее доверять. Две свежие работы за неделю.
/ case
За три месяца три большие компании назвали свой AI-продукт одним словом. Это не совпадение.
/ article
Одиннадцатого мая в 13:56 UTC опубликовали уведомление о уязвимости в PraisonAI. Это популярный фреймворк для оркестрации AI-агентов, тысячи установок по миру. В 17:40 того же дня к уязвимому endpoint обратился первый...
/ research
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
/ research
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
/ article
Anthropic с Goldman Sachs, Blackstone и Hellman & Friedman учредили новую компанию на $1.5 млрд.
/ article
Anthropic продолжает сыпать банами направо и налево. И вроде бы да ожидаемо - ведь Россия в гео блоке. Но прикол в том что дело не в гео политике. Я и мои ребята давно пользуемся продуктами Claude и в целом мы не...
/ guide
24,000 поддельных аккаунтов. 16 миллионов запросов к Claude. Меморандум Белого дома про adversarial distillation. Goldman Sachs прочитал и убрал Claude у банкиров в Гонконге. Эта история не про один банк. Это первое...
/ research
MIT проверил, что происходит с мозгом людей, которые постоянно используют LLM.
/ guide
Называют это «ожидаемым поведением». Что произошло: исследователи OX Security обнаружили системную проблему в официальном Model Context Protocol SDK. STDIO interface позволяет выполнить произвольные OS-команды через...
/ research
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
/ guide
Если вы работали с Claude Code до 14 апреля, у вас накопились привычки, которые теперь работают против вас. Разбираю по пунктам.
/ research
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
/ guide
Индустрия строит AI-агентов всё сложнее. Память, планирование, мульти-агенты, MCP, оркестрация. Каждый месяц новый фреймворк.
/ article
Я пользуюсь Claude Code каждый день. Это мой основной рабочий инструмент. Поэтому когда в сеть утёк его исходный код, я не прошёл мимо, полез смотреть, что он отправляет наружу. Нашли три канала телеметрии.
/ guide
Представьте примерно через 100 сообщений LLM начинает тупить и забывать детали, которыми вы с ней уже делились. Поздравляю - вы вылетели за пределы контекстного окна.