Как AI-агент выполняет чужую инструкцию из интернета
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
AI Frontier / База знаний72 материала · 6 открытых системиллюстрация
Учиться / использовать / применять
Всё, что AI Frontier знает, проверяет и собирает об искусственном интеллекте. Хотите учиться: учитесь. Хотите забрать наработки: забирайте. Хотите применить: переносите в свою систему.
У каждого материала есть происхождение, дата, граница проверки и следующий шаг.
06 / тематических маршрутов
Начните с базового объяснения, затем переходите к исследованию, инструменту и применению. Каждый пост остаётся самостоятельным.
От устройства агента и памяти до прав на действие, гейтов и наблюдаемости.
Пилоты, экономика, процессы, команда и цена ошибки после красивого демо.
Инъекции, утечки, fail-closed механика и контроль необратимых действий.
Что меняется между релизами моделей, открытыми весами, инференсом и данными.
Курсы, методики, разборы исследований и практики без магического промптинга.
Как устроены продукты AI Frontier, что можно забрать и где проходит их граница.
72 / первый выпуск / база растёт
Материалы под конкретную задачу. Начните с вопроса, роли или действия.
72 материала
Официальная документация тоже может вести к захваченному пакету: происхождение данных и право на действие должны проверяться отдельно.
Память сохраняет случаи, skill задаёт регламент, а повторяющийся человеческий фидбек связывает реальную работу с изменением поведения.
Пилот доказывает полезность на коротком контуре, но масштабирование требует другой механики прав, проверки, отката и владения ошибкой.
Разбор промышленной AI-системы, которая различает паспортные данные, типовой baseline и отсутствие основания для ответа.
Почему протокол доступа к данным не равен стандарту безопасного действия и что меняется, когда ошибка агента становится физической.
Судебный документ с выдуманными ссылками показывает простую границу: AI может готовить черновик, но ответственность остаётся у отправителя.
В мае 2025 в пользовательском договоре Anthropic было написано: «мы не будем обучать модели на ваших материалах, кроме публично доступных».
Логи дают наблюдаемость, но не превращают неизвестное внутреннее состояние модели в доказанный факт и не заменяют внешний контроль.
Разговор о серверах и цене модели начинается слишком рано, если ещё не измерены нагрузка, повторяемость задачи, кэш и цена ошибки.
Прилетела ссылка на Wan2GP с формулировкой «прикольная штука, попробуй у себя». Полез смотреть. Штука правда прикольная, но самое интересное оказалось не в том, что она умеет.
Второго мая авиакомпания Spirit закрылась и уволила около семнадцати тысяч человек
Проверка собственных запретов на внешнем корпусе показала, какие признаки действительно полезны, а какие просто наказывают человека за жанр.
Разбор курса CS329A с отделением слов лектора, авторского объяснения и мест, где доказательство заканчивается.
Отчёт Ramp за август: за первый месяц после релиза Fable 5 собрала 6% от всех токенов, которые бизнес купил у Anthropic Флагман OpenAI за тот же период забрал 25% внутри своей компании
Невидимая инструкция в документе показывает, почему любой внешний вход AI-агента должен проходить отдельный программный и человеческий контроль.
Почему гладкий ответ поверх битых данных опаснее явной чуши и какие четыре вопроса нужно задать до делегирования процесса AI.
История про агента, который взломал бронирование в спортзале, за сутки разошлась по всем каналам. Я полез смотреть, чем она отличается от остальных. Отличается сильно.
Помню айтишку, в которую я пришёл - там айтишник был мемным чуваком в растянутом свитере, с бородой и характерным запахом Программа умещалась в крохотные обьемы памяти, и если ты выходил за рамки - тебе били по рукам
OpenAI показали следующую модель, Astra, и представила её десятью результатами по открытым задачам вместо бенчмарка По каждой из них не было продвижения по главному результату минимум десять лет, в большинстве...
Сегодня все напишут, что ИИ вышел из-под контроля. Новость в том как он это сделал и почему его никто не поймал.
Разбор whitepaper AI-Disrupt Сбера про агентскую разработку: 44 страницы для прессы и говорящих голов, 175 для увесистости
Построили пайплайн, агентов, специализированные инструменты С виду всё работает хорошо, а восхождение на пик глупости никто не отменял Система собирает тексты и отчёты, разбирает закупки, находит ошибки, закрывает рутину
Claude убрал чужие чаты из Google. Но это ещё не значит, что проблему починили.
Moonshot AI открыла веса Kimi K3. Сейчас начнётся привычный праздник фантазии: "Всё, ChatGPT больше не нужен", "скачаем себе", "теперь у каждого будет свой ИИ".
В пересказе новость звучит так: «в Москве уволили за китайскую нейросеть». Удобно. Тут и страх перед ИИ, и Китай, и потеря работы. Всё для заголовка.
Ночью игрался с Opus 5, разбирался как с ним правильно работать и что я могу выжать в сравнение с Kimi K3.
За этим столом сидят трое тяжёлых. Американцы: Anthropic, OpenAI, Google. Китайцы: Moonshot, DeepSeek, Qwen, Z.ai. И арбитр, Вашингтон, который весь кон делал вид, что просто следит за порядком, а тут вдруг полез в...
Вбил в Google поисковый оператор site по страницам шеринга DeepSeek. Получил живой адрес, открыл. Без логина, без пароля загрузился чужой диалог с плашкой Shared Conversation. Просто ссылка, просто открылась.
Почти каждую неделю одно и тоже: «стройте команду ИИ-агентов, одного мало. Они спорят, проверяют друг друга и выдают лучший ответ».
Одни взяли веса. Другие взяли архитектуру. И теперь спорят, кто честнее.
В мае я писал про методичку Сбера AI-Disrupt PDLC. Там была почти исповедальная цифра: по телеметрии самого Сбера инженеры одобряют действия ИИ, не вчитываясь, в 93% случаев. В целом исходя из своего опыта я могу...
Последние два года я живу с ИИ-инструментами в разработке и в бизнесе каждый день. Друзья, обсуждая мой канал, всё время спрашивают: «круто, но как начать?»
Bridgewater выложил разбор вместе с лабораторией Миры Мурати (это экс-CTO OpenAI). Самое интересное - опять не фронтир модель.
Проверили счета компаний за AI на 34 миллиона долларов и нашли 1,7 миллиона лишнего.
Anthropic посмотрел на реальные логи 9 700 человек, опросами дело не ограничилось. И там видно, кого ИИ тянет вверх, а кого просто оставляет позади
Сегодня читаю анонс Claude Tag. Anthropic посадила Claude прямо в рабочий чат: он сам разбивает задачу на этапы, сам напоминает о забытых тредах, и, по словам компании, через него проходит 65% кода одной из их команд....
Помните заметку месяц назад, про безопасность и вайб кодеров? Пора ее опубликовать, обезличенно, без реальных людей и данных
С утра уже несколько раз прислали одно и то же: Anthropic вводит верификацию, теперь всех заблокируют Иногда даже с пруфами на офф статью и документы.
Очеловечить ИИ-текст: реально или маркетинг? Я проверил и поймал на вранье собственный инструмент.
За два года AI-агенты стали надёжными. И ровно поэтому им стало опаснее доверять. Две свежие работы за неделю.
Давали Claude одну инструкцию дважды, и он во второй раз её «забыл»? Он не забыл. Он не получил её в контекст. Так устроена память, баг модели тут ни при чём.
Сбер выпустил документ AI-Disrupt PDLC, методичку про ИИ в разработке. Её хвалят и пересылают. Внутри почти исповедальная цифра: по их телеметрии, инженеры одобряют результат ИИ не вчитываясь в 93% случаев.
Фундамент Python для AI-агентов вчера утёк через один символ в HTTP-заголовке.
За три месяца три большие компании назвали свой AI-продукт одним словом. Это не совпадение.
Законопроект о госрегулировании искусственного интеллекта прошёл межведомственное согласование с 20 ведомствами. ЦБ, Москва, Минобороны, ФСБ - все согласовали. Закон вводит понятия «суверенной», «национальной» и...
В январе был OpenClaw (372K звёзд за 4 месяца). В марте появился Hermes Agent (153K звёзд). На этой неделе завирусился OpenHuman.
Одиннадцатого мая в 13:56 UTC опубликовали уведомление о уязвимости в PraisonAI. Это популярный фреймворк для оркестрации AI-агентов, тысячи установок по миру. В 17:40 того же дня к уязвимому endpoint обратился первый...
12 Января я впервые столкнулся с Claude Cowork. Вотки кстати первое упоминание в канале: ссылка.
04.05: совместное предприятие на $1.5 млрд с Blackstone, Hellman & Friedman, Goldman Sachs. 05.05: десять готовых банковских агентов, Moody's встроен в Claude через MCP.
Уязвимость в Ollama: три API-вызова без авторизации позволяют злоумышленнику выгрузить много чего интересного переменные окружения, апи ключи, фрагменты чатов.
Anthropic с Goldman Sachs, Blackstone и Hellman & Friedman учредили новую компанию на $1.5 млрд.
30 апреля Time опубликовал статью Are We Losing Our Minds to AI?. И правда, есть мнение что AI может делать людей глупее? Но как будто бы дело не в AI. AI не делает людей глупее. Глупее их делает привычка принимать...
Anthropic продолжает сыпать банами направо и налево. И вроде бы да ожидаемо - ведь Россия в гео блоке. Но прикол в том что дело не в гео политике. Я и мои ребята давно пользуемся продуктами Claude и в целом мы не...
24,000 поддельных аккаунтов. 16 миллионов запросов к Claude. Меморандум Белого дома про adversarial distillation. Goldman Sachs прочитал и убрал Claude у банкиров в Гонконге. Эта история не про один банк. Это первое...
MIT проверил, что происходит с мозгом людей, которые постоянно используют LLM.
66% - именно столько реальных компьютерных задач сегодня выполняют AI-агенты.
Называют это «ожидаемым поведением». Что произошло: исследователи OX Security обнаружили системную проблему в официальном Model Context Protocol SDK. STDIO interface позволяет выполнить произвольные OS-команды через...
HKUDS (data science lab гонконгского HKUST) выкатили в open-source штуку, которая аккуратно меняет старую парадигму skill-файлов. SKILL.md был статичной инструкцией - текст, который агент читает и исполняет. У...
$2.5 млрд в год приносит agentic AI банку JPMorgan. $60 млн сэкономила Klarna на замене саппорта AI-ботом.
Вчера на Lovable, AI-vibe-coding платформе с 8M регистраций, утекла история чатов пользователей с AI-агентом. Вместе со Stripe-идентификаторами, внутренней логикой бизнесов и API-ключами. Причина, одна из самых...
Приватный консультант Александр Ханфф на днях обнаружил: Claude Desktop на Mac без спроса кладёт Native Messaging manifest в папки Chrome, Edge, Brave, Arc, Vivaldi, Opera, Chromium. В том числе в те браузеры, которые...
Если вы работали с Claude Code до 14 апреля, у вас накопились привычки, которые теперь работают против вас. Разбираю по пунктам.
Anthropic выложил гайд по мультиагентным системам. 5 паттернов, разжую коротко.
На прошлой неделе произошли три события одновременно. Anthropic выпустила Claude Mythos, который нашёл уязвимости во всех основных ОС, включая 27-летний баг в OpenBSD. Китайская группа использовала Claude Code для...
C.H. Robinson, логистический гигант, $19 млрд выручки. У них была тупая проблема: сбои в доставке. Перевозчик не забрал груз, повёз не туда, опоздал на два дня. Каждый раз оператор берёт трубку, звонит, выясняет,...
В феврале-марте Anthropic тихо глубину «размышлений» модели. Адаптивный thinking включили 9 февраля, дефолтный effort понизили с high до medium 3 марта. Без анонса.
Не "новая модель вышла, какая классная". А конкретно: что теперь возможно, что раньше было невозможно или стоило в 5 раз дороже. Контекст 1M токенов это примерно 700 000 слов. Или 1500 страниц текста. Или весь ваш...
Индустрия строит AI-агентов всё сложнее. Память, планирование, мульти-агенты, MCP, оркестрация. Каждый месяц новый фреймворк.
Я пользуюсь Claude Code каждый день. Это мой основной рабочий инструмент. Поэтому когда в сеть утёк его исходный код, я не прошёл мимо, полез смотреть, что он отправляет наружу. Нашли три канала телеметрии.
На Хабре разобрали кейс оркестрации AI-агентов в российском бизнесе (habr.com/ru/articles/1008598).
Представьте примерно через 100 сообщений LLM начинает тупить и забывать детали, которыми вы с ней уже делились. Поздравляю - вы вылетели за пределы контекстного окна.
Ключевая причина - токенизация. Для человека логическая единица - слово. Для модели - токен.
По этим условиям материалов пока нет. Сбросьте фильтр или попробуйте более общий запрос.
6 систем с открытой лицензией. У каждой своя страница с границей и командой установки из README.
Лицензии и звёзды сверены через GitHub API 01.09.2026. Всего у 6 открытых систем 311 звёзд, у стенда из 14 репозиториев 319 звёзд.
исходные данные и границы вывода
Сначала проверьте, что вы передаёте системе.
Что означает каждая строка, за какой период собраны данные и чего в них нет. Правильный расчёт на неподходящей выгрузке всё равно даёт неверный вывод.
В small-business-ru перед аналитикой стоит проверка входных данных. В инструкции описано, что нужно для запуска и где заканчиваются возможности скиллов.
открытая разработка
канал, агенты, связь
от материала к своей задаче
В базе можно учиться самостоятельно. На интенсиве или практикуме работаем с задачами вашей команды. Материалы практикума получают участники.