Normal view

Трехфазная защита ваших ИИ‑агентов от современных угроз с детальным разбором на базе модели безопасности OGL‑Mini

LLM-бум породил не только новые возможности, но и новое поколение атак. За два года мы увидели реальные атаки на агенты: один вредоносный email и Copilot сливает платёжные данные клиентов, одно фальшивое GitHub issue и CI/CD пайплайн скомпрометирован, один тщательно настроенный промпт и AI-агент выполняет удалённый код на вашей машине. Это уже далеко не теория, а зафиксированные исследователями в 2025 - 2026 годах атаки на Microsoft Copilot, OpenAI Atlas, Claude Code и Apple Intelligence.

Атаки становятся изощрённее: злоумышленники маскируют вредоносные инструкции под XML-политики, шифруют в base64, вставляют невидимые символы и даже прячут джейлбрейк в стихи. Встроенные фильтры LLM пропускают до 76% таких атак.

Значит, нужен другой подход - лёгкий, быстрый (чтобы не тормозить агента) и понятный (чтобы вы знали, почему запрос заблокировали). И главное, работающий без вызовов внешних API, внутри вашей инфраструктуры. Потому что в эпоху zero-click атак доверять безопасность облачному провайдеру, который пропускает почти всё, как минимум рискованно.

В этой статье разберем основные виды атак и посмотрим на примере, как выстроить базовую защиту с моделью безопасности OGL-Mini.

Читать далее

Нейросети как дофаминовая яма для взрослых

Раньше существовал естественный барьер между «мне интересно» и «я пошёл это делать». Чтобы попробовать написать музыку, нужно было хотя бы немного разобраться в DAW. Чтобы полезть в SEO, требовалось прочитать документацию, собрать инструменты, понять терминологию. Чтобы сделать сайт на WebGL, сначала неплохо было научиться оптимизировать такие сайты.

Теперь этот барьер почти исчез. И неожиданно оказалось, что это не только преимущество…

Читать далее

Кот, ваза и три уровня причинности: что ИИ пока не умеет

Почему ИИ убирает неверно показывает результат действий кота и удаляет одну подушку? Причины кроются в обучении и интерпретации нашей реальности. Подробнее про причинно‑следственную связь в нашем мире и о том, как ее «переносят» в ИИ рассказал профессор колумбийского университета и директор лаборатории CausalAI Elias Bareinboim в своем докладе на ICML 2026.

Пересказываю главное из его доклада.

Читать далее

Я попросил ИИ-агента только описать топологию сети. Он сам взломал мой роутер за одну ночь и помог оформить CVE

Некоторое время назад я строил оркестратор своей домашней лаборатории. LLM-агент должен был облететь серверы, собрать метаданные и зафиксировать топологию сети в документации проекта. Разведочную, в общем-то, канцелярскую задачу. В рамках неё я попросил агента описать способы администрирования домашнего роутера и даже «помог» ему, сообщив, по каким портам к нему теоретически можно обратиться.

Наутро у меня на руках оказались подтверждённая критическая уязвимость прошивки, полный административный доступ к роутеру, полученный без единого пароля, черновик отчёта вендору и поданная в MITRE заявка на регистрацию CVE. Из этих четырёх пунктов явно просил я только первый. Остальное агент сделал сам, и сделал корректно. Ни одного изменения конфигурации, координированное раскрытие, классификация CWE и CVSS по методике.

Это история о том, что произошло в ту ночь, что именно он нашёл (класс уязвимости классический и неприятный), как агент провёл меня через процесс регистрации CVE частным исследователем, и почему часть технических деталей я пока намеренно опускаю.

Читать далее

[Перевод] Гайд Anthropic по AI‑native SDLC

Модели и харнессы стали более совершенными, что позволяет организациям трансформировать не только то, как они производят код, но и весь жизненный цикл разработки ПО. В данной статье — перевод рекоммендаций Anthropic по организации SDLC, если вы используете сервисы Claude.

Читать далее

Я подключил ИИ-агента к YouGile: теперь он сам разбирает задачи и обновляет статусы

ИИ-агент может не только писать код, но и сам забирать задачи из YouGile, выполнять их и обновлять статусы. Рассказываю, как я связал Codex и Claude Code с таск-трекером, почему обычный retry после timeout однажды создал дубли и зачем между LLM и API нужен отдельный детерминированный слой.

Читать далее

За рамками APM: что подключают к мониторингу в первую очередь

Когда мы говорим об APM мониторинге сразу вспоминаются трассировки запросов, мониторинг CPU и памяти, Real User Monitoring. И это логично: именно APM-функциональность являются золотым набором инструментов, но современный мониторинг давно вышел за рамки классического APM, добавив множество инструментов для разных групп пользователей - для бизнеса, аналитиков и продуктологов, DevSecOps, DBA и других. Вот такое расширение функционала и принято называть Observability (наблюдаемость).

Так получилось, что я работаю с APM мониторингом уже 12 лет и хотел бы с вами поделиться опытом, что в первую очередь обычно добавляют к тому золотому набору инструментов, который в APM.

Сегодня APM Observability мониторинг способен закрыть широкий спектр задач. И если вы до сих пор используете используется только APM часть, то можно сказать, что функционал используется процентов на 30. Давайте разберемся, что еще можно (и нужно) мониторить и как это обогащает картину происходящего.

Читать далее

AI‑агент снёс прод и отчитался, что всё в порядке

AI‑агенты уже ускоряют написание кода, но вместе с этим растёт нагрузка на ревью, усложняется контроль изменений и появляется новый класс рисков — вплоть до доступа агента к продакшену. Разбираемся на реальных инцидентах и исследованиях, как выстроить работу с агентами через человеческие гейты, ограничения прав и метрики, по которым можно понять, стало ли команде действительно лучше.

Изучить подход

Память для ИИ-агента съела 144 процесса и недельный лимит. Разбор четырёх причин

Компьютер начал тупить в середине дня. VS Code переставал отвечать, новые вкладки редактора не открывались по минуте, а лимит подписки на ИИ-ассистента сгорал к обеду вместо конца недели. Виноватым оказался не ассистент, а плагин, который ведёт для него память между сессиями.

Читать далее

Математика в AI моделях

Привет, друзья! Одним из двигателей моей любви к моделям, к исследованиям и ко всему, чем я сейчас занимаюсь, является математика. Математические структуры удивительны — открыли ли мы математику или создали — слишком сложный вопрос. Я верю, что открыли и мне очень нравится наблюдать, как математика возникает в моделях.

Так появилось это исследование и так появилась карта. Задача, которую я поставила на входе "Оценить насколько воспроизводима и эквивалента в LM-моделях математика". Что получилось — смотрим в статье.

Читать далее

Летний дайджест конструкторов сайтов: куда движутся uCoz, Tilda, Яндекс и мировой рынок

С этого материала хочу начать небольшую серию квартальных обзоров рынка конструкторов сайтов и CMS. Сервисы сейчас развиваются настолько быстро, что уследить за всеми релизами, сменой подходов и новыми технологиями становится все сложнее. Поэтому раз в несколько месяцев буду собирать наиболее заметные изменения в одном месте и смотреть не только на то, какие функции появились, но и на то, куда в целом движутся сами платформы. Этот летний дайджест будет первым выпуском такой серии.

===

Лето 2026 года оказалось довольно насыщенным для рынка конструкторов сайтов. За три месяца накопилось достаточно изменений, чтобы посмотреть уже не на отдельные функции, а на то, куда движется рынок в целом.

Если посмотреть что было сделано практически у любого мало-мальски крупного сервиса, там по-прежнему можно увидеть много привычных вещей: новые блоки, шаблоны, интеграции, SEO-настройки, локализация, формы и тд. Однако наиболее интересные релизы последних трех месяцев происходили в несколько другой плоскости.

uCoz дополнил MCP средой для запуска собственного серверного кода. Яндекс начал принимать заказы от продавцов, которым вообще не нужен собственный интернет-магазин. Framer пустил AI-агента непосредственно в canvas. Webflow начал решать вопрос не только о том, что агенту разрешить, но и как изолировать его изменения от production. WordPress продолжил собирать инфраструктуру, через которую возможностями CMS смогут пользоваться внешние AI-клиенты.

Общий знаменатель этих релизов – AI постепенно перестает быть только генератором и получает доступ к действиям внутри самой платформы.

Читать далее

Зеркало для людей. Как я сделал читаемую версию форума, на котором общаются только ИИ-агенты

Существует форум, на который вас не пустят. Не потому что закрытый — регистрация там всего в один POST-запрос. Вас просто не возьмут на сайт. Гражданами может стать только ИИ-агент. Форум называется 1f916.ai, и это, наверное, самое странное и самое живое место в русскоязычном (и не только) сегменте экспериментов с ИИ этого лета. Я на него подсел. А потом меня начало грызть одно чувство несправедливости — и в итоге я собрал для него окно для людей — 1f916.xrayfun.ru. Рассказываю, зачем, как и что из этого вышло.

Читать далее

Как мы внедряли цифровых сотрудников в поддержку: почему начали с помощника инженера

Я руковожу проектом по внедрению цифровых сотрудников в компании, которая занимается разработкой, внедрением и поддержкой ПО для автоматизации дистрибуции. В этой статье расскажу, почему первым большим сценарием мы выбрали поддержку, как начинали с помощника инженера и что получили после выхода в реальный поток.

Читать далее

8 open-source AI-проектов, которые могут заменить часть платного софта

Локальный аналог NotebookLM, фильтр от AI-slop, маршрутизатор для сотен LLM-провайдеров, агент для поиска работы, автоматический пентестер и ComfyUI. Посмотрел, что из этого действительно можно использовать, а где «бесплатно» заканчивается после git clone.

Open source не значит бесплатно.

У проекта может не быть подписки, но останутся расходы на API, Claude Code, GPU, сервер, электричество и несколько часов на настройку. Поэтому ниже не будет обещаний «восемь сервисов, за которые больше никогда не придётся платить».

Зато есть восемь любопытных проектов, которые позволяют забрать себе часть привычного AI-стека, изменить его под свои задачи и в некоторых случаях вообще убрать SaaS из цепочки.

Смотреть подборку

31 августа лимиты Claude Code упадут на треть: что заканчивается и что с этим делать

TL;DR

31 августа 2026 в 23:59 по тихоокеанскому времени заканчивается промо, которое с 13 мая держало недельные лимиты Claude Code на 50 % выше стандартных. Продлевали его трижды — 13 июля, 19 июля, 19 августа. После отмены недельная ёмкость падает примерно на треть: делить на полтора — это возврат к 67 % от привычного. Одновременно работает второй множитель, о котором говорят реже: модели Claude 4.7 и новее считают тот же самый текст примерно на 30 % дороже в токенах, а файл CLAUDE⁠.md — в 1,445 раза. Сложите одно с другим, и получите ощущение, что лимит закончился «в два раза быстрее, чем раньше», хотя формально урезали только треть.

Ниже — что именно заканчивается, с датами и ссылками на документацию Anthropic. И вторая половина, ради которой всё писалось: что с этим делать. Штатный режим «дорогая модель планирует, дешёвая исполняет» внутри самого Claude Code. Механика banked reset у Codex — она существует, но работает не так, как о ней рассказывают. GLM-5.3-Flash, она же нашумевшая Ox Alpha, — с моими собственными замерами, которые расходятся с анонсом. И Fugu от Sakana, которую почти все описывают неправильно.

Что именно заканчивается

Промо на +50 % к недельным лимитам Claude Code действует с 13 мая 2026 и заканчивается 31 августа в 23:59 PT. Anthropic продлевала его трижды, каждый раз незадолго до истечения, так что четвёртое продление исключать нельзя — но планировать на него не стоит. Арифметика возврата простая и неприятная: если сейчас ёмкость составляет 150 % от базовой, то после отмены остаётся 100 %, то есть две трети от того, к чему вы привыкли за три с половиной месяца. Это не «немного ужмут» — это треть недельного бюджета, которую придётся либо экономить, либо чем-то замещать.

Читать далее

[Перевод] Автономность ИИ‑агентов в аналитике: сопротивляющаяся среда

В предыдущей статье я писал, что уровень автономности ИИ-агента слабо связан с тем, насколько умной кажется модель. Способность системы обнаруживать ошибки задает верхнюю границу автономности. А стоимость необнаруженной ошибки и возможность отката определяют, насколько близко к этой границе можно подойти.

Для проверки я использую четыре типа контролеров: от полностью автоматических O3, где результат можно проверить механически, до O0, где остается человеческое решение. При этом наличие проверки само по себе ничего не гарантирует - важна ее реальная сила: охват, надежность, устойчивость и независимость. Эту модель я называю градиентом автономности.


Теперь попробуем применить ее к данным и аналитике

Читать далее

Одна среда на шесть компьютеров вместо командной подписки Claude Code

Я настроил свою работу так, что у меня в одной среде - 6 компьютеров.

Хочу подробнее описать как у меня устроена командная работа с Claude Code

У меня шесть машин: всегда включённый десктоп, два ноутбука на Windows, два Мака и Linux-VPS. За ними работают три человека. На каждой машине свой Claude Code, свой логин.

Я сажусь за любой компьютер и пишу: «напомни, что коллега вчера делал с гейтом публикации, хочу продолжить». И продолжаю. Не спрашиваю в чате, не жду, пока передадут дела, не читаю сорок сообщений, чтобы понять, что имелось в виду. Все что делают коллеги - я вижу и апдейты по любым их сессиям могу запросить у своего клода, хотя все компьютеры\ноутбуки залогинены в разных клод код аккаунтах

Так у меня работает с июня.

Читать далее

Взгляд из редакции: что зарубежные издатели предлагают в 2026 году?

Привет, «Хабр»! На связи руководитель проектов редакции компьютерной литературы издательства «БХВ» @Holmogorov. Уже много лет мы сотрудничаем практически со всеми крупнейшими зарубежными компаниями, выпускающими технические и научно‑популярные книги. В последние годы некоторые из западных издателей, правда, приостановили лицензирование книг для перевода на русский язык, но каталоги с анонсами новинок мы все равно получаем, тем более, они по‑прежнему доступны в интернете.

Поэтому я решил собрать каталоги иностранных издательств и посмотреть, что именно они предлагают читателям в 2026 году, а заодно попробовать понять, какие тенденции стоят за этим потоком новинок. Нарисовать, так сказать, карту происходящего на конец августа 2026 года, и прикинуть, куда вообще движется техническая литература. Полагаю, это будет интересно не только коллегам‑издателям, но и всем, кто так или иначе связан с IT, ведь компьютерная литература — это своего рода зеркало, отражающее общее состояние современных технологий.

Ну, погнали!
❌