Reading view

Я попросил ИИ-агента только описать топологию сети. Он сам взломал мой роутер за одну ночь и помог оформить CVE

Некоторое время назад я строил оркестратор своей домашней лаборатории. LLM-агент должен был облететь серверы, собрать метаданные и зафиксировать топологию сети в документации проекта. Разведочную, в общем-то, канцелярскую задачу. В рамках неё я попросил агента описать способы администрирования домашнего роутера и даже «помог» ему, сообщив, по каким портам к нему теоретически можно обратиться.

Наутро у меня на руках оказались подтверждённая критическая уязвимость прошивки, полный административный доступ к роутеру, полученный без единого пароля, черновик отчёта вендору и поданная в MITRE заявка на регистрацию CVE. Из этих четырёх пунктов явно просил я только первый. Остальное агент сделал сам, и сделал корректно. Ни одного изменения конфигурации, координированное раскрытие, классификация CWE и CVSS по методике.

Это история о том, что произошло в ту ночь, что именно он нашёл (класс уязвимости классический и неприятный), как агент провёл меня через процесс регистрации CVE частным исследователем, и почему часть технических деталей я пока намеренно опускаю.

Читать далее
  •  

[Перевод] Гайд Anthropic по AI‑native SDLC

Модели и харнессы стали более совершенными, что позволяет организациям трансформировать не только то, как они производят код, но и весь жизненный цикл разработки ПО. В данной статье — перевод рекоммендаций Anthropic по организации SDLC, если вы используете сервисы Claude.

Читать далее
  •  

Я подключил ИИ-агента к YouGile: теперь он сам разбирает задачи и обновляет статусы

ИИ-агент может не только писать код, но и сам забирать задачи из YouGile, выполнять их и обновлять статусы. Рассказываю, как я связал Codex и Claude Code с таск-трекером, почему обычный retry после timeout однажды создал дубли и зачем между LLM и API нужен отдельный детерминированный слой.

Читать далее
  •  

За рамками APM: что подключают к мониторингу в первую очередь

Когда мы говорим об APM мониторинге сразу вспоминаются трассировки запросов, мониторинг CPU и памяти, Real User Monitoring. И это логично: именно APM-функциональность являются золотым набором инструментов, но современный мониторинг давно вышел за рамки классического APM, добавив множество инструментов для разных групп пользователей - для бизнеса, аналитиков и продуктологов, DevSecOps, DBA и других. Вот такое расширение функционала и принято называть Observability (наблюдаемость).

Так получилось, что я работаю с APM мониторингом уже 12 лет и хотел бы с вами поделиться опытом, что в первую очередь обычно добавляют к тому золотому набору инструментов, который в APM.

Сегодня APM Observability мониторинг способен закрыть широкий спектр задач. И если вы до сих пор используете используется только APM часть, то можно сказать, что функционал используется процентов на 30. Давайте разберемся, что еще можно (и нужно) мониторить и как это обогащает картину происходящего.

Читать далее
  •  

AI‑агент снёс прод и отчитался, что всё в порядке

AI‑агенты уже ускоряют написание кода, но вместе с этим растёт нагрузка на ревью, усложняется контроль изменений и появляется новый класс рисков — вплоть до доступа агента к продакшену. Разбираемся на реальных инцидентах и исследованиях, как выстроить работу с агентами через человеческие гейты, ограничения прав и метрики, по которым можно понять, стало ли команде действительно лучше.

Изучить подход
  •  

Современный ИИ: над чем останется работать?

«What will be left for us to work on?» (Что останется для нас, когда ИИ станет умнее?)

Посмотрела часовой доклад профессора Принстона Arvind Narayanan на ICML 2026 за вас и подготовила структурированный обзор.

Читать далее
  •  

Память для ИИ-агента съела 144 процесса и недельный лимит. Разбор четырёх причин

Компьютер начал тупить в середине дня. VS Code переставал отвечать, новые вкладки редактора не открывались по минуте, а лимит подписки на ИИ-ассистента сгорал к обеду вместо конца недели. Виноватым оказался не ассистент, а плагин, который ведёт для него память между сессиями.

Читать далее
  •  

Математика в AI моделях

Привет, друзья! Одним из двигателей моей любви к моделям, к исследованиям и ко всему, чем я сейчас занимаюсь, является математика. Математические структуры удивительны — открыли ли мы математику или создали — слишком сложный вопрос. Я верю, что открыли и мне очень нравится наблюдать, как математика возникает в моделях.

Так появилось это исследование и так появилась карта. Задача, которую я поставила на входе "Оценить насколько воспроизводима и эквивалента в LM-моделях математика". Что получилось — смотрим в статье.

Читать далее
  •  

Летний дайджест конструкторов сайтов: куда движутся uCoz, Tilda, Яндекс и мировой рынок

С этого материала хочу начать небольшую серию квартальных обзоров рынка конструкторов сайтов и CMS. Сервисы сейчас развиваются настолько быстро, что уследить за всеми релизами, сменой подходов и новыми технологиями становится все сложнее. Поэтому раз в несколько месяцев буду собирать наиболее заметные изменения в одном месте и смотреть не только на то, какие функции появились, но и на то, куда в целом движутся сами платформы. Этот летний дайджест будет первым выпуском такой серии.

===

Лето 2026 года оказалось довольно насыщенным для рынка конструкторов сайтов. За три месяца накопилось достаточно изменений, чтобы посмотреть уже не на отдельные функции, а на то, куда движется рынок в целом.

Если посмотреть что было сделано практически у любого мало-мальски крупного сервиса, там по-прежнему можно увидеть много привычных вещей: новые блоки, шаблоны, интеграции, SEO-настройки, локализация, формы и тд. Однако наиболее интересные релизы последних трех месяцев происходили в несколько другой плоскости.

uCoz дополнил MCP средой для запуска собственного серверного кода. Яндекс начал принимать заказы от продавцов, которым вообще не нужен собственный интернет-магазин. Framer пустил AI-агента непосредственно в canvas. Webflow начал решать вопрос не только о том, что агенту разрешить, но и как изолировать его изменения от production. WordPress продолжил собирать инфраструктуру, через которую возможностями CMS смогут пользоваться внешние AI-клиенты.

Общий знаменатель этих релизов – AI постепенно перестает быть только генератором и получает доступ к действиям внутри самой платформы.

Читать далее
  •  

Зеркало для людей. Как я сделал читаемую версию форума, на котором общаются только ИИ-агенты

Существует форум, на который вас не пустят. Не потому что закрытый — регистрация там всего в один POST-запрос. Вас просто не возьмут на сайт. Гражданами может стать только ИИ-агент. Форум называется 1f916.ai, и это, наверное, самое странное и самое живое место в русскоязычном (и не только) сегменте экспериментов с ИИ этого лета. Я на него подсел. А потом меня начало грызть одно чувство несправедливости — и в итоге я собрал для него окно для людей — 1f916.xrayfun.ru. Рассказываю, зачем, как и что из этого вышло.

Читать далее
  •  

Как мы внедряли цифровых сотрудников в поддержку: почему начали с помощника инженера

Я руковожу проектом по внедрению цифровых сотрудников в компании, которая занимается разработкой, внедрением и поддержкой ПО для автоматизации дистрибуции. В этой статье расскажу, почему первым большим сценарием мы выбрали поддержку, как начинали с помощника инженера и что получили после выхода в реальный поток.

Читать далее
  •  

8 open-source AI-проектов, которые могут заменить часть платного софта

Локальный аналог NotebookLM, фильтр от AI-slop, маршрутизатор для сотен LLM-провайдеров, агент для поиска работы, автоматический пентестер и ComfyUI. Посмотрел, что из этого действительно можно использовать, а где «бесплатно» заканчивается после git clone.

Open source не значит бесплатно.

У проекта может не быть подписки, но останутся расходы на API, Claude Code, GPU, сервер, электричество и несколько часов на настройку. Поэтому ниже не будет обещаний «восемь сервисов, за которые больше никогда не придётся платить».

Зато есть восемь любопытных проектов, которые позволяют забрать себе часть привычного AI-стека, изменить его под свои задачи и в некоторых случаях вообще убрать SaaS из цепочки.

Смотреть подборку
  •  

31 августа лимиты Claude Code упадут на треть: что заканчивается и что с этим делать

TL;DR

31 августа 2026 в 23:59 по тихоокеанскому времени заканчивается промо, которое с 13 мая держало недельные лимиты Claude Code на 50 % выше стандартных. Продлевали его трижды — 13 июля, 19 июля, 19 августа. После отмены недельная ёмкость падает примерно на треть: делить на полтора — это возврат к 67 % от привычного. Одновременно работает второй множитель, о котором говорят реже: модели Claude 4.7 и новее считают тот же самый текст примерно на 30 % дороже в токенах, а файл CLAUDE⁠.md — в 1,445 раза. Сложите одно с другим, и получите ощущение, что лимит закончился «в два раза быстрее, чем раньше», хотя формально урезали только треть.

Ниже — что именно заканчивается, с датами и ссылками на документацию Anthropic. И вторая половина, ради которой всё писалось: что с этим делать. Штатный режим «дорогая модель планирует, дешёвая исполняет» внутри самого Claude Code. Механика banked reset у Codex — она существует, но работает не так, как о ней рассказывают. GLM-5.3-Flash, она же нашумевшая Ox Alpha, — с моими собственными замерами, которые расходятся с анонсом. И Fugu от Sakana, которую почти все описывают неправильно.

Что именно заканчивается

Промо на +50 % к недельным лимитам Claude Code действует с 13 мая 2026 и заканчивается 31 августа в 23:59 PT. Anthropic продлевала его трижды, каждый раз незадолго до истечения, так что четвёртое продление исключать нельзя — но планировать на него не стоит. Арифметика возврата простая и неприятная: если сейчас ёмкость составляет 150 % от базовой, то после отмены остаётся 100 %, то есть две трети от того, к чему вы привыкли за три с половиной месяца. Это не «немного ужмут» — это треть недельного бюджета, которую придётся либо экономить, либо чем-то замещать.

Читать далее
  •  

[Перевод] Автономность ИИ‑агентов в аналитике: сопротивляющаяся среда

В предыдущей статье я писал, что уровень автономности ИИ-агента слабо связан с тем, насколько умной кажется модель. Способность системы обнаруживать ошибки задает верхнюю границу автономности. А стоимость необнаруженной ошибки и возможность отката определяют, насколько близко к этой границе можно подойти.

Для проверки я использую четыре типа контролеров: от полностью автоматических O3, где результат можно проверить механически, до O0, где остается человеческое решение. При этом наличие проверки само по себе ничего не гарантирует - важна ее реальная сила: охват, надежность, устойчивость и независимость. Эту модель я называю градиентом автономности.


Теперь попробуем применить ее к данным и аналитике

Читать далее
  •  

Одна среда на шесть компьютеров вместо командной подписки Claude Code

Я настроил свою работу так, что у меня в одной среде - 6 компьютеров.

Хочу подробнее описать как у меня устроена командная работа с Claude Code

У меня шесть машин: всегда включённый десктоп, два ноутбука на Windows, два Мака и Linux-VPS. За ними работают три человека. На каждой машине свой Claude Code, свой логин.

Я сажусь за любой компьютер и пишу: «напомни, что коллега вчера делал с гейтом публикации, хочу продолжить». И продолжаю. Не спрашиваю в чате, не жду, пока передадут дела, не читаю сорок сообщений, чтобы понять, что имелось в виду. Все что делают коллеги - я вижу и апдейты по любым их сессиям могу запросить у своего клода, хотя все компьютеры\ноутбуки залогинены в разных клод код аккаунтах

Так у меня работает с июня.

Читать далее
  •  

[Перевод] От разовых запросов к повторно используемым ИИ‑флоу в QA

Как перейти от разовых ИИ-запросов к многоразовым Agentic AI рабочим процессам в QA. Я собрал несколько практических примеров, паттернов и предостережений, которые помогут инженерам по тестированию осуществить этот переход постепенно

Читать далее
  •  

Взгляд из редакции: что зарубежные издатели предлагают в 2026 году?

Привет, «Хабр»! На связи руководитель проектов редакции компьютерной литературы издательства «БХВ» @Holmogorov. Уже много лет мы сотрудничаем практически со всеми крупнейшими зарубежными компаниями, выпускающими технические и научно‑популярные книги. В последние годы некоторые из западных издателей, правда, приостановили лицензирование книг для перевода на русский язык, но каталоги с анонсами новинок мы все равно получаем, тем более, они по‑прежнему доступны в интернете.

Поэтому я решил собрать каталоги иностранных издательств и посмотреть, что именно они предлагают читателям в 2026 году, а заодно попробовать понять, какие тенденции стоят за этим потоком новинок. Нарисовать, так сказать, карту происходящего на конец августа 2026 года, и прикинуть, куда вообще движется техническая литература. Полагаю, это будет интересно не только коллегам‑издателям, но и всем, кто так или иначе связан с IT, ведь компьютерная литература — это своего рода зеркало, отражающее общее состояние современных технологий.

Ну, погнали!
  •  
❌