Reading view

Массовый побег ИИ-агентов, серый кардинал в Anthropic, уход Джеффа Дина из Google: главные события августа в ИИ

Август — традиционное время затишья перед осенними презентациями, и громких релизов в этом месяце действительно было немного. Зато событий, заставляющих схватиться за голову, хватило с избытком. Модели, вдохновившись июльским инцидентом с Hugging Face, устроили массовый побег из песочниц. Anthropic напугали всех скрытыми вотермарками. А OpenAI и вовсе объявили о приостановке обучения моделей из-за того, что их грядущая модель Astra стала слишком хорошо разбираться в кибератаках.

Конечно, не оставили нас и без новых моделей. GLM-5.3-Flash под маской Ox Alpha навела шороху на OpenRouter. Google выпустили подешевевшую вдвое Gemini 3.7 Flash, а xAI догоняют конкурентов с Grok 4.6. 

Собрали всё это воедино, добавили свежих инструментов и приправили выводами из новых исследований. Поехали разбираться, что принес нам конец лета!

Читать далее
  •  

Девопс-инженер и ИИ влетают в бизнес-задачи с двух ног

209 тысяч наименований товаров в 150 представительствах записаны по-разному, а обычный join сопоставляет от силы 1% из них. Дата-инженер Дмитрий Дунаев на Вечерней школе Слёрма показал, как эту путаницу разгребли с помощью LLM, эмбеддингов и fuzzy-поиска, а заодно избавили менеджеров от звонков по 5 минут за штуку из бесконечного списка на обзвон.

Из 15 протестированных моделей нужный баланс критериев показала только одна. Какая именно и почему, разбираем в конспекте доклада вместе с чек-листом, когда агента строить стоит, а когда деньги лучше сэкономить.

Читать далее
  •  

Сериал «Чёрное зеркало» всё меньше похож на фантастику: странные случаи с ChatGPT и что за ними стоит

Пользователи слышат из ChatGPT собственный голос, внезапные крики и плач. Некоторые из этих историй звучат как байки с Reddit, но похожие сбои OpenAI фиксировала ещё во время тестирования голосовых моделей. Я попробовал разобраться, откуда они берутся и почему современный Voice Mode иногда ведёт себя настолько странно.

На днях говорил с мамой, она довольно часто пользуется ChatGPT. Есть одна формулировка, которая стабильно вызывает у неё ужас: она рассказывает какую-нибудь историю, а модель отвечает ей «у меня мурашки». Если честно, от этих ответов мурашки скорее у моей мамы.

Я каждый раз объясняю, что никаких мурашек там, конечно, нет. Модель подобрала реплику, которая хорошо смотрелась бы в человеческом разговоре. Но чем естественнее и чаще становятся такие ответы, тем сложнее воспринимать их как обычный вывод программы.

Недавно я наткнулся на случай, где эта граница стала ещё менее очевидной. Здесь я бы уже маму не успокоил.

Почему ChatGPT так делает
  •  

Как работает текстовый водяной знак в Claude

Привет!

Эпоха дикой генерации слопотекста, кажется, заканчивается.

Недавно от Anthropic вышла статья How Claude's Text Watermark Works, которая была посвящена покушению на святое — копирайту на сгенерированный текст и его детекции.

Тема супер интересная и когда один из главных научпоп-исследователей LLM — Себастьян Рашка — подготовил детальный разбор того, как вообще в LLM может быть устроен вотермаркинг, я понял, что надо брать. Я сделал частичный перевод этого разбора — автор очень крутой, но часто долго разгоняется, слишком много извиняется за свои предположения, порой чрезмерно рекламит, а иногда просто нудит и тяжело пишет.

Поэтому публикую чистенькую, вручную переписанную и адаптированную под русский язык версию. Тема очень крутая и горячая, приятного чтения!

Читать далее
  •  

Смерть сабагентов в Claude и Codex

С последними апдейтами Claude Code и Codex CLI классические сабагенты потеряли смысл. Сессии научились общаться между собой напрямую.

В сообществе всё чаще отключают автоматический спавн и отказываются от тяжелых ролевых конфигов: на Hacker News разработчики делятся воркэраундами, закрывают права через deny: [Agent(Explore)] или запускают CLI с флагом --disallowedTools Task, возвращая управление в свои руки.

Вместо обещанной параллельности и автономной команды сценарий часто выглядит так: модель берет обычную задачу, поднимает семерых детей... и съедает лимит аккаунта еще до того, как они закончат ресерч. При этом последовательный запуск в одном окне закрывает ту же задачу за пару минут без лишнего расхода токенов.

Ниже => разбор того, почему классические сабагенты стали оверхедом, и как устроен нативный пиринг живых сессий.

Читать далее
  •  

Какая LLM поможет вам заработать в 2026/27 году

Сегодня у айтишников появилось новое хобби - делать свой SaaS или писать торговых ботов с помощью LLM

Порог входа резко снизился: достаточно хорошей идеи, немного свободного времени и подписки на одну из современных LLM

Но есть одна проблема

Модель, которая набирает 90%+ в бенчмарке, совсем не обязательно поможет вам заработать деньги
Потому что между «написать хороший код» и создать работающий продукт есть огромная разница

Я дал шести LLM одну задачу - написать торгового бота и проверил, что из этого можно использовать на практике

GPT, Claude Opus, DeepSeek, Qwen, GigaChat, YandexGPT Pro

Читать далее
  •  

Переезд на GPT-5.6: что мы переписали в коде и как изменился счёт за API

Мы делаем сервис доступа к моделям разных провайдеров, так что интерес в этой теме у нас прямой. В середине июля мы переносили внутренние сервисы на GPT-5.6. Работы планировали на день, но ушло две недели.

Ниже по порядку: что поменялось в линейке за одно поколение, во сколько после этого обходится один запрос и где ломается код, который формально продолжал работать.

Читать далее
  •  

Конец жирной маржинальности ИИ: всё о ценообразовании и дешёвых стоимостях моделей

В последнее время ИИ-сфера не просто падает, а даже входит в активную стадию конкурентности между несколькими фронтами — корпоративные ИИ (OpenAI и Anthropic, которые тоже между собой соревнуются) против открытых моделей (Qwen, GLM, DeepSeek).

Цены за токен иногда падают, а когда не могут уменьшить цену — создают лёгкие модели с низкой стоимостью. Снижение стоимости вывода (инференс) перестало быть просто побочным эффектом оптимизации и превратилось в главную ось конкуренции. Решение OpenAI снизить цены на GPT 5.6 Sol минимум до ноября 2026 года — это попытка восстановить свою долю на рынке через демпинг. Открытые модели больше не догоняют закрытые по качеству, а даже иногда опережают их в экономике использования, делая доступ к ИИ коммунальной услугой.

В этой статье мы разберём влияние Qwen, GLM и прочих опенсорсных моделей, конкуренцию на рынке ИИ и наконец разберём, куда свернула ИИ-гонка на этот раз.

Читать далее
  •  

Компьютер по подписке: как Nvidia превращает вычисления в сервис

Ежегодная выставка Computex в Тайбэе уже более 40 лет собирает производителей и энтузиастов компьютерной индустрии. За годы мероприятие стало компасом всей отрасли, четко указывающим на то, как именно будет развиваться рынок в обозримом будущем.

Все это время Computex посвящалась потребительской электронике: готовым ПК, процессорам, видеокартам, памяти, материнским платам, системам охлаждения, мониторам и периферии, однако в 2026 году все изменилось. Главной темой экспозиции стала AI Together: в демозонах и на сценах обсуждали искусственный интеллект — агентов, роботов, ускорители, серверы, дата-центры и то, сколько гигаватт они будут потреблять. Консьюмерская техника, за исключением той, на которую бренды успели наклеить шильдик с упоминанием AI-технологий, оказалась вне главных павильонов. 

Ключевой фигурой выставки стал CEO Nvidia Дженсен Хуанг, сделавший ряд громких заявлений. Он говорил о том, что раньше компьютеры создавались для человека, а теперь вычислительные ресурсы, память и постоянный доступ к инфраструктуре нужны ИИ-агентам, которых потенциально может быть куда больше, чем людей, а значит, для чипмейкеров этот рынок куда объемнее и перспективнее.

Звучит как фантастика, но представители отрасли допускают, что все мы движемся к модели, где дома уже не будет производительного персонального компьютера, вместо него — тонкий клиент для базовых задач. Что-то сложнее, например, игры или комплексные вычисления в специализированных программах, будет запускаться в дата-центрах, а доступ к их мощностям станет приобретаться по подписке. На чем строится эта теория? Об этом — в материале.

Читать далее
  •  
❌