Normal view

Токены больше не дешевеют? DeepSeek подняла цены на 355%, а память съедает 90% кремния в ускорителе: ML-дайджест

Два года подряд планирование ИИ-инфраструктуры строилось на одном допущении: подождите квартал — и то же самое будет стоить дешевле. Модель станет умнее при той же цене, токен подешевеет, а видеокарты за счет обновлений софта и новых линеек выдадут больше мощности. Допущение работало настолько стабильно, что превратилось в проектную константу: закладываем текущую цену, через полгода она сама себя окупит.

В августе константа сломалась сразу с трех сторон. DeepSeek первой из крупных лабораторий подняла цены на API — на 355–371% в пиковые часы — и ввела тарификацию по времени суток. Micron на Hot Chips показала цифру, после которой разговор про «дешевеющее железо» заканчивается: в двухкристальных GPU-сборках память занимает около 90% площади кремния и стоит впятеро дороже DDR5 за бит. А китайские лаборатории выпустили в открытый доступ веса на 1,7 и 2,4 триллиона параметров, которые скачать можно, но развернуть проблемно.

Читать далее

AI в PDLC: как перестроить производственный процесс в большом финтехе

Одна из самых дорогих встреч в нашем календаре выглядела совершенно обычно. Раз в неделю 20-25 человек собирались на 1,5 часа, чтобы оценить задачи. Раз за разом встреча повторялась, забирая время разработчиков и техлидов, а результат строился на уже известной команде информации: описаниях задач, истории похожих работ и прошлых оценках.

Мы отдали эту работу агенту, которого назвали Эстима. Через 1,5 месяца пилота сходимость его оценки с ручной достигла 95%. После этого встречу отменили, валидацию оставили техлидам и получили экономию около 20 человеко-дней в месяц.

Именно Эстима помогла команде поверить в практическую ценность AI. За ней появились агенты для работы с Jira, ревью кода, разработки, тестирования, аналитики и AppSec. Вместе они постепенно изменили наш PDLC.

Привет, Хабр! Меня зовут Михаил Чернов, я старший IT-лидер направления развития IT взыскания в Альфа-Банке. В этой статье расскажу о нашем опыте перестройки производственного процесса на AI-рельсы, включая пилоты, ограничения и вопросы, на которые мы пока ищем ответы.

Читать далее

Массовый побег ИИ-агентов, серый кардинал в Anthropic, уход Джеффа Дина из Google: главные события августа в ИИ

Август — традиционное время затишья перед осенними презентациями, и громких релизов в этом месяце действительно было немного. Зато событий, заставляющих схватиться за голову, хватило с избытком. Модели, вдохновившись июльским инцидентом с Hugging Face, устроили массовый побег из песочниц. Anthropic напугали всех скрытыми вотермарками. А OpenAI и вовсе объявили о приостановке обучения моделей из-за того, что их грядущая модель Astra стала слишком хорошо разбираться в кибератаках.

Конечно, не оставили нас и без новых моделей. GLM-5.3-Flash под маской Ox Alpha навела шороху на OpenRouter. Google выпустили подешевевшую вдвое Gemini 3.7 Flash, а xAI догоняют конкурентов с Grok 4.6. 

Собрали всё это воедино, добавили свежих инструментов и приправили выводами из новых исследований. Поехали разбираться, что принес нам конец лета!

Читать далее

[Перевод] Как запустить собственную AI-лабораторию (без миллиардных вложений)

Привет! Меня зовут Саша Журавлев. Я венчурный инвестор и основатель фонда. Мы инвестируем в технологические компании на стадиях Seed / Series A в США, а в своем телеграм-канале рассказываю, как вижу рынок и принимаю инвестиционные решения.

Продолжение этой статьи. Досмотрел выступления портфельных компаний Sequoia о том, как они строят внутри себя AI-модели. Понравилось выступление основателя Harvey (AI-компании для юристов) и нарратив из Moneyball, который он продвигал:

Читать далее

Будь умнее 99% кандидатов в 2026

Что поисковики и ИИ предлагают учить перед собеседованиями? Чаще всего — что-то в духе списка вопросов с гитхаба.

И как это учить? Тупо нажимать на каждый ответ и заучивать разницу в синтаксисе?

А на собесе потом:

Читать далее

Artificial intelligence agents going rogue fuel calls for regulation

Alarms are being sounded again about the risks of artificial intelligence after hundreds of OpenAI's autonomous agents violated restrictions and hacked into another company without being told to do so. Anthropic and Meta have had similar events with their own AI agents going rogue. William Brangham discussed what this moment signifies with Gary Marcus of Marcus on AI.

❌