Reading view

Какая LLM поможет вам заработать в 2026/27 году

Сегодня у айтишников появилось новое хобби - делать свой SaaS или писать торговых ботов с помощью LLM

Порог входа резко снизился: достаточно хорошей идеи, немного свободного времени и подписки на одну из современных LLM

Но есть одна проблема

Модель, которая набирает 90%+ в бенчмарке, совсем не обязательно поможет вам заработать деньги
Потому что между «написать хороший код» и создать работающий продукт есть огромная разница

Я дал шести LLM одну задачу - написать торгового бота и проверил, что из этого можно использовать на практике

GPT, Claude Opus, DeepSeek, Qwen, GigaChat, YandexGPT Pro

Читать далее
  •  

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко — и надо разобраться, что и где подкрутить.

Горлышек оказалось несколько, и все снимаются флагами запуска: те же веса — 75 токенов в секунду. Под катом каждый флаг описан по одной схеме: зачем, что писать, что даёт в цифрах, где ломается и с какой строкой в логе. В конце — готовый docker run, три проверки после каждой смены флага и список того, что не сработало. Текст можно отдать целиком агенту с доступом к серверу — это инструкция, а не история.

Читать далее
  •  

Конец жирной маржинальности ИИ: всё о ценообразовании и дешёвых стоимостях моделей

В последнее время ИИ-сфера не просто падает, а даже входит в активную стадию конкурентности между несколькими фронтами — корпоративные ИИ (OpenAI и Anthropic, которые тоже между собой соревнуются) против открытых моделей (Qwen, GLM, DeepSeek).

Цены за токен иногда падают, а когда не могут уменьшить цену — создают лёгкие модели с низкой стоимостью. Снижение стоимости вывода (инференс) перестало быть просто побочным эффектом оптимизации и превратилось в главную ось конкуренции. Решение OpenAI снизить цены на GPT 5.6 Sol минимум до ноября 2026 года — это попытка восстановить свою долю на рынке через демпинг. Открытые модели больше не догоняют закрытые по качеству, а даже иногда опережают их в экономике использования, делая доступ к ИИ коммунальной услугой.

В этой статье мы разберём влияние Qwen, GLM и прочих опенсорсных моделей, конкуренцию на рынке ИИ и наконец разберём, куда свернула ИИ-гонка на этот раз.

Читать далее
  •  
❌