DeepSeek V4.1 Flash уже появился на OpenRouter и очень легко предсказать, что он сместит из лидеров Hy4 и GLM 5.3 Flash

МЕНЮ


Главная страница
Поиск
Регистрация на сайте
Помощь проекту
Архив новостей

ТЕМЫ


Новости ИИРазработка ИИВнедрение ИИРабота разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика

Авторизация



2026-09-12 11:45

ИИ проекты

DeepSeek V4.1 Flash уже появился на OpenRouter и очень легко предсказать, что он сместит из лидеров Hy4 и GLM 5.3 Flash. Просто в DeepSeek понимают, что для worker-агентов самые важные фичи — это цена и скорость. IQ должно быть мощным, но не требуется фронтирный уровень. Модель должна просто фиксить баги, делать доработки, а также функционировать как обычный агент для геноцида офисного планктона, т.е. просто исполнять линейную бизнес-инструкцию «без творчества».

Сейчас Weighted Average Input у DeepSeek V4.1 по реальному замеру биллинга, а не маркетингу составляет $0.02/M tokens — это в 2 раза дешевле GLM. В основном тут более дешёвая технология кеширования, которая связана с передовыми техниками оптимизации KV Cache у DeepSeek.

Напомню, что сейчас есть точно две прибыльных ИИ-компании — Anthropic и DeepSeek. Причём маржа у последнего по данным The Information не хуже 70%, что неслыханная прибыль для облачных сервисов. Маржа у Anthropic около 50%. Правда, путь у них разный. Дарио поставил цены просто в 50–100 раз выше китайцев и удачно позиционирует себя как «Apple в мире ИИ», т.е. там огромная «премия за бренд», конечно. В случае DeepSeek они просто направили свой вектор инноваций в сторону экстремального снижения себестоимости работы модели. Я показывал даже на примере V4, что там может быть в 50 раз меньше расход VRAM традиционных американских архитектур LLM, а тут DeepSeek ещё в 4 раза сжал VRAM и за счёт этого опустил цену снова. Строго говоря, Дарио даже и бросил идею конкуренции с DeepSeek и остальными китайцами, его Haiku в заброшенном состоянии. Поэтому для worker-агентов пользователь Anthropic обычно вынужден взять LLM от другого вендора.

Однако дело не только в ценах: скорость DeepSeek V4.1 где-то в 3 раза выше и GLM, и Claude, если для агентов-исполнителей это часто критично. Плюс это делает без разницы, если Flash-модели даже нужен в 3 раза больше CoT или циклов правок, т.к. она всё равно на скорости фронтира из-за инференса черепахи последней.


Телеграм: t.me/ainewsline

Источник: t.me

Комментарии: