DeepSeek V4.1 Flash уже появился на OpenRouter и очень легко предсказать, что он сместит из лидеров Hy4 и GLM 5.3 Flash |
||
|
МЕНЮ Главная страница Поиск Регистрация на сайте Помощь проекту Архив новостей ТЕМЫ Новости ИИ Голосовой помощник Разработка ИИГородские сумасшедшие ИИ в медицине ИИ проекты Искусственные нейросети Искусственный интеллект Слежка за людьми Угроза ИИ Атаки на ИИ Внедрение ИИИИ теория Компьютерные науки Машинное обуч. (Ошибки) Машинное обучение Машинный перевод Нейронные сети начинающим Психология ИИ Реализация ИИ Реализация нейросетей Создание беспилотных авто Трезво про ИИ Философия ИИ Big data Работа разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика
Генетические алгоритмы Капсульные нейросети Основы нейронных сетей Промпты. Генеративные запросы Распознавание лиц Распознавание образов Распознавание речи Творчество ИИ Техническое зрение Чат-боты Авторизация |
2026-09-12 11:45 DeepSeek V4.1 Flash уже появился на OpenRouter и очень легко предсказать, что он сместит из лидеров Hy4 и GLM 5.3 Flash. Просто в DeepSeek понимают, что для worker-агентов самые важные фичи — это цена и скорость. IQ должно быть мощным, но не требуется фронтирный уровень. Модель должна просто фиксить баги, делать доработки, а также функционировать как обычный агент для геноцида офисного планктона, т.е. просто исполнять линейную бизнес-инструкцию «без творчества». Сейчас Weighted Average Input у DeepSeek V4.1 по реальному замеру биллинга, а не маркетингу составляет $0.02/M tokens — это в 2 раза дешевле GLM. В основном тут более дешёвая технология кеширования, которая связана с передовыми техниками оптимизации KV Cache у DeepSeek. Напомню, что сейчас есть точно две прибыльных ИИ-компании — Anthropic и DeepSeek. Причём маржа у последнего по данным The Information не хуже 70%, что неслыханная прибыль для облачных сервисов. Маржа у Anthropic около 50%. Правда, путь у них разный. Дарио поставил цены просто в 50–100 раз выше китайцев и удачно позиционирует себя как «Apple в мире ИИ», т.е. там огромная «премия за бренд», конечно. В случае DeepSeek они просто направили свой вектор инноваций в сторону экстремального снижения себестоимости работы модели. Я показывал даже на примере V4, что там может быть в 50 раз меньше расход VRAM традиционных американских архитектур LLM, а тут DeepSeek ещё в 4 раза сжал VRAM и за счёт этого опустил цену снова. Строго говоря, Дарио даже и бросил идею конкуренции с DeepSeek и остальными китайцами, его Haiku в заброшенном состоянии. Поэтому для worker-агентов пользователь Anthropic обычно вынужден взять LLM от другого вендора. Однако дело не только в ценах: скорость DeepSeek V4.1 где-то в 3 раза выше и GLM, и Claude, если для агентов-исполнителей это часто критично. Плюс это делает без разницы, если Flash-модели даже нужен в 3 раза больше CoT или циклов правок, т.к. она всё равно на скорости фронтира из-за инференса черепахи последней. Телеграм: t.me/ainewsline Источник: t.me Комментарии: |
|