Жидкие нейросети: конец эпохи гигантских моделей |
||
|
МЕНЮ Главная страница Поиск Регистрация на сайте Помощь проекту Архив новостей ТЕМЫ Новости ИИ Голосовой помощник Разработка ИИГородские сумасшедшие ИИ в медицине ИИ проекты Искусственные нейросети Искусственный интеллект Слежка за людьми Угроза ИИ Атаки на ИИ Внедрение ИИИИ теория Компьютерные науки Машинное обуч. (Ошибки) Машинное обучение Машинный перевод Нейронные сети начинающим Психология ИИ Реализация ИИ Реализация нейросетей Создание беспилотных авто Трезво про ИИ Философия ИИ Big data Работа разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика
Генетические алгоритмы Капсульные нейросети Основы нейронных сетей Промпты. Генеративные запросы Распознавание лиц Распознавание образов Распознавание речи Творчество ИИ Техническое зрение Чат-боты Авторизация |
2026-08-12 12:41 Математика, вдохновленная нервной системой крошечного червя длиной в один миллиметр, оказалась эффективнее суперкомпьютеров стоимостью в миллиарды долларов. Пока индустрия искусственного интеллекта продолжает следовать «законам масштабирования», наращивая количество параметров и потребление энергии, группа исследователей из Массачусетского технологического института (MIT) предложила принципиально иной путь. В конце 2024 года компания Liquid AI представила свои первые «жидкие» фундаментальные модели (LFMs), которые бросают вызов доминированию архитектуры трансформеров, на которой построены ChatGPT, Claude и Gemini. Это событие знаменует начало перехода от гигантских, статичных нейросетей к компактным, адаптивным системам, способным обучаться в реальном времени прямо в процессе работы. Проблема современных нейросетей заключается в их фундаментальной неподвижности. Традиционные модели-трансформеры, при всей их впечатляющей мощи, являются «замороженными». После того как этап обучения завершен, их веса — цифровые связи между нейронами — больше не меняются. Если модель сталкивается с ситуацией, которой не было в обучающих данных, она не может адаптироваться на лету, а лишь пытается подобрать наиболее вероятный ответ на основе прошлого опыта. Кроме того, трансформеры страдают от «проклятия контекста»: чем длиннее последовательность данных, которую им нужно обработать (например, длинная книга или видеопоток), тем больше памяти и вычислительных ресурсов им требуется, причем эта потребность растет в квадратичной зависимости. Это делает ИИ невероятно дорогим и неповоротливым инструментом для работы в реальном мире. За разработкой «жидких» нейросетей (Liquid Neural Networks, LNN) стоят ученые Рамин Хасани, Даниэла Рус и их коллеги. Идея пришла из нейробиологии: исследователи изучали нервную систему червя C. elegans, который, имея всего 302 нейрона, способен на сложное поведение — поиск пищи, избегание опасностей и обучение на опыте. Секрет оказался в том, что связи в его нервной системе не статичны, они описываются непрерывными во времени дифференциальными уравнениями. В «жидких» нейросетях параметры меняются в зависимости от входящего потока данных. Это позволяет модели быть «живой» — её математика подстраивается под контекст здесь и сейчас, что делает систему невероятно гибкой и эффективной. Техническое расследование архитектуры LFM показывает ошеломляющие результаты. Модель Liquid Foundation на 1,3 миллиарда параметров в ряде задач по обработке текстов и программного кода обходит модели вроде Llama или Mistral, которые в несколько раз больше её по размеру. Главное преимущество проявляется в работе с длинными последовательностями. В то время как обычные модели начинают «забывать» начало текста или требовать гигантские объемы видеопамяти, «жидкие» модели обрабатывают данные с линейной сложностью. Это означает, что они могут анализировать огромные массивы документов, аудиозаписей или видеопотоков, потребляя в 10 раз меньше памяти, чем конкуренты. Это не просто улучшение, это качественный скачок в архитектуре глубокого обучения. Особое значение эта разработка имеет для сферы Edge AI — искусственного интеллекта, работающего непосредственно на устройствах, а не в облаке. Поскольку «жидкие» сети крайне компактны и эффективны, их можно устанавливать на небольшие дроны, в системы управления беспилотными автомобилями или в медицинские датчики. В ходе экспериментов в MIT дрон, управляемый LNN, смог успешно маневрировать в лесу, хотя обучался только на открытых пространствах. Он смог адаптироваться к новым визуальным паттернам деревьев прямо во время полета. Обычные нейросети в таких условиях часто выходят из строя, так как не могут справиться с «шумом» и изменениями среды, которые не были предусмотрены при обучении. Рынок технологий мгновенно отреагировал на потенциал Liquid AI. Инвесторы видят в этом решение главной боли индустрии — стоимости инференса (выполнения запросов). Если для работы ИИ требуется в разы меньше видеокарт, это радикально меняет экономику стартапов и корпораций. Теперь гонка идет не за количеством терафлопс, а за эффективностью алгоритмов. Мы наблюдаем закат эпохи «грубой силы», когда интеллект пытались создать простым нагромождением данных и транзисторов. «Жидкие» модели доказывают, что элегантная математика может быть важнее масштаба. Кульминация этой истории заключается в том, что Liquid AI фактически взломали код «черного ящика» нейросетей. Благодаря тому, что их модели описываются компактными уравнениями, они гораздо более интерпретируемы. Мы можем понять, почему модель приняла то или иное решение, просто анализируя динамику изменений её параметров. Это решает проблему доверия к ИИ в критических отраслях — таких как ядерная энергетика, авиация или хирургия. Машина, которая не просто выдает результат, а делает это логически прозрачно для инженеров, становится полноценным партнером, а не непредсказуемым инструментом. Скрытая проблема перехода на LNN заключается в необходимости переучивания целого поколения инженеров, привыкших работать с архитектурой трансформеров. Весь текущий стек программного обеспечения и библиотек оптимизирован под матричные вычисления старого типа. Внедрение «жидких» сетей потребует создания новых инструментов разработки и, возможно, даже новых типов специализированных чипов, которые смогут эффективнее решать дифференциальные уравнения в реальном времени. Однако выгоды настолько велики, что этот переход кажется неизбежным. Финал этой технологической трансформации приведет к тому, что ИИ станет по-настоящему вездесущим и незаметным. Мы переходим от громоздких серверов, пожирающих мегаватты, к умным системам, которые могут работать от батарейки в течение недель, постоянно подстраиваясь под своего владельца и окружающую среду. «Жидкие» нейросети — это мост к истинному автономному интеллекту, который не нуждается в постоянной связи с «материнским» облаком. За этой разработкой стоит следить, потому что она меняет правила игры: будущее ИИ теперь зависит не от того, насколько велики ваши серверные фермы, а от того, насколько «жидким» и адаптивным является ваш алгоритм. Мы стоим на пороге эры, когда машины наконец-то научатся главному свойству живого разума — умению меняться вместе с миром. Телеграм: t.me/ainewsline Источник: vk.com Комментарии: |
|