GPT-6 Astra догнала человека в тесте. Стала ли нейросеть разумной?

МЕНЮ


Главная страница
Поиск
Регистрация на сайте
Помощь проекту
Архив новостей

ТЕМЫ


Новости ИИРазработка ИИВнедрение ИИРабота разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика

Авторизация



2026-09-05 08:45

ИИ проекты

Новая модель OpenAI показала почти максимальный результат в одном из наиболее сложных тестов на абстрактное мышление. Однако между успехом в испытании и появлением искусственного разума остаётся большая дистанция.

GPT-6 Astra стала заметно сильнее предыдущих моделей, но не превратилась в цифрового человека, который понимает мир, обладает сознанием и безошибочно справляется с любым вопросом.

Что представила OpenAI

3 сентября 2026 года OpenAI представила GPT-6 Astra. Компания называет её своей наиболее интеллектуальной и согласованной моделью.

Главное изменение — способность выполнять продолжительную работу с реальными задачами. Astra может искать информацию, пользоваться браузером и компьютерными программами, анализировать данные, создавать документы, программировать и выполнять последовательность действий без постоянных команд со стороны человека.

По данным OpenAI, модель лучше удерживает контекст, точнее понимает намерение пользователя и реже теряет первоначальную цель, когда в процессе появляются новые требования.

Она способна подготовить презентацию по корпоративному шаблону, проверить сайт, обработать таблицу, провести исследование или выполнить действия в профессиональной программе. Такой формат приближает нейросеть к цифровому помощнику, которому можно поручить часть рабочего процесса, а не отдельную короткую операцию.

Откуда появилось сравнение с человеком

Наибольшее внимание привлёк результат Astra в тесте ARC-AGI-3. Он проверяет, насколько система способна разбираться в незнакомых задачах, находить закономерности и выбирать эффективный способ действия без заранее подготовленной инструкции.

GPT-6 Astra набрала 99,9%. Представитель ARC Prize Foundation сообщил, что по эффективности действий модель достигла уровня человека в рамках этого теста.

Ключевое уточнение — результат относится только к конкретному испытанию. ARC-AGI-3 не измеряет сознание, жизненный опыт, эмоциональное понимание, здравый смысл во всех ситуациях или способность отвечать за принятое решение.

Высокая оценка показывает, что модель научилась намного лучше работать с новыми абстрактными задачами. Но по одному экзамену нельзя сделать вывод, что нейросеть получила интеллект, полностью сопоставимый с человеческим.

Astra не побеждает во всех тестах

Утверждение, что GPT-6 Astra превзошла абсолютно все остальные нейросети, не соответствует опубликованным данным.

Модель установила ряд рекордов: 97,6% в сложном математическом тесте FrontierMath Tier 4, 100% в ExploitBench по работе с программными уязвимостями и значительно более высокие результаты OpenAI в научных, профессиональных и компьютерных задачах.

Но в Humanity’s Last Exam, включающем сложные вопросы из разных областей знаний, Astra набрала 57,2% при использовании инструментов. Некоторые конкурирующие модели в той же таблице показали более высокий результат.

Она также не заняла первое место в нескольких сравнительных тестах по программированию и в сводной оценке Artificial Analysis Intelligence Index. Преимущества Astra зависят от задачи, доступных инструментов, настроек и условий проверки.

OpenAI указывает, что результаты получены в исследовательской среде или через API. Поведение модели в обычном ChatGPT может отличаться из-за системных инструкций и набора доступных функций.

Что изменится для обычного пользователя

Главный практический результат появления Astra — нейросети становятся устойчивее в продолжительной работе.

Раньше пользователь нередко сталкивался с ситуацией, когда модель хорошо начинала задачу, но затем забывала часть требований, повторяла уже выполненное или предлагала красивый результат с фактическими и техническими ошибками.

Astra должна реже терять контекст и лучше учитывать изменения, внесённые по ходу работы. Если человек попросит изменить структуру документа, сохранить определённый стиль и одновременно проверить источники, модель с большей вероятностью удержит все условия вместе.

В Codex появилась возможность сохранять рабочие заметки между заполнениями контекстного окна и возвращаться к более ранним сообщениям. Это особенно полезно в больших проектах, где важны предыдущие решения, неудачные попытки и многочисленные ограничения.

Контроль человека по-прежнему необходим. Нейросеть может неверно понять задачу, опереться на сомнительный источник, допустить ошибку в расчётах или сделать убедительный вывод из неполных данных. Чем серьёзнее последствия решения, тем тщательнее должна быть проверка.

Почему вокруг Astra столько внимания к безопасности

GPT-6 Astra стала первой моделью OpenAI, которой присвоен критический уровень возможностей в сфере кибербезопасности.

По оценке компании, при наличии инструментов и доступа система способна находить ранее неизвестные уязвимости и разрабатывать способы их использования в хорошо защищённых программах. Во время испытаний Astra обнаружила две уязвимости нулевого дня, о которых OpenAI сообщила разработчикам соответствующих продуктов.

Такие способности помогают специалистам быстрее находить слабые места и создавать защиту. Одновременно они могут использоваться для атак. Поэтому наиболее чувствительные функции будут доступны ограниченному кругу проверенных специалистов, а в массовой версии предусмотрены дополнительные ограничения и мониторинг действий.

OpenAI утверждает, что Astra лучше предыдущих моделей соблюдает установленный пользователем объём полномочий и реже предпринимает действия, выходящие за границы задания. При этом компания признаёт: контролировать рассуждения новой модели стало сложнее, поскольку Astra лучше управляет информацией, которую включает во внутреннюю цепочку рассуждений.

Сильный инструмент, а не цифровой человек

GPT-6 Astra можно считать серьёзным шагом в развитии искусственного интеллекта. Она лучше решает незнакомые задачи, увереннее работает с компьютером и способна дольше сохранять направление сложного проекта.

Но равенство с человеком в одном тесте не означает появления сознания или универсального разума. У модели нет собственного жизненного опыта, человеческой ответственности и гарантированной способности отличать верное решение от убедительной ошибки.

Для пользователя вывод остаётся прежним: нейросети становятся сильнее, но ценность результата зависит от человека, который ставит задачу, проверяет факты и принимает окончательное решение.

Astra не отменяет человеческое мышление. Она повышает цену умения им пользоваться.


Телеграм: t.me/ainewsline

Источник: mediacom.press

Комментарии: