
OpenAI представила GPT-6 Astra — новую модель для сложных рассуждений, программирования и многоэтапных профессиональных задач. Компания называет ее своей самой интеллектуальной моделью и заявляет о 99,9% в рамках теста на гибкость мышления ARC-AGI-3, однако этот результат получен в специальном режиме тестирования, а в стандартном режиме оценка составляет 62,7%.
Формулировка самой компании Сэма Альтмана о «равенстве человеческому разуму» относится только к эффективности действий на отдельных заданиях ARC-AGI-3, а не к способности решать любые интеллектуальные задачи, подчеркивают эксперты.
Astra заметно превосходит GPT-5.6 Sol во многих тестах, но далеко не везде близка к 100%. В агрегированном Artificial Analysis Intelligence Index результат Astra — 61,2 балла, тогда как Claude Fable 5.1 набирает 65,7. Поэтому утверждение OpenAI, что новая модель «превосходит абсолютно все нейросети», некорректно.
Ошибаться Astra по-прежнему будет. OpenAI говорит о существенном улучшении надежности и следования инструкциям, но не заявляет об исчезновении галлюцинаций или ошибок. Пока модель доступна ограниченному числу организаций, но в течение нескольких дней ее обещают открыть пользователям ChatGPT Plus, Pro, Business и Enterprise.



ENG
