OpenAI объявила о начале эры искусственного общего интеллекта (ОИИ). Компания представила модель GPT-6 Astra, охарактеризовав её как выдающуюся по возможностям систему. По заявлению разработчиков, новый продукт демонстрирует результаты на ряде тестов, которые OpenAI рассматривает как свидетельство перехода к ОИИ.

Однако круг специалистов, занимающихся исследованиями искусственного интеллекта, не разделяет оптимизма компании. Критики указывают, что высокие баллы на тестовых бенчмарках не являются прямым подтверждением ОИИ. Бенчмарки оценивают выполнение конкретных задач — от ответов на вопросы до генерации текста, — но не измеряют широкий спектр когнитивных способностей, которые традиционно связывают с общим интеллектом.

Спор вокруг GPT-6 Astra сводится к разнице в подходах к оценке. OpenAI ориентируется на количественные показатели тестов, тогда как часть исследовательского сообщества настаивает на комплексной проверке: способности модели адаптироваться к незнакомым условиям, рассуждать в новых доменах и проявлять инициативу без дополнительного обучения.

Отдельные эксперты также обращают внимание на то, что результаты бенчмарков могут зависеть от специфики тестовых данных. Если модель обучалась на материалах, близких к содержанию тестов, высокий балл не обязательно говорит о глубоком понимании — скорее о качественной подготовке под конкретные задачи.

OpenAI не публикувала подробных методик оценки GPT-6 Astra, что усиливает дискуссию. Пока компания фиксирует заявку о начале эры ОИИ, научное сообщество ожидает прозрачных данных для независимой проверки.