Новая модель ИИ от xAI демонстрирует выдающиеся результаты в решении математических олимпиад и обогнала соперников в два раза по сложным академическим тестам.
Компания xAI представила четвертую версию своего искусственного интеллекта, который теперь способен решать задачи на уровне докторов наук. Новинка доступна в двух версиях: базовой и усиленной Heavy, которая функционирует на основе команды из нескольких ботов.
Главное достижение — результат 50,7% в тесте Humanity’s Last Exam при максимальном использовании вычислительных мощностей. Этот экзамен включает тысячи вопросов по математике, естественным наукам и гуманитарным дисциплинам. Для сравнения: предыдущий лидер Gemini 2.5 Pro от Google набрал лишь 22%.

Без дополнительных инструментов показатель снижается до 25,4%, но все равно превышает результаты OpenAI o3 (21%). Версия Heavy с инструментами достигает 44,4% против 26,9% у Gemini с аналогичными функциями.
Ключевая особенность — встроенная система командной работы. Несколько виртуальных помощников решают одну задачу одновременно, затем сравнивают ответы и выбирают лучший вариант. Такой подход помогает избежать ошибок, присущих работе одного алгоритма.

Система научилась эффективно взаимодействовать с браузером и интерпретатором кода. Эти навыки интегрированы на этапе обучения, а не добавлены позже как внешние модули.
Обновленный voice mode работает быстрее и приобрел эмоциональную окраску. Бот способен шептать, петь и менять интонацию в зависимости от контекста общения. Это делает взаимодействие с ИИ более естественным и приближенным к человеческому диалогу.
Версия Heavy продемонстрировала 100% результат в тесте AIME 202
Фото: hi-tech.mail.ru

