Модель самостоятельно научилась определять, когда требуется осуществить поиск в интернете, а когда запустить программный код, при этом её использование обходится в пять раз дешевле западных аналогов.
Alibaba обновила свою ведущую модель ИИ — теперь Qwen3-Max-Thinking доступна пользователям в чат-боте Qwen Chat и через API. Система демонстрирует результаты, сопоставимые с GPT-5.2-Thinking, Claude Opus 4.5 и Gemini 3 Pro, а в некоторых тестах даже превосходит их.
Основная особенность обновления — автоматический выбор инструментов. Ранее пользователю приходилось вручную указывать, нужен ли модели доступ к интернету или возможность запускать код. Теперь система сама определяет, какой инструмент лучше всего подходит для решения задачи. Например, если требуется получить свежие данные, она подключит веб-поиск. Если нужны вычисления — запустит интерпретатор кода, а если важен контекст предыдущих бесед — обратится к памяти.

Такой подход уменьшает количество ошибок и выдуманных фактов. В тесте HLE с использованием инструментов Qwen3-Max-Thinking модель набрала 49,8 балла — это лучше, чем результаты GPT-5.2 (45,5) и Gemini 3 Pro (45,8). Модель сама осознает, когда ей недостаточно информации, и восполняет пробелы без избыточных запросов к пользователю.
Кроме того, у модели появилась стратегия «накопления опыта» при решении сложных задач. Обычно ИИ-модели выполняют несколько параллельных попыток найти ответ, однако часто эти попытки дублируются. Qwen3-Max-Thinking работает иначе: она анализирует каждую попытку, извлекает ключевые выводы и использует их в следующем раунде. Это позволяет избежать траты вычислительных ресурсов на повторы и сосредоточиться на нерешенных вопросах.
На тесте GPQA по естественным наукам точность увеличилась с 90,3 до 92,8%, на бенчмарке LiveCodeBench v6 по программированию — с 88,0 до 91,4%, на математическом IMO-AnswerBench — с 89,5 до 91,5%. Система стала эффективнее использовать контекст и лучше справляться с многошаговыми рассуждениями. В пользовательском рейтинге Arena-Hard v2 модель набрала 90,2 балла — на 10 пунктов выше GPT-5.2 и на 14 пунктов выше Claude Opus 4.5. Это свидетельствует о том, что пользователи действительно замечают разницу в качестве ответов.

Одним из важных аспектов является стоимость. API Qwen3-Max-Thinking стоит $1,20 (примерно 100 рублей) за миллион входных токенов и $6 (примерно 460 рублей) за миллион выходных. Для сравнения: Claude Opus 4.5 обходится в $5 (примерно 380 рублей) и $25 (примерно 1 900 рублей) соответственно. Разница почти в пять раз делает китайскую модель более привлекательной для разработчиков.
Alibaba также обеспечила совместимость с протоколом Anthropic API, теперь Qwen3-Max-Thinking можно применять в инструменте Claude Code для программистов. Достаточно подставить ключ от Alibaba Cloud, и система начнет работать. В чат-боте Qwen Chat режим рассуждений активируется кнопкой «Мышление». Для сложных запросов он включается автоматически — модель сама решает, когда нужно уделить больше времени обдумыванию ответа.
Также недавно стало известно, что в мире возрос спрос на Mac mini. Подробнее о связи с этим ИИ и причинах рассказали в статье.
Фото: hi-tech.mail.ru

