Не только DeepSeek: запуск китайской модели Kimi K2 вызвал много обсуждений

Китайская компания Moonshot AI представила свою новую разработку — языковую модель Kimi K2, которая уже вызвала значительное обсуждение в научном и технологическом сообществах.DeepSeek оказался не единственным крупным релизом китайских разработчиковDeepSeek оказался не единственным крупным релизом китайских разработчиковИсточник: Unsplash

Всего через полгода после громкого выхода модели DeepSeek R1, появление еще одной мощной языковой модели из Китая подтверждает, что это уже не разовый успех, а начало значительного скачка страны в сфере искусственного интеллекта. Kimi K2 демонстрирует впечатляющие результаты в тестах, особенно в задачах, связанных с программированием и созданием текстов, а открытая архитектура делает модель доступной для специалистов по всему миру.

Созданная пекинским стартапом Moonshot AI, модель Kimi K2 основана на массивной архитектуре с триллионом параметров, что ставит ее в один ряд с крупнейшими искусственными интеллектами в мире. Однако благодаря архитектуре «смешанных экспертов», одновременно активируются лишь 32 миллиарда параметров — только те, что нужны для конкретной задачи. Это позволяет значительно сократить вычислительные затраты и делает модель более доступной для практического использования.

Kimi K2 уже признана лучшей открытой языковой моделью в мире по версии ряда экспертов. Она занимает топовые позиции в таких бенчмарках, как LiveCodeBench, который ориентирован на решение задач программирования, и Creative Writing v3, оценивающем литературные навыки ИИ. Особенно подчеркивается, что стиль написания модели звучит «не как у машины» — ее тексты отличаются выразительностью, реалистичными персонажами и способностью избегать банальностей. Более того, Kimi K2 возглавила рейтинг EQ-bench 3, продемонстрировав высокий уровень «эмоционального интеллекта» при взаимодействии с пользователем.

Новая языковая модель показывает высокие результаты на ведущих бенчмаркахНовая языковая модель показывает высокие результаты на ведущих бенчмаркахИсточник: Unsplash

Несмотря на впечатляющие результаты, Kimi K2 не является универсальной моделью. В тесте SciMuse, который оценивает способность ИИ предсказывать интересные для научного сообщества идеи, она уступила алгоритмам Google Gemini и некоторым моделям OpenAI. Тем не менее, эксперты считают, что потенциал новой LLM велик, особенно учитывая ее агентную направленность. В отличие от «рассуждающих» ИИ, которые обучены пошаговой логике, Kimi K2 сосредоточена на выполнении многошаговых задач с использованием различных инструментов, включая веб-поиск или специализированное программное обеспечение. Это делает ее особенно перспективной в контексте автоматизации сложных цифровых процессов.

Как и DeepSeek, Kimi K2 доступна в открытом доступе. Пользователи могут свободно загружать модель, дообучать ее и применять в собственных проектах, не создавая ИИ «с нуля». Такой подход резко контрастирует с политикой западных лидеров индустрии, чьи модели чаще всего закрыты и доступны только через платные API. По мнению аналитиков, открытая публикация таких мощных моделей укрепляет позиции Китая в академической и исследовательской среде, где открытость высоко ценится.

Оцените статью
Dfiles.ru