MiniMax разрабатывает крупнейшую в мире открытую LLM на 2,7 трлн параметров
Китайский AI-стартап MiniMax разрабатывает большую языковую модель размером 2,7 трлн параметров, сообщает Reuters со ссылкой на информированный источник. Это крупнейшая модель с открытыми весами, выпущенная китайской компанией, и, возможно, самая большая в мире на сегодняшний день.
AI-обработка оригинала 3DNews AI; редакция Hamidun News
Китайский AI-стартап MiniMax разрабатывает большую языковую модель размером 2,7 трлн параметров, сообщает Reuters со ссылкой на информированный источник. Это крупнейшая модель ИИ с открытыми весами, выпущенная китайской компанией, и, возможно, самая большая открытая модель в мире.
Насколько велика модель MiniMax на самом деле
2,7 трлн параметров — цифра, которая выводит будущую модель MiniMax в верхний эшелон известных на сегодня языковых моделей по заявленному размеру. Для сравнения: китайский DeepSeek, чья модель DeepSeek V3 (671 млрд параметров) в своё время произвела эффект разорвавшейся бомбы на рынке открытых AI-моделей, работает с моделью почти в четыре раза меньше по числу параметров, чем разрабатываемая MiniMax.
- Разработчик — китайский AI-стартап MiniMax
- Заявленный размер модели — 2,7 трлн параметров
- Источник информации — Reuters со ссылкой на информированного источника
- Модель заявлена как крупнейшая открытая AI-модель, выпущенная китайской компанией
Кто такая MiniMax и почему её стоит знать
MiniMax — один из так называемой китайской «шестёрки тигров» AI-стартапов, основанных в Шанхае и выпускающих собственные большие языковые, голосовые и видеомодели под брендом abab и MiniMax-01/M-серии. Компания уже публиковала открытые модели и API-сервисы для генерации текста, речи и видео и конкурирует внутри Китая с DeepSeek, Alibaba (модели линейки Qwen), Moonshot AI (Kimi) и Zhipu AI. Разработка модели такого масштаба, как 2,7 трлн параметров, требует значительных вычислительных мощностей и говорит о серьёзных амбициях компании закрепиться в верхнем эшелоне мировых AI-лабораторий, а не только на внутреннем китайском рынке.
Почему гонка за размером моделей снова обострилась
Крупные языковые модели такого масштаба почти всегда строятся по архитектуре MoE (mixture-of-experts), где в обработке каждого конкретного запроса участвует лишь часть от общего числа параметров — это позволяет наращивать общий размер модели без пропорционального роста вычислительных затрат на инференс. Гонка за количеством параметров среди китайских AI-лабораторий стала одним из главных фронтов конкуренции с американскими лабораториями на рынке открытых весов: после того как открытые модели DeepSeek произвели серьёзное впечатление на индустрию своим соотношением качества и стоимости обучения, интерес к китайским открытым моделям резко вырос среди разработчиков по всему миру, ищущих альтернативу закрытым API OpenAI, Anthropic и Google.
Открытые веса означают, что после публикации модель можно будет скачать, дообучить под собственные задачи и запускать на собственной инфраструктуре без зависимости от API конкретного поставщика — этим китайские лаборатории принципиально отличаются от большинства ведущих американских разработчиков, которые держат веса флагманских моделей закрытыми.
Что это значит
Если данные Reuters подтвердятся, MiniMax закрепит за собой статус разработчика самой крупной открытой языковой модели в мире — ещё один сигнал того, что именно китайские AI-лаборатории, а не американские, сейчас задают темп в гонке за масштаб моделей с открытыми весами.
Хотите не читать про ИИ, а внедрить его?
«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.
Главное из мира ИИ — раз в неделю
7 ключевых событий недели, отобранных вручную. Без шума, репостов и пресс-релизов.
Готово! Проверьте почту — мы отправили подтверждение.