Новая модель
MiniMax — шанхайский стартап в области генеративного ИИ — объявил в понедельник о выходе флагманской модели M3. Компания позиционирует её как основу для продвижения в сегмент AI-агентов, специализирующихся на написании и анализе кода, а также в автоматизированные производственные пайплайны.
M3 способна обрабатывать до одного миллиона токенов в рамках одного запроса — это примерно в пять раз больше, чем у предыдущего поколения модели. Расширенное контекстное окно критично для задач программирования: агент может единовременно «видеть» большие кодовые базы, длинные цепочки инструкций и результаты многоступенчатых инструментальных вызовов.
Архитектура и эффективность
Ключевое изменение в M3 — переработанная архитектура, сократившая вычислительные требования до одной двадцатой от прежних показателей. По данным компании, это напрямую транслируется в снижение стоимости инференса (вывода, то есть обработки каждого запроса) и увеличение скорости отклика — оба параметра принципиальны для агентных сценариев, где модель совершает десятки последовательных вызовов.
Сокращение вычислительной нагрузки в 20 раз при сохранении или расширении возможностей — заявление существенное: именно высокая стоимость инференса остаётся одним из главных барьеров для промышленного развёртывания AI-агентов.
Позиционирование на рынке
Выход M3 вписывается в широкую конкуренцию среди китайских ИИ-лабораторий за сегмент coding-агентов — область, где уже активны DeepSeek, Zhipu AI и ряд других игроков, а со стороны западных компаний доминируют Anthropic (Claude) и OpenAI.
Автоматизация рабочих процессов разработки — один из наиболее инвестиционно привлекательных прикладных направлений в ИИ на 2025–2026 годы. MiniMax делает ставку на то, что снижение стоимости инференса и расширенный контекст дадут M3 конкурентное преимущество именно в этом сегменте.