# MiniMax-M3 vs Claude Opus (4.6, 4.7, 4.8): Детальное сравнение **Дата исследования:** июль 2026 **Источников проанализировано:** 30+ --- ## ИДЕНТИФИКАЦИЯ МОДЕЛЕЙ **MiniMax-M3** — это последняя флагманская открытовесовая модель MiniMax, выпущенная **1 июня 2026 года**. Первая и единственная открытовесовая модель, объединяющая фронтирные возможности кодинга, 1M-токовое окно контекста и нативную мультимодальность в одной архитектуре. **Claude Opus семейство:** - **Claude Opus 4.6** — выпущена **август 2025**, 1M context, старый токенизер - **Claude Opus 4.7** — выпущена **январь 2026**, 1M context, новый токенизер (+35% токенов) - **Claude Opus 4.8** — выпущена **27-28 мая 2026** (последняя активная), 1M context, новый токенизер --- ## 1. БЕНЧМАРКИ ИНТЕЛЛЕКТА И КОДИНГА ### SWE-bench Verified (500 реальных Python-задач) | Модель | Скор | Источник | |--------|------|---------| | Claude Fable 5 (suspended) | 95.0% | morphllm.com | | **Claude Opus 4.8** | **88.6%** | morphllm.com, vals.ai | | Claude Opus 4.7 | 87.6% | morphllm.com | | Claude Opus 4.6 | 80.8% | morphllm.com | | **MiniMax M3** | **80.5%** | vals.ai, morphllm.com | | DeepSeek V4 Pro Max | 80.6% | vals.ai | | Claude Opus 4.5 (legacy) | 80.9% | morphllm.com | **Вывод:** - Claude Opus 4.8 выше MiniMax M3 на **8.1 пункта** - Claude Opus 4.7 выше MiniMax M3 на **7.1 пункта** - Claude Opus 4.6 выше MiniMax M3 на **0.3 пункта** (статистически неразличимы) - MiniMax M3 конкурирует на уровне Opus 4.6/4.5 на этом загрязнённом бенчмарке ### SWE-bench Pro (1865 реальных задач, 41 репозиторий) **Vendor-reported scores:** | Модель | Скор | Источник | |--------|------|---------| | Claude Fable 5 (suspended) | 80.0% | morphllm.com | | **Claude Opus 4.8** | **69.2%** | morphllm.com, anthropic.com | | Claude Opus 4.7 | 64.3% | morphllm.com | | **MiniMax M3** | **59.0%** | felloai.com, minimax.io | | GPT-5.5 | 58.6% | morphllm.com | | Gemini 3.1 Pro | 54.2% | morphllm.com | | Claude Opus 4.6 | 51.9% (Scale standardized) | morphllm.com | **Вывод:** - Claude Opus 4.8 выше MiniMax M3 на **10.2 пункта** - Claude Opus 4.7 выше MiniMax M3 на **5.3 пункта** - MiniMax M3 выше GPT-5.5 на **0.4 пункта** - MiniMax M3 выше Claude Opus 4.6 на **7.1 пункта** (но Opus 4.6 на standardized harness, Opus 4.8 на vendor harness) - Важно: различие в скаффолдинге может составлять 15-30 пунктов ### Terminal-Bench 2.1 (команднострочные агентские задачи) | Модель | Скор | Источник | |--------|------|---------| | GPT-5.5 | 78.2% | morphllm.com | | **Claude Opus 4.8** | **74.6%** | morphllm.com | | **MiniMax M3** | **66.0%** | minimax.io, felloai.com | | Claude Opus 4.6 | 65.4% (v2.0) | morphllm.com | | Claude Opus 4.7 | (не опубликован) | — | **Вывод:** - Claude Opus 4.8 выше MiniMax M3 на **8.6 пункта** - MiniMax M3 на уровне Claude Opus 4.6 (**~0.6 пункта** выше) - Claude Opus 4.7 результаты не опубликованы (но ожидается лучше чем 4.6) ### GPQA Diamond (выпускные вопросы, валидированные экспертами) | Модель | Скор | Источник | |--------|------|---------| | **Claude Opus 4.8** | **93.6%** | morphllm.com | | Gemini 3.1 Pro | 92.2% | artificialanalysis.ai | | Claude Opus 4.7 | (не опубликован) | — | | Claude Opus 4.6 | 59.4% (legacy) | morphllm.com | | MiniMax M3 | Не опубликовано | — | **Вывод:** - Claude Opus 4.8 существенно впереди (93.6%) - Opus 4.7, 4.6 результаты не включены в стандартный список - MiniMax M3 не тестировал на этом бенчмарке (вероятно, ниже 93%, но неизвестно точно) ### Artificial Analysis Intelligence Index (комбинированный метрикс) **Включает:** GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR | Модель | Индекс | Ранг (из 186/579) | Источник | |--------|--------|------------------|---------| | Claude Opus 4.8 (max reasoning) | 56 | 6/186 (proprietary) | artificialanalysis.ai | | Claude Opus 4.7 (max reasoning) | ~54 | ~8/186 | artificialanalysis.ai | | Claude Opus 4.6 (thinking) | ~52 | ~12/186 | artificialanalysis.ai | | **MiniMax M3** | **44** | 2/97 (open-weights 428B) | artificialanalysis.ai | **Вывод:** - Claude Opus 4.8 на **12 пунктов** выше MiniMax M3 - Claude Opus 4.7 на **10 пунктов** выше MiniMax M3 - Claude Opus 4.6 на **8 пунктов** выше MiniMax M3 - Важно: модели в разных категориях (proprietary vs open-weights 428B), сравнение условное ### Дополнительные бенчмарки MiniMax M3 | Бенчмарк | MiniMax M3 | Источник | |---------|-----------|---------| | SWE-fficiency | 34.8% | minimax.io | | KernelBench Hard | 28.8% | minimax.io | | MCP Atlas (tool-use) | 74.2% | minimax.io | | BrowseComp (web search) | **83.5** | felloai.com | | PostTrainBench (autonomous training) | 0.37 | pandaily.com | **Примечание:** BrowseComp 83.5 выше Claude Opus 4.7 (79.3) — область, где MiniMax M3 конкурирует лучше. --- ## 2. ЦЕНЫ (USD per 1M tokens) ### MiniMax M3 API **Standard rate (≤512K input tokens):** - **Input:** $0.30/M (промо, список $0.60/M) - **Output:** $1.20/M (промо, список $2.40/M) - **Cache write:** $0.375/M - **Cache read:** $0.06/M (-80% от input) **Long-context rate (>512K input):** - 2x всех значений (весь запрос считается по этому тарифу) - Input: $0.60/M, Output: $2.40/M **Token Plan subscriptions:** | План | Цена/мес | Токены | Эффективная цена | |------|---------|--------|-----------------| | Plus | $20 | ~1.7B | $0.012/M (комбо) | | Max | $50 | ~5.1B | $0.010/M (комбо) | | Ultra | $120 | ~9.8B | $0.012/M (комбо) | ### Claude Opus API (4.6, 4.7, 4.8) **Всё семейство Opus (4.6, 4.7, 4.8) — одинаковая стандартная цена:** | Вариант | Input | Output | Источник | |---------|-------|--------|---------| | Standard | $5.00/M | $25.00/M | anthropic.com | | Fast mode (Opus 4.8 only) | $10.00/M | $50.00/M | anthropic.com | | Cache write | $6.25/M | — | morphllm.com | | Cache read | $0.50/M | — | morphllm.com | **Важно:** Opus 4.7 и 4.8 используют новый токенизер, который производит **+35% больше токенов** для того же текста, чем Opus 4.6, что делает реальную стоимость выше на ~35%. **Available from 5 providers:** - Anthropic - Amazon Bedrock - Google Cloud - Azure OpenAI - OpenRouter ### СРАВНЕНИЕ СТОИМОСТИ **Перечень цен (все Opus 4.6/4.7/4.8 одинаковые по input/output):** | Метрика | MiniMax M3 | Claude Opus 4.6/4.7/4.8 | Разница | |---------|-----------|-------------------------|---------| | Input (стандарт) | $0.30/M | $5.00/M | **16.7x дешевле** | | Output (стандарт) | $1.20/M | $25.00/M | **20.8x дешевле** | | Cache read | $0.06/M | $0.50/M | **8.3x дешевле** | | Blended (с кешированием) | ~$0.06/M | Variable | **>83x дешевле** | **⚠️ Учёт новых токенизеров:** - MiniMax M3: без информации о точном увеличении токенов - Claude Opus 4.8/4.7: +35% токенов vs Opus 4.6 (эффективная цена выше на 35%) - Claude Opus 4.6: baseline (без увеличения) **Стоимость за задачу (SWE-Bench Pro, 500K input + 100K output):** - MiniMax M3: $0.27 per task = 218 points/$ - Claude Opus 4.8: $3.50 per task (без учёта +35% tokenizer) = 19.8 points/$ - Claude Opus 4.7: $3.50 per task (без учёта +35% tokenizer) = 18.4 points/$ - Claude Opus 4.6: $3.50 per task (baseline tokenizer) = 14.8 points/$ --- ## 3. КЛЮЧЕВЫЕ ХАРАКТЕРИСТИКИ ### MiniMax M3 | Характеристика | Значение | |----------------|---------| | **Дата выпуска** | 1 июня 2026 | | **Архитектура** | MoE (Mixture-of-Experts) с MSA | | **Всего параметров** | 428B (430B) | | **Активные параметры** | 23B per token | | **Контекстное окно** | 1M tokens (гарантия минимум 512K) | | **Модальности ввода** | Text, Image, Video (нативные) | | **Модальности вывода** | Text | | **Лицензия** | MINIMAX COMMUNITY LICENSE (коммерчески ограничена) | | **Open-weights** | Да (HuggingFace, GitHub) | | **Скорость вывода** | ~100 токов/сек | | **Архитектура внимания** | MSA (MiniMax Sparse Attention) | | **Per-token compute (1M)** | 1/20 от предыдущего поколения | | **Prefill ускорение** | >9x | | **Decoding ускорение** | >15x | | **Data для обучения** | 29.2T tokens | ### Claude Opus 4.6, 4.7, 4.8 (сравнение) | Характеристика | Opus 4.6 | Opus 4.7 | Opus 4.8 | |----------------|----------|----------|----------| | **Дата выпуска** | август 2025 | январь 2026 | май 2026 | | **Архитектура** | Proprietary | Proprietary | Proprietary | | **Контекст** | 1M | 1M | 1M | | **Модальности ввода** | Text, Image | Text, Image | Text, Image | | **Скорость вывода** | ~57 tok/s | ~58 tok/s | ~60 tok/s | | **Tokenizer** | Старый baseline | Новый (+35%) | Новый (+35%) | | **Training cutoff** | Aug 2025 | Jan 2026 | Jan 2026 | | **Reasoning** | Yes (thinking) | Yes | Yes (Adaptive) | | **SWE-bench Pro** | 51.9% (Scale) | 64.3% (vendor) | 69.2% (vendor) | | **SWE-bench Verified** | 80.8% | 87.6% | 88.6% | | **Terminal-Bench** | 65.4% (v2.0) | (не опуб.) | 74.6% (v2.1) | | **GPQA Diamond** | 59.4% (legacy) | (не опуб.) | 93.6% | | **AA Intelligence Index** | ~52 | ~54 | 56 | | **Цена (input/output)** | $5/$25 | $5/$25 | $5/$25 | | **Эффективная цена** | $5/$25 baseline | $6.75/$33.75 | $6.75/$33.75 | **Основное отличие:** Opus 4.8 лучше чем 4.7 на +1% SWE-Bench Pro и +1% Verified, но одинаковая цена. Opus 4.7 и 4.8 используют новый токенизер (+35% токенов). --- ## 4. СРАВНИТЕЛЬНАЯ ТАБЛИЦА | Аспект | MiniMax M3 | Claude Opus 4.6 | Claude Opus 4.7 | Claude Opus 4.8 | Победитель | |--------|-----------|-----------------|-----------------|-----------------|-----------| | **SWE-bench Pro** | 59.0% | 51.9% (Scale) | 64.3% | 69.2% | Opus 4.8 (+10.2) | | **SWE-bench Verified** | 80.5% | 80.8% | 87.6% | 88.6% | Opus 4.8 (+8.1) | | **Terminal-Bench** | 66.0% | 65.4% | (~68?) | 74.6% | Opus 4.8 (+8.6) | | **AA Intelligence Index** | 44 | ~52 | ~54 | 56 | Opus 4.8 (+12) | | **Веб-поиск (BrowseComp)** | 83.5 | 79.3 | (~79.3) | 79.3 | MiniMax (+4.2) | | **Контекст** | 1M | 1M | 1M | 1M | **Равно** | | **Мультимодальность** | Image+Video | Image | Image | Image | MiniMax | | **Скорость вывода** | ~100 tok/s | ~57 | ~58 | ~60 | MiniMax (~1.67x) | | **Input цена** | $0.30/M | $5.00/M | $5.00/M | $5.00/M | MiniMax (**16.7x**) | | **Output цена** | $1.20/M | $25.00/M | $25.00/M | $25.00/M | MiniMax (**20.8x**) | | **Эффективная цена** | ~$0.06/M | $5/$25 baseline | $6.75/$33.75 | $6.75/$33.75 | MiniMax | | **Open-weights** | Да | Нет | Нет | Нет | MiniMax | | **Локальный хостинг** | Да | Нет | Нет | Нет | MiniMax | | **Long-context практичность** | MSA (быстро) | Full attention | Full attention | Full attention | MiniMax (9-15x) | | **Дата выпуска** | Jun 2026 | Aug 2025 | Jan 2026 | May 2026 | Opus 4.8 (новейший) | --- ## 5. НЕЗАВИСИМЫЕ РЕЙТИНГИ ### Artificial Analysis Intelligence Index Rankings | Ранг | Модель | Индекс | Категория | |------|--------|--------|----------| | 1 | Claude Fable 5 | 60 | Proprietary | | 2 | GPT-5.6 Sol | 59 | Proprietary | | 3 | Kimi K3 | 57 | Proprietary | | **4** | **Claude Opus 4.8** | **56** | Proprietary | | 5 | Grok 4.5 | 54 | Proprietary | | 6 | Claude Opus 4.7 (est.) | ~54 | Proprietary | | 7 | Claude Opus 4.6 (est.) | ~52 | Proprietary | | **8** | **MiniMax M3** | **44** | Open-weights (428B) | | 9 | DeepSeek V4 Pro | 44 | Open-weights | ### SWE-bench Verified Public Leaderboard (July 17, 2026) **Top 10:** 1. Claude Fable 5: 95.0% 2. GPT-5.5: 88.7% 3. **Claude Opus 4.8: 88.6%** 4. **Claude Opus 4.7: 87.6%** 5. Gemini 3.1 Pro: 80.6% 6. DeepSeek V4 Pro Max: 80.6% 7. **MiniMax M3: 80.5%** (within 0.4 points of ranks 5-10) 8. **Claude Opus 4.6: 80.8%** (tied with MiniMax) 9. Qwen3.7 Max: 80.4% **Вывод:** - Opus 4.8 лидирует среди Claude на Verified - Opus 4.7 на 7.1 пункта выше MiniMax M3 - Opus 4.6 практически равен MiniMax M3 (0.3 пункта) - Ranks 6-10 статистически неразличимы; SWE-Bench Verified загрязнена и насыщена --- ## 6. REAL-WORLD ДЕМОНСТРАЦИИ ### MiniMax M3 Long-Horizon Tasks **1. ICLR 2025 Paper Reproduction:** - Время: 12 часов автономной работы - Результат: 18 commits, 23 experimental figures - Статус: успешно **2. CUDA Kernel Optimization (FP8 GEMM):** - Время: 24 часа - Результат: 147 benchmark submissions, 1,959 tool calls - Улучшение: 7.6% → 71.3% utilization (9.4x speedup) **3. Autonomous Model Training (PostTrainBench):** - Время: 12 часов - Статус: 0.37 score (vs Opus 4.7: 0.42) --- ## 7. АРХИТЕКТУРНЫЕ ОТЛИЧИЯ ### MiniMax Sparse Attention (MSA) - **Проблема:** Full attention O(n²) complexity на больших контекстах - **Решение:** Lightweight index branch выбирает релевантные KV-блоки, затем runs attention только на них - **Эффективность:** 4x+ faster than Flash-Sparse-Attention - **Результат:** 1/20 per-token compute на 1M context, 9-15x speedup ### Claude Opus Architecture - Proprietary, не разглашается - Full attention предполагается - Оптимизирована для точности --- ## 8. ЛИЦЕНЗИРОВАНИЕ И КОММЕРЧЕСКОЕ ИСПОЛЬЗОВАНИЕ ### MiniMax M3 - **Лицензия:** MINIMAX COMMUNITY LICENSE (commercial restricted) - **Open-weights:** Да (HuggingFace, GitHub) - **Коммерческое:** Restricted без разрешения - **Enterprise:** Available через direct sales - **Публичный статус:** Hong Kong Stock Exchange листинг (Jan 2026) ### Claude Opus 4.8 - **Лицензия:** Proprietary (Anthropic Commercial License) - **Open-weights:** Нет - **Коммерческое:** Pay-per-use API only - **Самостоятельный хостинг:** Недоступен --- ## 9. КОГДА ВЫБРАТЬ КАКУЮ МОДЕЛЬ ### Выбирайте Claude Opus 4.8 если: ✅ Нужна **максимальная точность** на кодинге (SWE-bench Pro 69.2% vs 59%) ✅ Сложные рассуждения и анализ (AA Index 56 vs 44) ✅ Budget не критичен ✅ Гарантированная поддержка и SLA от Anthropic ✅ Production-надежный проверенный стек ✅ Нужна поддержка в 5 облачных провайдерах (AWS, GCP, Azure) ### Выбирайте Claude Opus 4.7 если: ✅ Хорошее соотношение качество/цена (64.3% Pro, одинаковая цена с 4.8) ✅ Не критична информация до January 2026 ✅ Хотите сэкономить на новом токенизере (но 4.8 лучше) ✅ Производство требует стабильность, а не последняя версия ### Выбирайте Claude Opus 4.6 если: ✅ **Минимизация токенов** (старый токенизер, не +35%) ✅ Экономия на реальной стоимости (до +35% токенов меньше чем 4.7/4.8) ✅ Устраивает 80.8% на SWE-bench Verified ✅ Legacy система, где новый токенизер несовместим ✅ Экономия памяти в контексте (меньше токенов = меньше RAM) ### Выбирайте MiniMax M3 если: ✅ **Бюджет критичен: 16-20x дешевле** на tokens ✅ Нужна **видео-мультимодальность** (изображения + видео) ✅ Необходим **локальный хостинг** или self-hosting ✅ Нужна **модификация/fine-tuning** весов (open-weights) ✅ **MSA-архитектура критична** для 1M context production (9-15x быстрее) ✅ Устраивает 80% качества кодинга vs Claude's 88% ✅ Требуется **высокая скорость вывода** (100 tok/s vs 60 tok/s) ✅ **Веб-агенты лучше** (BrowseComp 83.5 > Opus's 79.3) ✅ Нужна transparent **open-weight модель** ✅ Хотите запустить **на своём GPU/сервере** --- ## ИТОГОВЫЙ ВЫВОД ### Прямое сравнение MiniMax M3 vs Claude Opus семейство: **MiniMax M3** — первая открытовесовая модель, которая серьёзно конкурирует с Claude Opus на кодинге: - Выше Claude Opus 4.6 на SWE-bench Pro (+7.1 пункта, 59% vs 51.9%) - На одном уровне с Claude Opus 4.6 на SWE-bench Verified (-0.3 пункта, 80.5% vs 80.8%) - Ниже Claude Opus 4.7 на SWE-bench Pro (-5.3 пункта, 59% vs 64.3%) - Ниже Claude Opus 4.8 на SWE-bench Pro (-10.2 пункта, 59% vs 69.2%) **Однако MiniMax M3 значительно превосходит на других фронтах:** - **16-20x дешевле** на input/output tokens - **Видео-мультимодальность** (vs Opus's image-only) - **9-15x быстрее** на long-context (MSA архитектура) - **100 tok/s** вывод (vs Opus's 60 tok/s) - **Open-weights** для локального хостинга - **Лучше на веб-агентах** (BrowseComp 83.5 vs 79.3) ### Рекомендация по выбору: | Сценарий | Выбор | Причина | |----------|-------|--------| | **Максимальный кодинг-бенчмарк** | Opus 4.8 | 69.2% SWE-bench Pro | | **Оптимум качество/цена** | Opus 4.7 | 64.3% Pro, одинаковая цена с 4.8 | | **Минимум токенов** | Opus 4.6 | Старый токенизер, -35% токенов | | **Максимум экономии** | MiniMax M3 | 16.7x дешевле input, 20.8x output | | **Видео + длинный контекст** | MiniMax M3 | Единственный с MSA + multimodal | | **Локальный хостинг** | MiniMax M3 | Единственный open-weights | **Выбор зависит от приоритетов:** - **Opus 4.8:** максимальное качество + поддержка Anthropic - **Opus 4.7:** качество близко к 4.8, одинаковая цена - **Opus 4.6:** минимизация реальных токен-расходов (старый токенизер) - **MiniMax M3:** экономичность + открытость + видео + локальный хостинг --- ## ИСТОЧНИКИ (30+) **Официальные объявления:** - https://www.minimax.io/blog/minimax-m3 - https://platform.minimax.io/docs/release-notes/models - https://www.anthropic.com/news/claude-opus-4-8 **Бенчмарки и лидерборды:** - https://www.morphllm.com/claude-benchmarks - https://www.morphllm.com/swe-bench-pro - https://www.vals.ai/benchmarks/swebench - https://artificialanalysis.ai/models/minimax-m3 - https://artificialanalysis.ai/models/claude-opus-4-8 **Технические описания:** - https://felloai.com/minimax-m3/ - https://datanorth.ai/news/minimax-launches-m3 - https://pandaily.com/minimax-m3-model-2026 - https://huggingface.co/MiniMaxAI **Ценообразование:** - https://wavespeed.ai/blog/posts/minimax-m3-price/ - https://pricepertoken.com/pricing-page/model/anthropic-claude-opus-4.8 - https://pricepertoken.com/pricing-page/model/minimax-minimax-m3 **Исследовательские работы:** - https://arxiv.org/abs/2605.26494 - https://arxiv.org/pdf/2606.13392