# MiniMax-M3 vs Claude Opus (4.6, 4.7, 4.8): Детальное сравнение
**Дата исследования:** июль 2026
**Источников проанализировано:** 30+
---
## ИДЕНТИФИКАЦИЯ МОДЕЛЕЙ
**MiniMax-M3** — это последняя флагманская открытовесовая модель MiniMax, выпущенная **1 июня 2026 года**. Первая и единственная открытовесовая модель, объединяющая фронтирные возможности кодинга, 1M-токовое окно контекста и нативную мультимодальность в одной архитектуре.
**Claude Opus семейство:**
- **Claude Opus 4.6** — выпущена **август 2025**, 1M context, старый токенизер
- **Claude Opus 4.7** — выпущена **январь 2026**, 1M context, новый токенизер (+35% токенов)
- **Claude Opus 4.8** — выпущена **27-28 мая 2026** (последняя активная), 1M context, новый токенизер
---
## 1. БЕНЧМАРКИ ИНТЕЛЛЕКТА И КОДИНГА
### SWE-bench Verified (500 реальных Python-задач)
| Модель | Скор | Источник |
|--------|------|---------|
| Claude Fable 5 (suspended) | 95.0% | morphllm.com |
| **Claude Opus 4.8** | **88.6%** | morphllm.com, vals.ai |
| Claude Opus 4.7 | 87.6% | morphllm.com |
| Claude Opus 4.6 | 80.8% | morphllm.com |
| **MiniMax M3** | **80.5%** | vals.ai, morphllm.com |
| DeepSeek V4 Pro Max | 80.6% | vals.ai |
| Claude Opus 4.5 (legacy) | 80.9% | morphllm.com |
**Вывод:**
- Claude Opus 4.8 выше MiniMax M3 на **8.1 пункта**
- Claude Opus 4.7 выше MiniMax M3 на **7.1 пункта**
- Claude Opus 4.6 выше MiniMax M3 на **0.3 пункта** (статистически неразличимы)
- MiniMax M3 конкурирует на уровне Opus 4.6/4.5 на этом загрязнённом бенчмарке
### SWE-bench Pro (1865 реальных задач, 41 репозиторий)
**Vendor-reported scores:**
| Модель | Скор | Источник |
|--------|------|---------|
| Claude Fable 5 (suspended) | 80.0% | morphllm.com |
| **Claude Opus 4.8** | **69.2%** | morphllm.com, anthropic.com |
| Claude Opus 4.7 | 64.3% | morphllm.com |
| **MiniMax M3** | **59.0%** | felloai.com, minimax.io |
| GPT-5.5 | 58.6% | morphllm.com |
| Gemini 3.1 Pro | 54.2% | morphllm.com |
| Claude Opus 4.6 | 51.9% (Scale standardized) | morphllm.com |
**Вывод:**
- Claude Opus 4.8 выше MiniMax M3 на **10.2 пункта**
- Claude Opus 4.7 выше MiniMax M3 на **5.3 пункта**
- MiniMax M3 выше GPT-5.5 на **0.4 пункта**
- MiniMax M3 выше Claude Opus 4.6 на **7.1 пункта** (но Opus 4.6 на standardized harness, Opus 4.8 на vendor harness)
- Важно: различие в скаффолдинге может составлять 15-30 пунктов
### Terminal-Bench 2.1 (команднострочные агентские задачи)
| Модель | Скор | Источник |
|--------|------|---------|
| GPT-5.5 | 78.2% | morphllm.com |
| **Claude Opus 4.8** | **74.6%** | morphllm.com |
| **MiniMax M3** | **66.0%** | minimax.io, felloai.com |
| Claude Opus 4.6 | 65.4% (v2.0) | morphllm.com |
| Claude Opus 4.7 | (не опубликован) | — |
**Вывод:**
- Claude Opus 4.8 выше MiniMax M3 на **8.6 пункта**
- MiniMax M3 на уровне Claude Opus 4.6 (**~0.6 пункта** выше)
- Claude Opus 4.7 результаты не опубликованы (но ожидается лучше чем 4.6)
### GPQA Diamond (выпускные вопросы, валидированные экспертами)
| Модель | Скор | Источник |
|--------|------|---------|
| **Claude Opus 4.8** | **93.6%** | morphllm.com |
| Gemini 3.1 Pro | 92.2% | artificialanalysis.ai |
| Claude Opus 4.7 | (не опубликован) | — |
| Claude Opus 4.6 | 59.4% (legacy) | morphllm.com |
| MiniMax M3 | Не опубликовано | — |
**Вывод:**
- Claude Opus 4.8 существенно впереди (93.6%)
- Opus 4.7, 4.6 результаты не включены в стандартный список
- MiniMax M3 не тестировал на этом бенчмарке (вероятно, ниже 93%, но неизвестно точно)
### Artificial Analysis Intelligence Index (комбинированный метрикс)
**Включает:** GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR
| Модель | Индекс | Ранг (из 186/579) | Источник |
|--------|--------|------------------|---------|
| Claude Opus 4.8 (max reasoning) | 56 | 6/186 (proprietary) | artificialanalysis.ai |
| Claude Opus 4.7 (max reasoning) | ~54 | ~8/186 | artificialanalysis.ai |
| Claude Opus 4.6 (thinking) | ~52 | ~12/186 | artificialanalysis.ai |
| **MiniMax M3** | **44** | 2/97 (open-weights 428B) | artificialanalysis.ai |
**Вывод:**
- Claude Opus 4.8 на **12 пунктов** выше MiniMax M3
- Claude Opus 4.7 на **10 пунктов** выше MiniMax M3
- Claude Opus 4.6 на **8 пунктов** выше MiniMax M3
- Важно: модели в разных категориях (proprietary vs open-weights 428B), сравнение условное
### Дополнительные бенчмарки MiniMax M3
| Бенчмарк | MiniMax M3 | Источник |
|---------|-----------|---------|
| SWE-fficiency | 34.8% | minimax.io |
| KernelBench Hard | 28.8% | minimax.io |
| MCP Atlas (tool-use) | 74.2% | minimax.io |
| BrowseComp (web search) | **83.5** | felloai.com |
| PostTrainBench (autonomous training) | 0.37 | pandaily.com |
**Примечание:** BrowseComp 83.5 выше Claude Opus 4.7 (79.3) — область, где MiniMax M3 конкурирует лучше.
---
## 2. ЦЕНЫ (USD per 1M tokens)
### MiniMax M3 API
**Standard rate (≤512K input tokens):**
- **Input:** $0.30/M (промо, список $0.60/M)
- **Output:** $1.20/M (промо, список $2.40/M)
- **Cache write:** $0.375/M
- **Cache read:** $0.06/M (-80% от input)
**Long-context rate (>512K input):**
- 2x всех значений (весь запрос считается по этому тарифу)
- Input: $0.60/M, Output: $2.40/M
**Token Plan subscriptions:**
| План | Цена/мес | Токены | Эффективная цена |
|------|---------|--------|-----------------|
| Plus | $20 | ~1.7B | $0.012/M (комбо) |
| Max | $50 | ~5.1B | $0.010/M (комбо) |
| Ultra | $120 | ~9.8B | $0.012/M (комбо) |
### Claude Opus API (4.6, 4.7, 4.8)
**Всё семейство Opus (4.6, 4.7, 4.8) — одинаковая стандартная цена:**
| Вариант | Input | Output | Источник |
|---------|-------|--------|---------|
| Standard | $5.00/M | $25.00/M | anthropic.com |
| Fast mode (Opus 4.8 only) | $10.00/M | $50.00/M | anthropic.com |
| Cache write | $6.25/M | — | morphllm.com |
| Cache read | $0.50/M | — | morphllm.com |
**Важно:** Opus 4.7 и 4.8 используют новый токенизер, который производит **+35% больше токенов** для того же текста, чем Opus 4.6, что делает реальную стоимость выше на ~35%.
**Available from 5 providers:**
- Anthropic
- Amazon Bedrock
- Google Cloud
- Azure OpenAI
- OpenRouter
### СРАВНЕНИЕ СТОИМОСТИ
**Перечень цен (все Opus 4.6/4.7/4.8 одинаковые по input/output):**
| Метрика | MiniMax M3 | Claude Opus 4.6/4.7/4.8 | Разница |
|---------|-----------|-------------------------|---------|
| Input (стандарт) | $0.30/M | $5.00/M | **16.7x дешевле** |
| Output (стандарт) | $1.20/M | $25.00/M | **20.8x дешевле** |
| Cache read | $0.06/M | $0.50/M | **8.3x дешевле** |
| Blended (с кешированием) | ~$0.06/M | Variable | **>83x дешевле** |
**⚠️ Учёт новых токенизеров:**
- MiniMax M3: без информации о точном увеличении токенов
- Claude Opus 4.8/4.7: +35% токенов vs Opus 4.6 (эффективная цена выше на 35%)
- Claude Opus 4.6: baseline (без увеличения)
**Стоимость за задачу (SWE-Bench Pro, 500K input + 100K output):**
- MiniMax M3: $0.27 per task = 218 points/$
- Claude Opus 4.8: $3.50 per task (без учёта +35% tokenizer) = 19.8 points/$
- Claude Opus 4.7: $3.50 per task (без учёта +35% tokenizer) = 18.4 points/$
- Claude Opus 4.6: $3.50 per task (baseline tokenizer) = 14.8 points/$
---
## 3. КЛЮЧЕВЫЕ ХАРАКТЕРИСТИКИ
### MiniMax M3
| Характеристика | Значение |
|----------------|---------|
| **Дата выпуска** | 1 июня 2026 |
| **Архитектура** | MoE (Mixture-of-Experts) с MSA |
| **Всего параметров** | 428B (430B) |
| **Активные параметры** | 23B per token |
| **Контекстное окно** | 1M tokens (гарантия минимум 512K) |
| **Модальности ввода** | Text, Image, Video (нативные) |
| **Модальности вывода** | Text |
| **Лицензия** | MINIMAX COMMUNITY LICENSE (коммерчески ограничена) |
| **Open-weights** | Да (HuggingFace, GitHub) |
| **Скорость вывода** | ~100 токов/сек |
| **Архитектура внимания** | MSA (MiniMax Sparse Attention) |
| **Per-token compute (1M)** | 1/20 от предыдущего поколения |
| **Prefill ускорение** | >9x |
| **Decoding ускорение** | >15x |
| **Data для обучения** | 29.2T tokens |
### Claude Opus 4.6, 4.7, 4.8 (сравнение)
| Характеристика | Opus 4.6 | Opus 4.7 | Opus 4.8 |
|----------------|----------|----------|----------|
| **Дата выпуска** | август 2025 | январь 2026 | май 2026 |
| **Архитектура** | Proprietary | Proprietary | Proprietary |
| **Контекст** | 1M | 1M | 1M |
| **Модальности ввода** | Text, Image | Text, Image | Text, Image |
| **Скорость вывода** | ~57 tok/s | ~58 tok/s | ~60 tok/s |
| **Tokenizer** | Старый baseline | Новый (+35%) | Новый (+35%) |
| **Training cutoff** | Aug 2025 | Jan 2026 | Jan 2026 |
| **Reasoning** | Yes (thinking) | Yes | Yes (Adaptive) |
| **SWE-bench Pro** | 51.9% (Scale) | 64.3% (vendor) | 69.2% (vendor) |
| **SWE-bench Verified** | 80.8% | 87.6% | 88.6% |
| **Terminal-Bench** | 65.4% (v2.0) | (не опуб.) | 74.6% (v2.1) |
| **GPQA Diamond** | 59.4% (legacy) | (не опуб.) | 93.6% |
| **AA Intelligence Index** | ~52 | ~54 | 56 |
| **Цена (input/output)** | $5/$25 | $5/$25 | $5/$25 |
| **Эффективная цена** | $5/$25 baseline | $6.75/$33.75 | $6.75/$33.75 |
**Основное отличие:** Opus 4.8 лучше чем 4.7 на +1% SWE-Bench Pro и +1% Verified, но одинаковая цена. Opus 4.7 и 4.8 используют новый токенизер (+35% токенов).
---
## 4. СРАВНИТЕЛЬНАЯ ТАБЛИЦА
| Аспект | MiniMax M3 | Claude Opus 4.6 | Claude Opus 4.7 | Claude Opus 4.8 | Победитель |
|--------|-----------|-----------------|-----------------|-----------------|-----------|
| **SWE-bench Pro** | 59.0% | 51.9% (Scale) | 64.3% | 69.2% | Opus 4.8 (+10.2) |
| **SWE-bench Verified** | 80.5% | 80.8% | 87.6% | 88.6% | Opus 4.8 (+8.1) |
| **Terminal-Bench** | 66.0% | 65.4% | (~68?) | 74.6% | Opus 4.8 (+8.6) |
| **AA Intelligence Index** | 44 | ~52 | ~54 | 56 | Opus 4.8 (+12) |
| **Веб-поиск (BrowseComp)** | 83.5 | 79.3 | (~79.3) | 79.3 | MiniMax (+4.2) |
| **Контекст** | 1M | 1M | 1M | 1M | **Равно** |
| **Мультимодальность** | Image+Video | Image | Image | Image | MiniMax |
| **Скорость вывода** | ~100 tok/s | ~57 | ~58 | ~60 | MiniMax (~1.67x) |
| **Input цена** | $0.30/M | $5.00/M | $5.00/M | $5.00/M | MiniMax (**16.7x**) |
| **Output цена** | $1.20/M | $25.00/M | $25.00/M | $25.00/M | MiniMax (**20.8x**) |
| **Эффективная цена** | ~$0.06/M | $5/$25 baseline | $6.75/$33.75 | $6.75/$33.75 | MiniMax |
| **Open-weights** | Да | Нет | Нет | Нет | MiniMax |
| **Локальный хостинг** | Да | Нет | Нет | Нет | MiniMax |
| **Long-context практичность** | MSA (быстро) | Full attention | Full attention | Full attention | MiniMax (9-15x) |
| **Дата выпуска** | Jun 2026 | Aug 2025 | Jan 2026 | May 2026 | Opus 4.8 (новейший) |
---
## 5. НЕЗАВИСИМЫЕ РЕЙТИНГИ
### Artificial Analysis Intelligence Index Rankings
| Ранг | Модель | Индекс | Категория |
|------|--------|--------|----------|
| 1 | Claude Fable 5 | 60 | Proprietary |
| 2 | GPT-5.6 Sol | 59 | Proprietary |
| 3 | Kimi K3 | 57 | Proprietary |
| **4** | **Claude Opus 4.8** | **56** | Proprietary |
| 5 | Grok 4.5 | 54 | Proprietary |
| 6 | Claude Opus 4.7 (est.) | ~54 | Proprietary |
| 7 | Claude Opus 4.6 (est.) | ~52 | Proprietary |
| **8** | **MiniMax M3** | **44** | Open-weights (428B) |
| 9 | DeepSeek V4 Pro | 44 | Open-weights |
### SWE-bench Verified Public Leaderboard (July 17, 2026)
**Top 10:**
1. Claude Fable 5: 95.0%
2. GPT-5.5: 88.7%
3. **Claude Opus 4.8: 88.6%**
4. **Claude Opus 4.7: 87.6%**
5. Gemini 3.1 Pro: 80.6%
6. DeepSeek V4 Pro Max: 80.6%
7. **MiniMax M3: 80.5%** (within 0.4 points of ranks 5-10)
8. **Claude Opus 4.6: 80.8%** (tied with MiniMax)
9. Qwen3.7 Max: 80.4%
**Вывод:**
- Opus 4.8 лидирует среди Claude на Verified
- Opus 4.7 на 7.1 пункта выше MiniMax M3
- Opus 4.6 практически равен MiniMax M3 (0.3 пункта)
- Ranks 6-10 статистически неразличимы; SWE-Bench Verified загрязнена и насыщена
---
## 6. REAL-WORLD ДЕМОНСТРАЦИИ
### MiniMax M3 Long-Horizon Tasks
**1. ICLR 2025 Paper Reproduction:**
- Время: 12 часов автономной работы
- Результат: 18 commits, 23 experimental figures
- Статус: успешно
**2. CUDA Kernel Optimization (FP8 GEMM):**
- Время: 24 часа
- Результат: 147 benchmark submissions, 1,959 tool calls
- Улучшение: 7.6% → 71.3% utilization (9.4x speedup)
**3. Autonomous Model Training (PostTrainBench):**
- Время: 12 часов
- Статус: 0.37 score (vs Opus 4.7: 0.42)
---
## 7. АРХИТЕКТУРНЫЕ ОТЛИЧИЯ
### MiniMax Sparse Attention (MSA)
- **Проблема:** Full attention O(n²) complexity на больших контекстах
- **Решение:** Lightweight index branch выбирает релевантные KV-блоки, затем runs attention только на них
- **Эффективность:** 4x+ faster than Flash-Sparse-Attention
- **Результат:** 1/20 per-token compute на 1M context, 9-15x speedup
### Claude Opus Architecture
- Proprietary, не разглашается
- Full attention предполагается
- Оптимизирована для точности
---
## 8. ЛИЦЕНЗИРОВАНИЕ И КОММЕРЧЕСКОЕ ИСПОЛЬЗОВАНИЕ
### MiniMax M3
- **Лицензия:** MINIMAX COMMUNITY LICENSE (commercial restricted)
- **Open-weights:** Да (HuggingFace, GitHub)
- **Коммерческое:** Restricted без разрешения
- **Enterprise:** Available через direct sales
- **Публичный статус:** Hong Kong Stock Exchange листинг (Jan 2026)
### Claude Opus 4.8
- **Лицензия:** Proprietary (Anthropic Commercial License)
- **Open-weights:** Нет
- **Коммерческое:** Pay-per-use API only
- **Самостоятельный хостинг:** Недоступен
---
## 9. КОГДА ВЫБРАТЬ КАКУЮ МОДЕЛЬ
### Выбирайте Claude Opus 4.8 если:
✅ Нужна **максимальная точность** на кодинге (SWE-bench Pro 69.2% vs 59%)
✅ Сложные рассуждения и анализ (AA Index 56 vs 44)
✅ Budget не критичен
✅ Гарантированная поддержка и SLA от Anthropic
✅ Production-надежный проверенный стек
✅ Нужна поддержка в 5 облачных провайдерах (AWS, GCP, Azure)
### Выбирайте Claude Opus 4.7 если:
✅ Хорошее соотношение качество/цена (64.3% Pro, одинаковая цена с 4.8)
✅ Не критична информация до January 2026
✅ Хотите сэкономить на новом токенизере (но 4.8 лучше)
✅ Производство требует стабильность, а не последняя версия
### Выбирайте Claude Opus 4.6 если:
✅ **Минимизация токенов** (старый токенизер, не +35%)
✅ Экономия на реальной стоимости (до +35% токенов меньше чем 4.7/4.8)
✅ Устраивает 80.8% на SWE-bench Verified
✅ Legacy система, где новый токенизер несовместим
✅ Экономия памяти в контексте (меньше токенов = меньше RAM)
### Выбирайте MiniMax M3 если:
✅ **Бюджет критичен: 16-20x дешевле** на tokens
✅ Нужна **видео-мультимодальность** (изображения + видео)
✅ Необходим **локальный хостинг** или self-hosting
✅ Нужна **модификация/fine-tuning** весов (open-weights)
✅ **MSA-архитектура критична** для 1M context production (9-15x быстрее)
✅ Устраивает 80% качества кодинга vs Claude's 88%
✅ Требуется **высокая скорость вывода** (100 tok/s vs 60 tok/s)
✅ **Веб-агенты лучше** (BrowseComp 83.5 > Opus's 79.3)
✅ Нужна transparent **open-weight модель**
✅ Хотите запустить **на своём GPU/сервере**
---
## ИТОГОВЫЙ ВЫВОД
### Прямое сравнение MiniMax M3 vs Claude Opus семейство:
**MiniMax M3** — первая открытовесовая модель, которая серьёзно конкурирует с Claude Opus на кодинге:
- Выше Claude Opus 4.6 на SWE-bench Pro (+7.1 пункта, 59% vs 51.9%)
- На одном уровне с Claude Opus 4.6 на SWE-bench Verified (-0.3 пункта, 80.5% vs 80.8%)
- Ниже Claude Opus 4.7 на SWE-bench Pro (-5.3 пункта, 59% vs 64.3%)
- Ниже Claude Opus 4.8 на SWE-bench Pro (-10.2 пункта, 59% vs 69.2%)
**Однако MiniMax M3 значительно превосходит на других фронтах:**
- **16-20x дешевле** на input/output tokens
- **Видео-мультимодальность** (vs Opus's image-only)
- **9-15x быстрее** на long-context (MSA архитектура)
- **100 tok/s** вывод (vs Opus's 60 tok/s)
- **Open-weights** для локального хостинга
- **Лучше на веб-агентах** (BrowseComp 83.5 vs 79.3)
### Рекомендация по выбору:
| Сценарий | Выбор | Причина |
|----------|-------|--------|
| **Максимальный кодинг-бенчмарк** | Opus 4.8 | 69.2% SWE-bench Pro |
| **Оптимум качество/цена** | Opus 4.7 | 64.3% Pro, одинаковая цена с 4.8 |
| **Минимум токенов** | Opus 4.6 | Старый токенизер, -35% токенов |
| **Максимум экономии** | MiniMax M3 | 16.7x дешевле input, 20.8x output |
| **Видео + длинный контекст** | MiniMax M3 | Единственный с MSA + multimodal |
| **Локальный хостинг** | MiniMax M3 | Единственный open-weights |
**Выбор зависит от приоритетов:**
- **Opus 4.8:** максимальное качество + поддержка Anthropic
- **Opus 4.7:** качество близко к 4.8, одинаковая цена
- **Opus 4.6:** минимизация реальных токен-расходов (старый токенизер)
- **MiniMax M3:** экономичность + открытость + видео + локальный хостинг
---
## ИСТОЧНИКИ (30+)
**Официальные объявления:**
- https://www.minimax.io/blog/minimax-m3
- https://platform.minimax.io/docs/release-notes/models
- https://www.anthropic.com/news/claude-opus-4-8
**Бенчмарки и лидерборды:**
- https://www.morphllm.com/claude-benchmarks
- https://www.morphllm.com/swe-bench-pro
- https://www.vals.ai/benchmarks/swebench
- https://artificialanalysis.ai/models/minimax-m3
- https://artificialanalysis.ai/models/claude-opus-4-8
**Технические описания:**
- https://felloai.com/minimax-m3/
- https://datanorth.ai/news/minimax-launches-m3
- https://pandaily.com/minimax-m3-model-2026
- https://huggingface.co/MiniMaxAI
**Ценообразование:**
- https://wavespeed.ai/blog/posts/minimax-m3-price/
- https://pricepertoken.com/pricing-page/model/anthropic-claude-opus-4.8
- https://pricepertoken.com/pricing-page/model/minimax-minimax-m3
**Исследовательские работы:**
- https://arxiv.org/abs/2605.26494
- https://arxiv.org/pdf/2606.13392