Veille quotidienne intelligente — 12:59
Propulsé par gemini-3.7-flash 🚀
📂 Rapports Précédents (Page 2) ➔État au 24 août 2026 · Sources : ai.google.dev/changelog · deepmind.google/models
⚠️ Paramètres dépréciés depuis 21/07/2026 : temperature, top_p, top_k
Sources : Artificial Analysis (AA Intelligence Index /63) · BenchLM (BenchAlign) · LiveBench (contamination-free /100) · Web search pour params
| Modèle ↕ | Compagnie ↕ | Date ↕ | Params total ↕ | Params actifs ↕ | $/M in ↕ | $/M out ↕ | AA Intel /63 ↕ | LiveBench /100 ↕ | Écart AA↔LB ↕ |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 (max) | Anthropic | 24/07/2026 | ~5T MoE | ~500B-1T | $15 | $75 | 63 | 80.1 | +27.1% |
| Claude Opus 5 (xhigh) | Anthropic | 24/07/2026 | ~5T MoE | ~500B-1T | $15 | $75 | 63 | N/D | — |
| Claude Fable 5 Max Effort | Anthropic | Juin 2026 | ~10T MoE | ~800B-1.2T | $10 | $50 | 62 | 83.0 | +33.9% |
| Claude Opus 5 (high) | Anthropic | 24/07/2026 | ~5T MoE | ~500B-1T | $15 | $75 | 62 | N/D | — |
| GPT-5.6 Sol Max | OpenAI | Juil 2026 | N/D | N/D | N/D | N/D | 61 | 81.0 | +32.8% |
| Kimi K3 (max) open | Moonshot | Juil 2026 | 2.8T MoE | 16/896 experts | N/D | N/D | 60 | 79.2 | +32.0% |
| Qwen 3.8 Max open | Alibaba | 2026 | N/D | N/D | N/D | N/D | 58 | N/D | — |
| DeepSeek V4 Pro 0813 | DeepSeek | Août 2026 | N/D | N/D | N/D | N/D | 57 | N/D | — |
| Grok 4.6 | xAI | 2026 | 0.5T MoE | N/D | N/D | N/D | 56 | N/D | — |
| Gemini 3.7 Flash High | Août 2026 | N/D | N/D | N/D | N/D | 55 | N/D | — | |
| GPT-5.5 Thinking xHigh | OpenAI | Avr 2026 | N/D | N/D | N/D | N/D | ~60 | 80.2 | +33.7% |
| Llama 4 Scout | Meta | 2026 | N/D | N/D | N/D | N/D | 54 | N/D | — |
Écart = (LiveBench/100 − AA/63) / (AA/63) × 100%. LiveBench, étant contamination-free, tend à être plus généreux que AA sur les modèles les plus récents.
| Rang | Modèle | Compagnie | AA Intel /63 | LiveBench /100 | Point fort |
|---|---|---|---|---|---|
| 🥇 1 | Claude Opus 5 (max)#1 AA | Anthropic | 63 | 80.1 | Raisonnement profond, agentic, code |
| 🥈 2 | Claude Fable 5 Max Effort | Anthropic | 62 | 83.0#1 LB | Frontier tasks, coding agentic |
| 🥉 3 | GPT-5.6 Sol Max | OpenAI | 61 | 81.0 | Frontier intelligence, agentic workflows |
| 4 | GPT-5.5 Thinking xHigh | OpenAI | ~60 | 80.2 | raisonnement étendu, benchmark frontier |
| 5 | Kimi K3 (max) open | Moonshot | 60 | 79.2 | 2.8T open, contexte long,,性价比 |
| 6 | Claude Opus 5 (high) | Anthropic | 62 | N/D | Mode haute qualité, codage pro |