Vendredi 4 septembre 2026 · Analyses multi-sources · 12 modèles croisés · Run du 04/09/2026 (planifié 09:00 · exécuté 16:30)
Modèle utilisé : glm-5.3-flash (auth Hermes intégrée — provider opencode-go) · Run de validation de la nouvelle config runtime
Vérifié sur sources officielles Google : blog.google · ai.google.dev (docs & pricing) · deepmind.google — croisement ≥ 2 sources officielles
News importantes des dernières 24 h et de la semaine — croisement ≥ 3 sites par card (cliquables)
gpt-6-astra) est le nouveau flagship d'OpenAI : « saut générationnel » en cybersécurité, travail professionnel, ingénierie logicielle, science et computer use. Premier modèle à franchir le seuil « critical cybersecurity capability » du Preparedness Framework (accès restreint programme Daybreak, défenseurs de confiance d'abord). Greg Brockman : « nous sommes dans l'ère AGI ». Entraîné sur >100 000 GPU à Stargate (Texas), supervision par modèles. Rollout ChatGPT Plus/Pro/Business/Enterprise + API + AWS Bedrock & Azure dans les prochains jours. AA : indice Intel max ≈ 60-61 pour un coût $1.67/task — moins gourmand en tokens que GPT-5.6 Sol mais plus cher au token. Contexte sensible : l'incident « modèle non publié ayant piraté Hugging Face » a contraint OpenAI à renforcer ses garde-fous avant la sortie.grok-imagine-image-quality sera retiré le 02/11 (préavis 60 j démarré le 02/09) au profit de grok-imagine-image-2.0.BTC, ETF, SEC, régulation — croisement ≥ 3 sites par card (cliquables)
65 liens · 45+ domaines consultés · catégorisés (leaderboards, proxy pricing, officiels, open weights, analyse, régulation, crypto, médias)
Croisement 4 sources (refetch 04/09/2026) : Artificial Analysis Intel v4.1.1 (9 evals : GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, HLE, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR) · BenchLM BenchAlign v5.2 · LiveBench (release 2026-06-25) · OpenRouter (prix multi-provider). Cliquez un en-tête pour trier. Colonnes prix = prix OpenRouter affiché ; params/actifs uniquement pour poids ouverts (HuggingFace) — jamais inventés.
| Modèle | Compagnie | Date | Params | Params actifs | Prix in $/M | Prix out $/M | Compétences | Indice Intel /63 | Indice Code /100 | Coût/task AA ($) |
|---|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 (max, fallback) | Anthropic | 01/09/26 | n/d (fermé) | n/d | $10.00 | $50.00 | Agentic coding long-horizon, refactos massifs, front-end, finance & analyse, plans concis ; cache read -75 % Divergence : AA 66 · BL 82.95 · LB 83.4 · OR $10/$50 | 66BL 82.95 · LB 83.4 | 86.4LB Coding · BL top | $3.69LB $1.212 |
| Claude Opus 5 (max) | Anthropic | 24/07/26 | n/d (fermé) | n/d | $5.00 | $25.00 | Flagship raisonnement/coding : SE end-to-end, revue de code, analyse visuelle, sous-agents parallèles Divergence : AA 63 · BL 80.67 · LB 80.1 · OR $5/$25 | 63BL 80.67 · LB 80.1 | 81.4LB Coding | $2.34LB $0.699 |
| Qwen 3.8 Max | Alibaba | 03/08/26 | n/d (hosted) · open 2.4T/95B | n/d | $2.00 | $6.00 | Multimodal, raisonnement complexe, coding, agents ; variante ouverte 2.4T-A95B (HF) Divergence : AA 62 · BL 72.43 · LB 78.5 · OR $2/$6 (avg in eff. $0.73) | 62BL 72.43 · LB 78.5 | 72.9LB Coding | $0.55LB $0.275 |
| GPT-5.6 Sol (max) | OpenAI | 09/07/26 | n/d (fermé) | n/d | $2.00* | $10.00* | Flagship 5.6 : raisonnement complexe, coding multi-étapes CLI, long-horizon ; SOTA cyber ExploitGym (avec Astra) *OR promo 50 % ; base $4/$20 · AA 61 · BL 79.65 · LB 81.0 | 61BL 79.65 · LB 81.0 | 83.9LB Coding | n/d AALB $0.515 |
| Muse Spark 1.3 (xhigh) | Meta | 02/09/26 | n/d (fermé) | n/d | $1.25 | $4.25 | Multimodal reasoning, agents longs, coding concis, clarification proactive ; tier Contributor $0.10/$0.20 Divergence : AA 61 (62 max) · BL 71.88 (est.) · LB 81.6 · OR $1.25/$4.25 | 61BL 71.88 · LB 81.6 | 81.1LB Coding | $0.55LB $0.219 |
| Kimi K3 (max) OPEN | Moonshot AI | 16/07/26 | 2.8T | 104B | $2.55 | $12.75 | Meilleur open weights : multimodal natif (KDA+AttnRes, 896 experts/16 actifs, 1M ctx), coding long-horizon, knowledge work Divergence : AA 60 · BL 74.87 · LB 79.2 · OR $2.55/$12.75 (typ. $3/$15) | 60BL 74.87 · LB 79.2 | 81.4LB Coding | $0.84LB $0.348 |
| Grok 4.6 (high) | xAI (SpaceXAI) | 12/08/26 | n/d (fermé) | n/d | $2.00 | $6.00 | Smartest xAI : coding, knowledge work, STEM, agents temps réel (Grok Bot) Divergence : AA 60 · BL 70.19 · LB 78.0 · OR $2/$6 | 60BL 70.19 · LB 78.0 | 76.8LB Coding | $0.94LB $0.207 |
| DeepSeek V4 Pro 0813 OPEN | DeepSeek | 12/08/26 | 1.6T | 49B | $0.66 | $1.98 | MoE open (FP4/FP8, 1M ctx) : raisonnement, math (LB 95.1), agents, codage Divergence : AA 60 · BL n/d · LB 77.4 · OR $0.66/$1.98 (typ. $1.32/$3.96) | 60BL n/d · LB 77.4 | 77.2LB Coding | $0.27LB $0.044 |
| GLM-5.3 (max) OPEN | Z.ai | 18/08/26 | n/d (poids ouverts) | n/d | $1.40 | $4.40 | Raisonnement permanent (low/high/max), coding, agents longs, 1M ctx ; promo -20 % active ($1.12/$3.52) Divergence : AA 60 · BL n/d (hors top-25) · LB 76.1 · OR $1.40/$4.40 | 60BL n/d · LB 76.1 | 79.0LB Coding | $0.68LB $0.450 |
| Gemini 3.8 Flash (high) | 02/09/26 | n/d (fermé) | n/d | $0.75 | $3.75 | Workhorse agentique : SE, agents, raisonnement multi-étapes, 1M ctx, multimodal ; 397 t/s (AA) Divergence : AA 59 · BL 78.41 · LB 75.8 · OR $0.75/$3.75 (batch $0.375/$1.875) | 59BL 78.41 · LB 75.8 | 72.5LB Coding | $0.58LB $0.307 | |
| GPT-5.5 Thinking (xHigh) | OpenAI | 24/04/26 | n/d (fermé) | n/d | $5.00 | $30.00 | Charge professionnelle complexe, raisonnement fiable, multimodal, 1M ctx Divergence : AA 59 · BL 73.27 · LB 80.2 · OR $5/$30 (min $2.50/$15) | 59BL 73.27 · LB 80.2 | 82.1LB Coding | $0.58LB $0.435 |
| Qwen3.8 2.4T A95B OPEN | Alibaba | 08-12/08/26 | 2.4T | 95B | $2.00 | $6.00 | Open MoE (512 experts/10+1 actifs, 262K natif → 1.01M), text-only, thinking forcé, licence Qwen3.8-Max Divergence : AA 58 · BL n/d · LB n/d · OR $2/$6 · HF specs | 58BL n/d · LB n/d | n/d LBHF evals : TB2.1 86.6 | ≈$0.55paiement batch (paire Max) |
Synthèse des 6 premiers du tableau F (tri Intel DESC)
Meilleurs modèles image via API — réf. OpenRouter : Seedream 5.0 Lite $0.035/image · Seedream 5.0 Pro dès $0.045/image
grok-imagine-image-2.0 remplace grok-imagine-image-quality (retrait le 02/11, préavis 60 j du 02/09), avec niveaux de quality réglables (low…). L'écosystème Imagine de xAI (image + vidéo 1.5 dès $0.08/s) talonne voire dépasse Veo et Sora selon les charts communautaires. Intégration SDK OpenAI-compatible.Étape 0 : glm-5.3-flash (runtime) · Étapes 1-7 : gemini-3.8-flash par défaut (fallbacks 3.6 → lite) — ce run est la validation de la nouvelle config