OSSemaine 41 · 5 oct. – 11 oct.

Open Source AI Top 10

Poids ouverts uniquement. Mêmes critères que le classement général, pour comparer ce qu'on peut vraiment héberger soi-même.

Dernière mise à jour : Comment ce classement est calculé →

#1 cette semaine

DeepSeek V3.2

13ᵉ semaine en tête

Plus forte hausse

gpt-oss-120b

3En hausse de 3 places n°3

Plus forte baisse

GLM-4.6

1En baisse de 1 place n°4

Entrées et sorties

1 in · 1 out

Llama Nemotron Ultra, Llama 4 Maverick

Trier par critère

  1. Place 01
    Place inchangéeS40 · n°1

    DeepSeek V3.2

    DeepSeek · Modèle open weights

    Un modèle généraliste ouvert, à très bas coût d'inférence

    • Coding 70
    • Reasoning 68
    • Speed 5
    • 0,32 $ /M tok
    • 128k ctx

    Global

    68,3

    13 sem. au Top · pic n°1

    DATAPourquoi ça bouge

    Place inchangée ; Coding 70 (0 pts).

    • SWE-bench Verified : 69,0 % (0 %)
    • LiveCodeBench : 71,0 % (0 %)
    OUR TAKEÉquipe Sandbox
    « Treize semaines en tête. Lent chez la plupart des fournisseurs, mais le prix fait oublier la latence pour les usages en batch. »
    Détails et sources

    Sous-scores

    • Coding70
    • Reasoning68
    • Maths89
    • Agents63
    • Multimodalnon évalué—
    • Long context51
    • Speed5
    • Price97
    • Value80

    Mesures · S41

    SWE-bench Verified69,0 %SWE-bench (nouvel onglet)
    LiveCodeBench71,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond82,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam23,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202589,0 %Epoch AI (nouvel onglet)
    Terminal-Bench41,0 %Terminal-Bench (nouvel onglet)
    τ-bench68,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR62,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte128kArtificial Analysis (nouvel onglet)
    Vitesse de sortie34 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,32 $calculé

    Ouvrir la fiche de DeepSeek V3.2 →

  2. Place 02
    Place inchangéeS40 · n°2

    Kimi K2

    Moonshot AI · Modèle open weights

    Une mixture d'experts à poids ouverts, pensée pour les agents et le code

    • Coding 68
    • Reasoning 66
    • Speed 9
    • 1,08 $ /M tok
    • 256k ctx

    Global

    68,1

    16 sem. au Top · pic n°1

    DATAPourquoi ça bouge

    Place inchangée ; Coding 68 (0 pts).

    • SWE-bench Verified : 70,0 % (0 %)
    • LiveCodeBench : 66,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding68
    • Reasoning66
    • Maths86
    • Agents64
    • Multimodalnon évalué—
    • Long context57
    • Speed9
    • Price81
    • Value73

    Mesures · S41

    SWE-bench Verified70,0 %SWE-bench (nouvel onglet)
    LiveCodeBench66,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond78,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam24,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202586,0 %Epoch AI (nouvel onglet)
    Terminal-Bench40,0 %Terminal-Bench (nouvel onglet)
    τ-bench72,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR62,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte256kArtificial Analysis (nouvel onglet)
    Vitesse de sortie38 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte1,08 $calculé

    Ouvrir la fiche de Kimi K2 →

  3. Place 03
    3En hausse de 3 placesS40 · n°6

    gpt-oss-120b

    OpenAI · Modèle open weights

    Les poids ouverts d'OpenAI, sous Apache-2.0

    • Coding 68
    • Reasoning 63
    • Speed 58
    • 0,26 $ /M tok
    • 128k ctx

    Global

    67,1

    12 sem. au Top · pic n°3

    DATAPourquoi ça bouge

    +3 places, porté par Agents : 67 (+15 pts).

    • Terminal-Bench : 45,0 % (+41 %)
    • τ-bench : 70,0 % (+17 %)
    OUR TAKEÉquipe Sandbox
    « +3 places. Le plus rapide du Top 10 des poids ouverts, et il tient sur une seule machine bien équipée. C'est ce qui compte quand on héberge soi-même. »
    Détails et sources

    Sous-scores

    • Coding68 +6
    • Reasoning63
    • Maths90
    • Agents67 +15
    • Multimodalnon évalué—
    • Long context45
    • Speed58
    • Price98
    • Value80 +3

    Mesures · S41

    SWE-bench Verified68,0 %+10,0SWE-bench (nouvel onglet)
    LiveCodeBench68,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond80,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam19,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202590,0 %Epoch AI (nouvel onglet)
    Terminal-Bench45,0 %+13,0Terminal-Bench (nouvel onglet)
    τ-bench70,0 %+10,0τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR52,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte128kArtificial Analysis (nouvel onglet)
    Vitesse de sortie134 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,26 $calculé

    Ouvrir la fiche de gpt-oss-120b →

  4. Place 04
    1En baisse de 1 placeS40 · n°3

    GLM-4.6

    Z.ai · Modèle open weights

    Un modèle ouvert généraliste et agentique de Z.ai

    • Coding 67
    • Reasoning 66
    • Speed 20
    • 0,81 $ /M tok
    • 200k ctx

    Global

    67,0

    10 sem. au Top · pic n°2

    DATAPourquoi ça bouge

    −1 place, freiné par Coding : 67 (0 pts).

    • SWE-bench Verified : 66,0 % (0 %)
    • LiveCodeBench : 69,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding67
    • Reasoning66
    • Maths86
    • Agents63
    • Multimodalnon évalué—
    • Long context52
    • Speed20
    • Price86
    • Value74

    Mesures · S41

    SWE-bench Verified66,0 %SWE-bench (nouvel onglet)
    LiveCodeBench69,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond80,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam22,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202586,0 %Epoch AI (nouvel onglet)
    Terminal-Bench40,0 %Terminal-Bench (nouvel onglet)
    τ-bench71,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR58,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte200kArtificial Analysis (nouvel onglet)
    Vitesse de sortie51 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,81 $calculé

    Ouvrir la fiche de GLM-4.6 →

  5. Place 05
    1En baisse de 1 placeS40 · n°4

    MiniMax M2

    MiniMax · Modèle open weights

    Un modèle ouvert rapide, orienté code et agents

    • Coding 69
    • Reasoning 63
    • Speed 35
    • 0,52 $ /M tok
    • 200k ctx

    Global

    66,5

    8 sem. au Top · pic n°3

    DATAPourquoi ça bouge

    −1 place, freiné par Coding : 69 (0 pts).

    • SWE-bench Verified : 68,0 % (0 %)
    • LiveCodeBench : 70,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding69
    • Reasoning63
    • Maths82
    • Agents65
    • Multimodalnon évalué—
    • Long context51
    • Speed35
    • Price92
    • Value77

    Mesures · S41

    SWE-bench Verified68,0 %SWE-bench (nouvel onglet)
    LiveCodeBench70,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond78,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam20,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202582,0 %Epoch AI (nouvel onglet)
    Terminal-Bench42,0 %Terminal-Bench (nouvel onglet)
    τ-bench72,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR55,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte200kArtificial Analysis (nouvel onglet)
    Vitesse de sortie75 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,52 $calculé

    Ouvrir la fiche de MiniMax M2 →

  6. Place 06
    1En baisse de 1 placeS40 · n°5

    Qwen3 235B

    Alibaba Qwen · Modèle open weights

    Une mixture d'experts de 235 milliards de paramètres, sous Apache-2.0

    • Coding 66
    • Reasoning 64
    • Speed 22
    • 0,39 $ /M tok
    • 256k ctx

    Global

    65,1

    16 sem. au Top · pic n°2

    DATAPourquoi ça bouge

    −1 place, freiné par Coding : 66 (0 pts).

    • SWE-bench Verified : 64,0 % (0 %)
    • LiveCodeBench : 70,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding66
    • Reasoning64
    • Maths90
    • Agents53
    • Multimodalnon évalué—
    • Long context56
    • Speed22
    • Price95
    • Value77

    Mesures · S41

    SWE-bench Verified64,0 %SWE-bench (nouvel onglet)
    LiveCodeBench70,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond82,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam18,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202590,0 %Epoch AI (nouvel onglet)
    Terminal-Bench30,0 %Terminal-Bench (nouvel onglet)
    τ-bench66,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR60,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte256kArtificial Analysis (nouvel onglet)
    Vitesse de sortie53 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,39 $calculé

    Ouvrir la fiche de Qwen3 235B →

  7. Place 07
    Place inchangéeS40 · n°7

    Qwen3 Coder

    Alibaba Qwen · Modèle open weights

    La variante de Qwen3 spécialisée dans le code et les agents

    • Coding 66
    • Reasoning 53
    • Speed 26
    • 0,52 $ /M tok
    • 256k ctx

    Global

    60,1

    9 sem. au Top · pic n°6

    DATAPourquoi ça bouge

    Place inchangée ; Coding 66 (0 pts).

    • SWE-bench Verified : 67,0 % (0 %)
    • LiveCodeBench : 65,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding66
    • Reasoning53
    • Maths70
    • Agents58
    • Multimodalnon évalué—
    • Long context53
    • Speed26
    • Price92
    • Value73

    Mesures · S41

    SWE-bench Verified67,0 %SWE-bench (nouvel onglet)
    LiveCodeBench65,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond72,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam12,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202570,0 %Epoch AI (nouvel onglet)
    Terminal-Bench38,0 %Terminal-Bench (nouvel onglet)
    τ-bench62,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR55,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte256kArtificial Analysis (nouvel onglet)
    Vitesse de sortie60 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,52 $calculé

    Ouvrir la fiche de Qwen3 Coder →

  8. Place 08
    Place inchangéeS40 · n°8

    Mistral Large 3

    Mistral AI · Modèle open weights

    Le grand modèle ouvert de Mistral AI

    • Coding 60
    • Reasoning 52
    • Speed 32
    • 0,75 $ /M tok
    • 256k ctx

    Global

    57,9

    11 sem. au Top · pic n°5

    DATAPourquoi ça bouge

    Place inchangée ; Coding 60 (0 pts).

    • SWE-bench Verified : 58,0 % (0 %)
    • LiveCodeBench : 62,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding60
    • Reasoning52
    • Maths72
    • Agents49
    • Multimodal68
    • Long context55
    • Speed32
    • Price87
    • Value70

    Mesures · S41

    SWE-bench Verified58,0 %SWE-bench (nouvel onglet)
    LiveCodeBench62,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond74,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam10,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202572,0 %Epoch AI (nouvel onglet)
    Terminal-Bench28,0 %Terminal-Bench (nouvel onglet)
    τ-bench60,0 %τ-bench (nouvel onglet)
    MMMU68,0 %MMMU (nouvel onglet)
    MRCR58,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte256kArtificial Analysis (nouvel onglet)
    Vitesse de sortie70 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,75 $calculé

    Ouvrir la fiche de Mistral Large 3 →

  9. Place 09
    NEWNouvelle entréeJamais classé

    Llama Nemotron Ultra

    NVIDIA · Modèle open weights

    Un dérivé de Llama optimisé par NVIDIA pour le raisonnement

    • Coding 56
    • Reasoning 55
    • Speed 14
    • 0,90 $ /M tok
    • 128k ctx

    Global

    56,6

    1 sem. au Top · pic n°9

    DATAPourquoi ça bouge

    Première entrée au Top, à la 9ᵉ place. Point fort : Price (16ᵉ du pool).

    OUR TAKEÉquipe Sandbox
    « Nouvelle entrée : un dérivé de Llama affiné par NVIDIA. Intéressant, mais lourd à héberger. À essayer avant d'en tirer une conclusion. »
    Détails et sources

    Sous-scores

    • Coding56
    • Reasoning55
    • Maths80
    • Agents49
    • Multimodalnon évalué—
    • Long context46
    • Speed14
    • Price84
    • Value68

    Mesures · S41

    SWE-bench Verified52,0 %SWE-bench (nouvel onglet)
    LiveCodeBench62,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond76,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam12,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202580,0 %Epoch AI (nouvel onglet)
    Terminal-Bench28,0 %Terminal-Bench (nouvel onglet)
    τ-bench60,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR55,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte128kArtificial Analysis (nouvel onglet)
    Vitesse de sortie43 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,90 $calculé

    Ouvrir la fiche de Llama Nemotron Ultra →

  10. Place 10
    1En baisse de 1 placeS40 · n°9

    DeepSeek R1

    DeepSeek · Modèle open weights

    Le modèle de raisonnement qui a popularisé les poids ouverts performants

    • Coding 56
    • Reasoning 57
    • Speed 0
    • 0,96 $ /M tok
    • 128k ctx

    Global

    55,7

    16 sem. au Top · pic n°3

    DATAPourquoi ça bouge

    −1 place, freiné par Coding : 56 (0 pts).

    • SWE-bench Verified : 50,0 % (0 %)
    • LiveCodeBench : 65,0 % (0 %)
    Détails et sources

    Sous-scores

    • Coding56
    • Reasoning57
    • Maths80
    • Agents44
    • Multimodalnon évalué—
    • Long context43
    • Speed0
    • Price83
    • Value67

    Mesures · S41

    SWE-bench Verified50,0 %SWE-bench (nouvel onglet)
    LiveCodeBench65,0 %LiveCodeBench (nouvel onglet)
    GPQA Diamond76,0 %GPQA Diamond (nouvel onglet)
    Humanity's Last Exam14,0 %Humanity's Last Exam (nouvel onglet)
    AIME 202580,0 %Epoch AI (nouvel onglet)
    Terminal-Bench25,0 %Terminal-Bench (nouvel onglet)
    τ-bench55,0 %τ-bench (nouvel onglet)
    MMMU—MMMU (nouvel onglet)
    MRCR50,0 %OpenAI MRCR (nouvel onglet)
    Fenêtre de contexte128kArtificial Analysis (nouvel onglet)
    Vitesse de sortie29 tok/sArtificial Analysis (nouvel onglet)
    Prix mixte0,96 $calculé

    Ouvrir la fiche de DeepSeek R1 →

Bubbling under · juste derrière le Top 10

Out · sortis du Top 10 cette semaine

Hall of #1 · qui a tenu la tête

  1. Kimi K2

    S26–S28 · 3 sem.

  2. DeepSeek V3.2

    en cours · S29–S41 · 13 sem.

DeepSeek V3.2 : 13 semaines / 16Kimi K2 : 3 semaines / 16

Classement open-source-ai

Épisodes liés

Dans les podcasts

Sandbox · EP. 42

Claude Code passe #1, et ce que ça dit des agents de code

1 h 16

6 oct. 2026

Épisode 42 · 6 oct. 2026 · 1 h 16

Première place pour Claude Code au GitHub Top 10, adk-python qui bondit de quatre rangs, Gemini 3 Pro qui revient sur le podium : on décortique les mouvements de la semaine 41.

Agents · Coding · Benchmarks

À propos de l’épisode

Première place pour Claude Code au GitHub Top 10, adk-python qui bondit de quatre rangs, Gemini 3 Pro qui revient sur le podium : on décortique les mouvements de la semaine 41.

Voir la fiche de l’épisode →
Sandbox · EP. 41

Poids ouverts : la remontada, graphique par graphique

1 h 10

29 sept. 2026

Épisode 41 · 29 sept. 2026 · 1 h 10

DeepSeek en tête depuis douze semaines, Kimi qui s'accroche, Qwen qui se met à jour : où en sont vraiment les modèles ouverts face aux propriétaires ?

Open source · Modèles · Infra et inférence

À propos de l’épisode

DeepSeek en tête depuis douze semaines, Kimi qui s'accroche, Qwen qui se met à jour : où en sont vraiment les modèles ouverts face aux propriétaires ?

Voir la fiche de l’épisode →

18 candidats suivis cette semaine. Les rangs au-delà du Top 10 sont affichés pour le contexte (« bubbling under »). Relevé du 6 octobre 2026. Méthodologie.