Accueil · Les modèles
Les modèles
Un état daté du paysage des modèles d'IA générative, trié d'abord par ce qu'on peut réellement héberger soi-même. Ce n'est pas un classement. Chaque ligne porte la date de sa dernière vérification ; celles qui n'en ont pas le disent. Ce que change vraiment la distinction « poids ouverts » / « fermé » est expliqué dans T5.2 — Ouvert contre fermé.
Les dernières sorties
Les 10 modèles les plus récents du registre, du plus récent au plus ancien. La date est celle de la disponibilité publique déclarée par l'éditeur — pas celle de l'annonce.
| Modèle | Éditeur | Sortie | Ouverture | Chez soi | Usages | Vérification |
|---|---|---|---|---|---|---|
| Gemini 3.7 Flash Statut « stable » au 16/08/2026. Présenté par Google comme sa version Flash la plus capable, orientée code complexe, flux agentiques et exécution multi-étapes. Deux versions Flash l'ont précédée de peu : Gemini 3.6 Flash le 21/07/2026, puis celle-ci le 13/08 — la ligne Flash bouge vite, une fiche de ce type se démode en semaines. |
Google DeepMind États-Unis | 13/08/2026 | Fermé | sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Grok 4.6 Succède à Grok 4.5 ; xAI dit se concentrer sur « les agents à longue durée d'exécution et les travaux interactifs et visuels plus ambitieux ». Tarif annoncé : 2 $ par million de tokens en entrée, 6 $ en sortie, avec une variante « fast » au double. Aucun rang de gamme ne lui est attribué ici : xAI ne situe pas ce modèle dans une hiérarchie sur sa page d'annonce, et sa documentation en propose d'autres à la fenêtre de contexte plus large (1 million de tokens contre 500 000). L'éditeur revendique par ailleurs un score égal à GPT-5.6 Sol sur l'Artificial Analysis Intelligence Index — c'est sa parole, le classement lui-même n'ayant pas été consulté pour cette fiche. |
xAI États-Unis | 12/08/2026 | Fermé | sans objet | Texte, Code | vérifié il y a 14 jours |
| Nemotron 3.5 Lightning (30B-A3B) Entrée qui n'existerait pas sans une exception écrite : la règle de tri « variante BF16 » l'écartait, alors que chez Nvidia le dépôt sans suffixe est FERMÉ (HTTP 401) et que le BF16 est la seule forme publiquement accessible. Cf. `ADMIS_MALGRE_REGLE` dans tech-site/sonde-tri.ts. Sur le fond, l'architecture est le point : Mamba-2 mêlé au MoE et à l'attention, soit une alternative au tout-transformeur que le registre n'illustrait qu'avec Jamba. |
Nvidia États-Unis | 11/08/2026 | Poids ouverts | Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Grok Imagine Image 2.0 Proposée comme « Quality Mode » sur grok.com/imagine et les applications mobiles xAI, et via l'API. L'éditeur met en avant la tenue de la typographie et de la mise en page dans les visuels denses. Il revendique par ailleurs un deuxième rang mondial en génération et en édition d'image sur les classements Arena : c'est sa parole, ces classements n'ayant pas été consultés pour cette fiche. |
xAI États-Unis | 07/08/2026 | Fermé | sans objet | Image | vérifié il y a 14 jours |
| MiniMax Music 3 Génération musicale À POIDS OUVERTS avec voix chantée — l'usage « musique » du registre était jusqu'ici presque entièrement fermé (Suno, Lyria) ou instrumental. Sa fiche ne porte pas de date ; celle retenue est la création du dépôt (07/08/2026). |
MiniMax Chine | 07/08/2026 | Poids ouverts | Station de travail | Musique | vérifié il y a 14 jours |
| Qwen3.8-2.4T-A95B Tête de la génération Qwen3.8, mise en ligne en août 2026 (la fiche ne donne que le mois, d'où la date à précision mensuelle). La licence porte un nom maison, « qwen3.8-max », et non l'Apache-2.0 des autres modèles Qwen ouverts : son texte intégral n'a pas été lu lors de cette revue, la classification « poids ouverts » repose donc sur la publication des poids, pas sur une lecture des conditions. À revoir avant toute affirmation sur ce qu'elle autorise. |
Alibaba Chine | 08/2026 | Poids ouverts | Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Qwen3.8-27B Volet vision-langage de la génération Qwen3.8, sous Apache-2.0 — contraste avec la licence maison de la tête 2.4T de la même génération : chez cet éditeur, l'ouverture se décide modèle par modèle, pas génération par génération. |
Alibaba Chine | 08/2026 | Poids ouverts | Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| North Micro Vision Instruct Cohere le présente explicitement comme une base pour prototyper et spécialiser, PAS comme un assistant conversationnel — franchise rare sur une fiche de modèle, et utile au lecteur qui choisit. Date à précision mensuelle (dépôt créé le 10/08/2026). |
Cohere Canada | 08/2026 | Poids ouverts | Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| DeepSeek-V4-Flash-0731 DeepSeek publie sur sa propre fiche des scores où ce modèle devance V4-Pro (preview) malgré un nombre de paramètres activés bien moindre — Terminal Bench 2.1 à 82,7 contre 72,1, DeepSWE à 54,4 contre 12,8. Chiffres de l'éditeur sur ses propres modèles : rapportés ici, non repris en `mesures` faute de mesure indépendante. |
DeepSeek Chine | 31/07/2026 | Poids ouverts | Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| MiniMax-H3 Génération vidéo À POIDS OUVERTS, avec audio stéréo produit dans la même passe — le registre ne comptait presque que des modèles fermés sur cet usage. La fiche ne donne pas de date ; celle retenue est la création du dépôt (28/07/2026). |
MiniMax Chine | 28/07/2026 | Poids ouverts | Serveur multi-GPU | Vidéo, Musique | vérifié il y a 14 jours |
Explorer le registre
Les 215 modèles, filtrables et triables. Les sections suivantes répondent chacune à une question choisie d'avance ; celle-ci répond aux vôtres, y compris quand elles se croisent — « du texte, à poids ouverts, qui tourne sur une carte de joueur » n'est lisible nulle part ailleurs. Le filtre de vérification sert aussi à celui qui tient le registre à jour : il montre ce qui attend une relecture.
Aucun modèle ne correspond à ces critères.
| Modèle | Éditeur | Sortie | Ouverture | Chez soi | Usages | Vérification |
|---|---|---|---|---|---|---|
| Gemini 3.7 Flash Contexte 1 048 576 tokens en entrée / 65 536 en sortie ; entrée texte, image, vidéo, audio, PDF ; sortie texte. |
Google DeepMind États-Unis | 13/08/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Grok 4.6 500 000 tokens de contexte ; entrée et sortie texte ; connaissances arrêtées au 1er février 2026. |
xAI États-Unis | 12/08/2026 | Fermé propriétaire — API |
sans objet | Texte, Code | vérifié il y a 14 jours |
| Nemotron 3.5 Lightning (30B-A3B) 30 milliards de paramètres au total, 3 milliards actifs ; architecture hybride Mamba-2 + MoE + attention ; contexte jusqu'à 1 million de tokens (256K sur un seul H100, limite mémoire) ; texte uniquement. |
Nvidia États-Unis | 11/08/2026 | Poids ouverts OpenMDW 1.1 |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Grok Imagine Image 2.0 Génération et édition d'image ; entrées texte et image, jusqu'à cinq images de référence en édition multi-références ; facturé 0,04 $ par image produite. |
xAI États-Unis | 07/08/2026 | Fermé propriétaire — API |
sans objet | Image | vérifié il y a 14 jours |
| MiniMax Music 3 Chansons complètes jusqu'à cinq minutes, en WAV stéréo 32 kHz / 16 bits, à partir de paroles et d'une description ; architecture à deux étages — un modèle de 8 Md pour la structure musicale longue et un de 0,6 Md pour le détail acoustique ; sections intro/couplet/refrain/pont pilotables. |
MiniMax Chine | 07/08/2026 | Poids ouverts Creative Commons (texte complet dans le dépôt) |
Station de travail | Musique | vérifié il y a 14 jours |
| Qwen3.8-2.4T-A95B 2 400 milliards de paramètres au total, 95 milliards actifs (MoE, 512 experts dont 11 activés par token) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; texte uniquement, mode « thinking » imposé. |
Alibaba Chine | 08/2026 | Poids ouverts qwen3.8-max (licence maison Alibaba) |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Qwen3.8-27B 27 milliards de paramètres ; contexte natif 262 144 tokens, extensible à ~1 000 000 ; modèle vision-langage natif acceptant image ET vidéo en entrée, sortie texte. |
Alibaba Chine | 08/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| North Micro Vision Instruct 2,4 milliards de paramètres (2 Md pour le modèle de langage, 400 M pour l'encodeur vision) ; contexte 128K tokens ; images et texte entrelacés, plusieurs images par requête ; traitement à RÉSOLUTION NATIVE, conservant le rapport d'aspect. |
Cohere Canada | 08/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| DeepSeek-V4-Flash-0731 304 milliards de paramètres au total (MoE, nombre de paramètres activés nettement inférieur à V4-Pro) ; contexte jusqu'à 384K tokens ; module de décodage spéculatif DSpark ; trois niveaux d'effort de raisonnement (low, high, max). |
DeepSeek Chine | 31/07/2026 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| MiniMax-H3 Transformer dense de 33 milliards de paramètres à flux unique, branches AdaLN par modalité, MM-RoPE tridimensionnel ; entrée texte, jusqu'à 9 images, 3 clips vidéo et 3 clips audio ; sortie VIDÉO avec son stéréo natif, jusqu'à 2K, 24 images/s, 15 secondes. |
MiniMax Chine | 28/07/2026 | Poids ouverts MiniMax H3 Community License Agreement |
Serveur multi-GPU | Vidéo, Musique | vérifié il y a 14 jours |
| Claude Opus 5 1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 24/07/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Gemini 3.6 Flash Contexte 1 048 576 tokens en entrée / 65 536 en sortie ; entrée texte, image, vidéo, audio, PDF ; sortie texte. |
Google DeepMind États-Unis | 21/07/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Cosmos3-Edge 4 milliards de paramètres entraînables ; entrée texte, images et trajectoires d'action (JSON) ; sortie images, vidéos, actions et texte ; architecture « Mixture-of-Transformers » associant un transformeur autorégressif pour le texte et un transformeur de diffusion pour la synthèse multimodale continue. |
Nvidia États-Unis | 20/07/2026 | Poids ouverts OpenMDW 1.1 |
Carte graphique de joueur | Texte, Image, Vidéo | vérifié il y a 14 jours |
| GPT-5.6 Sol ≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
OpenAI États-Unis | 09/07/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| GPT-5.6 Terra ≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
OpenAI États-Unis | 09/07/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| GPT-5.6 Luna ≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
OpenAI États-Unis | 09/07/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Muse Spark 1.1 1 M tokens de contexte ; multimodal texte/image/vidéo/PDF en entrée, raisonnement agentique (usage d'outils, contrôle d'ordinateur, code) |
Meta États-Unis | 09/07/2026 | Fermé propriétaire — accès via API uniquement (Meta Model API, preview publique), aucun poids publié |
sans objet | Texte, Code, Image, Vidéo, Voix | vérifié il y a 14 jours |
| Granite SWASH 2B 2,14 milliards de paramètres ; transformeur dense décodeur seul à attention HYBRIDE — attention complète sur 7 couches, attention à fenêtre glissante (128) sur 17 autres, plus des « puits d'attention » appris ; anglais. |
IBM États-Unis | 07/07/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte | vérifié il y a 13 jours |
| Fara 1.5 4B 4 milliards de paramètres ; contexte 262 144 tokens ; agent d'usage du navigateur par capture d'écran, comme ses aînés ; ajusté à partir de Qwen3.5-4B. |
Microsoft États-Unis | 07/2026 | Poids ouverts MIT |
Carte graphique de joueur | Vision, Texte, Code | vérifié il y a 13 jours |
| Fara 1.5 27B 27 milliards de paramètres ; contexte 262 144 tokens ; perception UNIQUEMENT par capture d'écran (aucun accès au DOM) ; actions ancrées en coordonnées, au pixel près ; sortie raisonnement + appels d'outils. |
Microsoft États-Unis | 07/2026 | Poids ouverts MIT |
Station de travail | Vision, Texte, Code | vérifié il y a 13 jours |
| VibeVoice-ASR-BitNet 0,3 milliard de paramètres ; reconnaissance vocale multilingue compressée de 4,62 à 1,58 Go (quantification hétérogène I8_S + I2_S/Q6_K) ; temps réel SANS GPU, sur processeur x86 AVX2 ou ARM NEON, à partir de 3 fils d'exécution. |
Microsoft États-Unis | 07/2026 | Poids ouverts MIT |
Portable récent | Voix | vérifié il y a 14 jours |
| Mage-VL 5 milliards de paramètres ; encodeur visuel Mage-ViT entraîné de zéro sur une base linguistique Qwen3-4B ; entrée images et vidéo, y compris flux encodés H.264/HEVC et codecs neuronaux ; sortie texte ; analyse hors ligne, flux temps réel et ancrage temporel. |
Microsoft États-Unis | 07/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| Shieldstral 1.0 3B 3 milliards de paramètres ; classifieur de sûreté acceptant une politique en LANGAGE NATUREL au moment de l'inférence et rendant un score continu ; contenu texte seul, image seule ou mixte ; 12 langues ; une seule passe avant, pour la modération en temps réel sur appareil. |
Mistral AI France | 07/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Vision | vérifié il y a 14 jours |
| Hy3 295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; même architecture que la preview, post-entraînement élargi. |
Tencent Chine | 07/2026 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| LTX-2.5 22 milliards de paramètres (versions distillée et complète) ; texte-vers-vidéo, image-vers-vidéo, vidéo-vers-vidéo ; jusqu'à 121 images à 24 im/s ; audio synchronisé via VAE audio et vocodeur dédiés ; encodeur de texte Gemma 4 12B personnalisé. |
Lightricks Israël | 07/2026 | Poids ouverts LTX-2 Community License Agreement |
Serveur multi-GPU | Vidéo, Musique | vérifié il y a 14 jours |
| Claude Sonnet 5 1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 30/06/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Qwen3-ASR-1.7B Reconnaissance vocale avec identification de langue sur 52 langues et dialectes (30 langues + 22 dialectes chinois) ; inférence en flux ou hors ligne ; audio long, parole chantée et chansons avec fond musical ; consignes de contexte et mots-clés pour orienter la transcription. |
Alibaba Chine | 26/06/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| Qwen3-ASR-0.6B Même périmètre fonctionnel que la 1.7B (52 langues et dialectes, flux ou hors ligne) pour un tiers de la taille. |
Alibaba Chine | 26/06/2026 | Poids ouverts Apache-2.0 |
Portable récent | Voix | vérifié il y a 14 jours |
| Unlimited-OCR 3 milliards de paramètres ; contexte 32 768 tokens ; entrée image + texte, sortie texte ; traite image seule, document multi-pages et PDF, en conservant la mise en page (boîtes englobantes). |
Baidu Chine | 23/06/2026 | Poids ouverts MIT |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| Grok Imagine Video 1.5 Vidéos de 6 secondes en 720p produites en 25 secondes environ ; bruitages, ambiance et dialogue générés dans la même passe que l'image. |
xAI États-Unis | 16/06/2026 | Fermé propriétaire — API |
sans objet | Vidéo | vérifié il y a 14 jours |
| GLM-5.2 753 milliards de paramètres au total (MoE, ~39-40 milliards actifs selon des sources secondaires convergentes, 256 experts) ; contexte jusqu'à 1 million de tokens. |
Z.ai (ex-Zhipu AI) Chine | 16/06/2026 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Kimi-K2.7-Code 1 000 milliards de paramètres au total, 32 milliards actifs (MoE) ; contexte 256 000 tokens ; accepte désormais image et vidéo en entrée, orienté code agentique long-horizon. |
Moonshot AI Chine | 15/06/2026 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Code, Texte, Vision | vérifié il y a 14 jours |
| Claude Fable 5 1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 09/06/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Claude Mythos 5 1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête (specs identiques à Claude Fable 5) |
Anthropic États-Unis | 09/06/2026 | Fermé propriétaire — accès restreint (Project Glasswing, sur invitation uniquement) |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Ray3.2 Résolutions 360p à 1080p ; 5 ou 10 s en texte/image-vers-vidéo, jusqu'à 20 s en modification vidéo (V2V) selon la fréquence d'image choisie. |
Luma AI États-Unis | 09/06/2026 | Fermé propriétaire — application/API |
sans objet | Vidéo | vérifié il y a 14 jours |
| Gemma 4 12B Contexte 256K tokens ; architecture « encodeur-free » unifiée (projette directement patches d'image et forme d'onde audio dans l'espace d'embedding) ; entrée texte + image + audio, sortie texte. |
Google DeepMind États-Unis | 03/06/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Vision | vérifié il y a 14 jours |
| MAI-Thinking-1 256K tokens de contexte ; ~35 milliards de paramètres actifs sur ~1 000 milliards au total (Mixture-of-Experts épars) ; entraîné from scratch sans distillation, sur données commerciales propres. |
Microsoft États-Unis | 02/06/2026 | Fermé propriétaire — API |
sans objet | Texte, Code | vérifié il y a 14 jours |
| MAI-Voice-2 Génération vocale texte-vers-parole ; voix mono-locuteur en disponibilité générale, multi-locuteurs annoncé en préversion au moment de la consultation. |
Microsoft États-Unis | 02/06/2026 | Fermé propriétaire — API |
sans objet | Voix | vérifié il y a 14 jours |
| MiniMax-M3 428 milliards de paramètres au total, 23 milliards actifs (MoE, architecture Sparse Attention MSA) ; contexte jusqu'à 1 million de tokens ; entrées texte, image et vidéo natives dès l'entraînement. |
MiniMax Chine | 01/06/2026 | Poids ouverts MiniMax Community License |
Serveur multi-GPU | Texte, Code, Vision, Vidéo | vérifié il y a 14 jours |
| DiffusionGemma 26B A4B 25,2 milliards de paramètres au total, 3,8 milliards actifs ; contexte 256K tokens ; entrée texte, image et vidéo, sortie texte. |
Google DeepMind États-Unis | 06/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen-AgentWorld-35B-A3B 35 milliards de paramètres au total, 3 milliards actifs (MoE) ; contexte 262 144 tokens ; texte uniquement. |
Alibaba Chine | 06/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte | vérifié il y a 14 jours |
| Kimi-K3 2 800 milliards de paramètres au total, 104 milliards actifs (MoE, 16 experts sur 896 par token) ; contexte 1 048 576 tokens ; entrée texte, image et vidéo, sortie texte. |
Moonshot AI Chine | 06/2026 | Poids ouverts Kimi K3 License |
Serveur multi-GPU | Texte, Code, Vision | vérifié il y a 14 jours |
| Nemotron Parse 2.0 Moins d'un milliard de paramètres ; transforme une image de document en représentation structurée — texte, classes de mise en page, boîtes englobantes et ORDRE DE LECTURE ; titres, tableaux, graphiques, pieds de page. |
Nvidia États-Unis | 06/2026 | Poids ouverts NVIDIA Open Model License (tokenizer en CC-BY-4.0) |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| North Mini Code 1.0 30 milliards de paramètres au total, 3 milliards actifs (MoE épars) ; contexte 256K en entrée, 64K en sortie ; appel d'outils et réflexion entrelacée pour le codage autonome. |
Cohere Canada | 06/2026 | Poids ouverts Apache-2.0 |
Station de travail | Code, Texte | vérifié il y a 14 jours |
| Cohere Transcribe Arabic (07-2026) 2 milliards de paramètres ; encodeur-décodeur conformer ; arabe standard moderne ET dialectes, anglais, et parole mêlant les deux (code-switching). |
Cohere Canada | 06/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| Claude Opus 4.8 1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 28/05/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Nano Banana 2 Contexte 131 072 tokens en entrée / 32 768 en sortie ; entrée texte, image, PDF ; sortie image ET texte. |
Google DeepMind États-Unis | 28/05/2026 | Fermé propriétaire — API |
sans objet | Image | vérifié il y a 14 jours |
| Stable Audio 3 Small Compositions jusqu'à 6 min 20 s ; explicitement optimisé par l'éditeur pour générer sur appareil mobile. |
Stability AI Royaume-Uni | 20/05/2026 | Poids ouverts Stability AI Community License |
Portable récent | Musique | vérifié il y a 14 jours |
| Stable Audio 3 Large Compositions jusqu'à 6 min 20 s, positionné par l'éditeur pour la production sonore de niveau entreprise. |
Stability AI Royaume-Uni | 20/05/2026 | Fermé propriétaire — API |
sans objet | Musique | vérifié il y a 14 jours |
| Gemini 3.5 Flash Contexte 1M tokens en entrée / 64K en sortie ; entrée texte, image, vidéo, audio, PDF ; sortie texte. |
Google DeepMind États-Unis | 19/05/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Stable Audio 3 Medium 2 milliards de paramètres ; composition de plusieurs minutes ; « inpainting » (retouche ciblée d'un passage) et continuation d'un extrait ; l'éditeur annonce moins de 2 s de génération sur GPU H200 et quelques secondes sur un MacBook Pro M4. |
Stability AI Royaume-Uni | 17/05/2026 | Poids ouverts Stability AI Community License |
Carte graphique de joueur | Musique | vérifié il y a 14 jours |
| Uni-1.1 API avec génération (create_image) et édition d'image par instruction (modify_image) ; jusqu'à 9 images de référence pour le style, le personnage ou le contenu. |
Luma AI États-Unis | 05/05/2026 | Fermé propriétaire — API |
sans objet | Image | vérifié il y a 14 jours |
| Granite Switch 4.1 3B (preview) 3 milliards de paramètres ; contexte 131 072 tokens ; un SEUL jeu de poids portant 12 adaptateurs spécialisés (RAG, sûreté, explicabilité), choisis à l'inférence par des jetons de contrôle via une couche d'aiguillage légère. |
IBM États-Unis | 05/05/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte | vérifié il y a 13 jours |
| Magenta RealTime 2 Deux tailles — 2,4 milliards de paramètres (base) et 230 millions (small) ; génération musicale CONTINUE en flux, pilotée par consigne texte, exemple audio et MIDI ; latence d'environ 200 ms, sur l'appareil. |
Google DeepMind États-Unis | 05/2026 | Poids ouverts Code en Apache-2.0, poids en CC BY 4.0 |
Carte graphique de joueur | Musique | vérifié il y a 13 jours |
| Fara 1.5 9B 9 milliards de paramètres ; contexte 262 144 tokens ; observe le navigateur par CAPTURES D'ÉCRAN et agit par appels d'outils structurés (clic, saisie, défilement, ouverture d'URL, recherche) jusqu'à l'accomplissement de la tâche. |
Microsoft États-Unis | 05/2026 | Poids ouverts MIT |
Carte graphique de joueur | Vision, Texte, Code | vérifié il y a 14 jours |
| Hy-MT2-7B 7 milliards de paramètres (dense) ; traduction entre 33 langues ; suivi de consignes de traduction multilingues. |
Tencent Chine | 05/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte | vérifié il y a 13 jours |
| Hy-MT2-30B-A3B 30 milliards de paramètres (MoE) ; traduction entre 36 langues ; suivi de consignes de traduction, gestion terminologique, adaptation de style et traduction de données structurées. |
Tencent Chine | 05/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte | vérifié il y a 13 jours |
| Hy-MT2-1.8B 1,8 milliard de paramètres ; traduction entre 33 langues et suivi de consignes de traduction dans plusieurs langues ; quantification extrême ramenant le modèle à 440 Mo pour une inférence 1,5 fois plus rapide, selon l'éditeur. |
Tencent Chine | 05/2026 | Poids ouverts Apache-2.0 |
Portable récent | Texte | vérifié il y a 14 jours |
| Command A+ (05-2026) 218 milliards de paramètres au total, 25 milliards actifs ; contexte 128K en entrée, 64K en sortie ; entrée texte et image, sortie texte ; 48 langues. |
Cohere Canada | 05/2026 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code, Vision | vérifié il y a 14 jours |
| Midjourney V8.1 Images HD jusqu'à 2048 px (2K) sans upscaling ; rendu standard 4 à 5 fois plus rapide que les versions précédentes selon l'éditeur. |
Midjourney États-Unis | 30/04/2026 | Fermé propriétaire — service en ligne (Discord/web) |
sans objet | Image | vérifié il y a 1 mois |
| Granite 4.1 (30B) 131 072 tokens de fenêtre de contexte |
IBM États-Unis | 29/04/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code | vérifié il y a 14 jours |
| Granite Speech 4.1 2B Plus 2 milliards de paramètres ; reconnaissance vocale ATTRIBUÉE PAR LOCUTEUR (étiquettes « [Speaker 1] ») et horodatage au MOT près ; anglais, français, allemand, espagnol, portugais. |
IBM États-Unis | 28/04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| DeepSeek-V4-Pro 1 600 milliards de paramètres au total, 49 milliards actifs (MoE) ; fenêtre de contexte 1 million de tokens. |
DeepSeek Chine | 24/04/2026 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| DeepSeek-V4-Flash 284 milliards de paramètres au total, 13 milliards actifs (MoE) ; fenêtre de contexte 1 million de tokens. |
DeepSeek Chine | 24/04/2026 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Qwen3.6-27B Modèle dense, orienté code agentique et « préservation de la pensée » entre itérations ; contexte annoncé 262 144 tokens en déploiement (SGLang/vLLM). |
Alibaba Chine | 22/04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Code, Texte | vérifié il y a 14 jours |
| MiniMax-M2.7 229 milliards de paramètres au total (MoE). |
MiniMax Chine | 20/04/2026 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Claude Opus 4.7 1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 16/04/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Qwen3.6-35B-A3B 35 milliards de paramètres au total (MoE) ; contexte annoncé 262 144 tokens en déploiement. Part active non précisée dans le README consulté. |
Alibaba Chine | 16/04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Code, Texte | vérifié il y a 14 jours |
| Mistral Medium 3.5 256 k tokens de contexte ; 128 Md paramètres (dense) |
Mistral AI France | 04/2026 | Poids ouverts Modified MIT License (Mistral AI) |
Serveur multi-GPU | Texte, Code, Image | vérifié il y a 14 jours |
| Kimi-K2.6 1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts dont 8 par token + 1 partagé, 61 couches) ; contexte 256 000 tokens ; encodeur vision MoonViT de 400 M de paramètres ; vidéo annoncée en expérimental via l'API. |
Moonshot AI Chine | 04/2026 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code, Vision | vérifié il y a 14 jours |
| GLM-5.1 ~754 milliards de paramètres ; architecture MoE à attention éparse (GLM_MOE_DSA) ; texte uniquement. |
Z.ai (ex-Zhipu AI) Chine | 04/2026 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Hy3-preview 295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; 64 têtes d'attention (GQA, 8 têtes KV) ; texte uniquement. |
Tencent Chine | 04/2026 | Poids ouverts Tencent Hy Community License Agreement |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Granite Guardian 4.1 8B Modèle de garde : juge une entrée ou une sortie de LLM contre un critère et répond oui/non ; détecteurs prêts pour les contournements de consigne, la vulgarité et l'hallucination en RAG ; critères personnalisés acceptés ; mode « thinking » avec trace de raisonnement ou mode direct. |
IBM États-Unis | 04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte | vérifié il y a 14 jours |
| Granite 4.1 3B 3 milliards de paramètres ; transformeur dense décodeur seul (40 couches, 40 têtes d'attention, 8 têtes KV, dimension 2 560) ; contexte 131 072 tokens ; 12 langues ; complétion de code « fill-in-the-middle ». |
IBM États-Unis | 04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Granite Speech 4.1 2B 2 milliards de paramètres ; reconnaissance vocale multilingue ET traduction vocale bidirectionnelle ; anglais, français, allemand, espagnol, portugais, japonais ; ponctuation et majuscules restituées ; reconnaissance orientable par mots-clés. |
IBM États-Unis | 04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| Granite Vision 4.1 4B 4 milliards de paramètres (3,4 Md pour le modèle de langage, 0,6 Md pour l'encodeur vision et les projecteurs) ; entrée consignes en anglais + images PNG/JPEG, sortie texte structuré (CSV, JSON, HTML, OTSL, code Python). |
IBM États-Unis | 04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| Granite 4.1 8B 8 milliards de paramètres ; transformeur dense décodeur seul (GQA, RoPE, SwiGLU, RMSNorm, embeddings d'entrée et de sortie partagés) ; contexte 131 072 tokens ; 12 langues. |
IBM États-Unis | 04/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Gemma 4 26B A4B 25,2 milliards de paramètres au total, 3,8 milliards actifs (MoE, 8 experts activés sur 128 + 1 partagé) ; contexte 256K tokens ; attention hybride (fenêtre glissante locale de 1024 tokens + attention globale) ; entrée texte et image, sortie texte ; plus de 140 langues. |
Google DeepMind États-Unis | 31/03/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| Gemma 4 E2B ~2,3 milliards de paramètres effectifs (5,1 Md avec les embeddings) ; contexte 128K tokens ; entrée texte, image ET audio, sortie texte ; annoncé pour téléphones haut de gamme et portables. |
Google DeepMind États-Unis | 31/03/2026 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code, Vision | vérifié il y a 14 jours |
| Gemma 4 31B 256K tokens de contexte ; 30,7 milliards de paramètres (dense) ; entrée texte + image, sortie texte ; poids non quantifiés testés sur GPU NVIDIA H100 80GB, versions quantifiées disponibles pour GPU grand public. |
Google DeepMind États-Unis | 31/03/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| Gemma 4 E4B 128K tokens de contexte ; ~4,5 milliards de paramètres effectifs (8B avec les embeddings), technique « Per-Layer Embeddings » ; entrée texte + image + audio, sortie texte ; conçu pour mobile, Raspberry Pi, NVIDIA Jetson Orin Nano. |
Google DeepMind États-Unis | 31/03/2026 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code, Vision | vérifié il y a 14 jours |
| Suno v5.5 | Suno États-Unis | 26/03/2026 | Fermé propriétaire — application/API |
sans objet | Musique | vérifié il y a 14 jours |
| Cohere Transcribe (03-2026) 2 milliards de paramètres ; architecture encodeur-décodeur de type conformer ; entrée audio (rééchantillonné à 16 kHz), sortie texte ; 14 langues (9 européennes, 4 APAC, arabe). |
Cohere Canada | 26/03/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| Voxtral TTS Synthèse vocale (TTS) streaming faible latence, clonage de voix zero-shot, sortie audio 24 kHz, 20 voix prédéfinies |
Mistral AI France | 23/03/2026 | Poids ouverts CC BY-NC 4.0 |
Portable récent | Voix | vérifié il y a 14 jours |
| Mistral Small 4 256 k tokens de contexte ; 119 Md paramètres au total / 6 Md actifs par token (128 experts, 4 actifs) |
Mistral AI France | 16/03/2026 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code, Image | vérifié il y a 14 jours |
| GLM-OCR Environ 0,9 à 1 milliard de paramètres ; OCR de documents complexes (mise en page, formules, tableaux). |
Z.ai (ex-Zhipu AI) Chine | 11/03/2026 | Poids ouverts MIT |
Portable récent | Vision, Texte | vérifié il y a 14 jours |
| Granite 4.0 1B Speech 1 milliard de paramètres (2 Md avec le projecteur) ; reconnaissance vocale multilingue et traduction vocale bidirectionnelle ; anglais, français, allemand, espagnol, portugais, japonais ; encodeur audio + projecteur à sous-échantillonnage temporel + modèle de langage. |
IBM États-Unis | 06/03/2026 | Poids ouverts Apache-2.0 |
Portable récent | Voix | vérifié il y a 14 jours |
| Phi-4-reasoning-vision-15B 15 milliards de paramètres ; contexte 16 384 tokens ; backbone Phi-4-Reasoning + encodeur vision SigLIP-2 (architecture mid-fusion) ; raisonnement visuel sur graphiques, diagrammes, mises en page de documents. |
Microsoft États-Unis | 04/03/2026 | Poids ouverts MIT |
Station de travail | Texte, Vision | vérifié il y a 14 jours |
| Qianfan-OCR 4 milliards de paramètres ; image vers Markdown en direct ; analyse de mise en page, extraction de tableaux, reconnaissance de formules, compréhension de graphiques, extraction d'informations clés ; 192 langues ; mécanisme optionnel « Layout-as-Thought » produisant l'analyse de structure avant la sortie finale. |
Baidu Chine | 03/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| LTX-2.3 22 milliards de paramètres ; modèle de fondation audio-vidéo à base de DiT produisant image ET son synchronisés en une seule passe ; texte-vers-vidéo et image-vers-vidéo ; sur-échantillonneurs spatial et temporel fournis. |
Lightricks Israël | 03/2026 | Poids ouverts LTX-2 Community License Agreement |
Serveur multi-GPU | Vidéo, Musique | vérifié il y a 14 jours |
| Gemini 3.1 Pro Contexte 1M tokens en entrée / 64K en sortie ; entrée texte, image, audio, vidéo, PDF ; sortie texte ; connaissances arrêtées janvier 2025. |
Google DeepMind États-Unis | 19/02/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Lyria 3 Génération de musique à partir de texte, instrumental ou avec voix/paroles ; diffusion latente appliquée à l'audio. |
Google DeepMind États-Unis | 18/02/2026 | Fermé propriétaire — API |
sans objet | Musique | vérifié il y a 14 jours |
| Claude Sonnet 4.6 1 000 000 tokens de contexte (bêta) ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 17/02/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Claude Opus 4.6 1 000 000 tokens de contexte (bêta, première génération Opus à ce palier) ; jusqu'à 128 000 tokens de sortie par requête |
Anthropic États-Unis | 05/02/2026 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Voxtral Mini 4B Realtime 4 milliards de paramètres ; transcription multilingue EN TEMPS RÉEL, architecture nativement en flux ; délai configurable de 240 ms à 2,4 s ; 13 langues ; l'éditeur annonce une précision comparable aux systèmes hors ligne à partir de 480 ms de délai. |
Mistral AI France | 02/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| Qwen3.5-397B-A17B 397 milliards de paramètres au total, 17 milliards actifs (MoE épars couplé à des « Gated Delta Networks », 512 experts dont 11 activés, 60 couches) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo ; 201 langues. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-122B-A10B 122 milliards de paramètres au total, 10 milliards actifs (MoE épars couplé à des « Gated Delta Networks », 48 couches) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo, sortie texte ; 201 langues et dialectes annoncés. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-35B-A3B 35 milliards de paramètres au total, 3 milliards actifs (MoE épars, 256 experts dont 8 routés + 1 partagé par token) ; contexte natif 262 144 tokens, extensible à ~1 010 000 par YaRN ; entrée texte, image et vidéo. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-27B 27 milliards de paramètres (dense) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; encodeur vision intégré — entrée texte, image et vidéo, sortie texte. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-4B 4 milliards de paramètres ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo, sortie texte. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-2B 2 milliards de paramètres ; contexte natif 262 144 tokens ; entrée texte, image et vidéo, sortie texte. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-0.8B 0,8 milliard de paramètres ; contexte natif 262 144 tokens ; entrée texte, image et vidéo, sortie texte. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code, Vision | vérifié il y a 14 jours |
| Qwen3.5-9B 9 milliards de paramètres ; contexte natif 262 144 tokens, extensible à ~1 010 000 par mise à l'échelle RoPE ; modèle causal à encodeur vision intégré — entrée texte, image et vidéo, sortie texte. |
Alibaba Chine | 02/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Vision | vérifié il y a 14 jours |
| GLM-5 744 milliards de paramètres au total, 40 milliards actifs (MoE) ; attention éparse de type DSA ; pré-entraînement porté de 23 000 à 28 500 milliards de tokens par rapport à GLM-4.5 ; texte uniquement. |
Z.ai (ex-Zhipu AI) Chine | 02/2026 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| MiniMax-M2.5 229 milliards de paramètres au total ; nombre de paramètres activés non précisé sur la fiche consultée ; fenêtre de contexte non précisée non plus. |
MiniMax Chine | 02/2026 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Eleven v3 70 langues et plus, balises audio (« audio tags ») pour le contrôle émotionnel ; positionné par l'éditeur pour la voix off à fort enjeu (documentaire, audiobook), pas le temps réel. |
ElevenLabs États-Unis | 02/2026 | Fermé propriétaire — API |
sans objet | Voix | vérifié il y a 14 jours |
| Kimi-K2.5 1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts dont 8 par token) ; contexte 256K tokens ; encodeur vision MoonViT de 400 M ; pré-entraînement continu sur ~15 000 milliards de tokens mixtes texte et image. |
Moonshot AI Chine | 29/01/2026 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code, Vision | vérifié il y a 14 jours |
| FLUX.2 [klein] 4B 4 milliards de paramètres, environ 8 Go de VRAM ; variante distillée orientée vitesse (« interactive visual intelligence »). |
Black Forest Labs Allemagne | 15/01/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Image | vérifié il y a 14 jours |
| LTX-2 Vidéo native 4K à 50 images/seconde avec audio synchronisé (voix comprise), clips jusqu'à 20 secondes. |
Lightricks Israël | 06/01/2026 | Poids ouverts LTX-2 Community License Agreement |
Carte graphique de joueur | Vidéo | vérifié il y a 14 jours |
| Jamba2 3B 3 milliards de paramètres ; architecture hybride SSM-Transformer ; contexte 256K tokens ; conçu pour l'exécution sur mobile et matériel grand public. |
AI21 Labs Israël | 06/01/2026 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| DeepSeek-OCR-2 3 milliards de paramètres ; résolution dynamique (l'image est traitée à plusieurs échelles) ; deux modes — conversion de document en markdown, ou OCR libre sans conservation de la mise en page. |
DeepSeek Chine | 01/2026 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| GLM-Image Architecture hybride autorégressive + diffusion : générateur autorégressif ~9 milliards + décodeur de diffusion ~7 milliards ; génération et édition d'image, rendu de texte, cohérence multi-sujets. |
Z.ai (ex-Zhipu AI) Chine | 01/2026 | Poids ouverts MIT |
Carte graphique de joueur | Image | vérifié il y a 14 jours |
| Nemotron 3 Nano (30B-A3B) Fenêtre de contexte jusqu’à 1M tokens (256k par défaut sur Hugging Face pour raison de VRAM) |
Nvidia États-Unis | 15/12/2025 | Poids ouverts NVIDIA Nemotron Open Model License |
Station de travail | Texte, Code | vérifié il y a 14 jours |
| Devstral 2 256 k tokens de contexte ; 123 Md paramètres (dense) ; 72,2 % sur SWE-bench Verified (score publié par l'éditeur) |
Mistral AI France | 09/12/2025 | Poids ouverts Modified MIT License (Mistral AI) |
Serveur multi-GPU | Code, Texte | vérifié il y a 14 jours |
| Devstral Small 2 256 k tokens de contexte ; 24 Md paramètres ; 68,0 % sur SWE-bench Verified (score publié par l'éditeur) |
Mistral AI France | 09/12/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Code, Texte | vérifié il y a 14 jours |
| Nova 2 Pro Contexte 1M tokens ; raisonnement ajustable (faible/moyen/élevé), outils intégrés (interpréteur de code, recherche web), support MCP distant ; annoncé pour tâches agentiques complexes (analyse multi-documents, raisonnement vidéo, migrations logicielles). |
Amazon États-Unis | 02/12/2025 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Nova 2 Lite Contexte 1M tokens ; raisonnement ajustable, outils intégrés (interpréteur de code, recherche web) ; disponibilité générale. |
Amazon États-Unis | 02/12/2025 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Nova 2 Sonic Contexte 1M tokens (sortie max 64K) ; conversation vocale en temps réel, entrée/sortie voix et texte en streaming bidirectionnel. |
Amazon États-Unis | 02/12/2025 | Fermé propriétaire — API |
sans objet | Voix | vérifié il y a 14 jours |
| Mistral Large 3 256 k tokens de contexte ; 675 Md paramètres au total / 41 Md actifs (mixture-of-experts épars) |
Mistral AI France | 02/12/2025 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code, Image | vérifié il y a 14 jours |
| Ministral 3 14B 256 k tokens de contexte (annoncé pour la famille) ; 14 Md paramètres |
Mistral AI France | 02/12/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Image | vérifié il y a 14 jours |
| Ministral 3 8B 256 k tokens de contexte ; 9 Md paramètres (8,4 Md langage + 0,4 Md encodeur vision) |
Mistral AI France | 02/12/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Image | vérifié il y a 14 jours |
| Ministral 3 3B 256 k tokens de contexte (annoncé pour la famille) ; 3 Md paramètres |
Mistral AI France | 02/12/2025 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code, Image | vérifié il y a 14 jours |
| DeepSeek-V3.2 685 milliards de paramètres au total (MoE). Introduit l'attention parcimonieuse DeepSeek (DSA), successeur de V3.2-Exp. |
DeepSeek Chine | 01/12/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Gen-4.5 Vidéos de 2 à 10 secondes, résolution jusqu'à 1280×720 (720p), 24 ou 25 images/seconde ; texte-vers-vidéo et image-vers-vidéo. |
Runway États-Unis | 01/12/2025 | Fermé propriétaire — application/API |
sans objet | Vidéo | vérifié il y a 1 mois |
| GLM-4.7 358 milliards de paramètres (MoE) ; contexte 131 072 tokens ; modes « Interleaved Thinking » et « Preserved Thinking » ; appel d'outils au format OpenAI. |
Z.ai (ex-Zhipu AI) Chine | 12/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| AutoGLM-Phone-9B Bâti sur GLM-4-9B ; comprend l'écran d'un téléphone par vision-langage et pilote l'appareil via ADB (Android Debug Bridge) ; planifie et exécute des séquences d'actions à partir d'une consigne en langage naturel. |
Z.ai (ex-Zhipu AI) Chine | 12/2025 | Poids ouverts MIT |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| GLM-ASR-Nano 1,5 milliard de paramètres ; transcription audio vers texte ; anglais, mandarin, cantonais et dialectes ; annoncé robuste sur la parole dialectale, chuchotée ou en réunion bruyante. |
Z.ai (ex-Zhipu AI) Chine | 12/2025 | Poids ouverts MIT |
Portable récent | Voix | vérifié il y a 14 jours |
| GLM-4.6V-Flash 9 milliards de paramètres ; contexte 128K tokens ; entrée image et texte, sortie texte et texte-image entrelacé ; appel de fonctions natif. |
Z.ai (ex-Zhipu AI) Chine | 12/2025 | Poids ouverts MIT |
Carte graphique de joueur | Texte, Vision | vérifié il y a 14 jours |
| MiniMax-M2.1 229 milliards de paramètres au total ; paramètres activés et fenêtre de contexte non précisés sur la fiche consultée. |
MiniMax Chine | 12/2025 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Chatterbox Turbo 350 millions de paramètres ; clonage vocal zero-shot, filigrane PerTh intégré à chaque extrait généré. |
Resemble AI États-Unis | 12/2025 | Poids ouverts MIT |
Carte graphique de joueur | Voix | vérifié il y a 14 jours |
| FLUX.2 [dev] 32 milliards de paramètres (VLM Mistral-3 24B + transformateur rectified-flow) ; édition d'image jusqu'à 4 mégapixels avec jusqu'à 10 images de référence. |
Black Forest Labs Allemagne | 25/11/2025 | Poids ouverts FLUX Non-Commercial License |
Station de travail | Image | vérifié il y a 14 jours |
| FLUX.2 [pro] Édition d'image jusqu'à 4 mégapixels, jusqu'à 10 images de référence (mêmes capacités annoncées que le reste de la famille FLUX.2). |
Black Forest Labs Allemagne | 25/11/2025 | Fermé propriétaire — API |
sans objet | Image | vérifié il y a 14 jours |
| Nano Banana Pro Génération et édition d'image nativement via Gemini 3 Pro ; rendu de texte long et multi-style dans l'image annoncé comme point fort par Google. |
Google DeepMind États-Unis | 20/11/2025 | Fermé propriétaire — API |
sans objet | Image | vérifié il y a 14 jours |
| OLMo 3 (32B, Base) 65 536 tokens de fenêtre de contexte (variante Base) |
Allen Institute for AI (Ai2) États-Unis | 20/11/2025 | Open source Apache-2.0 |
Station de travail | Texte, Code | vérifié il y a 14 jours |
| SAM 3 (Segment Anything Model) Segmentation/détection/suivi d'objets par concept texte, image ou masque ; mise à jour SAM 3.1 (27/03/2026) : ~7x plus rapide en suivi multi-objets sur un GPU H100 unique |
Meta États-Unis | 19/11/2025 | Poids ouverts SAM License |
Station de travail | Vision, Vidéo | vérifié il y a 14 jours |
| Kimi-K2-Thinking 1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts) ; contexte 256 000 tokens ; quantification INT4 native (entraînement conscient de la quantification). |
Moonshot AI Chine | 06/11/2025 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Claude Opus 4.5 200 000 tokens de contexte ; jusqu'à 64 000 tokens de sortie par requête |
Anthropic États-Unis | 01/11/2025 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| DeepSeek-V3.2-Speciale 685 milliards de paramètres ; attention éparse DeepSeek ; NE PREND PAS EN CHARGE l'appel d'outils — orienté exclusivement raisonnement. |
DeepSeek Chine | 11/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte | vérifié il y a 14 jours |
| Nova Premier Contexte 1M tokens (sortie max 25K), raisonnement pris en charge ; entrée texte/image/vidéo, sortie texte ; connaissances arrêtées octobre 2024 ; usages annoncés : distillation de modèle, workflows agentiques. |
Amazon États-Unis | 31/10/2025 | Fermé propriétaire — API |
sans objet | Texte, Vision | vérifié il y a 14 jours |
| Kimi-Linear-48B-A3B 48 milliards de paramètres au total, 3 milliards actifs ; contexte 1 million de tokens ; attention linéaire hybride « Kimi Delta Attention » et MLA globale dans un rapport 3:1. |
Moonshot AI Chine | 30/10/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Firefly Image Model 5 Génération en résolution native 4 mégapixels sans upscaling. |
Adobe États-Unis | 28/10/2025 | Fermé propriétaire — application/API Adobe Firefly |
sans objet | Image | vérifié il y a 14 jours |
| MiniMax-M2 230 milliards de paramètres au total, 10 milliards actifs (MoE) ; contexte évalué à 128 000 tokens. |
MiniMax Chine | 27/10/2025 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| DeepSeek-OCR 3 milliards de paramètres ; OCR et conversion document-vers-texte par compression visuelle (« optical compression »). |
DeepSeek Chine | 21/10/2025 | Poids ouverts MIT |
Portable récent | Vision, Texte | vérifié il y a 14 jours |
| Claude Haiku 4.5 200 000 tokens de contexte ; jusqu'à 64 000 tokens de sortie par requête |
Anthropic États-Unis | 01/10/2025 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| Veo 3.1 Génération vidéo avec audio natif synchronisé (dialogue, bruitages, ambiance) ; jusqu'à 4K et formats verticaux (mise à jour janvier 2026) ; 8 secondes par défaut, extension de scène pour récits plus longs. |
Google DeepMind États-Unis | 10/2025 | Fermé propriétaire — API |
sans objet | Vidéo | vérifié il y a 14 jours |
| Jamba Reasoning 3B 256K tokens de fenêtre de contexte |
AI21 Labs Israël | 10/2025 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| Sora 2 Clips de 15 à 25 secondes, son et image synchronisés |
OpenAI États-Unis | 30/09/2025 | Fermé propriétaire — API |
sans objet | Vidéo | vérifié il y a 14 jours |
| GLM-4.6 357 milliards de paramètres au total (MoE, ~32 milliards actifs selon des sources secondaires convergentes non confirmées verbatim sur la fiche officielle) ; contexte 200 000 tokens en entrée, 128 000 en sortie. |
Z.ai (ex-Zhipu AI) Chine | 30/09/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Claude Sonnet 4.5 200 000 tokens de contexte ; jusqu'à 64 000 tokens de sortie par requête |
Anthropic États-Unis | 29/09/2025 | Fermé propriétaire — API |
sans objet | Texte, Code, Image, Vision | vérifié il y a 14 jours |
| gpt-oss-safeguard-120b 117 milliards de paramètres, 5,1 milliards actifs ; tient sur un unique GPU H100 ; même rôle que la version 20b — interpréter une politique écrite et rendre une décision raisonnée — avec plus de finesse sur les politiques complexes, au prix de la latence. |
OpenAI États-Unis | 09/2025 | Poids ouverts Apache-2.0 |
Station de travail | Texte | vérifié il y a 13 jours |
| gpt-oss-safeguard-20b 21 milliards de paramètres, 3,6 milliards actifs ; modèle de raisonnement de sûreté bâti sur gpt-oss : il INTERPRÈTE une politique écrite par l'utilisateur pour filtrer entrées et sorties, et rend une décision RAISONNÉE plutôt qu'un score. |
OpenAI États-Unis | 09/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte | vérifié il y a 14 jours |
| Magistral Small 1.2 128 k tokens de contexte (qualité soutenue par l'éditeur) ; 24 Md paramètres ; encodeur vision ajouté en 1.2 |
Mistral AI France | 09/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code, Image | vérifié il y a 14 jours |
| Magistral Medium 1.2 128 k tokens de contexte (qualité soutenue par l'éditeur) ; encodeur vision ajouté en 1.2 |
Mistral AI France | 09/2025 | Fermé propriétaire — accès API uniquement |
sans objet | Texte, Code, Image | vérifié il y a 14 jours |
| DeepSeek-V3.1-Terminus 685 milliards de paramètres ; même architecture que V3.1 ; texte uniquement. |
DeepSeek Chine | 09/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 13 jours |
| DeepSeek-V3.2-Exp 685 milliards de paramètres ; attention éparse « DeepSeek Sparse Attention » (DSA) ; texte uniquement. |
DeepSeek Chine | 09/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Qwen3-Omni-30B-A3B-Instruct Architecture Thinker-Talker ; ~35 milliards de paramètres selon la fiche consultée (le nom du modèle suggère ~30 Md au total / 3 Md actifs, non confirmé explicitement). 119 langues en entrée texte, 19 en entrée vocale, 10 en sortie vocale. Contexte évalué à 32 768 tokens. |
Alibaba Chine | 09/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Vision, Voix, Vidéo | vérifié il y a 14 jours |
| Qwen3-VL-2B-Instruct 2 milliards de paramètres ; contexte natif 256 000 tokens, extensible à 1 million. |
Alibaba Chine | 09/2025 | Poids ouverts Apache-2.0 |
Portable récent | Vision, Texte | vérifié il y a 14 jours |
| Qwen3-VL-235B-A22B-Instruct 236 milliards de paramètres au total (MoE) ; contexte natif 256 000 tokens, extensible à 1 million. Comprend image, texte et vidéo. |
Alibaba Chine | 09/2025 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Vision, Texte | vérifié il y a 14 jours |
| ERNIE-4.5-21B-A3B-Thinking 21 milliards de paramètres au total, 3 milliards actifs par token ; contexte 131 072 tokens ; longueur de réflexion allongée ; usage d'outils ; texte uniquement. |
Baidu Chine | 09/2025 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code | vérifié il y a 13 jours |
| MAI-1-preview Modèle Mixture-of-Experts pré-entraîné et post-entraîné sur environ 15 000 GPU NVIDIA H100 ; ciblé sur le suivi d'instructions et les requêtes conversationnelles courantes (rédaction, résumé, tâches scolaires). |
Microsoft États-Unis | 28/08/2025 | Fermé propriétaire — API |
sans objet | Texte | vérifié il y a 14 jours |
| Seed-OSS-36B-Instruct 36 milliards de paramètres denses ; contexte natif entraîné jusqu'à 512 000 tokens ; budget de raisonnement ajustable par l'utilisateur. |
ByteDance Chine | 20/08/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| GLM-4.7-Flash 31 milliards de paramètres au total, 3 milliards actifs (MoE) ; contexte 131 072 tokens. |
Z.ai (ex-Zhipu AI) Chine | 08/08/2025 | Poids ouverts MIT |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Qwen-Image 20 milliards de paramètres ; génération et édition d'image (transfert de style, manipulation d'objets, édition de texte incrusté), rendu de texte complexe. |
Alibaba Chine | 04/08/2025 | Poids ouverts Apache-2.0 |
Station de travail | Image | vérifié il y a 14 jours |
| gpt-oss-120b 131 072 tokens de contexte et de sortie max ; 117 Md de paramètres (5,1 Md actifs, architecture MoE) |
OpenAI États-Unis | 08/2025 | Poids ouverts Apache-2.0 |
Station de travail | Texte, Code | vérifié il y a 14 jours |
| gpt-oss-20b 131 072 tokens de contexte et de sortie max ; 21 Md de paramètres (3,6 Md actifs, architecture MoE) |
OpenAI États-Unis | 08/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Codestral 25.08 128 k tokens de contexte (fill-in-the-middle, complétion basse latence) |
Mistral AI France | 08/2025 | Fermé propriétaire — accès API uniquement (offre "Premier") |
sans objet | Code | vérifié il y a 14 jours |
| DeepSeek-V3.1 671 milliards de paramètres au total, 37 milliards actifs ; contexte 128K tokens ; entraîné au format FP8 (UE8M0) sur les poids et les activations. |
DeepSeek Chine | 08/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| Jamba Large 1.7 256K tokens de fenêtre de contexte |
AI21 Labs Israël | 08/2025 | Poids ouverts Jamba Open Model License |
Serveur multi-GPU | Texte | vérifié il y a 14 jours |
| Wan2.2-TI2V-5B 5 milliards de paramètres ; texte-vers-vidéo et image-vers-vidéo, taillé pour tourner sur une carte grand public. |
Alibaba Chine | 28/07/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Vidéo | vérifié il y a 14 jours |
| Wan2.2-T2V-A14B 27 milliards de paramètres au total (MoE, deux experts de 14 Md — un pour la composition d'ensemble, un pour le raffinement des détails), 14 milliards actifs par étape de débruitage. |
Alibaba Chine | 28/07/2025 | Poids ouverts Apache-2.0 |
Station de travail | Vidéo | vérifié il y a 14 jours |
| Qwen3-Coder-30B-A3B-Instruct 30,5 milliards de paramètres au total, 3,3 milliards actifs (MoE) ; contexte natif 262 144 tokens, extensible à 1 million (YaRN). |
Alibaba Chine | 23/07/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Code | vérifié il y a 14 jours |
| Voxtral Small 24B 32 k tokens de contexte ; jusqu'à 40 min d'audio en compréhension / 30 min en transcription |
Mistral AI France | 15/07/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Voix, Texte | vérifié il y a 14 jours |
| Voxtral Mini 3B 32 k tokens de contexte ; jusqu'à 40 min d'audio en compréhension / 30 min en transcription |
Mistral AI France | 15/07/2025 | Poids ouverts Apache-2.0 |
Portable récent | Voix, Texte | vérifié il y a 14 jours |
| SmolLM3-3B 128K tokens de fenêtre de contexte (NoPE + YaRN) |
Hugging Face États-Unis | 08/07/2025 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| ERNIE-4.5-0.3B 0,36 milliard de paramètres denses ; contexte 131 072 tokens. |
Baidu Chine | 01/07/2025 | Poids ouverts Apache-2.0 |
Portable récent | Texte | vérifié il y a 14 jours |
| ERNIE-4.5-21B-A3B 21 milliards de paramètres au total, 3 milliards actifs (MoE) ; contexte 131 072 tokens. |
Baidu Chine | 01/07/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| ERNIE-4.5-VL-424B-A47B 424 milliards de paramètres au total, 47 milliards actifs (MoE multimodal hétérogène — experts partagés et dédiés selon la modalité) ; contexte 131 072 tokens ; image et texte en entrée, texte en sortie. |
Baidu Chine | 01/07/2025 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Vision, Texte | vérifié il y a 14 jours |
| Kimi-K2-Instruct 1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts, 8 sélectionnés par token) ; contexte 128 000 tokens. |
Moonshot AI Chine | 07/2025 | Poids ouverts Modified MIT License |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| GLM-4.6V 106 milliards de paramètres (variante complète ; une variante « Flash » à 9 milliards existe aussi pour un palier plus léger) ; contexte 128 000 tokens ; image, document et vidéo en entrée. |
Z.ai (ex-Zhipu AI) Chine | 07/2025 | Poids ouverts MIT |
Station de travail | Vision, Texte | vérifié il y a 14 jours |
| Hunyuan-A13B-Instruct 80 milliards de paramètres au total, 13 milliards actifs (MoE) ; contexte 256 000 tokens (mode par défaut limité à 32 000) ; bascule dynamique entre raisonnement rapide et lent. |
Tencent Chine | 27/06/2025 | Poids ouverts Tencent Hunyuan A13B Community License Agreement |
Station de travail | Texte, Code | vérifié il y a 14 jours |
| Qwen3-0.6B 600 millions de paramètres denses ; contexte natif 32 768 tokens. |
Alibaba Chine | 05/2025 | Poids ouverts Apache-2.0 |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| Qwen3-8B 8,2 milliards de paramètres denses ; contexte natif 32 768 tokens, extensible à 131 072 (YaRN). |
Alibaba Chine | 05/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Qwen3-32B 32,8 milliards de paramètres denses ; contexte natif 32 768 tokens, extensible à 131 072 (YaRN). |
Alibaba Chine | 05/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Qwen3-30B-A3B 30,5 milliards de paramètres au total, 3,3 milliards actifs (MoE) ; contexte natif 32 768 tokens, extensible à 131 072. |
Alibaba Chine | 05/2025 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| Qwen3-235B-A22B 235 milliards de paramètres au total, 22 milliards actifs (MoE) ; contexte natif 32 768 tokens, extensible à 131 072. |
Alibaba Chine | 05/2025 | Poids ouverts Apache-2.0 |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| o3 200 000 tokens de contexte ; jusqu'à 100 000 tokens de sortie par requête |
OpenAI États-Unis | 16/04/2025 | Fermé propriétaire — API |
sans objet | Texte, Code | vérifié il y a 14 jours |
| Kimi-VL-A3B-Thinking-2506 16 milliards de paramètres au total (MoE, ~3 milliards actifs) ; contexte 131 072 tokens ; image (jusqu'à 3,2 mégapixels), vidéo et texte en entrée. |
Moonshot AI Chine | 10/04/2025 | Poids ouverts MIT |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| Llama 4 Maverick 1 M tokens de contexte ; 400 Md paramètres au total / 17 Md actifs (mixture-of-experts, 128 experts) |
Meta États-Unis | 05/04/2025 | Poids ouverts Llama 4 Community License Agreement |
Serveur multi-GPU | Texte, Code, Image | vérifié il y a 14 jours |
| Llama 4 Scout 10 M tokens de contexte ; 109 Md paramètres au total / 17 Md actifs (mixture-of-experts, 16 experts) |
Meta États-Unis | 05/04/2025 | Poids ouverts Llama 4 Community License Agreement |
Station de travail | Texte, Code, Image | vérifié il y a 14 jours |
| Gemma 3 27B 128K tokens de contexte ; entrée texte + image (normalisée 896×896, 256 tokens/image), sortie texte jusqu'à 8192 tokens ; plus de 140 langues. |
Google DeepMind États-Unis | 10/03/2025 | Poids ouverts Gemma Terms of Use |
Carte graphique de joueur | Texte, Vision | vérifié il y a 14 jours |
| Gemini 2.5 Pro Contexte 1 048 576 tokens en entrée / 65 536 en sortie ; entrée audio, image, vidéo, PDF, texte ; sortie texte ; connaissances arrêtées janvier 2025. |
Google DeepMind États-Unis | 03/2025 | Fermé propriétaire — API |
sans objet | Texte, Code, Vision | vérifié il y a 14 jours |
| Command A (03-2025) 256K tokens de fenêtre de contexte (128K par défaut sur Hugging Face) |
Cohere Canada | 03/2025 | Poids ouverts CC-BY-NC-4.0 |
Serveur multi-GPU | Texte | vérifié il y a 14 jours |
| Claude 3.7 Sonnet Jusqu'à 128 000 tokens de sortie (budget de réflexion étendue inclus) ; fenêtre de contexte non précisée dans l'annonce consultée |
Anthropic États-Unis | 24/02/2025 | Fermé propriétaire — API |
sans objet | Texte, Code | vérifié il y a 14 jours |
| Phi-4-multimodal-instruct 5,6 milliards de paramètres ; contexte 128K tokens ; entrée texte (23 langues) + image (anglais uniquement) + audio (8 langues), sortie texte ; réseau multimodal intégré traitant les trois modalités conjointement. |
Microsoft États-Unis | 02/2025 | Poids ouverts MIT |
Carte graphique de joueur | Texte, Vision | vérifié il y a 14 jours |
| Janus-Pro-7B 7 milliards de paramètres ; compréhension et génération d'image unifiées dans un même transformeur, via des chemins d'encodage visuel découplés. |
DeepSeek Chine | 29/01/2025 | Poids ouverts MIT |
Carte graphique de joueur | Image, Vision, Texte | vérifié il y a 14 jours |
| DeepSeek-R1 671 milliards de paramètres au total (MoE) ; fenêtre de contexte 128 000 tokens. |
DeepSeek Chine | 01/2025 | Poids ouverts MIT |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| DeepSeek-R1-Distill-Qwen-32B Distillation de R1 sur base Qwen2.5-32B, environ 33 milliards de paramètres denses ; contexte évalué à 32 768 tokens. |
DeepSeek Chine | 01/2025 | Poids ouverts MIT |
Carte graphique de joueur | Texte, Code | vérifié il y a 14 jours |
| DeepSeek-R1-Distill-Qwen-1.5B Distillation de R1 sur base Qwen2.5-Math-1.5B, environ 1,5 à 2 milliards de paramètres denses. |
DeepSeek Chine | 01/2025 | Poids ouverts MIT |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| DeepSeek-VL2 4,5 milliards de paramètres actifs (MoE, architecture DeepSeekMoE + attention latente) ; taille totale non précisée clairement dans les sources consultées. Compréhension visuelle, OCR, documents, tableaux, ancrage visuel. |
DeepSeek Chine | 13/12/2024 | Poids ouverts DeepSeek Model License |
Carte graphique de joueur | Vision, Texte | vérifié il y a 14 jours |
| Phi-4 14 milliards de paramètres (dense, decoder-only) ; contexte 16K tokens ; entraîné sur environ 9,8 000 milliards de tokens sur 1920 GPU H100-80G (21 jours). |
Microsoft États-Unis | 12/12/2024 | Poids ouverts MIT |
Carte graphique de joueur | Texte | vérifié il y a 14 jours |
| Llama 3.3 70B 128 k tokens de contexte ; 70 Md paramètres (dense) |
Meta États-Unis | 06/12/2024 | Poids ouverts Llama 3.3 Community License Agreement |
Station de travail | Texte, Code | vérifié il y a 14 jours |
| Nova Pro Contexte 300K tokens (sortie max 5K) ; entrée texte/image/vidéo, sortie texte ; connaissances arrêtées octobre 2024. |
Amazon États-Unis | 05/12/2024 | Fermé propriétaire — API |
sans objet | Texte, Vision | vérifié il y a 14 jours |
| Nova Canvas Génération et édition d'image à partir de texte et d'image ; garde-fous intégrés (filigrane, modération de contenu). |
Amazon États-Unis | 03/12/2024 | Fermé propriétaire — API |
sans objet | Image | vérifié il y a 14 jours |
| Nova Reel Génération vidéo à partir de texte et d'image, avec contrôle du mouvement de caméra ; sortie vidéo en invocation asynchrone (StartAsyncInvoke). |
Amazon États-Unis | 03/12/2024 | Fermé propriétaire — API |
sans objet | Vidéo | vérifié il y a 14 jours |
| HunyuanVideo Plus de 13 milliards de paramètres selon l'éditeur (présenté comme le plus grand modèle ouvert de sa catégorie à sa sortie) ; génère des vidéos jusqu'à 129 images, typiquement 5 secondes. |
Tencent Chine | 03/12/2024 | Poids ouverts Tencent Hunyuan Community License Agreement |
Station de travail | Vidéo | vérifié il y a 14 jours |
| Stable Diffusion 3.5 Medium 2 milliards de paramètres ; explicitement conçu par l'éditeur pour fonctionner sur du matériel grand public. |
Stability AI Royaume-Uni | 29/10/2024 | Poids ouverts Stability AI Community License |
Carte graphique de joueur | Image | vérifié il y a 14 jours |
| Stable Diffusion 3.5 Large 8 milliards de paramètres, résolution jusqu'à 1 mégapixel. |
Stability AI Royaume-Uni | 22/10/2024 | Poids ouverts Stability AI Community License |
Station de travail | Image | vérifié il y a 14 jours |
| Llama 3.2 3B 128 k tokens de contexte ; 3,21 Md paramètres |
Meta États-Unis | 25/09/2024 | Poids ouverts Llama 3.2 Community License Agreement |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| Llama 3.2 1B 128 k tokens de contexte ; 1,23 Md paramètres |
Meta États-Unis | 25/09/2024 | Poids ouverts Llama 3.2 Community License Agreement |
Portable récent | Texte, Code | vérifié il y a 14 jours |
| Pixtral 12B 128 k tokens de contexte ; 12 Md paramètres (décodeur) + 400 M (encodeur vision) |
Mistral AI France | 09/2024 | Poids ouverts Apache-2.0 |
Carte graphique de joueur | Texte, Image | vérifié il y a 14 jours |
| Llama 3.1 405B 128 k tokens de contexte ; 405 Md paramètres (dense) |
Meta États-Unis | 23/07/2024 | Poids ouverts Llama 3.1 Community License Agreement |
Serveur multi-GPU | Texte, Code | vérifié il y a 14 jours |
| K2-65B | LLM360 (consortium MBZUAI, Petuum, Cerebras) International (MBZUAI, Émirats arabes unis ; Petuum et Cerebras, États-Unis) | 06/2024 | Open source Apache-2.0 |
Serveur multi-GPU | Texte | vérifié il y a 14 jours |
| Pythia-12B | EleutherAI États-Unis | 03/04/2023 | Open source Apache-2.0 |
Carte graphique de joueur | Texte | vérifié il y a 14 jours |
| GPT-4 8 192 tokens de contexte (modèle de base gpt-4-0613) |
OpenAI États-Unis | 14/03/2023 | Fermé propriétaire — API |
sans objet | Texte, Image | vérifié il y a 14 jours |
| Whisper Traite l'audio par fenêtres glissantes de 30 secondes (pas de « fenêtre de contexte » au sens LLM textuel) ; 6 tailles de « tiny » (39 M paramètres, ~1 Go VRAM) à « large » (1,55 Md paramètres, ~10 Go VRAM) |
OpenAI États-Unis | 09/2022 | Poids ouverts MIT |
Portable récent | Voix | vérifié il y a 14 jours |
Le haut de gamme de chaque éditeur
Le modèle que chaque société place elle-même au sommet de son catalogue, d'après sa page de tarification ou sa documentation. Ce n'est pas un jugement de puissance — le site ne compare pas les modèles entre éditeurs, il rapporte ce que chacun déclare de sa propre gamme. Et ce n'est pas non plus le dernier sorti : la dernière colonne signale les cas où l'éditeur a publié quelque chose de plus récent sans pour autant le placer plus haut.
| Éditeur | Modèle | Sortie | Ouverture | À noter |
|---|---|---|---|---|
| AI21 Labs | Jamba Large 1.7 | 08/2025 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Alibaba | Qwen3.8-2.4T-A95B | 08/2026 | Poids ouverts | — |
| Alibaba | Qwen3.5-397B-A17B | 02/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Alibaba | Qwen3-235B-A22B | 05/2025 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Amazon | Nova 2 Pro | 02/12/2025 | Fermé | — |
| Anthropic | Claude Fable 5 | 09/06/2026 | Fermé | plus ancien qu'une autre sortie du même éditeur |
| Baidu | ERNIE-4.5-VL-424B-A47B | 01/07/2025 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Black Forest Labs | FLUX.2 [pro] | 25/11/2025 | Fermé | plus ancien qu'une autre sortie du même éditeur |
| Cohere | Command A+ (05-2026) | 05/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| DeepSeek | DeepSeek-V4-Pro | 24/04/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Google DeepMind | Gemma 4 31B | 31/03/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Google DeepMind | Gemini 3.1 Pro | 19/02/2026 | Fermé | plus ancien qu'une autre sortie du même éditeur |
| Lightricks | LTX-2.5 | 07/2026 | Poids ouverts | — |
| Meta | Llama 4 Maverick | 05/04/2025 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Microsoft | MAI-Thinking-1 | 02/06/2026 | Fermé | plus ancien qu'une autre sortie du même éditeur |
| MiniMax | MiniMax-M3 | 01/06/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Mistral AI | Mistral Medium 3.5 | 04/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Moonshot AI | Kimi-K3 | 06/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Moonshot AI | Kimi-K2-Thinking | 06/11/2025 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| OpenAI | GPT-5.6 Sol | 09/07/2026 | Fermé | — |
| Stability AI | Stable Audio 3 Large | 20/05/2026 | Fermé | — |
| Stability AI | Stable Diffusion 3.5 Large | 22/10/2024 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Tencent | Hy3 | 07/2026 | Poids ouverts | — |
| Tencent | Hy-MT2-30B-A3B | 05/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Tencent | Hy3-preview | 04/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
| Z.ai (ex-Zhipu AI) | GLM-5.2 | 16/06/2026 | Poids ouverts | — |
| Z.ai (ex-Zhipu AI) | GLM-5.1 | 04/2026 | Poids ouverts | plus ancien qu'une autre sortie du même éditeur |
Par éditeur
Le catalogue complet, regroupé par société puis par lignée de modèles. Le plus récent de chaque lignée est en tête.
Adobe 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Firefly Image Model 5 | Firefly Image Model | 28/10/2025 | Fermé | vérifié il y a 14 jours |
AI21 Labs 3 modèles
Haut de gamme selon son éditeur
Jamba Large 1.7 08/2025 Poids ouverts vérifié il y a 14 jours
256K tokens de fenêtre de contexte
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Jamba2 3B | Jamba | 06/01/2026 | Poids ouverts | vérifié il y a 14 jours |
| Jamba Reasoning 3B | Jamba Reasoning | 10/2025 | Poids ouverts | vérifié il y a 14 jours |
Alibaba 27 modèles
Haut de gamme selon son éditeur
Qwen3.8-2.4T-A95B 08/2026 Poids ouverts vérifié il y a 14 jours
2 400 milliards de paramètres au total, 95 milliards actifs (MoE, 512 experts dont 11 activés par token) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; texte uniquement, mode « thinking » imposé.
Haut de gamme selon son éditeur
Qwen3.5-397B-A17B 02/2026 Poids ouverts vérifié il y a 14 jours
397 milliards de paramètres au total, 17 milliards actifs (MoE épars couplé à des « Gated Delta Networks », 512 experts dont 11 activés, 60 couches) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo ; 201 langues.
Haut de gamme selon son éditeur
Qwen3-235B-A22B 05/2025 Poids ouverts vérifié il y a 14 jours
235 milliards de paramètres au total, 22 milliards actifs (MoE) ; contexte natif 32 768 tokens, extensible à 131 072.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Qwen3.8-27B | Qwen | 08/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-ASR-1.7B | Qwen ASR | 26/06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-ASR-0.6B | Qwen ASR | 26/06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen-AgentWorld-35B-A3B | Qwen AgentWorld | 06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.6-27B | Qwen3 | 22/04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.6-35B-A3B | Qwen3 | 16/04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-122B-A10B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-35B-A3B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-27B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-4B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-2B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-0.8B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3.5-9B | Qwen | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-Omni-30B-A3B-Instruct | Qwen3 Omni | 09/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-VL-2B-Instruct | Qwen3 VL | 09/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-VL-235B-A22B-Instruct | Qwen3 VL | 09/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen-Image | Qwen Image | 04/08/2025 | Poids ouverts | vérifié il y a 14 jours |
| Wan2.2-TI2V-5B | Wan (vidéo) | 28/07/2025 | Poids ouverts | vérifié il y a 14 jours |
| Wan2.2-T2V-A14B | Wan (vidéo) | 28/07/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-Coder-30B-A3B-Instruct | Qwen3 Coder | 23/07/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-0.6B | Qwen3 | 05/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-8B | Qwen3 | 05/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-32B | Qwen3 | 05/2025 | Poids ouverts | vérifié il y a 14 jours |
| Qwen3-30B-A3B | Qwen3 | 05/2025 | Poids ouverts | vérifié il y a 14 jours |
Allen Institute for AI (Ai2) 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| OLMo 3 (32B, Base) | OLMo 3 | 20/11/2025 | Open source | vérifié il y a 14 jours |
Amazon 7 modèles
Haut de gamme selon son éditeur
Nova 2 Pro 02/12/2025 Fermé vérifié il y a 14 jours
Contexte 1M tokens ; raisonnement ajustable (faible/moyen/élevé), outils intégrés (interpréteur de code, recherche web), support MCP distant ; annoncé pour tâches agentiques complexes (analyse multi-documents, raisonnement vidéo, migrations logicielles).
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Nova 2 Lite | Nova | 02/12/2025 | Fermé | vérifié il y a 14 jours |
| Nova 2 Sonic | Nova Sonic | 02/12/2025 | Fermé | vérifié il y a 14 jours |
| Nova Premier | Nova | 31/10/2025 | Fermé | vérifié il y a 14 jours |
| Nova Pro | Nova | 05/12/2024 | Fermé | vérifié il y a 14 jours |
| Nova Canvas | Nova Canvas | 03/12/2024 | Fermé | vérifié il y a 14 jours |
| Nova Reel | Nova Reel | 03/12/2024 | Fermé | vérifié il y a 14 jours |
Anthropic 12 modèles
Haut de gamme selon son éditeur
Claude Fable 5 09/06/2026 Fermé vérifié il y a 14 jours
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Claude Opus 5 | Opus | 24/07/2026 | Fermé | vérifié il y a 14 jours |
| Claude Sonnet 5 | Sonnet | 30/06/2026 | Fermé | vérifié il y a 14 jours |
| Claude Mythos 5 | Mythos | 09/06/2026 | Fermé | vérifié il y a 14 jours |
| Claude Opus 4.8 | Opus | 28/05/2026 | Fermé | vérifié il y a 14 jours |
| Claude Opus 4.7 | Opus | 16/04/2026 | Fermé | vérifié il y a 14 jours |
| Claude Sonnet 4.6 | Sonnet | 17/02/2026 | Fermé | vérifié il y a 14 jours |
| Claude Opus 4.6 | Opus | 05/02/2026 | Fermé | vérifié il y a 14 jours |
| Claude Opus 4.5 | Opus | 01/11/2025 | Fermé | vérifié il y a 14 jours |
| Claude Haiku 4.5 | Haiku | 01/10/2025 | Fermé | vérifié il y a 14 jours |
| Claude Sonnet 4.5 | Sonnet | 29/09/2025 | Fermé | vérifié il y a 14 jours |
| Claude 3.7 Sonnet | Sonnet | 24/02/2025 | Fermé | vérifié il y a 14 jours |
Baidu 6 modèles
Haut de gamme selon son éditeur
ERNIE-4.5-VL-424B-A47B 01/07/2025 Poids ouverts vérifié il y a 14 jours
424 milliards de paramètres au total, 47 milliards actifs (MoE multimodal hétérogène — experts partagés et dédiés selon la modalité) ; contexte 131 072 tokens ; image et texte en entrée, texte en sortie.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Unlimited-OCR | OCR | 23/06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Qianfan-OCR | OCR | 03/2026 | Poids ouverts | vérifié il y a 14 jours |
| ERNIE-4.5-21B-A3B-Thinking | ERNIE | 09/2025 | Poids ouverts | vérifié il y a 13 jours |
| ERNIE-4.5-0.3B | ERNIE 4.5 | 01/07/2025 | Poids ouverts | vérifié il y a 14 jours |
| ERNIE-4.5-21B-A3B | ERNIE 4.5 | 01/07/2025 | Poids ouverts | vérifié il y a 14 jours |
Black Forest Labs 3 modèles
Haut de gamme selon son éditeur
FLUX.2 [pro] 25/11/2025 Fermé vérifié il y a 14 jours
Édition d'image jusqu'à 4 mégapixels, jusqu'à 10 images de référence (mêmes capacités annoncées que le reste de la famille FLUX.2).
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| FLUX.2 [klein] 4B | FLUX.2 | 15/01/2026 | Poids ouverts | vérifié il y a 14 jours |
| FLUX.2 [dev] | FLUX.2 | 25/11/2025 | Poids ouverts | vérifié il y a 14 jours |
ByteDance 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Seed-OSS-36B-Instruct | Seed-OSS | 20/08/2025 | Poids ouverts | vérifié il y a 14 jours |
Cohere 6 modèles
Haut de gamme selon son éditeur
Command A+ (05-2026) 05/2026 Poids ouverts vérifié il y a 14 jours
218 milliards de paramètres au total, 25 milliards actifs ; contexte 128K en entrée, 64K en sortie ; entrée texte et image, sortie texte ; 48 langues.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| North Micro Vision Instruct | North | 08/2026 | Poids ouverts | vérifié il y a 14 jours |
| North Mini Code 1.0 | North | 06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Cohere Transcribe Arabic (07-2026) | Cohere Transcribe | 06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Cohere Transcribe (03-2026) | Cohere Transcribe | 26/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| Command A (03-2025) | Command A | 03/2025 | Poids ouverts | vérifié il y a 14 jours |
DeepSeek 15 modèles
Haut de gamme selon son éditeur
DeepSeek-V4-Pro 24/04/2026 Poids ouverts vérifié il y a 14 jours
1 600 milliards de paramètres au total, 49 milliards actifs (MoE) ; fenêtre de contexte 1 million de tokens.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| DeepSeek-V4-Flash-0731 | DeepSeek V | 31/07/2026 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-V4-Flash | DeepSeek V | 24/04/2026 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-OCR-2 | DeepSeek OCR | 01/2026 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-V3.2 | DeepSeek V | 01/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-V3.2-Speciale | DeepSeek V | 11/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-OCR | DeepSeek OCR | 21/10/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-V3.1-Terminus | DeepSeek V | 09/2025 | Poids ouverts | vérifié il y a 13 jours |
| DeepSeek-V3.2-Exp | DeepSeek V | 09/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-V3.1 | DeepSeek V | 08/2025 | Poids ouverts | vérifié il y a 14 jours |
| Janus-Pro-7B | DeepSeek Janus | 29/01/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-R1 | DeepSeek R (raisonnement) | 01/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-R1-Distill-Qwen-32B | DeepSeek R1 Distill | 01/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-R1-Distill-Qwen-1.5B | DeepSeek R1 Distill | 01/2025 | Poids ouverts | vérifié il y a 14 jours |
| DeepSeek-VL2 | DeepSeek VL | 13/12/2024 | Poids ouverts | vérifié il y a 14 jours |
EleutherAI 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Pythia-12B | Pythia | 03/04/2023 | Open source | vérifié il y a 14 jours |
ElevenLabs 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Eleven v3 | Eleven | 02/2026 | Fermé | vérifié il y a 14 jours |
Google DeepMind 17 modèles
Haut de gamme selon son éditeur
Gemma 4 31B 31/03/2026 Poids ouverts vérifié il y a 14 jours
256K tokens de contexte ; 30,7 milliards de paramètres (dense) ; entrée texte + image, sortie texte ; poids non quantifiés testés sur GPU NVIDIA H100 80GB, versions quantifiées disponibles pour GPU grand public.
Haut de gamme selon son éditeur
Gemini 3.1 Pro 19/02/2026 Fermé vérifié il y a 14 jours
Contexte 1M tokens en entrée / 64K en sortie ; entrée texte, image, audio, vidéo, PDF ; sortie texte ; connaissances arrêtées janvier 2025.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Gemini 3.7 Flash | Gemini | 13/08/2026 | Fermé | vérifié il y a 14 jours |
| Gemini 3.6 Flash | Gemini | 21/07/2026 | Fermé | vérifié il y a 14 jours |
| Gemma 4 12B | Gemma | 03/06/2026 | Poids ouverts | vérifié il y a 14 jours |
| DiffusionGemma 26B A4B | Gemma (diffusion) | 06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Nano Banana 2 | Nano Banana (image, Gemini) | 28/05/2026 | Fermé | vérifié il y a 14 jours |
| Gemini 3.5 Flash | Gemini | 19/05/2026 | Fermé | vérifié il y a 14 jours |
| Magenta RealTime 2 | Magenta | 05/2026 | Poids ouverts | vérifié il y a 13 jours |
| Gemma 4 26B A4B | Gemma | 31/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| Gemma 4 E2B | Gemma | 31/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| Gemma 4 E4B | Gemma | 31/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| Lyria 3 | Lyria | 18/02/2026 | Fermé | vérifié il y a 14 jours |
| Nano Banana Pro | Nano Banana (image, Gemini) | 20/11/2025 | Fermé | vérifié il y a 14 jours |
| Veo 3.1 | Veo | 10/2025 | Fermé | vérifié il y a 14 jours |
| Gemma 3 27B | Gemma | 10/03/2025 | Poids ouverts | vérifié il y a 14 jours |
| Gemini 2.5 Pro | Gemini | 03/2025 | Fermé | vérifié il y a 14 jours |
Hugging Face 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| SmolLM3-3B | SmolLM | 08/07/2025 | Poids ouverts | vérifié il y a 14 jours |
IBM 10 modèles
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Granite SWASH 2B | Granite | 07/07/2026 | Poids ouverts | vérifié il y a 13 jours |
| Granite Switch 4.1 3B (preview) | Granite | 05/05/2026 | Poids ouverts | vérifié il y a 13 jours |
| Granite 4.1 (30B) | Granite 4 | 29/04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite Speech 4.1 2B Plus | Granite Speech | 28/04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite Guardian 4.1 8B | Granite Guardian | 04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite 4.1 3B | Granite | 04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite Speech 4.1 2B | Granite Speech | 04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite Vision 4.1 4B | Granite Vision | 04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite 4.1 8B | Granite | 04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Granite 4.0 1B Speech | Granite Speech | 06/03/2026 | Poids ouverts | vérifié il y a 14 jours |
Lightricks 3 modèles
Haut de gamme selon son éditeur
LTX-2.5 07/2026 Poids ouverts vérifié il y a 14 jours
22 milliards de paramètres (versions distillée et complète) ; texte-vers-vidéo, image-vers-vidéo, vidéo-vers-vidéo ; jusqu'à 121 images à 24 im/s ; audio synchronisé via VAE audio et vocodeur dédiés ; encodeur de texte Gemma 4 12B personnalisé.
LLM360 (consortium MBZUAI, Petuum, Cerebras) 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| K2-65B | K2 | 06/2024 | Open source | vérifié il y a 14 jours |
Luma AI 2 modèles
Meta 8 modèles
Haut de gamme selon son éditeur
Llama 4 Maverick 05/04/2025 Poids ouverts vérifié il y a 14 jours
1 M tokens de contexte ; 400 Md paramètres au total / 17 Md actifs (mixture-of-experts, 128 experts)
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Muse Spark 1.1 | Muse | 09/07/2026 | Fermé | vérifié il y a 14 jours |
| SAM 3 (Segment Anything Model) | SAM | 19/11/2025 | Poids ouverts | vérifié il y a 14 jours |
| Llama 4 Scout | Llama 4 | 05/04/2025 | Poids ouverts | vérifié il y a 14 jours |
| Llama 3.3 70B | Llama 3 | 06/12/2024 | Poids ouverts | vérifié il y a 14 jours |
| Llama 3.2 3B | Llama 3 | 25/09/2024 | Poids ouverts | vérifié il y a 14 jours |
| Llama 3.2 1B | Llama 3 | 25/09/2024 | Poids ouverts | vérifié il y a 14 jours |
| Llama 3.1 405B | Llama 3 | 23/07/2024 | Poids ouverts | vérifié il y a 14 jours |
Microsoft 11 modèles
Haut de gamme selon son éditeur
MAI-Thinking-1 02/06/2026 Fermé vérifié il y a 14 jours
256K tokens de contexte ; ~35 milliards de paramètres actifs sur ~1 000 milliards au total (Mixture-of-Experts épars) ; entraîné from scratch sans distillation, sur données commerciales propres.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Fara 1.5 4B | Fara | 07/2026 | Poids ouverts | vérifié il y a 13 jours |
| Fara 1.5 27B | Fara | 07/2026 | Poids ouverts | vérifié il y a 13 jours |
| VibeVoice-ASR-BitNet | VibeVoice | 07/2026 | Poids ouverts | vérifié il y a 14 jours |
| Mage-VL | Mage | 07/2026 | Poids ouverts | vérifié il y a 14 jours |
| MAI-Voice-2 | MAI-Voice | 02/06/2026 | Fermé | vérifié il y a 14 jours |
| Fara 1.5 9B | Fara | 05/2026 | Poids ouverts | vérifié il y a 14 jours |
| Phi-4-reasoning-vision-15B | Phi | 04/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| MAI-1-preview | MAI (texte, génération précédente) | 28/08/2025 | Fermé | vérifié il y a 14 jours |
| Phi-4-multimodal-instruct | Phi | 02/2025 | Poids ouverts | vérifié il y a 14 jours |
| Phi-4 | Phi | 12/12/2024 | Poids ouverts | vérifié il y a 14 jours |
Midjourney 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Midjourney V8.1 | Midjourney | 30/04/2026 | Fermé | vérifié il y a 1 mois |
MiniMax 7 modèles
Haut de gamme selon son éditeur
MiniMax-M3 01/06/2026 Poids ouverts vérifié il y a 14 jours
428 milliards de paramètres au total, 23 milliards actifs (MoE, architecture Sparse Attention MSA) ; contexte jusqu'à 1 million de tokens ; entrées texte, image et vidéo natives dès l'entraînement.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| MiniMax Music 3 | MiniMax Music | 07/08/2026 | Poids ouverts | vérifié il y a 14 jours |
| MiniMax-H3 | MiniMax H | 28/07/2026 | Poids ouverts | vérifié il y a 14 jours |
| MiniMax-M2.7 | MiniMax M | 20/04/2026 | Poids ouverts | vérifié il y a 14 jours |
| MiniMax-M2.5 | MiniMax M | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| MiniMax-M2.1 | MiniMax M | 12/2025 | Poids ouverts | vérifié il y a 14 jours |
| MiniMax-M2 | MiniMax M | 27/10/2025 | Poids ouverts | vérifié il y a 14 jours |
Mistral AI 17 modèles
Haut de gamme selon son éditeur
Mistral Medium 3.5 04/2026 Poids ouverts vérifié il y a 14 jours
256 k tokens de contexte ; 128 Md paramètres (dense)
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Shieldstral 1.0 3B | Shieldstral | 07/2026 | Poids ouverts | vérifié il y a 14 jours |
| Voxtral TTS | Voxtral | 23/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| Mistral Small 4 | Mistral | 16/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| Voxtral Mini 4B Realtime | Voxtral | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| Devstral 2 | Devstral | 09/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| Devstral Small 2 | Devstral | 09/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| Mistral Large 3 | Mistral | 02/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| Ministral 3 14B | Ministral | 02/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| Ministral 3 8B | Ministral | 02/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| Ministral 3 3B | Ministral | 02/12/2025 | Poids ouverts | vérifié il y a 14 jours |
| Magistral Small 1.2 | Magistral | 09/2025 | Poids ouverts | vérifié il y a 14 jours |
| Magistral Medium 1.2 | Magistral | 09/2025 | Fermé | vérifié il y a 14 jours |
| Codestral 25.08 | Codestral | 08/2025 | Fermé | vérifié il y a 14 jours |
| Voxtral Small 24B | Voxtral | 15/07/2025 | Poids ouverts | vérifié il y a 14 jours |
| Voxtral Mini 3B | Voxtral | 15/07/2025 | Poids ouverts | vérifié il y a 14 jours |
| Pixtral 12B | Pixtral | 09/2024 | Poids ouverts | vérifié il y a 14 jours |
Moonshot AI 8 modèles
Haut de gamme selon son éditeur
Kimi-K3 06/2026 Poids ouverts vérifié il y a 14 jours
2 800 milliards de paramètres au total, 104 milliards actifs (MoE, 16 experts sur 896 par token) ; contexte 1 048 576 tokens ; entrée texte, image et vidéo, sortie texte.
Haut de gamme selon son éditeur
Kimi-K2-Thinking 06/11/2025 Poids ouverts vérifié il y a 14 jours
1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts) ; contexte 256 000 tokens ; quantification INT4 native (entraînement conscient de la quantification).
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Kimi-K2.7-Code | Kimi K2 | 15/06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Kimi-K2.6 | Kimi | 04/2026 | Poids ouverts | vérifié il y a 14 jours |
| Kimi-K2.5 | Kimi | 29/01/2026 | Poids ouverts | vérifié il y a 14 jours |
| Kimi-Linear-48B-A3B | Kimi Linear | 30/10/2025 | Poids ouverts | vérifié il y a 14 jours |
| Kimi-K2-Instruct | Kimi K2 | 07/2025 | Poids ouverts | vérifié il y a 14 jours |
| Kimi-VL-A3B-Thinking-2506 | Kimi VL | 10/04/2025 | Poids ouverts | vérifié il y a 14 jours |
Nvidia 4 modèles
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Nemotron 3.5 Lightning (30B-A3B) | Nemotron | 11/08/2026 | Poids ouverts | vérifié il y a 14 jours |
| Cosmos3-Edge | Cosmos | 20/07/2026 | Poids ouverts | vérifié il y a 14 jours |
| Nemotron Parse 2.0 | Nemotron | 06/2026 | Poids ouverts | vérifié il y a 14 jours |
| Nemotron 3 Nano (30B-A3B) | Nemotron 3 | 15/12/2025 | Poids ouverts | vérifié il y a 14 jours |
OpenAI 11 modèles
Haut de gamme selon son éditeur
GPT-5.6 Sol 09/07/2026 Fermé vérifié il y a 14 jours
≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| GPT-5.6 Terra | GPT | 09/07/2026 | Fermé | vérifié il y a 14 jours |
| GPT-5.6 Luna | GPT | 09/07/2026 | Fermé | vérifié il y a 14 jours |
| Sora 2 | Sora | 30/09/2025 | Fermé | vérifié il y a 14 jours |
| gpt-oss-safeguard-120b | gpt-oss | 09/2025 | Poids ouverts | vérifié il y a 13 jours |
| gpt-oss-safeguard-20b | gpt-oss | 09/2025 | Poids ouverts | vérifié il y a 14 jours |
| gpt-oss-120b | gpt-oss | 08/2025 | Poids ouverts | vérifié il y a 14 jours |
| gpt-oss-20b | gpt-oss | 08/2025 | Poids ouverts | vérifié il y a 14 jours |
| o3 | o | 16/04/2025 | Fermé | vérifié il y a 14 jours |
| GPT-4 | GPT | 14/03/2023 | Fermé | vérifié il y a 14 jours |
| Whisper | Whisper | 09/2022 | Poids ouverts | vérifié il y a 14 jours |
Resemble AI 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Chatterbox Turbo | Chatterbox | 12/2025 | Poids ouverts | vérifié il y a 14 jours |
Runway 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Gen-4.5 | Gen | 01/12/2025 | Fermé | vérifié il y a 1 mois |
Stability AI 5 modèles
Haut de gamme selon son éditeur
Stable Audio 3 Large 20/05/2026 Fermé vérifié il y a 14 jours
Compositions jusqu'à 6 min 20 s, positionné par l'éditeur pour la production sonore de niveau entreprise.
Haut de gamme selon son éditeur
Stable Diffusion 3.5 Large 22/10/2024 Poids ouverts vérifié il y a 14 jours
8 milliards de paramètres, résolution jusqu'à 1 mégapixel.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Stable Audio 3 Small | Stable Audio 3 | 20/05/2026 | Poids ouverts | vérifié il y a 14 jours |
| Stable Audio 3 Medium | Stable Audio | 17/05/2026 | Poids ouverts | vérifié il y a 14 jours |
| Stable Diffusion 3.5 Medium | Stable Diffusion 3.5 | 29/10/2024 | Poids ouverts | vérifié il y a 14 jours |
Suno 1 modèle
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Suno v5.5 | Suno | 26/03/2026 | Fermé | vérifié il y a 14 jours |
Tencent 7 modèles
Haut de gamme selon son éditeur
Hy3 07/2026 Poids ouverts vérifié il y a 14 jours
295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; même architecture que la preview, post-entraînement élargi.
Haut de gamme selon son éditeur
Hy-MT2-30B-A3B 05/2026 Poids ouverts vérifié il y a 13 jours
30 milliards de paramètres (MoE) ; traduction entre 36 langues ; suivi de consignes de traduction, gestion terminologique, adaptation de style et traduction de données structurées.
Haut de gamme selon son éditeur
Hy3-preview 04/2026 Poids ouverts vérifié il y a 14 jours
295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; 64 têtes d'attention (GQA, 8 têtes KV) ; texte uniquement.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Hy-MT2-7B | Hunyuan MT | 05/2026 | Poids ouverts | vérifié il y a 13 jours |
| Hy-MT2-1.8B | Hunyuan MT | 05/2026 | Poids ouverts | vérifié il y a 14 jours |
| Hunyuan-A13B-Instruct | Hunyuan | 27/06/2025 | Poids ouverts | vérifié il y a 14 jours |
| HunyuanVideo | Hunyuan Video | 03/12/2024 | Poids ouverts | vérifié il y a 14 jours |
xAI 3 modèles
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| Grok 4.6 | Grok | 12/08/2026 | Fermé | vérifié il y a 14 jours |
| Grok Imagine Image 2.0 | Grok Imagine | 07/08/2026 | Fermé | vérifié il y a 14 jours |
| Grok Imagine Video 1.5 | Grok Imagine | 16/06/2026 | Fermé | vérifié il y a 14 jours |
Z.ai (ex-Zhipu AI) 12 modèles
Haut de gamme selon son éditeur
GLM-5.2 16/06/2026 Poids ouverts vérifié il y a 14 jours
753 milliards de paramètres au total (MoE, ~39-40 milliards actifs selon des sources secondaires convergentes, 256 experts) ; contexte jusqu'à 1 million de tokens.
Haut de gamme selon son éditeur
GLM-5.1 04/2026 Poids ouverts vérifié il y a 14 jours
~754 milliards de paramètres ; architecture MoE à attention éparse (GLM_MOE_DSA) ; texte uniquement.
| Modèle | Lignée | Sortie | Ouverture | Vérification |
|---|---|---|---|---|
| GLM-OCR | GLM OCR | 11/03/2026 | Poids ouverts | vérifié il y a 14 jours |
| GLM-5 | GLM | 02/2026 | Poids ouverts | vérifié il y a 14 jours |
| GLM-Image | GLM Image | 01/2026 | Poids ouverts | vérifié il y a 14 jours |
| GLM-4.7 | GLM | 12/2025 | Poids ouverts | vérifié il y a 14 jours |
| AutoGLM-Phone-9B | AutoGLM | 12/2025 | Poids ouverts | vérifié il y a 14 jours |
| GLM-ASR-Nano | GLM ASR | 12/2025 | Poids ouverts | vérifié il y a 14 jours |
| GLM-4.6V-Flash | GLM | 12/2025 | Poids ouverts | vérifié il y a 14 jours |
| GLM-4.6 | GLM | 30/09/2025 | Poids ouverts | vérifié il y a 14 jours |
| GLM-4.7-Flash | GLM | 08/08/2025 | Poids ouverts | vérifié il y a 14 jours |
| GLM-4.6V | GLM Vision | 07/2025 | Poids ouverts | vérifié il y a 14 jours |
Par usage
Qui fait quoi, et ce qui est réellement mesuré. Beaucoup d'usages n'ont aucune mesure indépendante publiée : les classements qu'on trouve ailleurs y sont des préférences d'utilisateurs ou de la communication d'éditeur, pas des protocoles publiés. Quand c'est le cas, cette page l'écrit plutôt que de fabriquer un palmarès sans source.
Texte
Gemini 3.7 Flash (Google DeepMind) · Grok 4.6 (xAI) · Nemotron 3.5 Lightning (30B-A3B) (Nvidia) · Qwen3.8-2.4T-A95B (Alibaba) · Qwen3.8-27B (Alibaba) · North Micro Vision Instruct (Cohere) · DeepSeek-V4-Flash-0731 (DeepSeek) · Claude Opus 5 (Anthropic) · Gemini 3.6 Flash (Google DeepMind) · Cosmos3-Edge (Nvidia) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Muse Spark 1.1 (Meta) · Granite SWASH 2B (IBM) · Fara 1.5 4B (Microsoft) · Fara 1.5 27B (Microsoft) · Mage-VL (Microsoft) · Shieldstral 1.0 3B (Mistral AI) · Hy3 (Tencent) · Claude Sonnet 5 (Anthropic) · Unlimited-OCR (Baidu) · GLM-5.2 (Z.ai (ex-Zhipu AI)) · Kimi-K2.7-Code (Moonshot AI) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Gemma 4 12B (Google DeepMind) · MAI-Thinking-1 (Microsoft) · MiniMax-M3 (MiniMax) · DiffusionGemma 26B A4B (Google DeepMind) · Qwen-AgentWorld-35B-A3B (Alibaba) · Kimi-K3 (Moonshot AI) · Nemotron Parse 2.0 (Nvidia) · North Mini Code 1.0 (Cohere) · Claude Opus 4.8 (Anthropic) · Gemini 3.5 Flash (Google DeepMind) · Granite Switch 4.1 3B (preview) (IBM) · Fara 1.5 9B (Microsoft) · Hy-MT2-7B (Tencent) · Hy-MT2-30B-A3B (Tencent) · Hy-MT2-1.8B (Tencent) · Command A+ (05-2026) (Cohere) · Granite 4.1 (30B) (IBM) · DeepSeek-V4-Pro (DeepSeek) · DeepSeek-V4-Flash (DeepSeek) · Qwen3.6-27B (Alibaba) · MiniMax-M2.7 (MiniMax) · Claude Opus 4.7 (Anthropic) · Qwen3.6-35B-A3B (Alibaba) · Mistral Medium 3.5 (Mistral AI) · Kimi-K2.6 (Moonshot AI) · GLM-5.1 (Z.ai (ex-Zhipu AI)) · Hy3-preview (Tencent) · Granite Guardian 4.1 8B (IBM) · Granite 4.1 3B (IBM) · Granite Vision 4.1 4B (IBM) · Granite 4.1 8B (IBM) · Gemma 4 26B A4B (Google DeepMind) · Gemma 4 E2B (Google DeepMind) · Gemma 4 31B (Google DeepMind) · Gemma 4 E4B (Google DeepMind) · Mistral Small 4 (Mistral AI) · GLM-OCR (Z.ai (ex-Zhipu AI)) · Phi-4-reasoning-vision-15B (Microsoft) · Qianfan-OCR (Baidu) · Gemini 3.1 Pro (Google DeepMind) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · Qwen3.5-397B-A17B (Alibaba) · Qwen3.5-122B-A10B (Alibaba) · Qwen3.5-35B-A3B (Alibaba) · Qwen3.5-27B (Alibaba) · Qwen3.5-4B (Alibaba) · Qwen3.5-2B (Alibaba) · Qwen3.5-0.8B (Alibaba) · Qwen3.5-9B (Alibaba) · GLM-5 (Z.ai (ex-Zhipu AI)) · MiniMax-M2.5 (MiniMax) · Kimi-K2.5 (Moonshot AI) · Jamba2 3B (AI21 Labs) · DeepSeek-OCR-2 (DeepSeek) · Nemotron 3 Nano (30B-A3B) (Nvidia) · Devstral 2 (Mistral AI) · Devstral Small 2 (Mistral AI) · Nova 2 Pro (Amazon) · Nova 2 Lite (Amazon) · Mistral Large 3 (Mistral AI) · Ministral 3 14B (Mistral AI) · Ministral 3 8B (Mistral AI) · Ministral 3 3B (Mistral AI) · DeepSeek-V3.2 (DeepSeek) · GLM-4.7 (Z.ai (ex-Zhipu AI)) · AutoGLM-Phone-9B (Z.ai (ex-Zhipu AI)) · GLM-4.6V-Flash (Z.ai (ex-Zhipu AI)) · MiniMax-M2.1 (MiniMax) · OLMo 3 (32B, Base) (Allen Institute for AI (Ai2)) · Kimi-K2-Thinking (Moonshot AI) · Claude Opus 4.5 (Anthropic) · DeepSeek-V3.2-Speciale (DeepSeek) · Nova Premier (Amazon) · Kimi-Linear-48B-A3B (Moonshot AI) · MiniMax-M2 (MiniMax) · DeepSeek-OCR (DeepSeek) · Claude Haiku 4.5 (Anthropic) · Jamba Reasoning 3B (AI21 Labs) · GLM-4.6 (Z.ai (ex-Zhipu AI)) · Claude Sonnet 4.5 (Anthropic) · gpt-oss-safeguard-120b (OpenAI) · gpt-oss-safeguard-20b (OpenAI) · Magistral Small 1.2 (Mistral AI) · Magistral Medium 1.2 (Mistral AI) · DeepSeek-V3.1-Terminus (DeepSeek) · DeepSeek-V3.2-Exp (DeepSeek) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Qwen3-VL-2B-Instruct (Alibaba) · Qwen3-VL-235B-A22B-Instruct (Alibaba) · ERNIE-4.5-21B-A3B-Thinking (Baidu) · MAI-1-preview (Microsoft) · Seed-OSS-36B-Instruct (ByteDance) · GLM-4.7-Flash (Z.ai (ex-Zhipu AI)) · gpt-oss-120b (OpenAI) · gpt-oss-20b (OpenAI) · DeepSeek-V3.1 (DeepSeek) · Jamba Large 1.7 (AI21 Labs) · Voxtral Small 24B (Mistral AI) · Voxtral Mini 3B (Mistral AI) · SmolLM3-3B (Hugging Face) · ERNIE-4.5-0.3B (Baidu) · ERNIE-4.5-21B-A3B (Baidu) · ERNIE-4.5-VL-424B-A47B (Baidu) · Kimi-K2-Instruct (Moonshot AI) · GLM-4.6V (Z.ai (ex-Zhipu AI)) · Hunyuan-A13B-Instruct (Tencent) · Qwen3-0.6B (Alibaba) · Qwen3-8B (Alibaba) · Qwen3-32B (Alibaba) · Qwen3-30B-A3B (Alibaba) · Qwen3-235B-A22B (Alibaba) · o3 (OpenAI) · Kimi-VL-A3B-Thinking-2506 (Moonshot AI) · Llama 4 Maverick (Meta) · Llama 4 Scout (Meta) · Gemma 3 27B (Google DeepMind) · Gemini 2.5 Pro (Google DeepMind) · Command A (03-2025) (Cohere) · Claude 3.7 Sonnet (Anthropic) · Phi-4-multimodal-instruct (Microsoft) · Janus-Pro-7B (DeepSeek) · DeepSeek-R1 (DeepSeek) · DeepSeek-R1-Distill-Qwen-32B (DeepSeek) · DeepSeek-R1-Distill-Qwen-1.5B (DeepSeek) · DeepSeek-VL2 (DeepSeek) · Phi-4 (Microsoft) · Llama 3.3 70B (Meta) · Nova Pro (Amazon) · Llama 3.2 3B (Meta) · Llama 3.2 1B (Meta) · Pixtral 12B (Mistral AI) · Llama 3.1 405B (Meta) · K2-65B (LLM360 (consortium MBZUAI, Petuum, Cerebras)) · Pythia-12B (EleutherAI) · GPT-4 (OpenAI)
- Muse Spark 1.1 — Indice composite d'intelligence générale, agrégeant plusieurs épreuves : 51 en variante « xhigh », contre 43 pour la version précédente trois mois plus tôt — gain de 8 points, à égalité avec GLM-5.2 (max) et GPT-5.4 (xhigh). Artificial Analysis Intelligence Index, mesuré le 10/07/2026 · source
- Claude Opus 4.5 — Raisonnement abstrait sur tâches inédites : 37,6 % de réussite (variante « Thinking, 64k »), premier rang des modèles commerciaux de ce classement à cette date, pour un coût d'environ 2,20 $ par tâche. ARC-AGI-2 (ARC Prize), mesuré le 05/12/2025 · source
- o3 — 4 % de réussite mesurés sur le checkpoint de pré-lancement « o3-preview-low », environ un mois avant la disponibilité générale d'o3 (16/04/2025) — chiffre présenté par ARC Prize elle-même comme une estimation provisoire, pas un score final. ARC-AGI-2 (ARC Prize), mesuré le 24/03/2025 · source
Code
Gemini 3.7 Flash (Google DeepMind) · Grok 4.6 (xAI) · Nemotron 3.5 Lightning (30B-A3B) (Nvidia) · Qwen3.8-2.4T-A95B (Alibaba) · Qwen3.8-27B (Alibaba) · DeepSeek-V4-Flash-0731 (DeepSeek) · Claude Opus 5 (Anthropic) · Gemini 3.6 Flash (Google DeepMind) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Muse Spark 1.1 (Meta) · Fara 1.5 4B (Microsoft) · Fara 1.5 27B (Microsoft) · Hy3 (Tencent) · Claude Sonnet 5 (Anthropic) · GLM-5.2 (Z.ai (ex-Zhipu AI)) · Kimi-K2.7-Code (Moonshot AI) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Gemma 4 12B (Google DeepMind) · MAI-Thinking-1 (Microsoft) · MiniMax-M3 (MiniMax) · DiffusionGemma 26B A4B (Google DeepMind) · Kimi-K3 (Moonshot AI) · North Mini Code 1.0 (Cohere) · Claude Opus 4.8 (Anthropic) · Gemini 3.5 Flash (Google DeepMind) · Fara 1.5 9B (Microsoft) · Command A+ (05-2026) (Cohere) · Granite 4.1 (30B) (IBM) · DeepSeek-V4-Pro (DeepSeek) · DeepSeek-V4-Flash (DeepSeek) · Qwen3.6-27B (Alibaba) · MiniMax-M2.7 (MiniMax) · Claude Opus 4.7 (Anthropic) · Qwen3.6-35B-A3B (Alibaba) · Mistral Medium 3.5 (Mistral AI) · Kimi-K2.6 (Moonshot AI) · GLM-5.1 (Z.ai (ex-Zhipu AI)) · Hy3-preview (Tencent) · Granite 4.1 3B (IBM) · Granite 4.1 8B (IBM) · Gemma 4 26B A4B (Google DeepMind) · Gemma 4 E2B (Google DeepMind) · Gemma 4 31B (Google DeepMind) · Gemma 4 E4B (Google DeepMind) · Mistral Small 4 (Mistral AI) · Gemini 3.1 Pro (Google DeepMind) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · Qwen3.5-397B-A17B (Alibaba) · Qwen3.5-122B-A10B (Alibaba) · Qwen3.5-35B-A3B (Alibaba) · Qwen3.5-27B (Alibaba) · Qwen3.5-4B (Alibaba) · Qwen3.5-2B (Alibaba) · Qwen3.5-0.8B (Alibaba) · Qwen3.5-9B (Alibaba) · GLM-5 (Z.ai (ex-Zhipu AI)) · MiniMax-M2.5 (MiniMax) · Kimi-K2.5 (Moonshot AI) · Jamba2 3B (AI21 Labs) · Nemotron 3 Nano (30B-A3B) (Nvidia) · Devstral 2 (Mistral AI) · Devstral Small 2 (Mistral AI) · Nova 2 Pro (Amazon) · Nova 2 Lite (Amazon) · Mistral Large 3 (Mistral AI) · Ministral 3 14B (Mistral AI) · Ministral 3 8B (Mistral AI) · Ministral 3 3B (Mistral AI) · DeepSeek-V3.2 (DeepSeek) · GLM-4.7 (Z.ai (ex-Zhipu AI)) · MiniMax-M2.1 (MiniMax) · OLMo 3 (32B, Base) (Allen Institute for AI (Ai2)) · Kimi-K2-Thinking (Moonshot AI) · Claude Opus 4.5 (Anthropic) · Kimi-Linear-48B-A3B (Moonshot AI) · MiniMax-M2 (MiniMax) · Claude Haiku 4.5 (Anthropic) · Jamba Reasoning 3B (AI21 Labs) · GLM-4.6 (Z.ai (ex-Zhipu AI)) · Claude Sonnet 4.5 (Anthropic) · Magistral Small 1.2 (Mistral AI) · Magistral Medium 1.2 (Mistral AI) · DeepSeek-V3.1-Terminus (DeepSeek) · DeepSeek-V3.2-Exp (DeepSeek) · ERNIE-4.5-21B-A3B-Thinking (Baidu) · Seed-OSS-36B-Instruct (ByteDance) · GLM-4.7-Flash (Z.ai (ex-Zhipu AI)) · gpt-oss-120b (OpenAI) · gpt-oss-20b (OpenAI) · Codestral 25.08 (Mistral AI) · DeepSeek-V3.1 (DeepSeek) · Qwen3-Coder-30B-A3B-Instruct (Alibaba) · SmolLM3-3B (Hugging Face) · ERNIE-4.5-21B-A3B (Baidu) · Kimi-K2-Instruct (Moonshot AI) · Hunyuan-A13B-Instruct (Tencent) · Qwen3-0.6B (Alibaba) · Qwen3-8B (Alibaba) · Qwen3-32B (Alibaba) · Qwen3-30B-A3B (Alibaba) · Qwen3-235B-A22B (Alibaba) · o3 (OpenAI) · Llama 4 Maverick (Meta) · Llama 4 Scout (Meta) · Gemini 2.5 Pro (Google DeepMind) · Claude 3.7 Sonnet (Anthropic) · DeepSeek-R1 (DeepSeek) · DeepSeek-R1-Distill-Qwen-32B (DeepSeek) · DeepSeek-R1-Distill-Qwen-1.5B (DeepSeek) · Llama 3.3 70B (Meta) · Llama 3.2 3B (Meta) · Llama 3.2 1B (Meta) · Llama 3.1 405B (Meta)
Aucune mesure indépendante datée enregistrée pour cet usage.
Image
Grok Imagine Image 2.0 (xAI) · Claude Opus 5 (Anthropic) · Cosmos3-Edge (Nvidia) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Muse Spark 1.1 (Meta) · Claude Sonnet 5 (Anthropic) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Claude Opus 4.8 (Anthropic) · Nano Banana 2 (Google DeepMind) · Uni-1.1 (Luma AI) · Midjourney V8.1 (Midjourney) · Claude Opus 4.7 (Anthropic) · Mistral Medium 3.5 (Mistral AI) · Mistral Small 4 (Mistral AI) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · FLUX.2 [klein] 4B (Black Forest Labs) · GLM-Image (Z.ai (ex-Zhipu AI)) · Mistral Large 3 (Mistral AI) · Ministral 3 14B (Mistral AI) · Ministral 3 8B (Mistral AI) · Ministral 3 3B (Mistral AI) · FLUX.2 [dev] (Black Forest Labs) · FLUX.2 [pro] (Black Forest Labs) · Nano Banana Pro (Google DeepMind) · Claude Opus 4.5 (Anthropic) · Firefly Image Model 5 (Adobe) · Claude Haiku 4.5 (Anthropic) · Claude Sonnet 4.5 (Anthropic) · Magistral Small 1.2 (Mistral AI) · Magistral Medium 1.2 (Mistral AI) · Qwen-Image (Alibaba) · Llama 4 Maverick (Meta) · Llama 4 Scout (Meta) · Janus-Pro-7B (DeepSeek) · Nova Canvas (Amazon) · Stable Diffusion 3.5 Medium (Stability AI) · Stable Diffusion 3.5 Large (Stability AI) · Pixtral 12B (Mistral AI) · GPT-4 (OpenAI)
Aucune mesure indépendante datée enregistrée pour cet usage.
Voix
Muse Spark 1.1 (Meta) · VibeVoice-ASR-BitNet (Microsoft) · Qwen3-ASR-1.7B (Alibaba) · Qwen3-ASR-0.6B (Alibaba) · MAI-Voice-2 (Microsoft) · Cohere Transcribe Arabic (07-2026) (Cohere) · Granite Speech 4.1 2B Plus (IBM) · Granite Speech 4.1 2B (IBM) · Cohere Transcribe (03-2026) (Cohere) · Voxtral TTS (Mistral AI) · Granite 4.0 1B Speech (IBM) · Voxtral Mini 4B Realtime (Mistral AI) · Eleven v3 (ElevenLabs) · Nova 2 Sonic (Amazon) · GLM-ASR-Nano (Z.ai (ex-Zhipu AI)) · Chatterbox Turbo (Resemble AI) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Voxtral Small 24B (Mistral AI) · Voxtral Mini 3B (Mistral AI) · Whisper (OpenAI)
Aucune mesure indépendante datée enregistrée pour cet usage.
Musique
MiniMax Music 3 (MiniMax) · MiniMax-H3 (MiniMax) · LTX-2.5 (Lightricks) · Stable Audio 3 Small (Stability AI) · Stable Audio 3 Large (Stability AI) · Stable Audio 3 Medium (Stability AI) · Magenta RealTime 2 (Google DeepMind) · Suno v5.5 (Suno) · LTX-2.3 (Lightricks) · Lyria 3 (Google DeepMind)
Aucune mesure indépendante datée enregistrée pour cet usage.
Vidéo
MiniMax-H3 (MiniMax) · Cosmos3-Edge (Nvidia) · Muse Spark 1.1 (Meta) · LTX-2.5 (Lightricks) · Grok Imagine Video 1.5 (xAI) · Ray3.2 (Luma AI) · MiniMax-M3 (MiniMax) · LTX-2.3 (Lightricks) · LTX-2 (Lightricks) · Gen-4.5 (Runway) · SAM 3 (Segment Anything Model) (Meta) · Veo 3.1 (Google DeepMind) · Sora 2 (OpenAI) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Wan2.2-TI2V-5B (Alibaba) · Wan2.2-T2V-A14B (Alibaba) · Nova Reel (Amazon) · HunyuanVideo (Tencent)
Aucune mesure indépendante datée enregistrée pour cet usage.
Vision
Gemini 3.7 Flash (Google DeepMind) · Qwen3.8-27B (Alibaba) · North Micro Vision Instruct (Cohere) · Claude Opus 5 (Anthropic) · Gemini 3.6 Flash (Google DeepMind) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Fara 1.5 4B (Microsoft) · Fara 1.5 27B (Microsoft) · Mage-VL (Microsoft) · Shieldstral 1.0 3B (Mistral AI) · Claude Sonnet 5 (Anthropic) · Unlimited-OCR (Baidu) · Kimi-K2.7-Code (Moonshot AI) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Gemma 4 12B (Google DeepMind) · MiniMax-M3 (MiniMax) · DiffusionGemma 26B A4B (Google DeepMind) · Kimi-K3 (Moonshot AI) · Nemotron Parse 2.0 (Nvidia) · Claude Opus 4.8 (Anthropic) · Gemini 3.5 Flash (Google DeepMind) · Fara 1.5 9B (Microsoft) · Command A+ (05-2026) (Cohere) · Claude Opus 4.7 (Anthropic) · Kimi-K2.6 (Moonshot AI) · Granite Vision 4.1 4B (IBM) · Gemma 4 26B A4B (Google DeepMind) · Gemma 4 E2B (Google DeepMind) · Gemma 4 31B (Google DeepMind) · Gemma 4 E4B (Google DeepMind) · GLM-OCR (Z.ai (ex-Zhipu AI)) · Phi-4-reasoning-vision-15B (Microsoft) · Qianfan-OCR (Baidu) · Gemini 3.1 Pro (Google DeepMind) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · Qwen3.5-397B-A17B (Alibaba) · Qwen3.5-122B-A10B (Alibaba) · Qwen3.5-35B-A3B (Alibaba) · Qwen3.5-27B (Alibaba) · Qwen3.5-4B (Alibaba) · Qwen3.5-2B (Alibaba) · Qwen3.5-0.8B (Alibaba) · Qwen3.5-9B (Alibaba) · Kimi-K2.5 (Moonshot AI) · DeepSeek-OCR-2 (DeepSeek) · Nova 2 Pro (Amazon) · Nova 2 Lite (Amazon) · AutoGLM-Phone-9B (Z.ai (ex-Zhipu AI)) · GLM-4.6V-Flash (Z.ai (ex-Zhipu AI)) · SAM 3 (Segment Anything Model) (Meta) · Claude Opus 4.5 (Anthropic) · Nova Premier (Amazon) · DeepSeek-OCR (DeepSeek) · Claude Haiku 4.5 (Anthropic) · Claude Sonnet 4.5 (Anthropic) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Qwen3-VL-2B-Instruct (Alibaba) · Qwen3-VL-235B-A22B-Instruct (Alibaba) · ERNIE-4.5-VL-424B-A47B (Baidu) · GLM-4.6V (Z.ai (ex-Zhipu AI)) · Kimi-VL-A3B-Thinking-2506 (Moonshot AI) · Gemma 3 27B (Google DeepMind) · Gemini 2.5 Pro (Google DeepMind) · Phi-4-multimodal-instruct (Microsoft) · Janus-Pro-7B (DeepSeek) · DeepSeek-VL2 (DeepSeek) · Nova Pro (Amazon)
Aucune mesure indépendante datée enregistrée pour cet usage.
Ce qui tourne chez soi
Les modèles dont les poids sont téléchargeables, classés par le matériel qu'ils demandent. Deux questions distinctes se posent ici : la licence autorise-t-elle le téléchargement, et la machine suit-elle ? Un modèle peut être parfaitement ouvert et hors de portée d'un portable.
Portable récent 24 modèles
| Modèle | Éditeur | Ouverture | Licence | Vérification |
|---|---|---|---|---|
| VibeVoice-ASR-BitNet | Microsoft | Poids ouverts | MIT | vérifié il y a 14 jours |
| Qwen3-ASR-0.6B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Stable Audio 3 Small | Stability AI | Poids ouverts | Stability AI Community License | vérifié il y a 14 jours |
| Hy-MT2-1.8B | Tencent | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Gemma 4 E2B | Google DeepMind | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Gemma 4 E4B | Google DeepMind | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Voxtral TTS | Mistral AI | Poids ouverts | CC BY-NC 4.0 | vérifié il y a 14 jours |
| GLM-OCR | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| Granite 4.0 1B Speech | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.5-0.8B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Jamba2 3B | AI21 Labs | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Ministral 3 3B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| GLM-ASR-Nano | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| DeepSeek-OCR | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| Jamba Reasoning 3B | AI21 Labs | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-VL-2B-Instruct | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Voxtral Mini 3B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| SmolLM3-3B | Hugging Face | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| ERNIE-4.5-0.3B | Baidu | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-0.6B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| DeepSeek-R1-Distill-Qwen-1.5B | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| Llama 3.2 3B | Meta | Poids ouverts | Llama 3.2 Community License Agreement | vérifié il y a 14 jours |
| Llama 3.2 1B | Meta | Poids ouverts | Llama 3.2 Community License Agreement | vérifié il y a 14 jours |
| Whisper | OpenAI | Poids ouverts | MIT | vérifié il y a 14 jours |
Carte graphique de joueur 63 modèles
| Modèle | Éditeur | Ouverture | Licence | Vérification |
|---|---|---|---|---|
| North Micro Vision Instruct | Cohere | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Cosmos3-Edge | Nvidia | Poids ouverts | OpenMDW 1.1 | vérifié il y a 14 jours |
| Granite SWASH 2B | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 13 jours |
| Fara 1.5 4B | Microsoft | Poids ouverts | MIT | vérifié il y a 13 jours |
| Mage-VL | Microsoft | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Shieldstral 1.0 3B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-ASR-1.7B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Unlimited-OCR | Baidu | Poids ouverts | MIT | vérifié il y a 14 jours |
| Gemma 4 12B | Google DeepMind | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Nemotron Parse 2.0 | Nvidia | Poids ouverts | NVIDIA Open Model License (tokenizer en CC-BY-4.0) | vérifié il y a 14 jours |
| Cohere Transcribe Arabic (07-2026) | Cohere | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Stable Audio 3 Medium | Stability AI | Poids ouverts | Stability AI Community License | vérifié il y a 14 jours |
| Granite Switch 4.1 3B (preview) | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 13 jours |
| Magenta RealTime 2 | Google DeepMind | Poids ouverts | Code en Apache-2.0, poids en CC BY 4.0 | vérifié il y a 13 jours |
| Fara 1.5 9B | Microsoft | Poids ouverts | MIT | vérifié il y a 14 jours |
| Hy-MT2-7B | Tencent | Poids ouverts | Apache-2.0 | vérifié il y a 13 jours |
| Granite Speech 4.1 2B Plus | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.6-27B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.6-35B-A3B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Granite Guardian 4.1 8B | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Granite 4.1 3B | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Granite Speech 4.1 2B | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Granite Vision 4.1 4B | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Granite 4.1 8B | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Cohere Transcribe (03-2026) | Cohere | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qianfan-OCR | Baidu | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Voxtral Mini 4B Realtime | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.5-4B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.5-2B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.5-9B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| FLUX.2 [klein] 4B | Black Forest Labs | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| LTX-2 | Lightricks | Poids ouverts | LTX-2 Community License Agreement | vérifié il y a 14 jours |
| DeepSeek-OCR-2 | DeepSeek | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| GLM-Image | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| Devstral Small 2 | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Ministral 3 14B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Ministral 3 8B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| AutoGLM-Phone-9B | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| GLM-4.6V-Flash | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| Chatterbox Turbo | Resemble AI | Poids ouverts | MIT | vérifié il y a 14 jours |
| gpt-oss-safeguard-20b | OpenAI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Magistral Small 1.2 | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-Omni-30B-A3B-Instruct | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Seed-OSS-36B-Instruct | ByteDance | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| GLM-4.7-Flash | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| gpt-oss-20b | OpenAI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Wan2.2-TI2V-5B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-Coder-30B-A3B-Instruct | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Voxtral Small 24B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| ERNIE-4.5-21B-A3B | Baidu | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-8B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-32B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3-30B-A3B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Kimi-VL-A3B-Thinking-2506 | Moonshot AI | Poids ouverts | MIT | vérifié il y a 14 jours |
| Gemma 3 27B | Google DeepMind | Poids ouverts | Gemma Terms of Use | vérifié il y a 14 jours |
| Phi-4-multimodal-instruct | Microsoft | Poids ouverts | MIT | vérifié il y a 14 jours |
| Janus-Pro-7B | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| DeepSeek-R1-Distill-Qwen-32B | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| DeepSeek-VL2 | DeepSeek | Poids ouverts | DeepSeek Model License | vérifié il y a 14 jours |
| Phi-4 | Microsoft | Poids ouverts | MIT | vérifié il y a 14 jours |
| Stable Diffusion 3.5 Medium | Stability AI | Poids ouverts | Stability AI Community License | vérifié il y a 14 jours |
| Pixtral 12B | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Pythia-12B | EleutherAI | Open source | Apache-2.0 | vérifié il y a 14 jours |
Station de travail 28 modèles
| Modèle | Éditeur | Ouverture | Licence | Vérification |
|---|---|---|---|---|
| MiniMax Music 3 | MiniMax | Poids ouverts | Creative Commons (texte complet dans le dépôt) | vérifié il y a 14 jours |
| Qwen3.8-27B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Fara 1.5 27B | Microsoft | Poids ouverts | MIT | vérifié il y a 13 jours |
| DiffusionGemma 26B A4B | Google DeepMind | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen-AgentWorld-35B-A3B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| North Mini Code 1.0 | Cohere | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Hy-MT2-30B-A3B | Tencent | Poids ouverts | Apache-2.0 | vérifié il y a 13 jours |
| Granite 4.1 (30B) | IBM | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Gemma 4 26B A4B | Google DeepMind | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Gemma 4 31B | Google DeepMind | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Phi-4-reasoning-vision-15B | Microsoft | Poids ouverts | MIT | vérifié il y a 14 jours |
| Qwen3.5-35B-A3B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.5-27B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Nemotron 3 Nano (30B-A3B) | Nvidia | Poids ouverts | NVIDIA Nemotron Open Model License | vérifié il y a 14 jours |
| FLUX.2 [dev] | Black Forest Labs | Poids ouverts | FLUX Non-Commercial License | vérifié il y a 14 jours |
| OLMo 3 (32B, Base) | Allen Institute for AI (Ai2) | Open source | Apache-2.0 | vérifié il y a 14 jours |
| SAM 3 (Segment Anything Model) | Meta | Poids ouverts | SAM License | vérifié il y a 14 jours |
| gpt-oss-safeguard-120b | OpenAI | Poids ouverts | Apache-2.0 | vérifié il y a 13 jours |
| ERNIE-4.5-21B-A3B-Thinking | Baidu | Poids ouverts | Apache-2.0 | vérifié il y a 13 jours |
| Qwen-Image | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| gpt-oss-120b | OpenAI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Wan2.2-T2V-A14B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| GLM-4.6V | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| Hunyuan-A13B-Instruct | Tencent | Poids ouverts | Tencent Hunyuan A13B Community License Agreement | vérifié il y a 14 jours |
| Llama 4 Scout | Meta | Poids ouverts | Llama 4 Community License Agreement | vérifié il y a 14 jours |
| Llama 3.3 70B | Meta | Poids ouverts | Llama 3.3 Community License Agreement | vérifié il y a 14 jours |
| HunyuanVideo | Tencent | Poids ouverts | Tencent Hunyuan Community License Agreement | vérifié il y a 14 jours |
| Stable Diffusion 3.5 Large | Stability AI | Poids ouverts | Stability AI Community License | vérifié il y a 14 jours |
Serveur multi-GPU 48 modèles
| Modèle | Éditeur | Ouverture | Licence | Vérification |
|---|---|---|---|---|
| Nemotron 3.5 Lightning (30B-A3B) | Nvidia | Poids ouverts | OpenMDW 1.1 | vérifié il y a 14 jours |
| Qwen3.8-2.4T-A95B | Alibaba | Poids ouverts | qwen3.8-max (licence maison Alibaba) | vérifié il y a 14 jours |
| DeepSeek-V4-Flash-0731 | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| MiniMax-H3 | MiniMax | Poids ouverts | MiniMax H3 Community License Agreement | vérifié il y a 14 jours |
| Hy3 | Tencent | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| LTX-2.5 | Lightricks | Poids ouverts | LTX-2 Community License Agreement | vérifié il y a 14 jours |
| GLM-5.2 | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| Kimi-K2.7-Code | Moonshot AI | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| MiniMax-M3 | MiniMax | Poids ouverts | MiniMax Community License | vérifié il y a 14 jours |
| Kimi-K3 | Moonshot AI | Poids ouverts | Kimi K3 License | vérifié il y a 14 jours |
| Command A+ (05-2026) | Cohere | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| DeepSeek-V4-Pro | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| DeepSeek-V4-Flash | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| MiniMax-M2.7 | MiniMax | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| Mistral Medium 3.5 | Mistral AI | Poids ouverts | Modified MIT License (Mistral AI) | vérifié il y a 14 jours |
| Kimi-K2.6 | Moonshot AI | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| GLM-5.1 | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| Hy3-preview | Tencent | Poids ouverts | Tencent Hy Community License Agreement | vérifié il y a 14 jours |
| Mistral Small 4 | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| LTX-2.3 | Lightricks | Poids ouverts | LTX-2 Community License Agreement | vérifié il y a 14 jours |
| Qwen3.5-397B-A17B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Qwen3.5-122B-A10B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| GLM-5 | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| MiniMax-M2.5 | MiniMax | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| Kimi-K2.5 | Moonshot AI | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| Devstral 2 | Mistral AI | Poids ouverts | Modified MIT License (Mistral AI) | vérifié il y a 14 jours |
| Mistral Large 3 | Mistral AI | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| DeepSeek-V3.2 | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| GLM-4.7 | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| MiniMax-M2.1 | MiniMax | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| Kimi-K2-Thinking | Moonshot AI | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| DeepSeek-V3.2-Speciale | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| Kimi-Linear-48B-A3B | Moonshot AI | Poids ouverts | MIT | vérifié il y a 14 jours |
| MiniMax-M2 | MiniMax | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| GLM-4.6 | Z.ai (ex-Zhipu AI) | Poids ouverts | MIT | vérifié il y a 14 jours |
| DeepSeek-V3.1-Terminus | DeepSeek | Poids ouverts | MIT | vérifié il y a 13 jours |
| DeepSeek-V3.2-Exp | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| Qwen3-VL-235B-A22B-Instruct | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| DeepSeek-V3.1 | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| Jamba Large 1.7 | AI21 Labs | Poids ouverts | Jamba Open Model License | vérifié il y a 14 jours |
| ERNIE-4.5-VL-424B-A47B | Baidu | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Kimi-K2-Instruct | Moonshot AI | Poids ouverts | Modified MIT License | vérifié il y a 14 jours |
| Qwen3-235B-A22B | Alibaba | Poids ouverts | Apache-2.0 | vérifié il y a 14 jours |
| Llama 4 Maverick | Meta | Poids ouverts | Llama 4 Community License Agreement | vérifié il y a 14 jours |
| Command A (03-2025) | Cohere | Poids ouverts | CC-BY-NC-4.0 | vérifié il y a 14 jours |
| DeepSeek-R1 | DeepSeek | Poids ouverts | MIT | vérifié il y a 14 jours |
| Llama 3.1 405B | Meta | Poids ouverts | Llama 3.1 Community License Agreement | vérifié il y a 14 jours |
| K2-65B | LLM360 (consortium MBZUAI, Petuum, Cerebras) | Open source | Apache-2.0 | vérifié il y a 14 jours |