PROTOTYPE INTERNE · démonstration interne · aucune donnée collectée · extraits « Tech Café » (droits Vendé, pré-accord)
L'École de la Techcomprendre, pas subir

Accueil · Les modèles

Les modèles

Un état daté du paysage des modèles d'IA générative, trié d'abord par ce qu'on peut réellement héberger soi-même. Ce n'est pas un classement. Chaque ligne porte la date de sa dernière vérification ; celles qui n'en ont pas le disent. Ce que change vraiment la distinction « poids ouverts » / « fermé » est expliqué dans T5.2 — Ouvert contre fermé.

Les dernières sorties

Les 10 modèles les plus récents du registre, du plus récent au plus ancien. La date est celle de la disponibilité publique déclarée par l'éditeur — pas celle de l'annonce.

ModèleÉditeurSortieOuvertureChez soiUsagesVérification
Gemini 3.7 Flash
Statut « stable » au 16/08/2026. Présenté par Google comme sa version Flash la plus capable, orientée code complexe, flux agentiques et exécution multi-étapes. Deux versions Flash l'ont précédée de peu : Gemini 3.6 Flash le 21/07/2026, puis celle-ci le 13/08 — la ligne Flash bouge vite, une fiche de ce type se démode en semaines.
Google DeepMind États-Unis 13/08/2026 Fermé sans objet Texte, Code, Vision vérifié il y a 14 jours
Grok 4.6
Succède à Grok 4.5 ; xAI dit se concentrer sur « les agents à longue durée d'exécution et les travaux interactifs et visuels plus ambitieux ». Tarif annoncé : 2 $ par million de tokens en entrée, 6 $ en sortie, avec une variante « fast » au double. Aucun rang de gamme ne lui est attribué ici : xAI ne situe pas ce modèle dans une hiérarchie sur sa page d'annonce, et sa documentation en propose d'autres à la fenêtre de contexte plus large (1 million de tokens contre 500 000). L'éditeur revendique par ailleurs un score égal à GPT-5.6 Sol sur l'Artificial Analysis Intelligence Index — c'est sa parole, le classement lui-même n'ayant pas été consulté pour cette fiche.
xAI États-Unis 12/08/2026 Fermé sans objet Texte, Code vérifié il y a 14 jours
Nemotron 3.5 Lightning (30B-A3B)
Entrée qui n'existerait pas sans une exception écrite : la règle de tri « variante BF16 » l'écartait, alors que chez Nvidia le dépôt sans suffixe est FERMÉ (HTTP 401) et que le BF16 est la seule forme publiquement accessible. Cf. `ADMIS_MALGRE_REGLE` dans tech-site/sonde-tri.ts. Sur le fond, l'architecture est le point : Mamba-2 mêlé au MoE et à l'attention, soit une alternative au tout-transformeur que le registre n'illustrait qu'avec Jamba.
Nvidia États-Unis 11/08/2026 Poids ouverts Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Grok Imagine Image 2.0
Proposée comme « Quality Mode » sur grok.com/imagine et les applications mobiles xAI, et via l'API. L'éditeur met en avant la tenue de la typographie et de la mise en page dans les visuels denses. Il revendique par ailleurs un deuxième rang mondial en génération et en édition d'image sur les classements Arena : c'est sa parole, ces classements n'ayant pas été consultés pour cette fiche.
xAI États-Unis 07/08/2026 Fermé sans objet Image vérifié il y a 14 jours
MiniMax Music 3
Génération musicale À POIDS OUVERTS avec voix chantée — l'usage « musique » du registre était jusqu'ici presque entièrement fermé (Suno, Lyria) ou instrumental. Sa fiche ne porte pas de date ; celle retenue est la création du dépôt (07/08/2026).
MiniMax Chine 07/08/2026 Poids ouverts Station de travail Musique vérifié il y a 14 jours
Qwen3.8-2.4T-A95B
Tête de la génération Qwen3.8, mise en ligne en août 2026 (la fiche ne donne que le mois, d'où la date à précision mensuelle). La licence porte un nom maison, « qwen3.8-max », et non l'Apache-2.0 des autres modèles Qwen ouverts : son texte intégral n'a pas été lu lors de cette revue, la classification « poids ouverts » repose donc sur la publication des poids, pas sur une lecture des conditions. À revoir avant toute affirmation sur ce qu'elle autorise.
Alibaba Chine 08/2026 Poids ouverts Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Qwen3.8-27B
Volet vision-langage de la génération Qwen3.8, sous Apache-2.0 — contraste avec la licence maison de la tête 2.4T de la même génération : chez cet éditeur, l'ouverture se décide modèle par modèle, pas génération par génération.
Alibaba Chine 08/2026 Poids ouverts Station de travail Texte, Code, Vision vérifié il y a 14 jours
North Micro Vision Instruct
Cohere le présente explicitement comme une base pour prototyper et spécialiser, PAS comme un assistant conversationnel — franchise rare sur une fiche de modèle, et utile au lecteur qui choisit. Date à précision mensuelle (dépôt créé le 10/08/2026).
Cohere Canada 08/2026 Poids ouverts Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
DeepSeek-V4-Flash-0731
DeepSeek publie sur sa propre fiche des scores où ce modèle devance V4-Pro (preview) malgré un nombre de paramètres activés bien moindre — Terminal Bench 2.1 à 82,7 contre 72,1, DeepSWE à 54,4 contre 12,8. Chiffres de l'éditeur sur ses propres modèles : rapportés ici, non repris en `mesures` faute de mesure indépendante.
DeepSeek Chine 31/07/2026 Poids ouverts Serveur multi-GPU Texte, Code vérifié il y a 14 jours
MiniMax-H3
Génération vidéo À POIDS OUVERTS, avec audio stéréo produit dans la même passe — le registre ne comptait presque que des modèles fermés sur cet usage. La fiche ne donne pas de date ; celle retenue est la création du dépôt (28/07/2026).
MiniMax Chine 28/07/2026 Poids ouverts Serveur multi-GPU Vidéo, Musique vérifié il y a 14 jours

Explorer le registre

Les 215 modèles, filtrables et triables. Les sections suivantes répondent chacune à une question choisie d'avance ; celle-ci répond aux vôtres, y compris quand elles se croisent — « du texte, à poids ouverts, qui tourne sur une carte de joueur » n'est lisible nulle part ailleurs. Le filtre de vérification sert aussi à celui qui tient le registre à jour : il montre ce qui attend une relecture.

ModèleÉditeurSortieOuvertureChez soiUsagesVérification
Gemini 3.7 Flash
Contexte 1 048 576 tokens en entrée / 65 536 en sortie ; entrée texte, image, vidéo, audio, PDF ; sortie texte.
Google DeepMind États-Unis 13/08/2026 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Grok 4.6
500 000 tokens de contexte ; entrée et sortie texte ; connaissances arrêtées au 1er février 2026.
xAI États-Unis 12/08/2026 Fermé
propriétaire — API
sans objet Texte, Code vérifié il y a 14 jours
Nemotron 3.5 Lightning (30B-A3B)
30 milliards de paramètres au total, 3 milliards actifs ; architecture hybride Mamba-2 + MoE + attention ; contexte jusqu'à 1 million de tokens (256K sur un seul H100, limite mémoire) ; texte uniquement.
Nvidia États-Unis 11/08/2026 Poids ouverts
OpenMDW 1.1
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Grok Imagine Image 2.0
Génération et édition d'image ; entrées texte et image, jusqu'à cinq images de référence en édition multi-références ; facturé 0,04 $ par image produite.
xAI États-Unis 07/08/2026 Fermé
propriétaire — API
sans objet Image vérifié il y a 14 jours
MiniMax Music 3
Chansons complètes jusqu'à cinq minutes, en WAV stéréo 32 kHz / 16 bits, à partir de paroles et d'une description ; architecture à deux étages — un modèle de 8 Md pour la structure musicale longue et un de 0,6 Md pour le détail acoustique ; sections intro/couplet/refrain/pont pilotables.
MiniMax Chine 07/08/2026 Poids ouverts
Creative Commons (texte complet dans le dépôt)
Station de travail Musique vérifié il y a 14 jours
Qwen3.8-2.4T-A95B
2 400 milliards de paramètres au total, 95 milliards actifs (MoE, 512 experts dont 11 activés par token) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; texte uniquement, mode « thinking » imposé.
Alibaba Chine 08/2026 Poids ouverts
qwen3.8-max (licence maison Alibaba)
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Qwen3.8-27B
27 milliards de paramètres ; contexte natif 262 144 tokens, extensible à ~1 000 000 ; modèle vision-langage natif acceptant image ET vidéo en entrée, sortie texte.
Alibaba Chine 08/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code, Vision vérifié il y a 14 jours
North Micro Vision Instruct
2,4 milliards de paramètres (2 Md pour le modèle de langage, 400 M pour l'encodeur vision) ; contexte 128K tokens ; images et texte entrelacés, plusieurs images par requête ; traitement à RÉSOLUTION NATIVE, conservant le rapport d'aspect.
Cohere Canada 08/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
DeepSeek-V4-Flash-0731
304 milliards de paramètres au total (MoE, nombre de paramètres activés nettement inférieur à V4-Pro) ; contexte jusqu'à 384K tokens ; module de décodage spéculatif DSpark ; trois niveaux d'effort de raisonnement (low, high, max).
DeepSeek Chine 31/07/2026 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
MiniMax-H3
Transformer dense de 33 milliards de paramètres à flux unique, branches AdaLN par modalité, MM-RoPE tridimensionnel ; entrée texte, jusqu'à 9 images, 3 clips vidéo et 3 clips audio ; sortie VIDÉO avec son stéréo natif, jusqu'à 2K, 24 images/s, 15 secondes.
MiniMax Chine 28/07/2026 Poids ouverts
MiniMax H3 Community License Agreement
Serveur multi-GPU Vidéo, Musique vérifié il y a 14 jours
Claude Opus 5
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 24/07/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Gemini 3.6 Flash
Contexte 1 048 576 tokens en entrée / 65 536 en sortie ; entrée texte, image, vidéo, audio, PDF ; sortie texte.
Google DeepMind États-Unis 21/07/2026 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Cosmos3-Edge
4 milliards de paramètres entraînables ; entrée texte, images et trajectoires d'action (JSON) ; sortie images, vidéos, actions et texte ; architecture « Mixture-of-Transformers » associant un transformeur autorégressif pour le texte et un transformeur de diffusion pour la synthèse multimodale continue.
Nvidia États-Unis 20/07/2026 Poids ouverts
OpenMDW 1.1
Carte graphique de joueur Texte, Image, Vidéo vérifié il y a 14 jours
GPT-5.6 Sol
≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
OpenAI États-Unis 09/07/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
GPT-5.6 Terra
≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
OpenAI États-Unis 09/07/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
GPT-5.6 Luna
≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
OpenAI États-Unis 09/07/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Muse Spark 1.1
1 M tokens de contexte ; multimodal texte/image/vidéo/PDF en entrée, raisonnement agentique (usage d'outils, contrôle d'ordinateur, code)
Meta États-Unis 09/07/2026 Fermé
propriétaire — accès via API uniquement (Meta Model API, preview publique), aucun poids publié
sans objet Texte, Code, Image, Vidéo, Voix vérifié il y a 14 jours
Granite SWASH 2B
2,14 milliards de paramètres ; transformeur dense décodeur seul à attention HYBRIDE — attention complète sur 7 couches, attention à fenêtre glissante (128) sur 17 autres, plus des « puits d'attention » appris ; anglais.
IBM États-Unis 07/07/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte vérifié il y a 13 jours
Fara 1.5 4B
4 milliards de paramètres ; contexte 262 144 tokens ; agent d'usage du navigateur par capture d'écran, comme ses aînés ; ajusté à partir de Qwen3.5-4B.
Microsoft États-Unis 07/2026 Poids ouverts
MIT
Carte graphique de joueur Vision, Texte, Code vérifié il y a 13 jours
Fara 1.5 27B
27 milliards de paramètres ; contexte 262 144 tokens ; perception UNIQUEMENT par capture d'écran (aucun accès au DOM) ; actions ancrées en coordonnées, au pixel près ; sortie raisonnement + appels d'outils.
Microsoft États-Unis 07/2026 Poids ouverts
MIT
Station de travail Vision, Texte, Code vérifié il y a 13 jours
VibeVoice-ASR-BitNet
0,3 milliard de paramètres ; reconnaissance vocale multilingue compressée de 4,62 à 1,58 Go (quantification hétérogène I8_S + I2_S/Q6_K) ; temps réel SANS GPU, sur processeur x86 AVX2 ou ARM NEON, à partir de 3 fils d'exécution.
Microsoft États-Unis 07/2026 Poids ouverts
MIT
Portable récent Voix vérifié il y a 14 jours
Mage-VL
5 milliards de paramètres ; encodeur visuel Mage-ViT entraîné de zéro sur une base linguistique Qwen3-4B ; entrée images et vidéo, y compris flux encodés H.264/HEVC et codecs neuronaux ; sortie texte ; analyse hors ligne, flux temps réel et ancrage temporel.
Microsoft États-Unis 07/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
Shieldstral 1.0 3B
3 milliards de paramètres ; classifieur de sûreté acceptant une politique en LANGAGE NATUREL au moment de l'inférence et rendant un score continu ; contenu texte seul, image seule ou mixte ; 12 langues ; une seule passe avant, pour la modération en temps réel sur appareil.
Mistral AI France 07/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Vision vérifié il y a 14 jours
Hy3
295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; même architecture que la preview, post-entraînement élargi.
Tencent Chine 07/2026 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
LTX-2.5
22 milliards de paramètres (versions distillée et complète) ; texte-vers-vidéo, image-vers-vidéo, vidéo-vers-vidéo ; jusqu'à 121 images à 24 im/s ; audio synchronisé via VAE audio et vocodeur dédiés ; encodeur de texte Gemma 4 12B personnalisé.
Lightricks Israël 07/2026 Poids ouverts
LTX-2 Community License Agreement
Serveur multi-GPU Vidéo, Musique vérifié il y a 14 jours
Claude Sonnet 5
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 30/06/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Qwen3-ASR-1.7B
Reconnaissance vocale avec identification de langue sur 52 langues et dialectes (30 langues + 22 dialectes chinois) ; inférence en flux ou hors ligne ; audio long, parole chantée et chansons avec fond musical ; consignes de contexte et mots-clés pour orienter la transcription.
Alibaba Chine 26/06/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix vérifié il y a 14 jours
Qwen3-ASR-0.6B
Même périmètre fonctionnel que la 1.7B (52 langues et dialectes, flux ou hors ligne) pour un tiers de la taille.
Alibaba Chine 26/06/2026 Poids ouverts
Apache-2.0
Portable récent Voix vérifié il y a 14 jours
Unlimited-OCR
3 milliards de paramètres ; contexte 32 768 tokens ; entrée image + texte, sortie texte ; traite image seule, document multi-pages et PDF, en conservant la mise en page (boîtes englobantes).
Baidu Chine 23/06/2026 Poids ouverts
MIT
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
Grok Imagine Video 1.5
Vidéos de 6 secondes en 720p produites en 25 secondes environ ; bruitages, ambiance et dialogue générés dans la même passe que l'image.
xAI États-Unis 16/06/2026 Fermé
propriétaire — API
sans objet Vidéo vérifié il y a 14 jours
GLM-5.2
753 milliards de paramètres au total (MoE, ~39-40 milliards actifs selon des sources secondaires convergentes, 256 experts) ; contexte jusqu'à 1 million de tokens.
Z.ai (ex-Zhipu AI) Chine 16/06/2026 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Kimi-K2.7-Code
1 000 milliards de paramètres au total, 32 milliards actifs (MoE) ; contexte 256 000 tokens ; accepte désormais image et vidéo en entrée, orienté code agentique long-horizon.
Moonshot AI Chine 15/06/2026 Poids ouverts
Modified MIT License
Serveur multi-GPU Code, Texte, Vision vérifié il y a 14 jours
Claude Fable 5
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 09/06/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Claude Mythos 5
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête (specs identiques à Claude Fable 5)
Anthropic États-Unis 09/06/2026 Fermé
propriétaire — accès restreint (Project Glasswing, sur invitation uniquement)
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Ray3.2
Résolutions 360p à 1080p ; 5 ou 10 s en texte/image-vers-vidéo, jusqu'à 20 s en modification vidéo (V2V) selon la fréquence d'image choisie.
Luma AI États-Unis 09/06/2026 Fermé
propriétaire — application/API
sans objet Vidéo vérifié il y a 14 jours
Gemma 4 12B
Contexte 256K tokens ; architecture « encodeur-free » unifiée (projette directement patches d'image et forme d'onde audio dans l'espace d'embedding) ; entrée texte + image + audio, sortie texte.
Google DeepMind États-Unis 03/06/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Vision vérifié il y a 14 jours
MAI-Thinking-1
256K tokens de contexte ; ~35 milliards de paramètres actifs sur ~1 000 milliards au total (Mixture-of-Experts épars) ; entraîné from scratch sans distillation, sur données commerciales propres.
Microsoft États-Unis 02/06/2026 Fermé
propriétaire — API
sans objet Texte, Code vérifié il y a 14 jours
MAI-Voice-2
Génération vocale texte-vers-parole ; voix mono-locuteur en disponibilité générale, multi-locuteurs annoncé en préversion au moment de la consultation.
Microsoft États-Unis 02/06/2026 Fermé
propriétaire — API
sans objet Voix vérifié il y a 14 jours
MiniMax-M3
428 milliards de paramètres au total, 23 milliards actifs (MoE, architecture Sparse Attention MSA) ; contexte jusqu'à 1 million de tokens ; entrées texte, image et vidéo natives dès l'entraînement.
MiniMax Chine 01/06/2026 Poids ouverts
MiniMax Community License
Serveur multi-GPU Texte, Code, Vision, Vidéo vérifié il y a 14 jours
DiffusionGemma 26B A4B
25,2 milliards de paramètres au total, 3,8 milliards actifs ; contexte 256K tokens ; entrée texte, image et vidéo, sortie texte.
Google DeepMind États-Unis 06/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code, Vision vérifié il y a 14 jours
Qwen-AgentWorld-35B-A3B
35 milliards de paramètres au total, 3 milliards actifs (MoE) ; contexte 262 144 tokens ; texte uniquement.
Alibaba Chine 06/2026 Poids ouverts
Apache-2.0
Station de travail Texte vérifié il y a 14 jours
Kimi-K3
2 800 milliards de paramètres au total, 104 milliards actifs (MoE, 16 experts sur 896 par token) ; contexte 1 048 576 tokens ; entrée texte, image et vidéo, sortie texte.
Moonshot AI Chine 06/2026 Poids ouverts
Kimi K3 License
Serveur multi-GPU Texte, Code, Vision vérifié il y a 14 jours
Nemotron Parse 2.0
Moins d'un milliard de paramètres ; transforme une image de document en représentation structurée — texte, classes de mise en page, boîtes englobantes et ORDRE DE LECTURE ; titres, tableaux, graphiques, pieds de page.
Nvidia États-Unis 06/2026 Poids ouverts
NVIDIA Open Model License (tokenizer en CC-BY-4.0)
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
North Mini Code 1.0
30 milliards de paramètres au total, 3 milliards actifs (MoE épars) ; contexte 256K en entrée, 64K en sortie ; appel d'outils et réflexion entrelacée pour le codage autonome.
Cohere Canada 06/2026 Poids ouverts
Apache-2.0
Station de travail Code, Texte vérifié il y a 14 jours
Cohere Transcribe Arabic (07-2026)
2 milliards de paramètres ; encodeur-décodeur conformer ; arabe standard moderne ET dialectes, anglais, et parole mêlant les deux (code-switching).
Cohere Canada 06/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix vérifié il y a 14 jours
Claude Opus 4.8
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 28/05/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Nano Banana 2
Contexte 131 072 tokens en entrée / 32 768 en sortie ; entrée texte, image, PDF ; sortie image ET texte.
Google DeepMind États-Unis 28/05/2026 Fermé
propriétaire — API
sans objet Image vérifié il y a 14 jours
Stable Audio 3 Small
Compositions jusqu'à 6 min 20 s ; explicitement optimisé par l'éditeur pour générer sur appareil mobile.
Stability AI Royaume-Uni 20/05/2026 Poids ouverts
Stability AI Community License
Portable récent Musique vérifié il y a 14 jours
Stable Audio 3 Large
Compositions jusqu'à 6 min 20 s, positionné par l'éditeur pour la production sonore de niveau entreprise.
Stability AI Royaume-Uni 20/05/2026 Fermé
propriétaire — API
sans objet Musique vérifié il y a 14 jours
Gemini 3.5 Flash
Contexte 1M tokens en entrée / 64K en sortie ; entrée texte, image, vidéo, audio, PDF ; sortie texte.
Google DeepMind États-Unis 19/05/2026 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Stable Audio 3 Medium
2 milliards de paramètres ; composition de plusieurs minutes ; « inpainting » (retouche ciblée d'un passage) et continuation d'un extrait ; l'éditeur annonce moins de 2 s de génération sur GPU H200 et quelques secondes sur un MacBook Pro M4.
Stability AI Royaume-Uni 17/05/2026 Poids ouverts
Stability AI Community License
Carte graphique de joueur Musique vérifié il y a 14 jours
Uni-1.1
API avec génération (create_image) et édition d'image par instruction (modify_image) ; jusqu'à 9 images de référence pour le style, le personnage ou le contenu.
Luma AI États-Unis 05/05/2026 Fermé
propriétaire — API
sans objet Image vérifié il y a 14 jours
Granite Switch 4.1 3B (preview)
3 milliards de paramètres ; contexte 131 072 tokens ; un SEUL jeu de poids portant 12 adaptateurs spécialisés (RAG, sûreté, explicabilité), choisis à l'inférence par des jetons de contrôle via une couche d'aiguillage légère.
IBM États-Unis 05/05/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte vérifié il y a 13 jours
Magenta RealTime 2
Deux tailles — 2,4 milliards de paramètres (base) et 230 millions (small) ; génération musicale CONTINUE en flux, pilotée par consigne texte, exemple audio et MIDI ; latence d'environ 200 ms, sur l'appareil.
Google DeepMind États-Unis 05/2026 Poids ouverts
Code en Apache-2.0, poids en CC BY 4.0
Carte graphique de joueur Musique vérifié il y a 13 jours
Fara 1.5 9B
9 milliards de paramètres ; contexte 262 144 tokens ; observe le navigateur par CAPTURES D'ÉCRAN et agit par appels d'outils structurés (clic, saisie, défilement, ouverture d'URL, recherche) jusqu'à l'accomplissement de la tâche.
Microsoft États-Unis 05/2026 Poids ouverts
MIT
Carte graphique de joueur Vision, Texte, Code vérifié il y a 14 jours
Hy-MT2-7B
7 milliards de paramètres (dense) ; traduction entre 33 langues ; suivi de consignes de traduction multilingues.
Tencent Chine 05/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte vérifié il y a 13 jours
Hy-MT2-30B-A3B
30 milliards de paramètres (MoE) ; traduction entre 36 langues ; suivi de consignes de traduction, gestion terminologique, adaptation de style et traduction de données structurées.
Tencent Chine 05/2026 Poids ouverts
Apache-2.0
Station de travail Texte vérifié il y a 13 jours
Hy-MT2-1.8B
1,8 milliard de paramètres ; traduction entre 33 langues et suivi de consignes de traduction dans plusieurs langues ; quantification extrême ramenant le modèle à 440 Mo pour une inférence 1,5 fois plus rapide, selon l'éditeur.
Tencent Chine 05/2026 Poids ouverts
Apache-2.0
Portable récent Texte vérifié il y a 14 jours
Command A+ (05-2026)
218 milliards de paramètres au total, 25 milliards actifs ; contexte 128K en entrée, 64K en sortie ; entrée texte et image, sortie texte ; 48 langues.
Cohere Canada 05/2026 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code, Vision vérifié il y a 14 jours
Midjourney V8.1
Images HD jusqu'à 2048 px (2K) sans upscaling ; rendu standard 4 à 5 fois plus rapide que les versions précédentes selon l'éditeur.
Midjourney États-Unis 30/04/2026 Fermé
propriétaire — service en ligne (Discord/web)
sans objet Image vérifié il y a 1 mois
Granite 4.1 (30B)
131 072 tokens de fenêtre de contexte
IBM États-Unis 29/04/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code vérifié il y a 14 jours
Granite Speech 4.1 2B Plus
2 milliards de paramètres ; reconnaissance vocale ATTRIBUÉE PAR LOCUTEUR (étiquettes « [Speaker 1] ») et horodatage au MOT près ; anglais, français, allemand, espagnol, portugais.
IBM États-Unis 28/04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix vérifié il y a 14 jours
DeepSeek-V4-Pro
1 600 milliards de paramètres au total, 49 milliards actifs (MoE) ; fenêtre de contexte 1 million de tokens.
DeepSeek Chine 24/04/2026 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
DeepSeek-V4-Flash
284 milliards de paramètres au total, 13 milliards actifs (MoE) ; fenêtre de contexte 1 million de tokens.
DeepSeek Chine 24/04/2026 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Qwen3.6-27B
Modèle dense, orienté code agentique et « préservation de la pensée » entre itérations ; contexte annoncé 262 144 tokens en déploiement (SGLang/vLLM).
Alibaba Chine 22/04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Code, Texte vérifié il y a 14 jours
MiniMax-M2.7
229 milliards de paramètres au total (MoE).
MiniMax Chine 20/04/2026 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Claude Opus 4.7
1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 16/04/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Qwen3.6-35B-A3B
35 milliards de paramètres au total (MoE) ; contexte annoncé 262 144 tokens en déploiement. Part active non précisée dans le README consulté.
Alibaba Chine 16/04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Code, Texte vérifié il y a 14 jours
Mistral Medium 3.5
256 k tokens de contexte ; 128 Md paramètres (dense)
Mistral AI France 04/2026 Poids ouverts
Modified MIT License (Mistral AI)
Serveur multi-GPU Texte, Code, Image vérifié il y a 14 jours
Kimi-K2.6
1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts dont 8 par token + 1 partagé, 61 couches) ; contexte 256 000 tokens ; encodeur vision MoonViT de 400 M de paramètres ; vidéo annoncée en expérimental via l'API.
Moonshot AI Chine 04/2026 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code, Vision vérifié il y a 14 jours
GLM-5.1
~754 milliards de paramètres ; architecture MoE à attention éparse (GLM_MOE_DSA) ; texte uniquement.
Z.ai (ex-Zhipu AI) Chine 04/2026 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Hy3-preview
295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; 64 têtes d'attention (GQA, 8 têtes KV) ; texte uniquement.
Tencent Chine 04/2026 Poids ouverts
Tencent Hy Community License Agreement
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Granite Guardian 4.1 8B
Modèle de garde : juge une entrée ou une sortie de LLM contre un critère et répond oui/non ; détecteurs prêts pour les contournements de consigne, la vulgarité et l'hallucination en RAG ; critères personnalisés acceptés ; mode « thinking » avec trace de raisonnement ou mode direct.
IBM États-Unis 04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte vérifié il y a 14 jours
Granite 4.1 3B
3 milliards de paramètres ; transformeur dense décodeur seul (40 couches, 40 têtes d'attention, 8 têtes KV, dimension 2 560) ; contexte 131 072 tokens ; 12 langues ; complétion de code « fill-in-the-middle ».
IBM États-Unis 04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Granite Speech 4.1 2B
2 milliards de paramètres ; reconnaissance vocale multilingue ET traduction vocale bidirectionnelle ; anglais, français, allemand, espagnol, portugais, japonais ; ponctuation et majuscules restituées ; reconnaissance orientable par mots-clés.
IBM États-Unis 04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix vérifié il y a 14 jours
Granite Vision 4.1 4B
4 milliards de paramètres (3,4 Md pour le modèle de langage, 0,6 Md pour l'encodeur vision et les projecteurs) ; entrée consignes en anglais + images PNG/JPEG, sortie texte structuré (CSV, JSON, HTML, OTSL, code Python).
IBM États-Unis 04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
Granite 4.1 8B
8 milliards de paramètres ; transformeur dense décodeur seul (GQA, RoPE, SwiGLU, RMSNorm, embeddings d'entrée et de sortie partagés) ; contexte 131 072 tokens ; 12 langues.
IBM États-Unis 04/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Gemma 4 26B A4B
25,2 milliards de paramètres au total, 3,8 milliards actifs (MoE, 8 experts activés sur 128 + 1 partagé) ; contexte 256K tokens ; attention hybride (fenêtre glissante locale de 1024 tokens + attention globale) ; entrée texte et image, sortie texte ; plus de 140 langues.
Google DeepMind États-Unis 31/03/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code, Vision vérifié il y a 14 jours
Gemma 4 E2B
~2,3 milliards de paramètres effectifs (5,1 Md avec les embeddings) ; contexte 128K tokens ; entrée texte, image ET audio, sortie texte ; annoncé pour téléphones haut de gamme et portables.
Google DeepMind États-Unis 31/03/2026 Poids ouverts
Apache-2.0
Portable récent Texte, Code, Vision vérifié il y a 14 jours
Gemma 4 31B
256K tokens de contexte ; 30,7 milliards de paramètres (dense) ; entrée texte + image, sortie texte ; poids non quantifiés testés sur GPU NVIDIA H100 80GB, versions quantifiées disponibles pour GPU grand public.
Google DeepMind États-Unis 31/03/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code, Vision vérifié il y a 14 jours
Gemma 4 E4B
128K tokens de contexte ; ~4,5 milliards de paramètres effectifs (8B avec les embeddings), technique « Per-Layer Embeddings » ; entrée texte + image + audio, sortie texte ; conçu pour mobile, Raspberry Pi, NVIDIA Jetson Orin Nano.
Google DeepMind États-Unis 31/03/2026 Poids ouverts
Apache-2.0
Portable récent Texte, Code, Vision vérifié il y a 14 jours
Suno v5.5 Suno États-Unis 26/03/2026 Fermé
propriétaire — application/API
sans objet Musique vérifié il y a 14 jours
Cohere Transcribe (03-2026)
2 milliards de paramètres ; architecture encodeur-décodeur de type conformer ; entrée audio (rééchantillonné à 16 kHz), sortie texte ; 14 langues (9 européennes, 4 APAC, arabe).
Cohere Canada 26/03/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix vérifié il y a 14 jours
Voxtral TTS
Synthèse vocale (TTS) streaming faible latence, clonage de voix zero-shot, sortie audio 24 kHz, 20 voix prédéfinies
Mistral AI France 23/03/2026 Poids ouverts
CC BY-NC 4.0
Portable récent Voix vérifié il y a 14 jours
Mistral Small 4
256 k tokens de contexte ; 119 Md paramètres au total / 6 Md actifs par token (128 experts, 4 actifs)
Mistral AI France 16/03/2026 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code, Image vérifié il y a 14 jours
GLM-OCR
Environ 0,9 à 1 milliard de paramètres ; OCR de documents complexes (mise en page, formules, tableaux).
Z.ai (ex-Zhipu AI) Chine 11/03/2026 Poids ouverts
MIT
Portable récent Vision, Texte vérifié il y a 14 jours
Granite 4.0 1B Speech
1 milliard de paramètres (2 Md avec le projecteur) ; reconnaissance vocale multilingue et traduction vocale bidirectionnelle ; anglais, français, allemand, espagnol, portugais, japonais ; encodeur audio + projecteur à sous-échantillonnage temporel + modèle de langage.
IBM États-Unis 06/03/2026 Poids ouverts
Apache-2.0
Portable récent Voix vérifié il y a 14 jours
Phi-4-reasoning-vision-15B
15 milliards de paramètres ; contexte 16 384 tokens ; backbone Phi-4-Reasoning + encodeur vision SigLIP-2 (architecture mid-fusion) ; raisonnement visuel sur graphiques, diagrammes, mises en page de documents.
Microsoft États-Unis 04/03/2026 Poids ouverts
MIT
Station de travail Texte, Vision vérifié il y a 14 jours
Qianfan-OCR
4 milliards de paramètres ; image vers Markdown en direct ; analyse de mise en page, extraction de tableaux, reconnaissance de formules, compréhension de graphiques, extraction d'informations clés ; 192 langues ; mécanisme optionnel « Layout-as-Thought » produisant l'analyse de structure avant la sortie finale.
Baidu Chine 03/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
LTX-2.3
22 milliards de paramètres ; modèle de fondation audio-vidéo à base de DiT produisant image ET son synchronisés en une seule passe ; texte-vers-vidéo et image-vers-vidéo ; sur-échantillonneurs spatial et temporel fournis.
Lightricks Israël 03/2026 Poids ouverts
LTX-2 Community License Agreement
Serveur multi-GPU Vidéo, Musique vérifié il y a 14 jours
Gemini 3.1 Pro
Contexte 1M tokens en entrée / 64K en sortie ; entrée texte, image, audio, vidéo, PDF ; sortie texte ; connaissances arrêtées janvier 2025.
Google DeepMind États-Unis 19/02/2026 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Lyria 3
Génération de musique à partir de texte, instrumental ou avec voix/paroles ; diffusion latente appliquée à l'audio.
Google DeepMind États-Unis 18/02/2026 Fermé
propriétaire — API
sans objet Musique vérifié il y a 14 jours
Claude Sonnet 4.6
1 000 000 tokens de contexte (bêta) ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 17/02/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Claude Opus 4.6
1 000 000 tokens de contexte (bêta, première génération Opus à ce palier) ; jusqu'à 128 000 tokens de sortie par requête
Anthropic États-Unis 05/02/2026 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Voxtral Mini 4B Realtime
4 milliards de paramètres ; transcription multilingue EN TEMPS RÉEL, architecture nativement en flux ; délai configurable de 240 ms à 2,4 s ; 13 langues ; l'éditeur annonce une précision comparable aux systèmes hors ligne à partir de 480 ms de délai.
Mistral AI France 02/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix vérifié il y a 14 jours
Qwen3.5-397B-A17B
397 milliards de paramètres au total, 17 milliards actifs (MoE épars couplé à des « Gated Delta Networks », 512 experts dont 11 activés, 60 couches) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo ; 201 langues.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-122B-A10B
122 milliards de paramètres au total, 10 milliards actifs (MoE épars couplé à des « Gated Delta Networks », 48 couches) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo, sortie texte ; 201 langues et dialectes annoncés.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-35B-A3B
35 milliards de paramètres au total, 3 milliards actifs (MoE épars, 256 experts dont 8 routés + 1 partagé par token) ; contexte natif 262 144 tokens, extensible à ~1 010 000 par YaRN ; entrée texte, image et vidéo.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-27B
27 milliards de paramètres (dense) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; encodeur vision intégré — entrée texte, image et vidéo, sortie texte.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Station de travail Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-4B
4 milliards de paramètres ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo, sortie texte.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-2B
2 milliards de paramètres ; contexte natif 262 144 tokens ; entrée texte, image et vidéo, sortie texte.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-0.8B
0,8 milliard de paramètres ; contexte natif 262 144 tokens ; entrée texte, image et vidéo, sortie texte.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Portable récent Texte, Code, Vision vérifié il y a 14 jours
Qwen3.5-9B
9 milliards de paramètres ; contexte natif 262 144 tokens, extensible à ~1 010 000 par mise à l'échelle RoPE ; modèle causal à encodeur vision intégré — entrée texte, image et vidéo, sortie texte.
Alibaba Chine 02/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Vision vérifié il y a 14 jours
GLM-5
744 milliards de paramètres au total, 40 milliards actifs (MoE) ; attention éparse de type DSA ; pré-entraînement porté de 23 000 à 28 500 milliards de tokens par rapport à GLM-4.5 ; texte uniquement.
Z.ai (ex-Zhipu AI) Chine 02/2026 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
MiniMax-M2.5
229 milliards de paramètres au total ; nombre de paramètres activés non précisé sur la fiche consultée ; fenêtre de contexte non précisée non plus.
MiniMax Chine 02/2026 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Eleven v3
70 langues et plus, balises audio (« audio tags ») pour le contrôle émotionnel ; positionné par l'éditeur pour la voix off à fort enjeu (documentaire, audiobook), pas le temps réel.
ElevenLabs États-Unis 02/2026 Fermé
propriétaire — API
sans objet Voix vérifié il y a 14 jours
Kimi-K2.5
1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts dont 8 par token) ; contexte 256K tokens ; encodeur vision MoonViT de 400 M ; pré-entraînement continu sur ~15 000 milliards de tokens mixtes texte et image.
Moonshot AI Chine 29/01/2026 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code, Vision vérifié il y a 14 jours
FLUX.2 [klein] 4B
4 milliards de paramètres, environ 8 Go de VRAM ; variante distillée orientée vitesse (« interactive visual intelligence »).
Black Forest Labs Allemagne 15/01/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Image vérifié il y a 14 jours
LTX-2
Vidéo native 4K à 50 images/seconde avec audio synchronisé (voix comprise), clips jusqu'à 20 secondes.
Lightricks Israël 06/01/2026 Poids ouverts
LTX-2 Community License Agreement
Carte graphique de joueur Vidéo vérifié il y a 14 jours
Jamba2 3B
3 milliards de paramètres ; architecture hybride SSM-Transformer ; contexte 256K tokens ; conçu pour l'exécution sur mobile et matériel grand public.
AI21 Labs Israël 06/01/2026 Poids ouverts
Apache-2.0
Portable récent Texte, Code vérifié il y a 14 jours
DeepSeek-OCR-2
3 milliards de paramètres ; résolution dynamique (l'image est traitée à plusieurs échelles) ; deux modes — conversion de document en markdown, ou OCR libre sans conservation de la mise en page.
DeepSeek Chine 01/2026 Poids ouverts
Apache-2.0
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
GLM-Image
Architecture hybride autorégressive + diffusion : générateur autorégressif ~9 milliards + décodeur de diffusion ~7 milliards ; génération et édition d'image, rendu de texte, cohérence multi-sujets.
Z.ai (ex-Zhipu AI) Chine 01/2026 Poids ouverts
MIT
Carte graphique de joueur Image vérifié il y a 14 jours
Nemotron 3 Nano (30B-A3B)
Fenêtre de contexte jusqu’à 1M tokens (256k par défaut sur Hugging Face pour raison de VRAM)
Nvidia États-Unis 15/12/2025 Poids ouverts
NVIDIA Nemotron Open Model License
Station de travail Texte, Code vérifié il y a 14 jours
Devstral 2
256 k tokens de contexte ; 123 Md paramètres (dense) ; 72,2 % sur SWE-bench Verified (score publié par l'éditeur)
Mistral AI France 09/12/2025 Poids ouverts
Modified MIT License (Mistral AI)
Serveur multi-GPU Code, Texte vérifié il y a 14 jours
Devstral Small 2
256 k tokens de contexte ; 24 Md paramètres ; 68,0 % sur SWE-bench Verified (score publié par l'éditeur)
Mistral AI France 09/12/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Code, Texte vérifié il y a 14 jours
Nova 2 Pro
Contexte 1M tokens ; raisonnement ajustable (faible/moyen/élevé), outils intégrés (interpréteur de code, recherche web), support MCP distant ; annoncé pour tâches agentiques complexes (analyse multi-documents, raisonnement vidéo, migrations logicielles).
Amazon États-Unis 02/12/2025 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Nova 2 Lite
Contexte 1M tokens ; raisonnement ajustable, outils intégrés (interpréteur de code, recherche web) ; disponibilité générale.
Amazon États-Unis 02/12/2025 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Nova 2 Sonic
Contexte 1M tokens (sortie max 64K) ; conversation vocale en temps réel, entrée/sortie voix et texte en streaming bidirectionnel.
Amazon États-Unis 02/12/2025 Fermé
propriétaire — API
sans objet Voix vérifié il y a 14 jours
Mistral Large 3
256 k tokens de contexte ; 675 Md paramètres au total / 41 Md actifs (mixture-of-experts épars)
Mistral AI France 02/12/2025 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code, Image vérifié il y a 14 jours
Ministral 3 14B
256 k tokens de contexte (annoncé pour la famille) ; 14 Md paramètres
Mistral AI France 02/12/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Image vérifié il y a 14 jours
Ministral 3 8B
256 k tokens de contexte ; 9 Md paramètres (8,4 Md langage + 0,4 Md encodeur vision)
Mistral AI France 02/12/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Image vérifié il y a 14 jours
Ministral 3 3B
256 k tokens de contexte (annoncé pour la famille) ; 3 Md paramètres
Mistral AI France 02/12/2025 Poids ouverts
Apache-2.0
Portable récent Texte, Code, Image vérifié il y a 14 jours
DeepSeek-V3.2
685 milliards de paramètres au total (MoE). Introduit l'attention parcimonieuse DeepSeek (DSA), successeur de V3.2-Exp.
DeepSeek Chine 01/12/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Gen-4.5
Vidéos de 2 à 10 secondes, résolution jusqu'à 1280×720 (720p), 24 ou 25 images/seconde ; texte-vers-vidéo et image-vers-vidéo.
Runway États-Unis 01/12/2025 Fermé
propriétaire — application/API
sans objet Vidéo vérifié il y a 1 mois
GLM-4.7
358 milliards de paramètres (MoE) ; contexte 131 072 tokens ; modes « Interleaved Thinking » et « Preserved Thinking » ; appel d'outils au format OpenAI.
Z.ai (ex-Zhipu AI) Chine 12/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
AutoGLM-Phone-9B
Bâti sur GLM-4-9B ; comprend l'écran d'un téléphone par vision-langage et pilote l'appareil via ADB (Android Debug Bridge) ; planifie et exécute des séquences d'actions à partir d'une consigne en langage naturel.
Z.ai (ex-Zhipu AI) Chine 12/2025 Poids ouverts
MIT
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
GLM-ASR-Nano
1,5 milliard de paramètres ; transcription audio vers texte ; anglais, mandarin, cantonais et dialectes ; annoncé robuste sur la parole dialectale, chuchotée ou en réunion bruyante.
Z.ai (ex-Zhipu AI) Chine 12/2025 Poids ouverts
MIT
Portable récent Voix vérifié il y a 14 jours
GLM-4.6V-Flash
9 milliards de paramètres ; contexte 128K tokens ; entrée image et texte, sortie texte et texte-image entrelacé ; appel de fonctions natif.
Z.ai (ex-Zhipu AI) Chine 12/2025 Poids ouverts
MIT
Carte graphique de joueur Texte, Vision vérifié il y a 14 jours
MiniMax-M2.1
229 milliards de paramètres au total ; paramètres activés et fenêtre de contexte non précisés sur la fiche consultée.
MiniMax Chine 12/2025 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Chatterbox Turbo
350 millions de paramètres ; clonage vocal zero-shot, filigrane PerTh intégré à chaque extrait généré.
Resemble AI États-Unis 12/2025 Poids ouverts
MIT
Carte graphique de joueur Voix vérifié il y a 14 jours
FLUX.2 [dev]
32 milliards de paramètres (VLM Mistral-3 24B + transformateur rectified-flow) ; édition d'image jusqu'à 4 mégapixels avec jusqu'à 10 images de référence.
Black Forest Labs Allemagne 25/11/2025 Poids ouverts
FLUX Non-Commercial License
Station de travail Image vérifié il y a 14 jours
FLUX.2 [pro]
Édition d'image jusqu'à 4 mégapixels, jusqu'à 10 images de référence (mêmes capacités annoncées que le reste de la famille FLUX.2).
Black Forest Labs Allemagne 25/11/2025 Fermé
propriétaire — API
sans objet Image vérifié il y a 14 jours
Nano Banana Pro
Génération et édition d'image nativement via Gemini 3 Pro ; rendu de texte long et multi-style dans l'image annoncé comme point fort par Google.
Google DeepMind États-Unis 20/11/2025 Fermé
propriétaire — API
sans objet Image vérifié il y a 14 jours
OLMo 3 (32B, Base)
65 536 tokens de fenêtre de contexte (variante Base)
Allen Institute for AI (Ai2) États-Unis 20/11/2025 Open source
Apache-2.0
Station de travail Texte, Code vérifié il y a 14 jours
SAM 3 (Segment Anything Model)
Segmentation/détection/suivi d'objets par concept texte, image ou masque ; mise à jour SAM 3.1 (27/03/2026) : ~7x plus rapide en suivi multi-objets sur un GPU H100 unique
Meta États-Unis 19/11/2025 Poids ouverts
SAM License
Station de travail Vision, Vidéo vérifié il y a 14 jours
Kimi-K2-Thinking
1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts) ; contexte 256 000 tokens ; quantification INT4 native (entraînement conscient de la quantification).
Moonshot AI Chine 06/11/2025 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Claude Opus 4.5
200 000 tokens de contexte ; jusqu'à 64 000 tokens de sortie par requête
Anthropic États-Unis 01/11/2025 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
DeepSeek-V3.2-Speciale
685 milliards de paramètres ; attention éparse DeepSeek ; NE PREND PAS EN CHARGE l'appel d'outils — orienté exclusivement raisonnement.
DeepSeek Chine 11/2025 Poids ouverts
MIT
Serveur multi-GPU Texte vérifié il y a 14 jours
Nova Premier
Contexte 1M tokens (sortie max 25K), raisonnement pris en charge ; entrée texte/image/vidéo, sortie texte ; connaissances arrêtées octobre 2024 ; usages annoncés : distillation de modèle, workflows agentiques.
Amazon États-Unis 31/10/2025 Fermé
propriétaire — API
sans objet Texte, Vision vérifié il y a 14 jours
Kimi-Linear-48B-A3B
48 milliards de paramètres au total, 3 milliards actifs ; contexte 1 million de tokens ; attention linéaire hybride « Kimi Delta Attention » et MLA globale dans un rapport 3:1.
Moonshot AI Chine 30/10/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Firefly Image Model 5
Génération en résolution native 4 mégapixels sans upscaling.
Adobe États-Unis 28/10/2025 Fermé
propriétaire — application/API Adobe Firefly
sans objet Image vérifié il y a 14 jours
MiniMax-M2
230 milliards de paramètres au total, 10 milliards actifs (MoE) ; contexte évalué à 128 000 tokens.
MiniMax Chine 27/10/2025 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
DeepSeek-OCR
3 milliards de paramètres ; OCR et conversion document-vers-texte par compression visuelle (« optical compression »).
DeepSeek Chine 21/10/2025 Poids ouverts
MIT
Portable récent Vision, Texte vérifié il y a 14 jours
Claude Haiku 4.5
200 000 tokens de contexte ; jusqu'à 64 000 tokens de sortie par requête
Anthropic États-Unis 01/10/2025 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
Veo 3.1
Génération vidéo avec audio natif synchronisé (dialogue, bruitages, ambiance) ; jusqu'à 4K et formats verticaux (mise à jour janvier 2026) ; 8 secondes par défaut, extension de scène pour récits plus longs.
Google DeepMind États-Unis 10/2025 Fermé
propriétaire — API
sans objet Vidéo vérifié il y a 14 jours
Jamba Reasoning 3B
256K tokens de fenêtre de contexte
AI21 Labs Israël 10/2025 Poids ouverts
Apache-2.0
Portable récent Texte, Code vérifié il y a 14 jours
Sora 2
Clips de 15 à 25 secondes, son et image synchronisés
OpenAI États-Unis 30/09/2025 Fermé
propriétaire — API
sans objet Vidéo vérifié il y a 14 jours
GLM-4.6
357 milliards de paramètres au total (MoE, ~32 milliards actifs selon des sources secondaires convergentes non confirmées verbatim sur la fiche officielle) ; contexte 200 000 tokens en entrée, 128 000 en sortie.
Z.ai (ex-Zhipu AI) Chine 30/09/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Claude Sonnet 4.5
200 000 tokens de contexte ; jusqu'à 64 000 tokens de sortie par requête
Anthropic États-Unis 29/09/2025 Fermé
propriétaire — API
sans objet Texte, Code, Image, Vision vérifié il y a 14 jours
gpt-oss-safeguard-120b
117 milliards de paramètres, 5,1 milliards actifs ; tient sur un unique GPU H100 ; même rôle que la version 20b — interpréter une politique écrite et rendre une décision raisonnée — avec plus de finesse sur les politiques complexes, au prix de la latence.
OpenAI États-Unis 09/2025 Poids ouverts
Apache-2.0
Station de travail Texte vérifié il y a 13 jours
gpt-oss-safeguard-20b
21 milliards de paramètres, 3,6 milliards actifs ; modèle de raisonnement de sûreté bâti sur gpt-oss : il INTERPRÈTE une politique écrite par l'utilisateur pour filtrer entrées et sorties, et rend une décision RAISONNÉE plutôt qu'un score.
OpenAI États-Unis 09/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte vérifié il y a 14 jours
Magistral Small 1.2
128 k tokens de contexte (qualité soutenue par l'éditeur) ; 24 Md paramètres ; encodeur vision ajouté en 1.2
Mistral AI France 09/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code, Image vérifié il y a 14 jours
Magistral Medium 1.2
128 k tokens de contexte (qualité soutenue par l'éditeur) ; encodeur vision ajouté en 1.2
Mistral AI France 09/2025 Fermé
propriétaire — accès API uniquement
sans objet Texte, Code, Image vérifié il y a 14 jours
DeepSeek-V3.1-Terminus
685 milliards de paramètres ; même architecture que V3.1 ; texte uniquement.
DeepSeek Chine 09/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 13 jours
DeepSeek-V3.2-Exp
685 milliards de paramètres ; attention éparse « DeepSeek Sparse Attention » (DSA) ; texte uniquement.
DeepSeek Chine 09/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Qwen3-Omni-30B-A3B-Instruct
Architecture Thinker-Talker ; ~35 milliards de paramètres selon la fiche consultée (le nom du modèle suggère ~30 Md au total / 3 Md actifs, non confirmé explicitement). 119 langues en entrée texte, 19 en entrée vocale, 10 en sortie vocale. Contexte évalué à 32 768 tokens.
Alibaba Chine 09/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Vision, Voix, Vidéo vérifié il y a 14 jours
Qwen3-VL-2B-Instruct
2 milliards de paramètres ; contexte natif 256 000 tokens, extensible à 1 million.
Alibaba Chine 09/2025 Poids ouverts
Apache-2.0
Portable récent Vision, Texte vérifié il y a 14 jours
Qwen3-VL-235B-A22B-Instruct
236 milliards de paramètres au total (MoE) ; contexte natif 256 000 tokens, extensible à 1 million. Comprend image, texte et vidéo.
Alibaba Chine 09/2025 Poids ouverts
Apache-2.0
Serveur multi-GPU Vision, Texte vérifié il y a 14 jours
ERNIE-4.5-21B-A3B-Thinking
21 milliards de paramètres au total, 3 milliards actifs par token ; contexte 131 072 tokens ; longueur de réflexion allongée ; usage d'outils ; texte uniquement.
Baidu Chine 09/2025 Poids ouverts
Apache-2.0
Station de travail Texte, Code vérifié il y a 13 jours
MAI-1-preview
Modèle Mixture-of-Experts pré-entraîné et post-entraîné sur environ 15 000 GPU NVIDIA H100 ; ciblé sur le suivi d'instructions et les requêtes conversationnelles courantes (rédaction, résumé, tâches scolaires).
Microsoft États-Unis 28/08/2025 Fermé
propriétaire — API
sans objet Texte vérifié il y a 14 jours
Seed-OSS-36B-Instruct
36 milliards de paramètres denses ; contexte natif entraîné jusqu'à 512 000 tokens ; budget de raisonnement ajustable par l'utilisateur.
ByteDance Chine 20/08/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
GLM-4.7-Flash
31 milliards de paramètres au total, 3 milliards actifs (MoE) ; contexte 131 072 tokens.
Z.ai (ex-Zhipu AI) Chine 08/08/2025 Poids ouverts
MIT
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Qwen-Image
20 milliards de paramètres ; génération et édition d'image (transfert de style, manipulation d'objets, édition de texte incrusté), rendu de texte complexe.
Alibaba Chine 04/08/2025 Poids ouverts
Apache-2.0
Station de travail Image vérifié il y a 14 jours
gpt-oss-120b
131 072 tokens de contexte et de sortie max ; 117 Md de paramètres (5,1 Md actifs, architecture MoE)
OpenAI États-Unis 08/2025 Poids ouverts
Apache-2.0
Station de travail Texte, Code vérifié il y a 14 jours
gpt-oss-20b
131 072 tokens de contexte et de sortie max ; 21 Md de paramètres (3,6 Md actifs, architecture MoE)
OpenAI États-Unis 08/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Codestral 25.08
128 k tokens de contexte (fill-in-the-middle, complétion basse latence)
Mistral AI France 08/2025 Fermé
propriétaire — accès API uniquement (offre "Premier")
sans objet Code vérifié il y a 14 jours
DeepSeek-V3.1
671 milliards de paramètres au total, 37 milliards actifs ; contexte 128K tokens ; entraîné au format FP8 (UE8M0) sur les poids et les activations.
DeepSeek Chine 08/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
Jamba Large 1.7
256K tokens de fenêtre de contexte
AI21 Labs Israël 08/2025 Poids ouverts
Jamba Open Model License
Serveur multi-GPU Texte vérifié il y a 14 jours
Wan2.2-TI2V-5B
5 milliards de paramètres ; texte-vers-vidéo et image-vers-vidéo, taillé pour tourner sur une carte grand public.
Alibaba Chine 28/07/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Vidéo vérifié il y a 14 jours
Wan2.2-T2V-A14B
27 milliards de paramètres au total (MoE, deux experts de 14 Md — un pour la composition d'ensemble, un pour le raffinement des détails), 14 milliards actifs par étape de débruitage.
Alibaba Chine 28/07/2025 Poids ouverts
Apache-2.0
Station de travail Vidéo vérifié il y a 14 jours
Qwen3-Coder-30B-A3B-Instruct
30,5 milliards de paramètres au total, 3,3 milliards actifs (MoE) ; contexte natif 262 144 tokens, extensible à 1 million (YaRN).
Alibaba Chine 23/07/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Code vérifié il y a 14 jours
Voxtral Small 24B
32 k tokens de contexte ; jusqu'à 40 min d'audio en compréhension / 30 min en transcription
Mistral AI France 15/07/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Voix, Texte vérifié il y a 14 jours
Voxtral Mini 3B
32 k tokens de contexte ; jusqu'à 40 min d'audio en compréhension / 30 min en transcription
Mistral AI France 15/07/2025 Poids ouverts
Apache-2.0
Portable récent Voix, Texte vérifié il y a 14 jours
SmolLM3-3B
128K tokens de fenêtre de contexte (NoPE + YaRN)
Hugging Face États-Unis 08/07/2025 Poids ouverts
Apache-2.0
Portable récent Texte, Code vérifié il y a 14 jours
ERNIE-4.5-0.3B
0,36 milliard de paramètres denses ; contexte 131 072 tokens.
Baidu Chine 01/07/2025 Poids ouverts
Apache-2.0
Portable récent Texte vérifié il y a 14 jours
ERNIE-4.5-21B-A3B
21 milliards de paramètres au total, 3 milliards actifs (MoE) ; contexte 131 072 tokens.
Baidu Chine 01/07/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
ERNIE-4.5-VL-424B-A47B
424 milliards de paramètres au total, 47 milliards actifs (MoE multimodal hétérogène — experts partagés et dédiés selon la modalité) ; contexte 131 072 tokens ; image et texte en entrée, texte en sortie.
Baidu Chine 01/07/2025 Poids ouverts
Apache-2.0
Serveur multi-GPU Vision, Texte vérifié il y a 14 jours
Kimi-K2-Instruct
1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts, 8 sélectionnés par token) ; contexte 128 000 tokens.
Moonshot AI Chine 07/2025 Poids ouverts
Modified MIT License
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
GLM-4.6V
106 milliards de paramètres (variante complète ; une variante « Flash » à 9 milliards existe aussi pour un palier plus léger) ; contexte 128 000 tokens ; image, document et vidéo en entrée.
Z.ai (ex-Zhipu AI) Chine 07/2025 Poids ouverts
MIT
Station de travail Vision, Texte vérifié il y a 14 jours
Hunyuan-A13B-Instruct
80 milliards de paramètres au total, 13 milliards actifs (MoE) ; contexte 256 000 tokens (mode par défaut limité à 32 000) ; bascule dynamique entre raisonnement rapide et lent.
Tencent Chine 27/06/2025 Poids ouverts
Tencent Hunyuan A13B Community License Agreement
Station de travail Texte, Code vérifié il y a 14 jours
Qwen3-0.6B
600 millions de paramètres denses ; contexte natif 32 768 tokens.
Alibaba Chine 05/2025 Poids ouverts
Apache-2.0
Portable récent Texte, Code vérifié il y a 14 jours
Qwen3-8B
8,2 milliards de paramètres denses ; contexte natif 32 768 tokens, extensible à 131 072 (YaRN).
Alibaba Chine 05/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Qwen3-32B
32,8 milliards de paramètres denses ; contexte natif 32 768 tokens, extensible à 131 072 (YaRN).
Alibaba Chine 05/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Qwen3-30B-A3B
30,5 milliards de paramètres au total, 3,3 milliards actifs (MoE) ; contexte natif 32 768 tokens, extensible à 131 072.
Alibaba Chine 05/2025 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
Qwen3-235B-A22B
235 milliards de paramètres au total, 22 milliards actifs (MoE) ; contexte natif 32 768 tokens, extensible à 131 072.
Alibaba Chine 05/2025 Poids ouverts
Apache-2.0
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
o3
200 000 tokens de contexte ; jusqu'à 100 000 tokens de sortie par requête
OpenAI États-Unis 16/04/2025 Fermé
propriétaire — API
sans objet Texte, Code vérifié il y a 14 jours
Kimi-VL-A3B-Thinking-2506
16 milliards de paramètres au total (MoE, ~3 milliards actifs) ; contexte 131 072 tokens ; image (jusqu'à 3,2 mégapixels), vidéo et texte en entrée.
Moonshot AI Chine 10/04/2025 Poids ouverts
MIT
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
Llama 4 Maverick
1 M tokens de contexte ; 400 Md paramètres au total / 17 Md actifs (mixture-of-experts, 128 experts)
Meta États-Unis 05/04/2025 Poids ouverts
Llama 4 Community License Agreement
Serveur multi-GPU Texte, Code, Image vérifié il y a 14 jours
Llama 4 Scout
10 M tokens de contexte ; 109 Md paramètres au total / 17 Md actifs (mixture-of-experts, 16 experts)
Meta États-Unis 05/04/2025 Poids ouverts
Llama 4 Community License Agreement
Station de travail Texte, Code, Image vérifié il y a 14 jours
Gemma 3 27B
128K tokens de contexte ; entrée texte + image (normalisée 896×896, 256 tokens/image), sortie texte jusqu'à 8192 tokens ; plus de 140 langues.
Google DeepMind États-Unis 10/03/2025 Poids ouverts
Gemma Terms of Use
Carte graphique de joueur Texte, Vision vérifié il y a 14 jours
Gemini 2.5 Pro
Contexte 1 048 576 tokens en entrée / 65 536 en sortie ; entrée audio, image, vidéo, PDF, texte ; sortie texte ; connaissances arrêtées janvier 2025.
Google DeepMind États-Unis 03/2025 Fermé
propriétaire — API
sans objet Texte, Code, Vision vérifié il y a 14 jours
Command A (03-2025)
256K tokens de fenêtre de contexte (128K par défaut sur Hugging Face)
Cohere Canada 03/2025 Poids ouverts
CC-BY-NC-4.0
Serveur multi-GPU Texte vérifié il y a 14 jours
Claude 3.7 Sonnet
Jusqu'à 128 000 tokens de sortie (budget de réflexion étendue inclus) ; fenêtre de contexte non précisée dans l'annonce consultée
Anthropic États-Unis 24/02/2025 Fermé
propriétaire — API
sans objet Texte, Code vérifié il y a 14 jours
Phi-4-multimodal-instruct
5,6 milliards de paramètres ; contexte 128K tokens ; entrée texte (23 langues) + image (anglais uniquement) + audio (8 langues), sortie texte ; réseau multimodal intégré traitant les trois modalités conjointement.
Microsoft États-Unis 02/2025 Poids ouverts
MIT
Carte graphique de joueur Texte, Vision vérifié il y a 14 jours
Janus-Pro-7B
7 milliards de paramètres ; compréhension et génération d'image unifiées dans un même transformeur, via des chemins d'encodage visuel découplés.
DeepSeek Chine 29/01/2025 Poids ouverts
MIT
Carte graphique de joueur Image, Vision, Texte vérifié il y a 14 jours
DeepSeek-R1
671 milliards de paramètres au total (MoE) ; fenêtre de contexte 128 000 tokens.
DeepSeek Chine 01/2025 Poids ouverts
MIT
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
DeepSeek-R1-Distill-Qwen-32B
Distillation de R1 sur base Qwen2.5-32B, environ 33 milliards de paramètres denses ; contexte évalué à 32 768 tokens.
DeepSeek Chine 01/2025 Poids ouverts
MIT
Carte graphique de joueur Texte, Code vérifié il y a 14 jours
DeepSeek-R1-Distill-Qwen-1.5B
Distillation de R1 sur base Qwen2.5-Math-1.5B, environ 1,5 à 2 milliards de paramètres denses.
DeepSeek Chine 01/2025 Poids ouverts
MIT
Portable récent Texte, Code vérifié il y a 14 jours
DeepSeek-VL2
4,5 milliards de paramètres actifs (MoE, architecture DeepSeekMoE + attention latente) ; taille totale non précisée clairement dans les sources consultées. Compréhension visuelle, OCR, documents, tableaux, ancrage visuel.
DeepSeek Chine 13/12/2024 Poids ouverts
DeepSeek Model License
Carte graphique de joueur Vision, Texte vérifié il y a 14 jours
Phi-4
14 milliards de paramètres (dense, decoder-only) ; contexte 16K tokens ; entraîné sur environ 9,8 000 milliards de tokens sur 1920 GPU H100-80G (21 jours).
Microsoft États-Unis 12/12/2024 Poids ouverts
MIT
Carte graphique de joueur Texte vérifié il y a 14 jours
Llama 3.3 70B
128 k tokens de contexte ; 70 Md paramètres (dense)
Meta États-Unis 06/12/2024 Poids ouverts
Llama 3.3 Community License Agreement
Station de travail Texte, Code vérifié il y a 14 jours
Nova Pro
Contexte 300K tokens (sortie max 5K) ; entrée texte/image/vidéo, sortie texte ; connaissances arrêtées octobre 2024.
Amazon États-Unis 05/12/2024 Fermé
propriétaire — API
sans objet Texte, Vision vérifié il y a 14 jours
Nova Canvas
Génération et édition d'image à partir de texte et d'image ; garde-fous intégrés (filigrane, modération de contenu).
Amazon États-Unis 03/12/2024 Fermé
propriétaire — API
sans objet Image vérifié il y a 14 jours
Nova Reel
Génération vidéo à partir de texte et d'image, avec contrôle du mouvement de caméra ; sortie vidéo en invocation asynchrone (StartAsyncInvoke).
Amazon États-Unis 03/12/2024 Fermé
propriétaire — API
sans objet Vidéo vérifié il y a 14 jours
HunyuanVideo
Plus de 13 milliards de paramètres selon l'éditeur (présenté comme le plus grand modèle ouvert de sa catégorie à sa sortie) ; génère des vidéos jusqu'à 129 images, typiquement 5 secondes.
Tencent Chine 03/12/2024 Poids ouverts
Tencent Hunyuan Community License Agreement
Station de travail Vidéo vérifié il y a 14 jours
Stable Diffusion 3.5 Medium
2 milliards de paramètres ; explicitement conçu par l'éditeur pour fonctionner sur du matériel grand public.
Stability AI Royaume-Uni 29/10/2024 Poids ouverts
Stability AI Community License
Carte graphique de joueur Image vérifié il y a 14 jours
Stable Diffusion 3.5 Large
8 milliards de paramètres, résolution jusqu'à 1 mégapixel.
Stability AI Royaume-Uni 22/10/2024 Poids ouverts
Stability AI Community License
Station de travail Image vérifié il y a 14 jours
Llama 3.2 3B
128 k tokens de contexte ; 3,21 Md paramètres
Meta États-Unis 25/09/2024 Poids ouverts
Llama 3.2 Community License Agreement
Portable récent Texte, Code vérifié il y a 14 jours
Llama 3.2 1B
128 k tokens de contexte ; 1,23 Md paramètres
Meta États-Unis 25/09/2024 Poids ouverts
Llama 3.2 Community License Agreement
Portable récent Texte, Code vérifié il y a 14 jours
Pixtral 12B
128 k tokens de contexte ; 12 Md paramètres (décodeur) + 400 M (encodeur vision)
Mistral AI France 09/2024 Poids ouverts
Apache-2.0
Carte graphique de joueur Texte, Image vérifié il y a 14 jours
Llama 3.1 405B
128 k tokens de contexte ; 405 Md paramètres (dense)
Meta États-Unis 23/07/2024 Poids ouverts
Llama 3.1 Community License Agreement
Serveur multi-GPU Texte, Code vérifié il y a 14 jours
K2-65B LLM360 (consortium MBZUAI, Petuum, Cerebras) International (MBZUAI, Émirats arabes unis ; Petuum et Cerebras, États-Unis) 06/2024 Open source
Apache-2.0
Serveur multi-GPU Texte vérifié il y a 14 jours
Pythia-12B EleutherAI États-Unis 03/04/2023 Open source
Apache-2.0
Carte graphique de joueur Texte vérifié il y a 14 jours
GPT-4
8 192 tokens de contexte (modèle de base gpt-4-0613)
OpenAI États-Unis 14/03/2023 Fermé
propriétaire — API
sans objet Texte, Image vérifié il y a 14 jours
Whisper
Traite l'audio par fenêtres glissantes de 30 secondes (pas de « fenêtre de contexte » au sens LLM textuel) ; 6 tailles de « tiny » (39 M paramètres, ~1 Go VRAM) à « large » (1,55 Md paramètres, ~10 Go VRAM)
OpenAI États-Unis 09/2022 Poids ouverts
MIT
Portable récent Voix vérifié il y a 14 jours

Le haut de gamme de chaque éditeur

Le modèle que chaque société place elle-même au sommet de son catalogue, d'après sa page de tarification ou sa documentation. Ce n'est pas un jugement de puissance — le site ne compare pas les modèles entre éditeurs, il rapporte ce que chacun déclare de sa propre gamme. Et ce n'est pas non plus le dernier sorti : la dernière colonne signale les cas où l'éditeur a publié quelque chose de plus récent sans pour autant le placer plus haut.

ÉditeurModèleSortieOuvertureÀ noter
AI21 Labs Jamba Large 1.7 08/2025 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Alibaba Qwen3.8-2.4T-A95B 08/2026 Poids ouverts —
Alibaba Qwen3.5-397B-A17B 02/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Alibaba Qwen3-235B-A22B 05/2025 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Amazon Nova 2 Pro 02/12/2025 Fermé —
Anthropic Claude Fable 5 09/06/2026 Fermé plus ancien qu'une autre sortie du même éditeur
Baidu ERNIE-4.5-VL-424B-A47B 01/07/2025 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Black Forest Labs FLUX.2 [pro] 25/11/2025 Fermé plus ancien qu'une autre sortie du même éditeur
Cohere Command A+ (05-2026) 05/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
DeepSeek DeepSeek-V4-Pro 24/04/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Google DeepMind Gemma 4 31B 31/03/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Google DeepMind Gemini 3.1 Pro 19/02/2026 Fermé plus ancien qu'une autre sortie du même éditeur
Lightricks LTX-2.5 07/2026 Poids ouverts —
Meta Llama 4 Maverick 05/04/2025 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Microsoft MAI-Thinking-1 02/06/2026 Fermé plus ancien qu'une autre sortie du même éditeur
MiniMax MiniMax-M3 01/06/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Mistral AI Mistral Medium 3.5 04/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Moonshot AI Kimi-K3 06/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Moonshot AI Kimi-K2-Thinking 06/11/2025 Poids ouverts plus ancien qu'une autre sortie du même éditeur
OpenAI GPT-5.6 Sol 09/07/2026 Fermé —
Stability AI Stable Audio 3 Large 20/05/2026 Fermé —
Stability AI Stable Diffusion 3.5 Large 22/10/2024 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Tencent Hy3 07/2026 Poids ouverts —
Tencent Hy-MT2-30B-A3B 05/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Tencent Hy3-preview 04/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur
Z.ai (ex-Zhipu AI) GLM-5.2 16/06/2026 Poids ouverts —
Z.ai (ex-Zhipu AI) GLM-5.1 04/2026 Poids ouverts plus ancien qu'une autre sortie du même éditeur

Par éditeur

Le catalogue complet, regroupé par société puis par lignée de modèles. Le plus récent de chaque lignée est en tête.

Adobe 1 modèle

ModèleLignéeSortieOuvertureVérification
Firefly Image Model 5 Firefly Image Model 28/10/2025 Fermé vérifié il y a 14 jours

AI21 Labs 3 modèles

Haut de gamme selon son éditeur

Jamba Large 1.7 08/2025 Poids ouverts vérifié il y a 14 jours

256K tokens de fenêtre de contexte

ModèleLignéeSortieOuvertureVérification
Jamba2 3B Jamba 06/01/2026 Poids ouverts vérifié il y a 14 jours
Jamba Reasoning 3B Jamba Reasoning 10/2025 Poids ouverts vérifié il y a 14 jours

Alibaba 27 modèles

Haut de gamme selon son éditeur

Qwen3.8-2.4T-A95B 08/2026 Poids ouverts vérifié il y a 14 jours

2 400 milliards de paramètres au total, 95 milliards actifs (MoE, 512 experts dont 11 activés par token) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; texte uniquement, mode « thinking » imposé.

Haut de gamme selon son éditeur

Qwen3.5-397B-A17B 02/2026 Poids ouverts vérifié il y a 14 jours

397 milliards de paramètres au total, 17 milliards actifs (MoE épars couplé à des « Gated Delta Networks », 512 experts dont 11 activés, 60 couches) ; contexte natif 262 144 tokens, extensible à ~1 010 000 ; entrée texte, image et vidéo ; 201 langues.

Haut de gamme selon son éditeur

Qwen3-235B-A22B 05/2025 Poids ouverts vérifié il y a 14 jours

235 milliards de paramètres au total, 22 milliards actifs (MoE) ; contexte natif 32 768 tokens, extensible à 131 072.

ModèleLignéeSortieOuvertureVérification
Qwen3.8-27B Qwen 08/2026 Poids ouverts vérifié il y a 14 jours
Qwen3-ASR-1.7B Qwen ASR 26/06/2026 Poids ouverts vérifié il y a 14 jours
Qwen3-ASR-0.6B Qwen ASR 26/06/2026 Poids ouverts vérifié il y a 14 jours
Qwen-AgentWorld-35B-A3B Qwen AgentWorld 06/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.6-27B Qwen3 22/04/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.6-35B-A3B Qwen3 16/04/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-122B-A10B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-35B-A3B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-27B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-4B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-2B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-0.8B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3.5-9B Qwen 02/2026 Poids ouverts vérifié il y a 14 jours
Qwen3-Omni-30B-A3B-Instruct Qwen3 Omni 09/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-VL-2B-Instruct Qwen3 VL 09/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-VL-235B-A22B-Instruct Qwen3 VL 09/2025 Poids ouverts vérifié il y a 14 jours
Qwen-Image Qwen Image 04/08/2025 Poids ouverts vérifié il y a 14 jours
Wan2.2-TI2V-5B Wan (vidéo) 28/07/2025 Poids ouverts vérifié il y a 14 jours
Wan2.2-T2V-A14B Wan (vidéo) 28/07/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-Coder-30B-A3B-Instruct Qwen3 Coder 23/07/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-0.6B Qwen3 05/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-8B Qwen3 05/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-32B Qwen3 05/2025 Poids ouverts vérifié il y a 14 jours
Qwen3-30B-A3B Qwen3 05/2025 Poids ouverts vérifié il y a 14 jours

Allen Institute for AI (Ai2) 1 modèle

ModèleLignéeSortieOuvertureVérification
OLMo 3 (32B, Base) OLMo 3 20/11/2025 Open source vérifié il y a 14 jours

Amazon 7 modèles

Haut de gamme selon son éditeur

Nova 2 Pro 02/12/2025 Fermé vérifié il y a 14 jours

Contexte 1M tokens ; raisonnement ajustable (faible/moyen/élevé), outils intégrés (interpréteur de code, recherche web), support MCP distant ; annoncé pour tâches agentiques complexes (analyse multi-documents, raisonnement vidéo, migrations logicielles).

ModèleLignéeSortieOuvertureVérification
Nova 2 Lite Nova 02/12/2025 Fermé vérifié il y a 14 jours
Nova 2 Sonic Nova Sonic 02/12/2025 Fermé vérifié il y a 14 jours
Nova Premier Nova 31/10/2025 Fermé vérifié il y a 14 jours
Nova Pro Nova 05/12/2024 Fermé vérifié il y a 14 jours
Nova Canvas Nova Canvas 03/12/2024 Fermé vérifié il y a 14 jours
Nova Reel Nova Reel 03/12/2024 Fermé vérifié il y a 14 jours

Anthropic 12 modèles

Haut de gamme selon son éditeur

Claude Fable 5 09/06/2026 Fermé vérifié il y a 14 jours

1 000 000 tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête

ModèleLignéeSortieOuvertureVérification
Claude Opus 5 Opus 24/07/2026 Fermé vérifié il y a 14 jours
Claude Sonnet 5 Sonnet 30/06/2026 Fermé vérifié il y a 14 jours
Claude Mythos 5 Mythos 09/06/2026 Fermé vérifié il y a 14 jours
Claude Opus 4.8 Opus 28/05/2026 Fermé vérifié il y a 14 jours
Claude Opus 4.7 Opus 16/04/2026 Fermé vérifié il y a 14 jours
Claude Sonnet 4.6 Sonnet 17/02/2026 Fermé vérifié il y a 14 jours
Claude Opus 4.6 Opus 05/02/2026 Fermé vérifié il y a 14 jours
Claude Opus 4.5 Opus 01/11/2025 Fermé vérifié il y a 14 jours
Claude Haiku 4.5 Haiku 01/10/2025 Fermé vérifié il y a 14 jours
Claude Sonnet 4.5 Sonnet 29/09/2025 Fermé vérifié il y a 14 jours
Claude 3.7 Sonnet Sonnet 24/02/2025 Fermé vérifié il y a 14 jours

Baidu 6 modèles

Haut de gamme selon son éditeur

ERNIE-4.5-VL-424B-A47B 01/07/2025 Poids ouverts vérifié il y a 14 jours

424 milliards de paramètres au total, 47 milliards actifs (MoE multimodal hétérogène — experts partagés et dédiés selon la modalité) ; contexte 131 072 tokens ; image et texte en entrée, texte en sortie.

ModèleLignéeSortieOuvertureVérification
Unlimited-OCR OCR 23/06/2026 Poids ouverts vérifié il y a 14 jours
Qianfan-OCR OCR 03/2026 Poids ouverts vérifié il y a 14 jours
ERNIE-4.5-21B-A3B-Thinking ERNIE 09/2025 Poids ouverts vérifié il y a 13 jours
ERNIE-4.5-0.3B ERNIE 4.5 01/07/2025 Poids ouverts vérifié il y a 14 jours
ERNIE-4.5-21B-A3B ERNIE 4.5 01/07/2025 Poids ouverts vérifié il y a 14 jours

Black Forest Labs 3 modèles

Haut de gamme selon son éditeur

FLUX.2 [pro] 25/11/2025 Fermé vérifié il y a 14 jours

Édition d'image jusqu'à 4 mégapixels, jusqu'à 10 images de référence (mêmes capacités annoncées que le reste de la famille FLUX.2).

ModèleLignéeSortieOuvertureVérification
FLUX.2 [klein] 4B FLUX.2 15/01/2026 Poids ouverts vérifié il y a 14 jours
FLUX.2 [dev] FLUX.2 25/11/2025 Poids ouverts vérifié il y a 14 jours

ByteDance 1 modèle

ModèleLignéeSortieOuvertureVérification
Seed-OSS-36B-Instruct Seed-OSS 20/08/2025 Poids ouverts vérifié il y a 14 jours

Cohere 6 modèles

Haut de gamme selon son éditeur

Command A+ (05-2026) 05/2026 Poids ouverts vérifié il y a 14 jours

218 milliards de paramètres au total, 25 milliards actifs ; contexte 128K en entrée, 64K en sortie ; entrée texte et image, sortie texte ; 48 langues.

ModèleLignéeSortieOuvertureVérification
North Micro Vision Instruct North 08/2026 Poids ouverts vérifié il y a 14 jours
North Mini Code 1.0 North 06/2026 Poids ouverts vérifié il y a 14 jours
Cohere Transcribe Arabic (07-2026) Cohere Transcribe 06/2026 Poids ouverts vérifié il y a 14 jours
Cohere Transcribe (03-2026) Cohere Transcribe 26/03/2026 Poids ouverts vérifié il y a 14 jours
Command A (03-2025) Command A 03/2025 Poids ouverts vérifié il y a 14 jours

DeepSeek 15 modèles

Haut de gamme selon son éditeur

DeepSeek-V4-Pro 24/04/2026 Poids ouverts vérifié il y a 14 jours

1 600 milliards de paramètres au total, 49 milliards actifs (MoE) ; fenêtre de contexte 1 million de tokens.

ModèleLignéeSortieOuvertureVérification
DeepSeek-V4-Flash-0731 DeepSeek V 31/07/2026 Poids ouverts vérifié il y a 14 jours
DeepSeek-V4-Flash DeepSeek V 24/04/2026 Poids ouverts vérifié il y a 14 jours
DeepSeek-OCR-2 DeepSeek OCR 01/2026 Poids ouverts vérifié il y a 14 jours
DeepSeek-V3.2 DeepSeek V 01/12/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-V3.2-Speciale DeepSeek V 11/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-OCR DeepSeek OCR 21/10/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-V3.1-Terminus DeepSeek V 09/2025 Poids ouverts vérifié il y a 13 jours
DeepSeek-V3.2-Exp DeepSeek V 09/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-V3.1 DeepSeek V 08/2025 Poids ouverts vérifié il y a 14 jours
Janus-Pro-7B DeepSeek Janus 29/01/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-R1 DeepSeek R (raisonnement) 01/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-R1-Distill-Qwen-32B DeepSeek R1 Distill 01/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-R1-Distill-Qwen-1.5B DeepSeek R1 Distill 01/2025 Poids ouverts vérifié il y a 14 jours
DeepSeek-VL2 DeepSeek VL 13/12/2024 Poids ouverts vérifié il y a 14 jours

EleutherAI 1 modèle

ModèleLignéeSortieOuvertureVérification
Pythia-12B Pythia 03/04/2023 Open source vérifié il y a 14 jours

ElevenLabs 1 modèle

ModèleLignéeSortieOuvertureVérification
Eleven v3 Eleven 02/2026 Fermé vérifié il y a 14 jours

Google DeepMind 17 modèles

Haut de gamme selon son éditeur

Gemma 4 31B 31/03/2026 Poids ouverts vérifié il y a 14 jours

256K tokens de contexte ; 30,7 milliards de paramètres (dense) ; entrée texte + image, sortie texte ; poids non quantifiés testés sur GPU NVIDIA H100 80GB, versions quantifiées disponibles pour GPU grand public.

Haut de gamme selon son éditeur

Gemini 3.1 Pro 19/02/2026 Fermé vérifié il y a 14 jours

Contexte 1M tokens en entrée / 64K en sortie ; entrée texte, image, audio, vidéo, PDF ; sortie texte ; connaissances arrêtées janvier 2025.

ModèleLignéeSortieOuvertureVérification
Gemini 3.7 Flash Gemini 13/08/2026 Fermé vérifié il y a 14 jours
Gemini 3.6 Flash Gemini 21/07/2026 Fermé vérifié il y a 14 jours
Gemma 4 12B Gemma 03/06/2026 Poids ouverts vérifié il y a 14 jours
DiffusionGemma 26B A4B Gemma (diffusion) 06/2026 Poids ouverts vérifié il y a 14 jours
Nano Banana 2 Nano Banana (image, Gemini) 28/05/2026 Fermé vérifié il y a 14 jours
Gemini 3.5 Flash Gemini 19/05/2026 Fermé vérifié il y a 14 jours
Magenta RealTime 2 Magenta 05/2026 Poids ouverts vérifié il y a 13 jours
Gemma 4 26B A4B Gemma 31/03/2026 Poids ouverts vérifié il y a 14 jours
Gemma 4 E2B Gemma 31/03/2026 Poids ouverts vérifié il y a 14 jours
Gemma 4 E4B Gemma 31/03/2026 Poids ouverts vérifié il y a 14 jours
Lyria 3 Lyria 18/02/2026 Fermé vérifié il y a 14 jours
Nano Banana Pro Nano Banana (image, Gemini) 20/11/2025 Fermé vérifié il y a 14 jours
Veo 3.1 Veo 10/2025 Fermé vérifié il y a 14 jours
Gemma 3 27B Gemma 10/03/2025 Poids ouverts vérifié il y a 14 jours
Gemini 2.5 Pro Gemini 03/2025 Fermé vérifié il y a 14 jours

Hugging Face 1 modèle

ModèleLignéeSortieOuvertureVérification
SmolLM3-3B SmolLM 08/07/2025 Poids ouverts vérifié il y a 14 jours

IBM 10 modèles

ModèleLignéeSortieOuvertureVérification
Granite SWASH 2B Granite 07/07/2026 Poids ouverts vérifié il y a 13 jours
Granite Switch 4.1 3B (preview) Granite 05/05/2026 Poids ouverts vérifié il y a 13 jours
Granite 4.1 (30B) Granite 4 29/04/2026 Poids ouverts vérifié il y a 14 jours
Granite Speech 4.1 2B Plus Granite Speech 28/04/2026 Poids ouverts vérifié il y a 14 jours
Granite Guardian 4.1 8B Granite Guardian 04/2026 Poids ouverts vérifié il y a 14 jours
Granite 4.1 3B Granite 04/2026 Poids ouverts vérifié il y a 14 jours
Granite Speech 4.1 2B Granite Speech 04/2026 Poids ouverts vérifié il y a 14 jours
Granite Vision 4.1 4B Granite Vision 04/2026 Poids ouverts vérifié il y a 14 jours
Granite 4.1 8B Granite 04/2026 Poids ouverts vérifié il y a 14 jours
Granite 4.0 1B Speech Granite Speech 06/03/2026 Poids ouverts vérifié il y a 14 jours

Lightricks 3 modèles

Haut de gamme selon son éditeur

LTX-2.5 07/2026 Poids ouverts vérifié il y a 14 jours

22 milliards de paramètres (versions distillée et complète) ; texte-vers-vidéo, image-vers-vidéo, vidéo-vers-vidéo ; jusqu'à 121 images à 24 im/s ; audio synchronisé via VAE audio et vocodeur dédiés ; encodeur de texte Gemma 4 12B personnalisé.

ModèleLignéeSortieOuvertureVérification
LTX-2.3 LTX 03/2026 Poids ouverts vérifié il y a 14 jours
LTX-2 LTX 06/01/2026 Poids ouverts vérifié il y a 14 jours

LLM360 (consortium MBZUAI, Petuum, Cerebras) 1 modèle

ModèleLignéeSortieOuvertureVérification
K2-65B K2 06/2024 Open source vérifié il y a 14 jours

Luma AI 2 modèles

ModèleLignéeSortieOuvertureVérification
Ray3.2 Ray 09/06/2026 Fermé vérifié il y a 14 jours
Uni-1.1 Uni 05/05/2026 Fermé vérifié il y a 14 jours

Meta 8 modèles

Haut de gamme selon son éditeur

Llama 4 Maverick 05/04/2025 Poids ouverts vérifié il y a 14 jours

1 M tokens de contexte ; 400 Md paramètres au total / 17 Md actifs (mixture-of-experts, 128 experts)

ModèleLignéeSortieOuvertureVérification
Muse Spark 1.1 Muse 09/07/2026 Fermé vérifié il y a 14 jours
SAM 3 (Segment Anything Model) SAM 19/11/2025 Poids ouverts vérifié il y a 14 jours
Llama 4 Scout Llama 4 05/04/2025 Poids ouverts vérifié il y a 14 jours
Llama 3.3 70B Llama 3 06/12/2024 Poids ouverts vérifié il y a 14 jours
Llama 3.2 3B Llama 3 25/09/2024 Poids ouverts vérifié il y a 14 jours
Llama 3.2 1B Llama 3 25/09/2024 Poids ouverts vérifié il y a 14 jours
Llama 3.1 405B Llama 3 23/07/2024 Poids ouverts vérifié il y a 14 jours

Microsoft 11 modèles

Haut de gamme selon son éditeur

MAI-Thinking-1 02/06/2026 Fermé vérifié il y a 14 jours

256K tokens de contexte ; ~35 milliards de paramètres actifs sur ~1 000 milliards au total (Mixture-of-Experts épars) ; entraîné from scratch sans distillation, sur données commerciales propres.

ModèleLignéeSortieOuvertureVérification
Fara 1.5 4B Fara 07/2026 Poids ouverts vérifié il y a 13 jours
Fara 1.5 27B Fara 07/2026 Poids ouverts vérifié il y a 13 jours
VibeVoice-ASR-BitNet VibeVoice 07/2026 Poids ouverts vérifié il y a 14 jours
Mage-VL Mage 07/2026 Poids ouverts vérifié il y a 14 jours
MAI-Voice-2 MAI-Voice 02/06/2026 Fermé vérifié il y a 14 jours
Fara 1.5 9B Fara 05/2026 Poids ouverts vérifié il y a 14 jours
Phi-4-reasoning-vision-15B Phi 04/03/2026 Poids ouverts vérifié il y a 14 jours
MAI-1-preview MAI (texte, génération précédente) 28/08/2025 Fermé vérifié il y a 14 jours
Phi-4-multimodal-instruct Phi 02/2025 Poids ouverts vérifié il y a 14 jours
Phi-4 Phi 12/12/2024 Poids ouverts vérifié il y a 14 jours

Midjourney 1 modèle

ModèleLignéeSortieOuvertureVérification
Midjourney V8.1 Midjourney 30/04/2026 Fermé vérifié il y a 1 mois

MiniMax 7 modèles

Haut de gamme selon son éditeur

MiniMax-M3 01/06/2026 Poids ouverts vérifié il y a 14 jours

428 milliards de paramètres au total, 23 milliards actifs (MoE, architecture Sparse Attention MSA) ; contexte jusqu'à 1 million de tokens ; entrées texte, image et vidéo natives dès l'entraînement.

ModèleLignéeSortieOuvertureVérification
MiniMax Music 3 MiniMax Music 07/08/2026 Poids ouverts vérifié il y a 14 jours
MiniMax-H3 MiniMax H 28/07/2026 Poids ouverts vérifié il y a 14 jours
MiniMax-M2.7 MiniMax M 20/04/2026 Poids ouverts vérifié il y a 14 jours
MiniMax-M2.5 MiniMax M 02/2026 Poids ouverts vérifié il y a 14 jours
MiniMax-M2.1 MiniMax M 12/2025 Poids ouverts vérifié il y a 14 jours
MiniMax-M2 MiniMax M 27/10/2025 Poids ouverts vérifié il y a 14 jours

Mistral AI 17 modèles

Haut de gamme selon son éditeur

Mistral Medium 3.5 04/2026 Poids ouverts vérifié il y a 14 jours

256 k tokens de contexte ; 128 Md paramètres (dense)

ModèleLignéeSortieOuvertureVérification
Shieldstral 1.0 3B Shieldstral 07/2026 Poids ouverts vérifié il y a 14 jours
Voxtral TTS Voxtral 23/03/2026 Poids ouverts vérifié il y a 14 jours
Mistral Small 4 Mistral 16/03/2026 Poids ouverts vérifié il y a 14 jours
Voxtral Mini 4B Realtime Voxtral 02/2026 Poids ouverts vérifié il y a 14 jours
Devstral 2 Devstral 09/12/2025 Poids ouverts vérifié il y a 14 jours
Devstral Small 2 Devstral 09/12/2025 Poids ouverts vérifié il y a 14 jours
Mistral Large 3 Mistral 02/12/2025 Poids ouverts vérifié il y a 14 jours
Ministral 3 14B Ministral 02/12/2025 Poids ouverts vérifié il y a 14 jours
Ministral 3 8B Ministral 02/12/2025 Poids ouverts vérifié il y a 14 jours
Ministral 3 3B Ministral 02/12/2025 Poids ouverts vérifié il y a 14 jours
Magistral Small 1.2 Magistral 09/2025 Poids ouverts vérifié il y a 14 jours
Magistral Medium 1.2 Magistral 09/2025 Fermé vérifié il y a 14 jours
Codestral 25.08 Codestral 08/2025 Fermé vérifié il y a 14 jours
Voxtral Small 24B Voxtral 15/07/2025 Poids ouverts vérifié il y a 14 jours
Voxtral Mini 3B Voxtral 15/07/2025 Poids ouverts vérifié il y a 14 jours
Pixtral 12B Pixtral 09/2024 Poids ouverts vérifié il y a 14 jours

Moonshot AI 8 modèles

Haut de gamme selon son éditeur

Kimi-K3 06/2026 Poids ouverts vérifié il y a 14 jours

2 800 milliards de paramètres au total, 104 milliards actifs (MoE, 16 experts sur 896 par token) ; contexte 1 048 576 tokens ; entrée texte, image et vidéo, sortie texte.

Haut de gamme selon son éditeur

Kimi-K2-Thinking 06/11/2025 Poids ouverts vérifié il y a 14 jours

1 000 milliards de paramètres au total, 32 milliards actifs (MoE, 384 experts) ; contexte 256 000 tokens ; quantification INT4 native (entraînement conscient de la quantification).

ModèleLignéeSortieOuvertureVérification
Kimi-K2.7-Code Kimi K2 15/06/2026 Poids ouverts vérifié il y a 14 jours
Kimi-K2.6 Kimi 04/2026 Poids ouverts vérifié il y a 14 jours
Kimi-K2.5 Kimi 29/01/2026 Poids ouverts vérifié il y a 14 jours
Kimi-Linear-48B-A3B Kimi Linear 30/10/2025 Poids ouverts vérifié il y a 14 jours
Kimi-K2-Instruct Kimi K2 07/2025 Poids ouverts vérifié il y a 14 jours
Kimi-VL-A3B-Thinking-2506 Kimi VL 10/04/2025 Poids ouverts vérifié il y a 14 jours

Nvidia 4 modèles

ModèleLignéeSortieOuvertureVérification
Nemotron 3.5 Lightning (30B-A3B) Nemotron 11/08/2026 Poids ouverts vérifié il y a 14 jours
Cosmos3-Edge Cosmos 20/07/2026 Poids ouverts vérifié il y a 14 jours
Nemotron Parse 2.0 Nemotron 06/2026 Poids ouverts vérifié il y a 14 jours
Nemotron 3 Nano (30B-A3B) Nemotron 3 15/12/2025 Poids ouverts vérifié il y a 14 jours

OpenAI 11 modèles

Haut de gamme selon son éditeur

GPT-5.6 Sol 09/07/2026 Fermé vérifié il y a 14 jours

≈1,05 million de tokens de contexte ; jusqu'à 128 000 tokens de sortie par requête

ModèleLignéeSortieOuvertureVérification
GPT-5.6 Terra GPT 09/07/2026 Fermé vérifié il y a 14 jours
GPT-5.6 Luna GPT 09/07/2026 Fermé vérifié il y a 14 jours
Sora 2 Sora 30/09/2025 Fermé vérifié il y a 14 jours
gpt-oss-safeguard-120b gpt-oss 09/2025 Poids ouverts vérifié il y a 13 jours
gpt-oss-safeguard-20b gpt-oss 09/2025 Poids ouverts vérifié il y a 14 jours
gpt-oss-120b gpt-oss 08/2025 Poids ouverts vérifié il y a 14 jours
gpt-oss-20b gpt-oss 08/2025 Poids ouverts vérifié il y a 14 jours
o3 o 16/04/2025 Fermé vérifié il y a 14 jours
GPT-4 GPT 14/03/2023 Fermé vérifié il y a 14 jours
Whisper Whisper 09/2022 Poids ouverts vérifié il y a 14 jours

Resemble AI 1 modèle

ModèleLignéeSortieOuvertureVérification
Chatterbox Turbo Chatterbox 12/2025 Poids ouverts vérifié il y a 14 jours

Runway 1 modèle

ModèleLignéeSortieOuvertureVérification
Gen-4.5 Gen 01/12/2025 Fermé vérifié il y a 1 mois

Stability AI 5 modèles

Haut de gamme selon son éditeur

Stable Audio 3 Large 20/05/2026 Fermé vérifié il y a 14 jours

Compositions jusqu'à 6 min 20 s, positionné par l'éditeur pour la production sonore de niveau entreprise.

Haut de gamme selon son éditeur

Stable Diffusion 3.5 Large 22/10/2024 Poids ouverts vérifié il y a 14 jours

8 milliards de paramètres, résolution jusqu'à 1 mégapixel.

ModèleLignéeSortieOuvertureVérification
Stable Audio 3 Small Stable Audio 3 20/05/2026 Poids ouverts vérifié il y a 14 jours
Stable Audio 3 Medium Stable Audio 17/05/2026 Poids ouverts vérifié il y a 14 jours
Stable Diffusion 3.5 Medium Stable Diffusion 3.5 29/10/2024 Poids ouverts vérifié il y a 14 jours

Suno 1 modèle

ModèleLignéeSortieOuvertureVérification
Suno v5.5 Suno 26/03/2026 Fermé vérifié il y a 14 jours

Tencent 7 modèles

Haut de gamme selon son éditeur

Hy3 07/2026 Poids ouverts vérifié il y a 14 jours

295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; même architecture que la preview, post-entraînement élargi.

Haut de gamme selon son éditeur

Hy-MT2-30B-A3B 05/2026 Poids ouverts vérifié il y a 13 jours

30 milliards de paramètres (MoE) ; traduction entre 36 langues ; suivi de consignes de traduction, gestion terminologique, adaptation de style et traduction de données structurées.

Haut de gamme selon son éditeur

Hy3-preview 04/2026 Poids ouverts vérifié il y a 14 jours

295 milliards de paramètres au total, 21 milliards actifs (MoE, 192 experts dont 8 activés) ; contexte 256K tokens ; 64 têtes d'attention (GQA, 8 têtes KV) ; texte uniquement.

ModèleLignéeSortieOuvertureVérification
Hy-MT2-7B Hunyuan MT 05/2026 Poids ouverts vérifié il y a 13 jours
Hy-MT2-1.8B Hunyuan MT 05/2026 Poids ouverts vérifié il y a 14 jours
Hunyuan-A13B-Instruct Hunyuan 27/06/2025 Poids ouverts vérifié il y a 14 jours
HunyuanVideo Hunyuan Video 03/12/2024 Poids ouverts vérifié il y a 14 jours

xAI 3 modèles

ModèleLignéeSortieOuvertureVérification
Grok 4.6 Grok 12/08/2026 Fermé vérifié il y a 14 jours
Grok Imagine Image 2.0 Grok Imagine 07/08/2026 Fermé vérifié il y a 14 jours
Grok Imagine Video 1.5 Grok Imagine 16/06/2026 Fermé vérifié il y a 14 jours

Z.ai (ex-Zhipu AI) 12 modèles

Haut de gamme selon son éditeur

GLM-5.2 16/06/2026 Poids ouverts vérifié il y a 14 jours

753 milliards de paramètres au total (MoE, ~39-40 milliards actifs selon des sources secondaires convergentes, 256 experts) ; contexte jusqu'à 1 million de tokens.

Haut de gamme selon son éditeur

GLM-5.1 04/2026 Poids ouverts vérifié il y a 14 jours

~754 milliards de paramètres ; architecture MoE à attention éparse (GLM_MOE_DSA) ; texte uniquement.

ModèleLignéeSortieOuvertureVérification
GLM-OCR GLM OCR 11/03/2026 Poids ouverts vérifié il y a 14 jours
GLM-5 GLM 02/2026 Poids ouverts vérifié il y a 14 jours
GLM-Image GLM Image 01/2026 Poids ouverts vérifié il y a 14 jours
GLM-4.7 GLM 12/2025 Poids ouverts vérifié il y a 14 jours
AutoGLM-Phone-9B AutoGLM 12/2025 Poids ouverts vérifié il y a 14 jours
GLM-ASR-Nano GLM ASR 12/2025 Poids ouverts vérifié il y a 14 jours
GLM-4.6V-Flash GLM 12/2025 Poids ouverts vérifié il y a 14 jours
GLM-4.6 GLM 30/09/2025 Poids ouverts vérifié il y a 14 jours
GLM-4.7-Flash GLM 08/08/2025 Poids ouverts vérifié il y a 14 jours
GLM-4.6V GLM Vision 07/2025 Poids ouverts vérifié il y a 14 jours

Par usage

Qui fait quoi, et ce qui est réellement mesuré. Beaucoup d'usages n'ont aucune mesure indépendante publiée : les classements qu'on trouve ailleurs y sont des préférences d'utilisateurs ou de la communication d'éditeur, pas des protocoles publiés. Quand c'est le cas, cette page l'écrit plutôt que de fabriquer un palmarès sans source.

Texte

Gemini 3.7 Flash (Google DeepMind) · Grok 4.6 (xAI) · Nemotron 3.5 Lightning (30B-A3B) (Nvidia) · Qwen3.8-2.4T-A95B (Alibaba) · Qwen3.8-27B (Alibaba) · North Micro Vision Instruct (Cohere) · DeepSeek-V4-Flash-0731 (DeepSeek) · Claude Opus 5 (Anthropic) · Gemini 3.6 Flash (Google DeepMind) · Cosmos3-Edge (Nvidia) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Muse Spark 1.1 (Meta) · Granite SWASH 2B (IBM) · Fara 1.5 4B (Microsoft) · Fara 1.5 27B (Microsoft) · Mage-VL (Microsoft) · Shieldstral 1.0 3B (Mistral AI) · Hy3 (Tencent) · Claude Sonnet 5 (Anthropic) · Unlimited-OCR (Baidu) · GLM-5.2 (Z.ai (ex-Zhipu AI)) · Kimi-K2.7-Code (Moonshot AI) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Gemma 4 12B (Google DeepMind) · MAI-Thinking-1 (Microsoft) · MiniMax-M3 (MiniMax) · DiffusionGemma 26B A4B (Google DeepMind) · Qwen-AgentWorld-35B-A3B (Alibaba) · Kimi-K3 (Moonshot AI) · Nemotron Parse 2.0 (Nvidia) · North Mini Code 1.0 (Cohere) · Claude Opus 4.8 (Anthropic) · Gemini 3.5 Flash (Google DeepMind) · Granite Switch 4.1 3B (preview) (IBM) · Fara 1.5 9B (Microsoft) · Hy-MT2-7B (Tencent) · Hy-MT2-30B-A3B (Tencent) · Hy-MT2-1.8B (Tencent) · Command A+ (05-2026) (Cohere) · Granite 4.1 (30B) (IBM) · DeepSeek-V4-Pro (DeepSeek) · DeepSeek-V4-Flash (DeepSeek) · Qwen3.6-27B (Alibaba) · MiniMax-M2.7 (MiniMax) · Claude Opus 4.7 (Anthropic) · Qwen3.6-35B-A3B (Alibaba) · Mistral Medium 3.5 (Mistral AI) · Kimi-K2.6 (Moonshot AI) · GLM-5.1 (Z.ai (ex-Zhipu AI)) · Hy3-preview (Tencent) · Granite Guardian 4.1 8B (IBM) · Granite 4.1 3B (IBM) · Granite Vision 4.1 4B (IBM) · Granite 4.1 8B (IBM) · Gemma 4 26B A4B (Google DeepMind) · Gemma 4 E2B (Google DeepMind) · Gemma 4 31B (Google DeepMind) · Gemma 4 E4B (Google DeepMind) · Mistral Small 4 (Mistral AI) · GLM-OCR (Z.ai (ex-Zhipu AI)) · Phi-4-reasoning-vision-15B (Microsoft) · Qianfan-OCR (Baidu) · Gemini 3.1 Pro (Google DeepMind) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · Qwen3.5-397B-A17B (Alibaba) · Qwen3.5-122B-A10B (Alibaba) · Qwen3.5-35B-A3B (Alibaba) · Qwen3.5-27B (Alibaba) · Qwen3.5-4B (Alibaba) · Qwen3.5-2B (Alibaba) · Qwen3.5-0.8B (Alibaba) · Qwen3.5-9B (Alibaba) · GLM-5 (Z.ai (ex-Zhipu AI)) · MiniMax-M2.5 (MiniMax) · Kimi-K2.5 (Moonshot AI) · Jamba2 3B (AI21 Labs) · DeepSeek-OCR-2 (DeepSeek) · Nemotron 3 Nano (30B-A3B) (Nvidia) · Devstral 2 (Mistral AI) · Devstral Small 2 (Mistral AI) · Nova 2 Pro (Amazon) · Nova 2 Lite (Amazon) · Mistral Large 3 (Mistral AI) · Ministral 3 14B (Mistral AI) · Ministral 3 8B (Mistral AI) · Ministral 3 3B (Mistral AI) · DeepSeek-V3.2 (DeepSeek) · GLM-4.7 (Z.ai (ex-Zhipu AI)) · AutoGLM-Phone-9B (Z.ai (ex-Zhipu AI)) · GLM-4.6V-Flash (Z.ai (ex-Zhipu AI)) · MiniMax-M2.1 (MiniMax) · OLMo 3 (32B, Base) (Allen Institute for AI (Ai2)) · Kimi-K2-Thinking (Moonshot AI) · Claude Opus 4.5 (Anthropic) · DeepSeek-V3.2-Speciale (DeepSeek) · Nova Premier (Amazon) · Kimi-Linear-48B-A3B (Moonshot AI) · MiniMax-M2 (MiniMax) · DeepSeek-OCR (DeepSeek) · Claude Haiku 4.5 (Anthropic) · Jamba Reasoning 3B (AI21 Labs) · GLM-4.6 (Z.ai (ex-Zhipu AI)) · Claude Sonnet 4.5 (Anthropic) · gpt-oss-safeguard-120b (OpenAI) · gpt-oss-safeguard-20b (OpenAI) · Magistral Small 1.2 (Mistral AI) · Magistral Medium 1.2 (Mistral AI) · DeepSeek-V3.1-Terminus (DeepSeek) · DeepSeek-V3.2-Exp (DeepSeek) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Qwen3-VL-2B-Instruct (Alibaba) · Qwen3-VL-235B-A22B-Instruct (Alibaba) · ERNIE-4.5-21B-A3B-Thinking (Baidu) · MAI-1-preview (Microsoft) · Seed-OSS-36B-Instruct (ByteDance) · GLM-4.7-Flash (Z.ai (ex-Zhipu AI)) · gpt-oss-120b (OpenAI) · gpt-oss-20b (OpenAI) · DeepSeek-V3.1 (DeepSeek) · Jamba Large 1.7 (AI21 Labs) · Voxtral Small 24B (Mistral AI) · Voxtral Mini 3B (Mistral AI) · SmolLM3-3B (Hugging Face) · ERNIE-4.5-0.3B (Baidu) · ERNIE-4.5-21B-A3B (Baidu) · ERNIE-4.5-VL-424B-A47B (Baidu) · Kimi-K2-Instruct (Moonshot AI) · GLM-4.6V (Z.ai (ex-Zhipu AI)) · Hunyuan-A13B-Instruct (Tencent) · Qwen3-0.6B (Alibaba) · Qwen3-8B (Alibaba) · Qwen3-32B (Alibaba) · Qwen3-30B-A3B (Alibaba) · Qwen3-235B-A22B (Alibaba) · o3 (OpenAI) · Kimi-VL-A3B-Thinking-2506 (Moonshot AI) · Llama 4 Maverick (Meta) · Llama 4 Scout (Meta) · Gemma 3 27B (Google DeepMind) · Gemini 2.5 Pro (Google DeepMind) · Command A (03-2025) (Cohere) · Claude 3.7 Sonnet (Anthropic) · Phi-4-multimodal-instruct (Microsoft) · Janus-Pro-7B (DeepSeek) · DeepSeek-R1 (DeepSeek) · DeepSeek-R1-Distill-Qwen-32B (DeepSeek) · DeepSeek-R1-Distill-Qwen-1.5B (DeepSeek) · DeepSeek-VL2 (DeepSeek) · Phi-4 (Microsoft) · Llama 3.3 70B (Meta) · Nova Pro (Amazon) · Llama 3.2 3B (Meta) · Llama 3.2 1B (Meta) · Pixtral 12B (Mistral AI) · Llama 3.1 405B (Meta) · K2-65B (LLM360 (consortium MBZUAI, Petuum, Cerebras)) · Pythia-12B (EleutherAI) · GPT-4 (OpenAI)

  • Muse Spark 1.1 — Indice composite d'intelligence générale, agrégeant plusieurs épreuves : 51 en variante « xhigh », contre 43 pour la version précédente trois mois plus tôt — gain de 8 points, à égalité avec GLM-5.2 (max) et GPT-5.4 (xhigh). Artificial Analysis Intelligence Index, mesuré le 10/07/2026 · source
  • Claude Opus 4.5 — Raisonnement abstrait sur tâches inédites : 37,6 % de réussite (variante « Thinking, 64k »), premier rang des modèles commerciaux de ce classement à cette date, pour un coût d'environ 2,20 $ par tâche. ARC-AGI-2 (ARC Prize), mesuré le 05/12/2025 · source
  • o3 — 4 % de réussite mesurés sur le checkpoint de pré-lancement « o3-preview-low », environ un mois avant la disponibilité générale d'o3 (16/04/2025) — chiffre présenté par ARC Prize elle-même comme une estimation provisoire, pas un score final. ARC-AGI-2 (ARC Prize), mesuré le 24/03/2025 · source

Code

Gemini 3.7 Flash (Google DeepMind) · Grok 4.6 (xAI) · Nemotron 3.5 Lightning (30B-A3B) (Nvidia) · Qwen3.8-2.4T-A95B (Alibaba) · Qwen3.8-27B (Alibaba) · DeepSeek-V4-Flash-0731 (DeepSeek) · Claude Opus 5 (Anthropic) · Gemini 3.6 Flash (Google DeepMind) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Muse Spark 1.1 (Meta) · Fara 1.5 4B (Microsoft) · Fara 1.5 27B (Microsoft) · Hy3 (Tencent) · Claude Sonnet 5 (Anthropic) · GLM-5.2 (Z.ai (ex-Zhipu AI)) · Kimi-K2.7-Code (Moonshot AI) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Gemma 4 12B (Google DeepMind) · MAI-Thinking-1 (Microsoft) · MiniMax-M3 (MiniMax) · DiffusionGemma 26B A4B (Google DeepMind) · Kimi-K3 (Moonshot AI) · North Mini Code 1.0 (Cohere) · Claude Opus 4.8 (Anthropic) · Gemini 3.5 Flash (Google DeepMind) · Fara 1.5 9B (Microsoft) · Command A+ (05-2026) (Cohere) · Granite 4.1 (30B) (IBM) · DeepSeek-V4-Pro (DeepSeek) · DeepSeek-V4-Flash (DeepSeek) · Qwen3.6-27B (Alibaba) · MiniMax-M2.7 (MiniMax) · Claude Opus 4.7 (Anthropic) · Qwen3.6-35B-A3B (Alibaba) · Mistral Medium 3.5 (Mistral AI) · Kimi-K2.6 (Moonshot AI) · GLM-5.1 (Z.ai (ex-Zhipu AI)) · Hy3-preview (Tencent) · Granite 4.1 3B (IBM) · Granite 4.1 8B (IBM) · Gemma 4 26B A4B (Google DeepMind) · Gemma 4 E2B (Google DeepMind) · Gemma 4 31B (Google DeepMind) · Gemma 4 E4B (Google DeepMind) · Mistral Small 4 (Mistral AI) · Gemini 3.1 Pro (Google DeepMind) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · Qwen3.5-397B-A17B (Alibaba) · Qwen3.5-122B-A10B (Alibaba) · Qwen3.5-35B-A3B (Alibaba) · Qwen3.5-27B (Alibaba) · Qwen3.5-4B (Alibaba) · Qwen3.5-2B (Alibaba) · Qwen3.5-0.8B (Alibaba) · Qwen3.5-9B (Alibaba) · GLM-5 (Z.ai (ex-Zhipu AI)) · MiniMax-M2.5 (MiniMax) · Kimi-K2.5 (Moonshot AI) · Jamba2 3B (AI21 Labs) · Nemotron 3 Nano (30B-A3B) (Nvidia) · Devstral 2 (Mistral AI) · Devstral Small 2 (Mistral AI) · Nova 2 Pro (Amazon) · Nova 2 Lite (Amazon) · Mistral Large 3 (Mistral AI) · Ministral 3 14B (Mistral AI) · Ministral 3 8B (Mistral AI) · Ministral 3 3B (Mistral AI) · DeepSeek-V3.2 (DeepSeek) · GLM-4.7 (Z.ai (ex-Zhipu AI)) · MiniMax-M2.1 (MiniMax) · OLMo 3 (32B, Base) (Allen Institute for AI (Ai2)) · Kimi-K2-Thinking (Moonshot AI) · Claude Opus 4.5 (Anthropic) · Kimi-Linear-48B-A3B (Moonshot AI) · MiniMax-M2 (MiniMax) · Claude Haiku 4.5 (Anthropic) · Jamba Reasoning 3B (AI21 Labs) · GLM-4.6 (Z.ai (ex-Zhipu AI)) · Claude Sonnet 4.5 (Anthropic) · Magistral Small 1.2 (Mistral AI) · Magistral Medium 1.2 (Mistral AI) · DeepSeek-V3.1-Terminus (DeepSeek) · DeepSeek-V3.2-Exp (DeepSeek) · ERNIE-4.5-21B-A3B-Thinking (Baidu) · Seed-OSS-36B-Instruct (ByteDance) · GLM-4.7-Flash (Z.ai (ex-Zhipu AI)) · gpt-oss-120b (OpenAI) · gpt-oss-20b (OpenAI) · Codestral 25.08 (Mistral AI) · DeepSeek-V3.1 (DeepSeek) · Qwen3-Coder-30B-A3B-Instruct (Alibaba) · SmolLM3-3B (Hugging Face) · ERNIE-4.5-21B-A3B (Baidu) · Kimi-K2-Instruct (Moonshot AI) · Hunyuan-A13B-Instruct (Tencent) · Qwen3-0.6B (Alibaba) · Qwen3-8B (Alibaba) · Qwen3-32B (Alibaba) · Qwen3-30B-A3B (Alibaba) · Qwen3-235B-A22B (Alibaba) · o3 (OpenAI) · Llama 4 Maverick (Meta) · Llama 4 Scout (Meta) · Gemini 2.5 Pro (Google DeepMind) · Claude 3.7 Sonnet (Anthropic) · DeepSeek-R1 (DeepSeek) · DeepSeek-R1-Distill-Qwen-32B (DeepSeek) · DeepSeek-R1-Distill-Qwen-1.5B (DeepSeek) · Llama 3.3 70B (Meta) · Llama 3.2 3B (Meta) · Llama 3.2 1B (Meta) · Llama 3.1 405B (Meta)

Aucune mesure indépendante datée enregistrée pour cet usage.

Image

Grok Imagine Image 2.0 (xAI) · Claude Opus 5 (Anthropic) · Cosmos3-Edge (Nvidia) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Muse Spark 1.1 (Meta) · Claude Sonnet 5 (Anthropic) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Claude Opus 4.8 (Anthropic) · Nano Banana 2 (Google DeepMind) · Uni-1.1 (Luma AI) · Midjourney V8.1 (Midjourney) · Claude Opus 4.7 (Anthropic) · Mistral Medium 3.5 (Mistral AI) · Mistral Small 4 (Mistral AI) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · FLUX.2 [klein] 4B (Black Forest Labs) · GLM-Image (Z.ai (ex-Zhipu AI)) · Mistral Large 3 (Mistral AI) · Ministral 3 14B (Mistral AI) · Ministral 3 8B (Mistral AI) · Ministral 3 3B (Mistral AI) · FLUX.2 [dev] (Black Forest Labs) · FLUX.2 [pro] (Black Forest Labs) · Nano Banana Pro (Google DeepMind) · Claude Opus 4.5 (Anthropic) · Firefly Image Model 5 (Adobe) · Claude Haiku 4.5 (Anthropic) · Claude Sonnet 4.5 (Anthropic) · Magistral Small 1.2 (Mistral AI) · Magistral Medium 1.2 (Mistral AI) · Qwen-Image (Alibaba) · Llama 4 Maverick (Meta) · Llama 4 Scout (Meta) · Janus-Pro-7B (DeepSeek) · Nova Canvas (Amazon) · Stable Diffusion 3.5 Medium (Stability AI) · Stable Diffusion 3.5 Large (Stability AI) · Pixtral 12B (Mistral AI) · GPT-4 (OpenAI)

Aucune mesure indépendante datée enregistrée pour cet usage.

Voix

Muse Spark 1.1 (Meta) · VibeVoice-ASR-BitNet (Microsoft) · Qwen3-ASR-1.7B (Alibaba) · Qwen3-ASR-0.6B (Alibaba) · MAI-Voice-2 (Microsoft) · Cohere Transcribe Arabic (07-2026) (Cohere) · Granite Speech 4.1 2B Plus (IBM) · Granite Speech 4.1 2B (IBM) · Cohere Transcribe (03-2026) (Cohere) · Voxtral TTS (Mistral AI) · Granite 4.0 1B Speech (IBM) · Voxtral Mini 4B Realtime (Mistral AI) · Eleven v3 (ElevenLabs) · Nova 2 Sonic (Amazon) · GLM-ASR-Nano (Z.ai (ex-Zhipu AI)) · Chatterbox Turbo (Resemble AI) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Voxtral Small 24B (Mistral AI) · Voxtral Mini 3B (Mistral AI) · Whisper (OpenAI)

Aucune mesure indépendante datée enregistrée pour cet usage.

Musique

MiniMax Music 3 (MiniMax) · MiniMax-H3 (MiniMax) · LTX-2.5 (Lightricks) · Stable Audio 3 Small (Stability AI) · Stable Audio 3 Large (Stability AI) · Stable Audio 3 Medium (Stability AI) · Magenta RealTime 2 (Google DeepMind) · Suno v5.5 (Suno) · LTX-2.3 (Lightricks) · Lyria 3 (Google DeepMind)

Aucune mesure indépendante datée enregistrée pour cet usage.

Vidéo

MiniMax-H3 (MiniMax) · Cosmos3-Edge (Nvidia) · Muse Spark 1.1 (Meta) · LTX-2.5 (Lightricks) · Grok Imagine Video 1.5 (xAI) · Ray3.2 (Luma AI) · MiniMax-M3 (MiniMax) · LTX-2.3 (Lightricks) · LTX-2 (Lightricks) · Gen-4.5 (Runway) · SAM 3 (Segment Anything Model) (Meta) · Veo 3.1 (Google DeepMind) · Sora 2 (OpenAI) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Wan2.2-TI2V-5B (Alibaba) · Wan2.2-T2V-A14B (Alibaba) · Nova Reel (Amazon) · HunyuanVideo (Tencent)

Aucune mesure indépendante datée enregistrée pour cet usage.

Vision

Gemini 3.7 Flash (Google DeepMind) · Qwen3.8-27B (Alibaba) · North Micro Vision Instruct (Cohere) · Claude Opus 5 (Anthropic) · Gemini 3.6 Flash (Google DeepMind) · GPT-5.6 Sol (OpenAI) · GPT-5.6 Terra (OpenAI) · GPT-5.6 Luna (OpenAI) · Fara 1.5 4B (Microsoft) · Fara 1.5 27B (Microsoft) · Mage-VL (Microsoft) · Shieldstral 1.0 3B (Mistral AI) · Claude Sonnet 5 (Anthropic) · Unlimited-OCR (Baidu) · Kimi-K2.7-Code (Moonshot AI) · Claude Fable 5 (Anthropic) · Claude Mythos 5 (Anthropic) · Gemma 4 12B (Google DeepMind) · MiniMax-M3 (MiniMax) · DiffusionGemma 26B A4B (Google DeepMind) · Kimi-K3 (Moonshot AI) · Nemotron Parse 2.0 (Nvidia) · Claude Opus 4.8 (Anthropic) · Gemini 3.5 Flash (Google DeepMind) · Fara 1.5 9B (Microsoft) · Command A+ (05-2026) (Cohere) · Claude Opus 4.7 (Anthropic) · Kimi-K2.6 (Moonshot AI) · Granite Vision 4.1 4B (IBM) · Gemma 4 26B A4B (Google DeepMind) · Gemma 4 E2B (Google DeepMind) · Gemma 4 31B (Google DeepMind) · Gemma 4 E4B (Google DeepMind) · GLM-OCR (Z.ai (ex-Zhipu AI)) · Phi-4-reasoning-vision-15B (Microsoft) · Qianfan-OCR (Baidu) · Gemini 3.1 Pro (Google DeepMind) · Claude Sonnet 4.6 (Anthropic) · Claude Opus 4.6 (Anthropic) · Qwen3.5-397B-A17B (Alibaba) · Qwen3.5-122B-A10B (Alibaba) · Qwen3.5-35B-A3B (Alibaba) · Qwen3.5-27B (Alibaba) · Qwen3.5-4B (Alibaba) · Qwen3.5-2B (Alibaba) · Qwen3.5-0.8B (Alibaba) · Qwen3.5-9B (Alibaba) · Kimi-K2.5 (Moonshot AI) · DeepSeek-OCR-2 (DeepSeek) · Nova 2 Pro (Amazon) · Nova 2 Lite (Amazon) · AutoGLM-Phone-9B (Z.ai (ex-Zhipu AI)) · GLM-4.6V-Flash (Z.ai (ex-Zhipu AI)) · SAM 3 (Segment Anything Model) (Meta) · Claude Opus 4.5 (Anthropic) · Nova Premier (Amazon) · DeepSeek-OCR (DeepSeek) · Claude Haiku 4.5 (Anthropic) · Claude Sonnet 4.5 (Anthropic) · Qwen3-Omni-30B-A3B-Instruct (Alibaba) · Qwen3-VL-2B-Instruct (Alibaba) · Qwen3-VL-235B-A22B-Instruct (Alibaba) · ERNIE-4.5-VL-424B-A47B (Baidu) · GLM-4.6V (Z.ai (ex-Zhipu AI)) · Kimi-VL-A3B-Thinking-2506 (Moonshot AI) · Gemma 3 27B (Google DeepMind) · Gemini 2.5 Pro (Google DeepMind) · Phi-4-multimodal-instruct (Microsoft) · Janus-Pro-7B (DeepSeek) · DeepSeek-VL2 (DeepSeek) · Nova Pro (Amazon)

Aucune mesure indépendante datée enregistrée pour cet usage.

Ce qui tourne chez soi

Les modèles dont les poids sont téléchargeables, classés par le matériel qu'ils demandent. Deux questions distinctes se posent ici : la licence autorise-t-elle le téléchargement, et la machine suit-elle ? Un modèle peut être parfaitement ouvert et hors de portée d'un portable.

Portable récent 24 modèles

ModèleÉditeurOuvertureLicenceVérification
VibeVoice-ASR-BitNet Microsoft Poids ouverts MIT vérifié il y a 14 jours
Qwen3-ASR-0.6B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Stable Audio 3 Small Stability AI Poids ouverts Stability AI Community License vérifié il y a 14 jours
Hy-MT2-1.8B Tencent Poids ouverts Apache-2.0 vérifié il y a 14 jours
Gemma 4 E2B Google DeepMind Poids ouverts Apache-2.0 vérifié il y a 14 jours
Gemma 4 E4B Google DeepMind Poids ouverts Apache-2.0 vérifié il y a 14 jours
Voxtral TTS Mistral AI Poids ouverts CC BY-NC 4.0 vérifié il y a 14 jours
GLM-OCR Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
Granite 4.0 1B Speech IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.5-0.8B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Jamba2 3B AI21 Labs Poids ouverts Apache-2.0 vérifié il y a 14 jours
Ministral 3 3B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
GLM-ASR-Nano Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
DeepSeek-OCR DeepSeek Poids ouverts MIT vérifié il y a 14 jours
Jamba Reasoning 3B AI21 Labs Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-VL-2B-Instruct Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Voxtral Mini 3B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
SmolLM3-3B Hugging Face Poids ouverts Apache-2.0 vérifié il y a 14 jours
ERNIE-4.5-0.3B Baidu Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-0.6B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
DeepSeek-R1-Distill-Qwen-1.5B DeepSeek Poids ouverts MIT vérifié il y a 14 jours
Llama 3.2 3B Meta Poids ouverts Llama 3.2 Community License Agreement vérifié il y a 14 jours
Llama 3.2 1B Meta Poids ouverts Llama 3.2 Community License Agreement vérifié il y a 14 jours
Whisper OpenAI Poids ouverts MIT vérifié il y a 14 jours

Carte graphique de joueur 63 modèles

ModèleÉditeurOuvertureLicenceVérification
North Micro Vision Instruct Cohere Poids ouverts Apache-2.0 vérifié il y a 14 jours
Cosmos3-Edge Nvidia Poids ouverts OpenMDW 1.1 vérifié il y a 14 jours
Granite SWASH 2B IBM Poids ouverts Apache-2.0 vérifié il y a 13 jours
Fara 1.5 4B Microsoft Poids ouverts MIT vérifié il y a 13 jours
Mage-VL Microsoft Poids ouverts Apache-2.0 vérifié il y a 14 jours
Shieldstral 1.0 3B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-ASR-1.7B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Unlimited-OCR Baidu Poids ouverts MIT vérifié il y a 14 jours
Gemma 4 12B Google DeepMind Poids ouverts Apache-2.0 vérifié il y a 14 jours
Nemotron Parse 2.0 Nvidia Poids ouverts NVIDIA Open Model License (tokenizer en CC-BY-4.0) vérifié il y a 14 jours
Cohere Transcribe Arabic (07-2026) Cohere Poids ouverts Apache-2.0 vérifié il y a 14 jours
Stable Audio 3 Medium Stability AI Poids ouverts Stability AI Community License vérifié il y a 14 jours
Granite Switch 4.1 3B (preview) IBM Poids ouverts Apache-2.0 vérifié il y a 13 jours
Magenta RealTime 2 Google DeepMind Poids ouverts Code en Apache-2.0, poids en CC BY 4.0 vérifié il y a 13 jours
Fara 1.5 9B Microsoft Poids ouverts MIT vérifié il y a 14 jours
Hy-MT2-7B Tencent Poids ouverts Apache-2.0 vérifié il y a 13 jours
Granite Speech 4.1 2B Plus IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.6-27B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.6-35B-A3B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Granite Guardian 4.1 8B IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Granite 4.1 3B IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Granite Speech 4.1 2B IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Granite Vision 4.1 4B IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Granite 4.1 8B IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Cohere Transcribe (03-2026) Cohere Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qianfan-OCR Baidu Poids ouverts Apache-2.0 vérifié il y a 14 jours
Voxtral Mini 4B Realtime Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.5-4B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.5-2B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.5-9B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
FLUX.2 [klein] 4B Black Forest Labs Poids ouverts Apache-2.0 vérifié il y a 14 jours
LTX-2 Lightricks Poids ouverts LTX-2 Community License Agreement vérifié il y a 14 jours
DeepSeek-OCR-2 DeepSeek Poids ouverts Apache-2.0 vérifié il y a 14 jours
GLM-Image Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
Devstral Small 2 Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Ministral 3 14B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Ministral 3 8B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
AutoGLM-Phone-9B Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
GLM-4.6V-Flash Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
Chatterbox Turbo Resemble AI Poids ouverts MIT vérifié il y a 14 jours
gpt-oss-safeguard-20b OpenAI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Magistral Small 1.2 Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-Omni-30B-A3B-Instruct Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Seed-OSS-36B-Instruct ByteDance Poids ouverts Apache-2.0 vérifié il y a 14 jours
GLM-4.7-Flash Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
gpt-oss-20b OpenAI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Wan2.2-TI2V-5B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-Coder-30B-A3B-Instruct Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Voxtral Small 24B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
ERNIE-4.5-21B-A3B Baidu Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-8B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-32B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3-30B-A3B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Kimi-VL-A3B-Thinking-2506 Moonshot AI Poids ouverts MIT vérifié il y a 14 jours
Gemma 3 27B Google DeepMind Poids ouverts Gemma Terms of Use vérifié il y a 14 jours
Phi-4-multimodal-instruct Microsoft Poids ouverts MIT vérifié il y a 14 jours
Janus-Pro-7B DeepSeek Poids ouverts MIT vérifié il y a 14 jours
DeepSeek-R1-Distill-Qwen-32B DeepSeek Poids ouverts MIT vérifié il y a 14 jours
DeepSeek-VL2 DeepSeek Poids ouverts DeepSeek Model License vérifié il y a 14 jours
Phi-4 Microsoft Poids ouverts MIT vérifié il y a 14 jours
Stable Diffusion 3.5 Medium Stability AI Poids ouverts Stability AI Community License vérifié il y a 14 jours
Pixtral 12B Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Pythia-12B EleutherAI Open source Apache-2.0 vérifié il y a 14 jours

Station de travail 28 modèles

ModèleÉditeurOuvertureLicenceVérification
MiniMax Music 3 MiniMax Poids ouverts Creative Commons (texte complet dans le dépôt) vérifié il y a 14 jours
Qwen3.8-27B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Fara 1.5 27B Microsoft Poids ouverts MIT vérifié il y a 13 jours
DiffusionGemma 26B A4B Google DeepMind Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen-AgentWorld-35B-A3B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
North Mini Code 1.0 Cohere Poids ouverts Apache-2.0 vérifié il y a 14 jours
Hy-MT2-30B-A3B Tencent Poids ouverts Apache-2.0 vérifié il y a 13 jours
Granite 4.1 (30B) IBM Poids ouverts Apache-2.0 vérifié il y a 14 jours
Gemma 4 26B A4B Google DeepMind Poids ouverts Apache-2.0 vérifié il y a 14 jours
Gemma 4 31B Google DeepMind Poids ouverts Apache-2.0 vérifié il y a 14 jours
Phi-4-reasoning-vision-15B Microsoft Poids ouverts MIT vérifié il y a 14 jours
Qwen3.5-35B-A3B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.5-27B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Nemotron 3 Nano (30B-A3B) Nvidia Poids ouverts NVIDIA Nemotron Open Model License vérifié il y a 14 jours
FLUX.2 [dev] Black Forest Labs Poids ouverts FLUX Non-Commercial License vérifié il y a 14 jours
OLMo 3 (32B, Base) Allen Institute for AI (Ai2) Open source Apache-2.0 vérifié il y a 14 jours
SAM 3 (Segment Anything Model) Meta Poids ouverts SAM License vérifié il y a 14 jours
gpt-oss-safeguard-120b OpenAI Poids ouverts Apache-2.0 vérifié il y a 13 jours
ERNIE-4.5-21B-A3B-Thinking Baidu Poids ouverts Apache-2.0 vérifié il y a 13 jours
Qwen-Image Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
gpt-oss-120b OpenAI Poids ouverts Apache-2.0 vérifié il y a 14 jours
Wan2.2-T2V-A14B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
GLM-4.6V Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
Hunyuan-A13B-Instruct Tencent Poids ouverts Tencent Hunyuan A13B Community License Agreement vérifié il y a 14 jours
Llama 4 Scout Meta Poids ouverts Llama 4 Community License Agreement vérifié il y a 14 jours
Llama 3.3 70B Meta Poids ouverts Llama 3.3 Community License Agreement vérifié il y a 14 jours
HunyuanVideo Tencent Poids ouverts Tencent Hunyuan Community License Agreement vérifié il y a 14 jours
Stable Diffusion 3.5 Large Stability AI Poids ouverts Stability AI Community License vérifié il y a 14 jours

Serveur multi-GPU 48 modèles

ModèleÉditeurOuvertureLicenceVérification
Nemotron 3.5 Lightning (30B-A3B) Nvidia Poids ouverts OpenMDW 1.1 vérifié il y a 14 jours
Qwen3.8-2.4T-A95B Alibaba Poids ouverts qwen3.8-max (licence maison Alibaba) vérifié il y a 14 jours
DeepSeek-V4-Flash-0731 DeepSeek Poids ouverts MIT vérifié il y a 14 jours
MiniMax-H3 MiniMax Poids ouverts MiniMax H3 Community License Agreement vérifié il y a 14 jours
Hy3 Tencent Poids ouverts Apache-2.0 vérifié il y a 14 jours
LTX-2.5 Lightricks Poids ouverts LTX-2 Community License Agreement vérifié il y a 14 jours
GLM-5.2 Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
Kimi-K2.7-Code Moonshot AI Poids ouverts Modified MIT License vérifié il y a 14 jours
MiniMax-M3 MiniMax Poids ouverts MiniMax Community License vérifié il y a 14 jours
Kimi-K3 Moonshot AI Poids ouverts Kimi K3 License vérifié il y a 14 jours
Command A+ (05-2026) Cohere Poids ouverts Apache-2.0 vérifié il y a 14 jours
DeepSeek-V4-Pro DeepSeek Poids ouverts MIT vérifié il y a 14 jours
DeepSeek-V4-Flash DeepSeek Poids ouverts MIT vérifié il y a 14 jours
MiniMax-M2.7 MiniMax Poids ouverts Modified MIT License vérifié il y a 14 jours
Mistral Medium 3.5 Mistral AI Poids ouverts Modified MIT License (Mistral AI) vérifié il y a 14 jours
Kimi-K2.6 Moonshot AI Poids ouverts Modified MIT License vérifié il y a 14 jours
GLM-5.1 Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
Hy3-preview Tencent Poids ouverts Tencent Hy Community License Agreement vérifié il y a 14 jours
Mistral Small 4 Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
LTX-2.3 Lightricks Poids ouverts LTX-2 Community License Agreement vérifié il y a 14 jours
Qwen3.5-397B-A17B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Qwen3.5-122B-A10B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
GLM-5 Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
MiniMax-M2.5 MiniMax Poids ouverts Modified MIT License vérifié il y a 14 jours
Kimi-K2.5 Moonshot AI Poids ouverts Modified MIT License vérifié il y a 14 jours
Devstral 2 Mistral AI Poids ouverts Modified MIT License (Mistral AI) vérifié il y a 14 jours
Mistral Large 3 Mistral AI Poids ouverts Apache-2.0 vérifié il y a 14 jours
DeepSeek-V3.2 DeepSeek Poids ouverts MIT vérifié il y a 14 jours
GLM-4.7 Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
MiniMax-M2.1 MiniMax Poids ouverts Modified MIT License vérifié il y a 14 jours
Kimi-K2-Thinking Moonshot AI Poids ouverts Modified MIT License vérifié il y a 14 jours
DeepSeek-V3.2-Speciale DeepSeek Poids ouverts MIT vérifié il y a 14 jours
Kimi-Linear-48B-A3B Moonshot AI Poids ouverts MIT vérifié il y a 14 jours
MiniMax-M2 MiniMax Poids ouverts Modified MIT License vérifié il y a 14 jours
GLM-4.6 Z.ai (ex-Zhipu AI) Poids ouverts MIT vérifié il y a 14 jours
DeepSeek-V3.1-Terminus DeepSeek Poids ouverts MIT vérifié il y a 13 jours
DeepSeek-V3.2-Exp DeepSeek Poids ouverts MIT vérifié il y a 14 jours
Qwen3-VL-235B-A22B-Instruct Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
DeepSeek-V3.1 DeepSeek Poids ouverts MIT vérifié il y a 14 jours
Jamba Large 1.7 AI21 Labs Poids ouverts Jamba Open Model License vérifié il y a 14 jours
ERNIE-4.5-VL-424B-A47B Baidu Poids ouverts Apache-2.0 vérifié il y a 14 jours
Kimi-K2-Instruct Moonshot AI Poids ouverts Modified MIT License vérifié il y a 14 jours
Qwen3-235B-A22B Alibaba Poids ouverts Apache-2.0 vérifié il y a 14 jours
Llama 4 Maverick Meta Poids ouverts Llama 4 Community License Agreement vérifié il y a 14 jours
Command A (03-2025) Cohere Poids ouverts CC-BY-NC-4.0 vérifié il y a 14 jours
DeepSeek-R1 DeepSeek Poids ouverts MIT vérifié il y a 14 jours
Llama 3.1 405B Meta Poids ouverts Llama 3.1 Community License Agreement vérifié il y a 14 jours
K2-65B LLM360 (consortium MBZUAI, Petuum, Cerebras) Open source Apache-2.0 vérifié il y a 14 jours