AI Models Catalog
发布时间:2026-08-20 | 浏览:7
Recherchez et comparez des modèles de texte, image, vidéo et audio proposés par les principaux fournisseurs. Consultez les fonctionnalités et les tarifs, puis intégrez-les avec une seule clé API.
Gemini 3.7 Flash
3.7 Flash apporte des améliorations significatives dans les flux de travail de l’ingénierie logicielle, du travail intellectuel et du développement web — avec un prix de lancement équivalent à la moitié du coût initial de 3.6 Flash par million de jetons.
DeepSeek V4 Pro
DeepSeek V4 Pro est un modèle à mélange d’experts à grande échelle de DeepSeek, avec 1.6T de paramètres au total et 49B de paramètres activés, prenant en charge une fenêtre de contexte de 1M-token. Il est conçu pour le raisonnement avancé, la programmation et les flux de travail d’agents à long horizon, avec de solides performances sur des benchmarks de connaissances, de mathématiques et d’ingénierie logicielle.
Le modèle phare pour le code et tout le reste : appels d’outils agentiques, hallucinations minimales, raisonnement configurable.
minimax-h3 est un nouveau modèle de génération vidéo conçu pour une production créative de haute qualité. Il offre une meilleure compréhension des requêtes, une cohérence visuelle renforcée, des mouvements plus fluides et un contrôle plus flexible des images de référence, pour des flux de travail de génération vidéo cinématographiques.
seedance-2-5 est un modèle de génération conjointe audio-vidéo de nouvelle génération, conçu pour des récits de 30 secondes, avec un contrôle précis des références et de puissantes capacités d'édition.
GLM-5.3 est un grand modèle de langage open source de nouvelle génération, optimisé pour la programmation complexe, les tâches à long horizon et les scénarios de cybersécurité. Il offre des capacités de programmation et des performances d’agent nettement améliorées par rapport à GLM-5.2.
FLUX 3 - Modèles du monde réel : vers des modèles de flux multimodaux en tant qu'ossature de l'intelligence visuelle.
L’accès à Claude Fable 5 a été rétabli. Il apporte une intelligence de 5e génération à vos projets de programmation et à vos travaux professionnels les plus ambitieux.
Claude Sonnet 5
Modèle à hautes performances pour la programmation et les agents
Qwen3.8-Max est le modèle de langage phare d'Alibaba Qwen, conçu pour le raisonnement avancé, les flux de travail agentiques, la compréhension multimodale et les applications d'IA à l'échelle de l'entreprise. Il compte 2.4T de paramètres, adopte l'architecture MoE, prend en charge le basculement entre les modes de réflexion et d'inférence rapide, peut gérer divers formats de contenu et excelle dans des scénarios tels que l'ingénierie logicielle, la bureautique professionnelle et le raisonnement logique complexe, et n'est devancé que par Fable 5 d'Anthropic.
Commencez par GPT-5.6 Sol pour le raisonnement complexe et le codage, choisissez GPT-5.6 Terra pour équilibrer l'intelligence et le coût, ou utilisez GPT-5.6 Luna pour des charges de travail à grand volume sensibles au coût.
GPT Image 2 est le modèle de génération d’images de pointe d’OpenAI, conçu pour une génération et une édition d’images rapides et de haute qualité. Il prend en charge des tailles d’images flexibles et des entrées d’images haute fidélité.
Claude Opus 5 est disponible dès aujourd'hui. C'est un modèle réfléchi et proactif qui se rapproche de l'intelligence de pointe de Claude Fable 5, à moitié prix.
Gemini 3.6 Flash
Gemini 3.6 Flash offre une intelligence de pointe soutenue, optimisée pour des tâches du monde réel, à une vitesse supérieure et à moindre coût. Conçu pour l’ère agentique, il excelle en génération de code, en exécution agentique et en raisonnement spatial. Ce modèle est particulièrement efficace pour des boucles agentiques rapides impliquant des cycles et des itérations de codage complexes.
Seedance 2.0 est le modèle de fondation vidéo multimodal de nouvelle génération de ByteDance, axé sur la génération de vidéos narratives cinématographiques à plusieurs plans. Contrairement aux démonstrations texte-vers-vidéo à plan unique, Seedance 2.0 met l’accent sur un contrôle basé sur des références (images, clips courts, audio), la cohérence des personnages et des styles d’un plan à l’autre, ainsi qu’une synchronisation audio/vidéo native — visant à rendre la vidéo générée par IA utile aux workflows professionnels de création et de prévisualisation.
Nano Banana 2 lite
Le modèle Gemini 3.1 Flash Lite Image est un spécialiste de l’efficacité au sein de la famille de modèles de génération d’images, conçu pour une latence ultra-faible et pour une génération et une modification d’images à moindre coût.
Happy Horse 1.1
HappyHorse 1.1 est un modèle multimodal de génération de vidéos conçu pour la création de contenus professionnels, la publicité, les courts métrages, la production pour les réseaux sociaux et la narration. Il étend les capacités de HappyHorse 1.0 — qui a suscité une attention considérable après s’être classé parmi les meilleurs lors d’évaluations indépendantes de génération vidéo — en offrant une cohérence des scènes renforcée et une fidélité visuelle améliorée.
Claude Opus 4.8
Claude Opus 4.8 est un modèle d’IA haut de gamme conçu pour le raisonnement avancé, l’analyse approfondie et la génération de contenus de haute qualité. Il excelle dans le traitement d’instructions complexes, la compréhension de contextes étendus et la résolution de problèmes avancée dans les domaines professionnels et techniques.
Gemini 3.5 Flash
Gemini 3.5 Flash est un modèle d’IA à grande vitesse, conçu pour une réponse rapide et des performances de codage efficaces. Il offre une vitesse de génération nettement améliorée tout en conservant de solides capacités de raisonnement, ce qui le rend adapté aux applications en temps réel et aux flux de travail des développeurs.
Gemini 3.1 Pro est la prochaine génération dans la série de modèles Gemini, une suite de modèles de raisonnement hautement performants, nativement multimodaux. Gemini 3 Pro est désormais le modèle le plus avancé de Google pour les tâches complexes, et peut comprendre de vastes ensembles de données ainsi que des problèmes difficiles issus de différentes sources d’information, y compris le texte, l’audio, les images, la vidéo et des dépôts de code entiers.
Kimi K3 est le modèle phare de Kimi, conçu pour la programmation à longue portée et le travail de la connaissance de bout en bout, doté d’un contexte de 1M de jetons et d’une intelligence polyvalente de pointe.
Kimi K2.7 Code est le modèle de programmation le plus intelligent de Kimi à ce jour, capable de suivre de manière fiable des instructions dans des contextes longs et d’accomplir des tâches de programmation avec un taux de réussite plus élevé. Il prend en charge les entrées texte, image et vidéo, et ne prend en charge que le mode réflexion, le dialogue et les tâches d’agent.
Happy Horse 1.0
Happy Horse 1.0 — un modèle de génération audio‑vidéo de haute qualité prenant en charge la création texte‑vers‑vidéo et image‑vers‑vidéo. Il peut générer des visuels, de l’audio et des mouvements des lèvres synchronisés, ce qui le rend adapté aux courts métrages, aux créations publicitaires et aux présentations de produits.
Claude Mythos 5
Partage les capacités de Claude Fable 5 sans les classificateurs de sécurité. Disponible via Project Glasswing. Successeur de Claude Mythos Preview.
Claude Opus 4.7
Le modèle le plus intelligent pour les agents et la programmation
Minimax-m3 est un modèle d'IA multimodal conçu pour un raisonnement robuste, des conversations naturelles et la génération de contenu créatif. Il offre des performances équilibrées sur les tâches de compréhension textuelle et visuelle, ce qui le rend adapté aux applications d'IA à usage général.
GPT-5.5 Pro allie intelligence de pointe, précision et efficacité pour relever des défis complexes. Du développement logiciel et de l'analyse de données à la recherche et à l'aide à la décision, il fournit une assistance de niveau expert avec rapidité et constance.
Model 5.5 est un modèle d’IA de nouvelle génération, conçu pour un raisonnement plus solide, des réponses plus rapides et une précision accrue sur un large éventail de tâches. Il excelle dans la compréhension des instructions complexes, la génération de contenu de haute qualité et l’assistance à la programmation, à l’analyse et à la résolution de problèmes.
MiniMax-M2.7 offre la même intelligence de premier ordre que la version standard — y compris l’auto-évolution récursive et une productivité bureautique de niveau expert — mais est conçu pour les applications nécessitant une latence inférieure à la seconde et une génération de jetons à grande vitesse. S’appuyant sur une architecture de backbone d’inférence améliorée, sa vitesse de sortie est 66 % plus rapide que celle du modèle standard (atteignant 100 tps). C’est le choix privilégié pour les assistants de programmation interactifs, l’exécution de boucles d’agents en temps réel et les pipelines d’entreprise à haut débit avec des exigences strictes en matière de temps de réponse.
DeepSeek V4 Flash
DeepSeek V4 Flash est un modèle à mélange d’experts optimisé pour l’efficacité de DeepSeek, avec 284B de paramètres au total et 13B de paramètres activés, prenant en charge une fenêtre de contexte de 1M de tokens. Il est conçu pour une inférence rapide et des charges de travail à haut débit, tout en conservant de solides performances en raisonnement et en programmation.
GPT-5.4 Nano est un modèle d'IA ultra-léger conçu pour une vitesse et une efficacité maximales. Il est optimisé pour les tâches simples, les interactions en temps réel et les déploiements à grande échelle, où une faible latence et une consommation minimale de ressources sont essentielles.
GPT-5.4 Mini est un modèle d’IA léger et efficace, optimisé pour la vitesse et la productivité au quotidien. Il offre des capacités conversationnelles fiables, la génération de contenu et une assistance aux tâches, tout en maintenant une faible latence et une faible utilisation des ressources.