Le modèle le plus intelligent et le plus aligné d'OpenAI pour le codage, la navigation, la science et le travail professionnel.
Le modèle Flash le plus intelligent de Google pour l'ingénierie logicielle à long terme, les agents autonomes et le raisonnement complexe en plusieurs étapes—avec des performances de pointe, à la vitesse et au coût de Flash.
Le modèle de raisonnement multimodal amélioré de Meta pour les tâches agentiques de longue durée et de programmation, avec un meilleur suivi des instructions, une utilisation plus efficace des outils et une fenêtre de contexte de 1 million de tokens.
Le modèle le plus avancé d'Anthropic pour le codage et le travail intellectuel — ses capacités de recherche offrent un premier aperçu de la façon dont l'IA contribuera au progrès scientifique.
Traduisez vos vidéos en plus de 170 langues et accents, avec synchronisation labiale.
Transformez une photo et un script ou un audio en vidéo parlante, avec 30 voix IA.
Étendez les bords de la vidéo par IA pour l'adapter à n'importe quel format d'image.
Générez des effets sonores et une ambiance adaptés à votre vidéo à partir d'un texte.
Améliorez vos vidéos en 720p, 1080p ou 4K à 60 fps grâce à l'IA Topaz.
~0,035 $/s, génération vraiment ILLIMITÉE.
Modèle de raisonnement multimodal rapide d’Alibaba pour le codage, les workflows agentiques, la compréhension visuelle, l’analyse de documents/bases de code, l’interaction avec le bureau, les graphiques et les longues vidéos.
Modèle multimodal natif de Z.ai, adapté au codage efficace et aux tâches d’agents sur le long terme.
L'édition haute vitesse du modèle vidéo tout-en-un d'Alibaba : mêmes entrées texte, images, vidéo/audio de référence, documents et pages web, avec une génération de bout en bout nettement plus rapide.
Transcription de réunion en temps réel avec séparation des locuteurs, dialogue nettoyé par IA, traduction et résumés générés automatiquement.
Le modèle phare de Z.ai, avec des améliorations significatives en programmation, en ingénierie logicielle, en raisonnement et en capacités d’agent à long terme.
Le tout dernier modèle de Google, à moindre coût.
~0,005 $/image, conçu pour la génération à grande échelle.
N° 1 en intelligence × vitesse × coût — selon Elon.
Idéal pour le texte et la mise en page
Un modèle de texte en image offrant une meilleure fidélité, des styles plus variés et un rendu de texte amélioré.
Modèle vidéo tout-en-un d'Alibaba : texte, images, vidéo/audio de référence, même un document ou une page web.
Un modèle d’IA multimodal pour créer des vidéos réalistes avec audio natif.
Le modèle de raisonnement de Meta pour les tâches agentiques complexes, avec une entrée multimodale et une fenêtre de contexte de 1 million de tokens.
Le meilleur modèle vidéo au monde
Un outil de détection de vidéos IA qui identifie avec précision le contenu généré par l’IA dans les vidéos.
Un outil de détection d’images IA qui identifie avec précision le contenu généré par l’IA dans les images.
Un modèle multimodal de génération vidéo prenant en charge la génération de vidéos à partir de texte ou d'images, ainsi que la génération guidée par des images, des vidéos et de l'audio de référence.
Synthèse vocale multilingue rapide.
Génération de musique avec deux modes : Song (transforme des paroles en chanson complète avec une invite de style) et BGM (crée une musique de fond instrumentale à partir d'une description).
Synthèse vocale et effets sonores ; prend en charge l'audio ou les images de référence, avec 18 langues disponibles.
Générez de la musique à partir d’un prompt textuel, de 3 secondes à 10 minutes.
Voix de narration longue très stable, compatible avec 29 langues et jusqu’à 10 000 caractères.
Synthèse vocale expressive avec des balises audio comme [whispering], compatible avec plus de 70 langues.
Un modèle d'IA haut de gamme, performant en raisonnement, en programmation et en tâches multilingues.
Claude Opus 5 est un grand modèle de langage phare conçu pour les tâches très complexes, excellent en raisonnement approfondi, en programmation professionnelle, en analyse longue et en création de contenu de haute qualité.
Modèle haute efficacité de Google doté de capacités agentiques améliorées, adapté aux sous-agents qui exécutent des tâches ciblées dans des workflows multi-agents.
Le modèle haute efficacité de Google prend en charge le codage, les workflows agentiques et le développement web/app, en fournissant des résultats soignés avec une utilisation réduite des tokens et moins d’appels au modèle.
GLM-5.2 est le modèle phare de Zhipu AI, doté d'une fenêtre de contexte de 1 million de tokens et de solides capacités en programmation, raisonnement, rédaction et agents à long terme.
Kimi K3 est le modèle de langage de nouvelle génération de Moonshot AI, conçu pour la compréhension du chinois, le raisonnement, la programmation, le traitement de contextes longs et la création de contenu.
~0,007 $/s, génération vraiment ILLIMITÉE.
Le modèle d’image nouvelle génération de ByteDance, offrant une génération fidèle, rapide et précise aux requêtes.
GPT-5.6 Luna est la version légère et ultra-rapide, optimisée pour les interactions rapides. Elle est idéale pour les réponses instantanées, l'aide simple au codage, la traduction, les résumés et les tâches quotidiennes où la réactivité compte le plus.
GPT-5.6 Terra est la version équilibrée, conçue pour la productivité au quotidien. Elle offre d'excellentes performances en raisonnement, codage, rédaction et multilingue tout en gardant des réponses rapides et efficaces, ce qui en fait un excellent choix par défaut pour la plupart des utilisateurs.
GPT-5.6 Sol est la version phare conçue pour le raisonnement avancé, le codage complexe, le travail sur de longs contextes et la rédaction de haute qualité. Elle convient particulièrement aux utilisateurs qui recherchent l'intelligence globale la plus puissante et acceptent de sacrifier un peu de rapidité pour des réponses plus approfondies et fiables.
Claude Sonnet 5 est le modèle économique d’Anthropic conçu pour un usage quotidien exigeant, offrant des réponses rapides, de solides capacités de programmation et de tâches agentiques, ainsi qu’une performance globale proche de la série phare Opus.
Prend en charge l’importation de fichiers, l’édition du texte source, la traduction intelligente et l’exportation des résultats, tout en préservant la terminologie, la structure et le style lors des révisions.
Génération de vidéo cinématographique avec audio synchronisé.
Claude Fable 5 est un modèle de langage conçu pour un raisonnement clair, une écriture naturelle et une exécution fiable des tâches. Il met l’accent sur une communication concise, la collaboration créative et la résolution pratique de problèmes dans le codage, l’analyse et la génération de contenu.
Claude Opus 4.8 est le modèle phare d’Anthropic pour le raisonnement avancé, la programmation et les tâches à long contexte. Il excelle dans les tâches logicielles complexes, l’analyse de documents et la collaboration continue sur plusieurs échanges. Sa force réside dans sa profondeur et sa fiabilité, tandis que la vitesse est moins prioritaire que pour les modèles plus légers.
Gemini 3.5 Flash est un modèle de pointe ultra-rapide et léger, offrant des capacités de codage et de raisonnement de niveau Pro, ainsi qu’une fenêtre de contexte d’un million de tokens pour des workflows multimodaux avancés.
GLM-5.1 marque un bond dans la puissance de codage. Au-delà des interactions brèves, il peut travailler de manière autonome pendant plus de 8 heures sur une seule tâche — planifier, exécuter et affiner jusqu’à fournir des résultats prêts pour la production.
Grok 4.3 est un modèle de raisonnement de xAI prenant en charge les entrées de texte et d’image. Conçu pour les workflows agentiques et une grande précision factuelle, il propose un effort de raisonnement ajustable pour traiter des instructions complexes.
Le modèle nouvelle génération d’Alibaba prend en charge la génération de vidéos à partir d’images, de textes et de références, avec des outils de montage pour un contenu créatif flexible et multimodal.
Le modèle vidéo IA tout‑en‑un d’Alibaba — générez, animez, utilisez des références et éditez des vidéos avec un mouvement cinématographique et une physique réaliste.
Presque aussi intelligent que Fable 5. Pour 1/10 du prix.
Modèle MoE optimisé pour l’efficacité de DeepSeek, avec une inférence rapide, une fenêtre de contexte de 1M tokens et de solides capacités de raisonnement pour les chats et les tâches de programmation à haut débit.
L’intelligence au sommet d’OpenAI. Maître du raisonnement complexe, de la multimodalité native et de l’exécution autonome par agents.
Le modèle le plus avancé d’OpenAI pour générer des images photoréalistes, afficher du texte sans défaut et effectuer des retouches haute fidélité.
Le modèle le plus récent et le plus intelligent de Kimi, offrant des capacités d’écriture de code à long terme plus puissantes et plus stables.
Le modèle haut de gamme d’Anthropic pour le raisonnement avancé et le codage complexe.
Génération de vidéos cinématographiques avec références
Modèle vidéo cinématographique haute vitesse de ByteDance.
Le modèle vidéo IA le plus puissant de ByteDance, avec une qualité visuelle digne du cinéma.
Le modèle léger d’OpenAI, optimisé pour des tâches simples à grand volume.
Le modèle mini le plus puissant d’OpenAI à ce jour, pour le codage, l’utilisation de l’ordinateur et les sous‑agents.
Des performances de premier plan à un prix abordable. Un modèle de haute qualité, prêt pour la production, pour la génération d’images avancée et l’édition fluide.
Votre assistant IA personnel qui fonctionne sur vos propres appareils. Optimisé pour la voix, l’automatisation du navigateur et les flux de travail multi‑agents — local d’abord, conçu pour la confidentialité.
Remplace le visage de la personne dans l’image originale selon l’image téléchargée.
Remplacez l’arrière-plan de l’image d’origine selon l’image téléchargée ou une description.
Remplace les vêtements de la personne dans l’image originale selon l’image téléchargée.
Modifie la coiffure et la couleur des cheveux de la personne sur l’image.
Transformez votre produit en visuels à forte conversion en quelques secondes.
Créez des affiches professionnelles avec texte, mise en page et visuels en un clic.
Le modèle le plus intelligent d’OpenAI. Optimisé pour les flux de travail longue durée, les agents de codage et les tâches complexes à plusieurs étapes nécessitant un large contexte.
Le modèle de nouvelle génération d’OpenAI, offrant une intelligence instantanée grâce à un raisonnement et une vitesse révolutionnaires.
Le modèle léger le plus économique de Google, optimisé pour les tâches à haut volume et faible latence.
Le modèle d’image rapide de Google pour la génération et l’édition générales, offrant une haute qualité et une faible latence.
Le modèle d’images nouvelle génération de ByteDance, doté de la recherche web en temps réel, du raisonnement intelligent et de capacités de génération visuelle adaptées aux entreprises.
Le modèle phare amélioré de Google, offrant un raisonnement plus puissant, une efficacité accrue et des performances plus fiables pour les tâches complexes du monde réel.
Le modèle Sonnet le plus puissant d’Anthropic, offrant des performances quasi phares en codage et en raisonnement.
Un modèle de génération vidéo cinématographique qui crée des vidéos avec un son natif.
Le modèle le plus puissant d’Anthropic, conçu pour le raisonnement avancé, la programmation et les flux de travail complexes.
Le modèle le plus polyvalent de Kimi, avec une multimodalité native pour la vision, le texte, le raisonnement et les tâches d’agent.
Génération vidéo instantanée et stable pour un usage créatif quotidien
Générez des photos d’identité professionnelles à partir de n’importe quelle image.
Étend les images au-delà de leurs bords en haute qualité
Restaure les images en haute définition, avec un réglage spécifique pour les visages.
Suppression automatique des filigranes sur les images grâce à l’IA.
Suppression automatique de l’arrière-plan des images grâce à l’IA.
Le modèle nouvelle génération d’Alibaba, offrant une narration cinématographique multi‑plans pour une génération de vidéos cohérentes.
Le modèle de raisonnement rapide et performant de Google, optimisé pour les workflows d’agents et le codage interactif.
Le tout dernier modèle d’OpenAI, doté d’un raisonnement adaptatif, d’un comportement plus autonome et de meilleures performances sur les longs contextes.
Le modèle le plus intelligent d’Anthropic, alliant des capacités de haut niveau à des performances pratiques. Idéal pour les tâches complexes et le développement logiciel.
Le modèle de génération et d’édition d’images le plus puissant et le plus avancé de Google.
Le dernier modèle phare de Google, conçu pour des tâches complexes nécessitant une vaste connaissance du monde et un raisonnement multimodal avancé.
Le dernier modèle polyvalent d’OpenAI, offrant une personnalité plus chaleureuse et une meilleure capacité à suivre les instructions.
Le dernier modèle de génération vidéo de Google, offrant une génération audio native avec un réalisme, une physique et une fidélité au prompt exceptionnels.
Le modèle Haiku le plus rapide et le plus intelligent d’Anthropic, offrant une intelligence proche de la pointe à une fraction du coût et de la latence.
Le modèle Sonnet le plus avancé d’Anthropic, conçu pour alimenter des agents autonomes grâce au codage avancé et à l’orchestration d’outils.
Une version d’Ideogram 3.0 offrant une fidélité supérieure et plus de détails.
Une version plus rapide et plus économique de l’Ideogram 3.0.
Transformez instantanément n’importe quel PDF en chat interactif avec IA pour une lecture plus intelligente et des idées plus rapides.
Gemini 2.5 Flash Image, génération et édition d’images de pointe
Le modèle ultra-léger et ultra-rapide d’OpenAI, qui offre de grandes capacités pour un coût minimal.
Variante économique du GPT-5 d'OpenAI offrant de hautes performances avec une latence et un coût réduits.
Modèle polyvalent d’OpenAI avec des capacités de raisonnement renforcées, une longueur de contexte réduite et une vérification grammaticale plus stricte.
Le modèle de raisonnement d'OpenAI, excellent en raisonnement, en programmation et en mathématiques.
Transcription précise dans 99 langues. Prend en charge l’identification des locuteurs et des horodatages précis.
Un modèle de conversion d'image en vidéo de TikTok offrant une haute fidélité et une grande diversité de mouvements professionnels.
Transforme des images à partir d’instructions textuelles et génère des visuels de haute qualité, sensibles au contexte.
Version haute définition du modèle texte-vers-image créatif de Runway, offrant une grande liberté de création.
Version commerciale du modèle texte-vers-image créatif de Runway, offrant une grande liberté de création.
Le dernier modèle texte-vidéo de Google, avec des effets sonores intégrés : la qualité premium parmi les modèles.
Modèle hybride simplifié d’Anthropic, navigue de façon autonome dans les bases de code, équilibrant performance et efficacité. Adapté à divers contextes de développement.
Outil de recherche IA classique qui peut synthétiser les résultats et afficher les sources.
Le dernier modèle de raisonnement de Google, idéal pour la programmation et les tâches scientifiques.
Le modèle d'inférence open-source d'Alibaba, doté de paramètres activés efficaces et d'une capacité d'inférence remarquable.
Modèle de raisonnement allégé, avec plus de fonctionnalités multimodales, plus compact qu’o3 mini.
Basé sur o4 mini, la vitesse de raisonnement a été optimisée.
Basé sur o3 mini, avec capacités multimodales et recherche en ligne ajoutées.
Version rapide du dernier modèle de raisonnement de Google, excellente en mathématiques et codage avec des réponses rapides.
Outil de détection de contenus IA, identifiant avec précision les textes, images, audios et vidéos générés par IA.
Agent auto-développé avancé pour la recherche d’informations en ligne, le raisonnement, la vérification et l’organisation d’explorations de recherche multi-étapes.
Modèle de raisonnement efficace d’OpenAI, optimisé pour les sciences, les mathématiques et la programmation.
Ancien modèle de raisonnement d’OpenAI.
Modèle léger et rapide, optimisé pour la mise en cache du contexte.
Un modèle de génération vidéo reconnu pour son excellent contrôle des mouvements et ses animations.
Un modèle de texte en vidéo avec une reconnaissance de texte précise et des mouvements de caméra fluides.
Le modèle d’image le plus populaire et classique, prenant en charge plusieurs réglages de paramètres.
Version open source du modèle texte-vers-image créatif de Runway, offrant une grande liberté de création.
Modèle classique d’OpenAI, polyvalent et doté d’une excellente compréhension multimodale.