14 modèles de 6 éditeurs. Choisissez-en un pour voir les meilleures créations, les modes pris en charge et comment les autres écrivent leurs prompts.
Premier modèle d'image d'OpenAI. Suit bien les instructions, dessine avec précision le texte et les mises en page complexes.
Modèles d'image de la génération Google Gemini 2.5 Flash. Génération rapide, retouche et cohérence des personnages très pratiques, accessible à tous.
Kling de Kuaishou. Côté image, il excelle dans les portraits, le style chinois et les visuels produits, avec un rendu fin des lumières et matières ; écrivez le prompt en chinois, et une image de référence verrouille le personnage et la composition. Pour le modèle vidéo de la même maison, voir Kling Vidéo.
Sortie en avril 2026. Génération plus rapide que la génération précédente, retouche d'image plus précise, dimensions flexibles, possibilité d'utiliser directement une image en entrée, texte et mise en page nettement meilleurs.
La série de modèles d'image Seedream de ByteDance. Bonne compréhension sémantique du chinois, stable pour portraits, images produits et affiches, lumière et matières fines ; écrivez les prompts en chinois, choisissez le ratio et la résolution dans l'interface ou dans le prompt.
La plus artistique, forte en lumière, texture et composition. Utilisez la référence de style (--sref) et Omni Reference (--oref) pour fixer style et personnage, paramètres à la fin du prompt.
Génération d'images xAI (Grok Imagine). Sur X, une phrase suffit pour créer une image, et modifier (changer le fond, le style, agrandir) se fait aussi en parlant ; style réaliste et tendance, idéal pour tester des idées rapidement.
Sortie en septembre 2026, la génération la plus précise en édition, en deux versions Flare (rapide) et Sunburst (précise), plus fiable sur le texte et les instructions.
Basé sur Gemini 3 Pro, il raisonne avant de générer l'image, et maîtrise les connaissances du monde et les infos en temps réel. Très fiable pour affiches, infographies et visualisations, avec un texte quasi sans erreur.
Génération Gemini 3.1 Flash, la suivante rapide. Recherche web, infographies, 1K / 2K et ratios personnalisés.
La série Seedream 5.0 de ByteDance. Elle raisonne avant de générer, peut consulter le web, et excelle en visuels produits et affiches.
Modèle vidéo de Kuaishou Kling. Génération de vidéo à partir de texte ou d'image, mouvements naturels ; styles chinois, réaliste et pub ; prompts en chinois, image initiale pour figer la composition.
Nouveau modèle de génération audio-vidéo de ByteDance, jusqu'à 30 s, prolongeable deux fois ; comprend la composition et le langage caméra d'une vidéo de référence, prend en charge fond vert, maquette blanche et autres éditions pro.
Architecture unifiée de génération audio-vidéo, acceptant texte, image, audio et vidéo comme références ; mouvement stable, audio et image synchronisés, contrôle du jeu, de la lumière et des mouvements de caméra via les références.