Key capabilities
- Text-to-Image — Generate images from natural language descriptions
- Flexible resolution — Any custom size up to 4K (3840px), edges must be multiples of 16
- Near-perfect text rendering — ~99% character-level accuracy across 12+ languages
- Multi-object composition — Complex scenes without occlusion or misplacement issues
- Multi-style — Photorealism, illustration, anime, vector, 3D, data visualization
- Batch generation — Generate up to 4 images per request
Output specifications
Quick example
Parameters
API Reference
View the interactive API playground.