6개 회사의 모델 14개. 하나를 골라 뛰어난 작품, 지원 모드, 사람들의 작성법을 살펴보세요.
OpenAI의 첫 번째 이미지 모델. 지시를 잘 따르고, 이미지 속 텍스트와 복잡한 레이아웃도 정확하게 그립니다.
구글 Gemini 2.5 Flash 세대의 이미지 모델. 생성이 빠르고, 편집과 인물 일관성 유지가 특히 편리해 일반인도 쉽게 즐길 수 있음.
콰이쇼우 클링(Kling). 이미지 쪽은 인물, 국풍, 상품 이미지에 강하며 빛과 질감 표현이 섬세하다. 프롬프트는 중국어로 쓰면 되고, 참고 이미지를 주면 인물과 구도를 고정할 수 있다. 같은 회사의 비디오 모델은 클링 비디오 참고.
2026년 4월 출시. 이전 세대보다 생성이 빠르고 이미지 수정이 더 정확하며, 크기가 유연하고 한 장의 이미지를 바로 입력으로 사용할 수 있고, 화면 속 텍스트와 레이아웃이 눈에 띄게 좋아졌습니다.
바이트댄스의 Seedream 시리즈 이미지 모델. 중국어 의미 이해가 뛰어나고 인물, 상품 이미지, 포스터 모두 안정적이며 빛과 질감이 섬세함. 프롬프트는 중국어로 쓰면 되고, 비율과 해상도는 인터페이스에서 선택하거나 프롬프트에 적으면 됨.
그림 맛이 가장 진한 곳으로, 빛과 질감, 구도가 강점입니다. 스타일 레퍼런스(--sref)와 Omni Reference(--oref)로 스타일과 캐릭터를 고정할 수 있으며, 파라미터는 프롬프트 끝에 적습니다.
xAI의 이미지 생성(Grok Imagine). X에서 한 문장으로 이미지를 만들고, 배경 교체·스타일 변경·확장 같은 수정도 바로 말하면 됩니다. 사실적이고 인터넷 감성이 강해 아이디어를 빠르게 시험하기 좋습니다.
2026년 9월 출시, 편집 정밀도가 가장 높은 세대. Flare(속도형)와 Sunburst(정밀형) 두 버전으로 나뉘며 텍스트와 지시 준수가 더 안정적입니다.
Gemini 3 Pro 기반으로, 먼저 추론한 뒤 이미지를 생성하며 세계 지식과 실시간 정보도 이해합니다. 포스터, 인포그래픽, 시각화 작업이 안정적이고 이미지 속 텍스트도 거의 틀리지 않습니다.
Gemini 3.1 Flash 세대, 빠른 속도의 차세대 모델. 웹 검색과 인포그래픽 제작을 지원하며 1K / 2K 및 사용자 지정 화면 비율을 지원합니다.
바이트의 Seedream 5.0 시리즈. 먼저 추론한 뒤 이미지를 생성하고, 인터넷 검색도 가능하며, 상품 이미지와 포스터에 특히 뛰어납니다.
콰이쇼우 클링(Kling)의 비디오 모델. 텍스트→비디오와 이미지→비디오 모두 가능하고, 인물 동작과 카메라 움직임이 자연스러움. 중국풍, 실사, 광고 느낌 모두 강점. 프롬프트는 중국어로 쓰면 되고, 첫 프레임 이미지를 주면 구도와 인물을 고정할 수 있음.
바이트의 차세대 오디오·비디오 통합 생성 모델로, 한 번에 최대 30초까지 생성하고 두 번까지 이어붙일 수 있습니다. 참고 영상의 구도와 카메라 언어를 이해하며, 그린 스크린·화이트 모델 등 전문 편집을 지원합니다.
통합 오디오·비디오 생성 아키텍처로 텍스트, 이미지, 오디오, 비디오를 동시에 참조 가능; 움직임이 안정적이고 음화가 동기화되며 참조 소재로 연기, 조명, 카메라 무빙을 제어.