Mô hình
Duyệt các mô hình AI có sẵn. Chọn một và bắt đầu tạo.

GPT Image 2
OpenAI
API tạo hình ảnh GPT Image 2 của OpenAI - lên đến 4K với suy luận tích hợp, hiển thị văn bản đa ngôn ngữ, và chỉnh sửa theo hình ảnh tham chiếu.

GPT Image 1.5
OpenAI
API tạo hình ảnh GPT Image 1.5 của OpenAI — nhanh hơn 4 lần so với v1 với hiển thị văn bản vượt trội, 3 tỷ lệ khung hình, và chế độ chất lượng medium/high.

GPT Image 1
OpenAI
API tạo hình ảnh GPT Image 1 của OpenAI — mô hình hình ảnh GPT-4o gốc đầu tiên của OpenAI với khả năng tuân thủ prompt mạnh mẽ và tối đa 5 hình ảnh tham chiếu.

Nano Banana 2
API tạo hình ảnh Nano Banana 2 của Google - Gemini 3.1 Flash với đầu ra 4K, 15 tỷ lệ khung hình, và nhất quán nhân vật cho tối đa 5 nhân vật.

Nano Banana Pro
API tạo hình ảnh Nano Banana Pro của Google - Gemini 3 Pro với hiển thị văn bản sắc nét nhất, đầu ra 4K, và chất lượng cao nhất trong dòng sản phẩm.

Nano Banana
API tạo hình ảnh Nano Banana của Google - mô hình giá rẻ chạy bằng Gemini 2.5 Flash với 11 tỷ lệ khung hình và tối đa 10 hình ảnh tham chiếu.

Seedream 5.0 Lite
ByteDance
API tạo hình ảnh Seedream 5.0 Lite của ByteDance — tốc độ và tính mạch lạc hình ảnh thế hệ mới nhất với đầu ra 2K/3K và 14 hình ảnh tham chiếu.

Seedream 4.5
ByteDance
API tạo hình ảnh Seedream 4.5 của ByteDance — tạo và chỉnh sửa hình ảnh trong cùng một mô hình với đầu ra lên đến 4K và 14 hình ảnh tham chiếu.

Seedance 2.0
ByteDance
API tạo video Seedance 2.0 của ByteDance — lên đến 1080p với âm thanh và hội thoại tích hợp, chuyển hình ảnh thành video, và clip từ 4 đến 15 giây.

Seedance 2.0 Fast
ByteDance
API tạo video Seedance 2.0 Fast của ByteDance — phiên bản tối ưu tốc độ với tạo âm thanh, tỷ lệ khung hình tự động, và clip lên đến 15 giây.

Seedance 1.5 Pro
ByteDance
API tạo video Seedance 1.5 Pro của ByteDance — video chất lượng điện ảnh với âm thanh đồng bộ, hội thoại đa ngôn ngữ, và độ phân giải lên đến 1080p.

Seedance 1.0 Pro
ByteDance
API tạo video Seedance 1.0 Pro của ByteDance — video điện ảnh chất lượng cao với chuyển cảnh đa góc quay ở độ phân giải 720p và 1080p.

Seedance 1.0 Lite
ByteDance
API tạo video Seedance 1.0 Lite của ByteDance — lựa chọn tiết kiệm cho các clip nhanh lên đến 1080p với chuyển văn bản thành video và chuyển hình ảnh thành video.

Kling 3.0
Kling
API tạo video Kling 3.0 của Kuaishou — 4K gốc ở 60fps với storyboard đa góc quay, âm thanh 5 ngôn ngữ, và 3 chế độ chất lượng.

Veo 3.1 Fast
Veo 3.1 Fast — mô hình video nhanh và tiết kiệm chi phí của Google DeepMind với âm thanh tích hợp (hội thoại và hiệu ứng âm thanh), chuyển hình ảnh thành video, và độ phân giải lên đến 1080p.

Hailuo Pro
Hailuo
API tạo video Hailuo Pro của MiniMax — chuyển văn bản thành video và chuyển hình ảnh thành video nhanh với chất lượng chuyển động và nhất quán nhân vật vượt trội.

MiniMax H3
MiniMax
MiniMax H3 (Hailuo 03) là mô hình tạo video đa phương thức thống nhất, biến văn bản, hình ảnh, video và tài liệu âm thanh thành các video 2K hoàn chỉnh với âm thanh nổi gốc. Xây dựng cảnh nguyên bản, chuyển động ảnh tĩnh, chỉnh sửa video hiện có — tất cả qua một MiniMax H3 API duy nhất.

Qwen Image 3.0
Alibaba Qwen
Qwen Image 3.0 (Qwen-Image-3.0-Pro) là mô hình tạo ảnh tiên tiến của Alibaba dành cho hình ảnh chân thực, bố cục có cấu trúc, chi tiết phong phú và typography chất lượng cao. Tạo và chỉnh sửa hình ảnh với văn bản nhỏ chính xác, kết xuất đa ngôn ngữ và bố cục phức tạp thông qua một Qwen Image 3.0 API duy nhất.

FLUX 3
Black Forest Labs
FLUX 3 là nền tảng đa phương thức thống nhất sắp ra mắt của Black Forest Labs, kết hợp hình ảnh, video, âm thanh, ngôn ngữ và dự đoán hành động vào cùng một mô hình. Flux 3 API sẽ bao gồm văn bản thành video với âm thanh gốc, tổng hợp và chỉnh sửa hình ảnh, cùng các khả năng AI vật lý khi từng tính năng được ra mắt.
Không tìm thấy mô hình bạn cần? Cho chúng tôi biết và chúng tôi sẽ xem xét bổ sung.

