groq/whisper-large-v3Bóc lời từ file âm thanh thành văn bản. Tối đa 25MB mỗi file.
Giá dưới đây là giá bạn trả, đã tính sẵn. Mỗi model có nhiều mức tuỳ thời lượng, độ phân giải và chế độ — bấm vào thẻ để xem đủ.
44 modelgroq/whisper-large-v3Bóc lời từ file âm thanh thành văn bản. Tối đa 25MB mỗi file.
gpt-5.5Viết kịch bản, tóm tắt, dịch và mọi tác vụ xử lý chữ. Đọc được cả ảnh.
groq/whisper-large-v3-turboBóc lời từ file âm thanh thành văn bản. Tối đa 25MB mỗi file.
claude-opus-4-8Viết kịch bản, tóm tắt, dịch và mọi tác vụ xử lý chữ. Đọc được cả ảnh.
fal-ai/birefnet/v2Cắt chủ thể ra khỏi nền, giữ NGUYÊN từng điểm ảnh gốc — không vẽ lại, không sai chữ. Trả về PNG nền trong suốt thật. Hợp với ảnh sản phẩm, ảnh người, ảnh vật thể; ảnh phong cảnh không có chủ thể rõ thì không dùng được.
kling_colors_1_5kling_colors_2_0kling_colors_2_1z_imageTạo ảnh nhanh, chất lượng mới nhất của Alibaba
dreamina_3_1o1Tính năng nhất quán cao với khả năng chỉnh sửa chi tiết chính xác và chuyển đổi phong cách chính xác.
3.0-omniBiểu đạt nội dung kể chuyện nâng cao, xuất đầu ra 2K/4K siêu nét gốc, và tạo chuỗi hình ảnh liên tiếp.
google_image_gen_bananaBest For Fast Edit
seedream_4_0Best For Edit
gpt-image-2Tạo ảnh từ mô tả bằng chữ.
google_image_gen_banana_proGoogle Nano Banana Pro cho phép sửa hình ảnh và tạo văn bản thành hình ảnh với đầu ra chất lượng cao, 1k 2k 4k. Hỗ trợ font chữ tiếng Việt.
generative_upscale_v2Generative Upscale - Upscale cao cấp, nhanh chóng, tái tạo chi tiết, cải thiện chất lượng... đa dạng tùy chọn , mức giá cả hợp lý, phù hợp cho số lượng lớn.
seedream_4_5Model ảnh 2k 4k mới nhất của ByteDance
midjourney_7_0[Mỗi lượt 4 ảnh] MidJourney là mô hình AI tạo ảnh từ văn bản, nổi bật với phong cách nghệ thuật đa dạng, chi tiết đẹp mắt và khả năng biến ý tưởng thành hình ảnh sống động.
midjourney_8_0[Mỗi lượt 4 ảnh] MidJourney V8 là phiên bản AI tạo ảnh mới với chất lượng vượt trội, chi tiết sắc nét, ánh sáng chân thực, hiểu prompt tốt hơn, hỗ trợ phong cách đa dạng từ nghệ thuật đến ảnh real.
google_image_gen_banana_2Nano 2 là một model AI tạo và hiểu hình ảnh nhanh của Google, thuộc dòng Gemini Flash Image — nổi bật với tốc độ cao, chi phí thấp, cho phép tạo/chỉnh sửa ảnh từ mô tả văn bản hoặc phân tích nội dung hình ảnh.
seedream_5_0Là mô hình tạo ảnh mới nhất từ BytePlus (thuộc ByteDance), nổi bật với khả năng kết nối web thời gian thực để tạo ảnh luôn cập nhật và đúng ngữ cảnh. Mô hình được nâng cấp mạnh về hiểu prompt phức tạp, độ nhất quán hình tham chiếu, tri thức toàn cầu và tạo cảnh chuyên nghiệp, phù hợp cho các quy trì
imagegen_2_0GPT Image 2 là model tạo ảnh AI thế hệ mới với khả năng hiểu prompt chính xác, cho hình ảnh sắc nét, chi tiết cao và bố cục tự nhiên. Phù hợp tạo ảnh chân dung, quảng cáo, sản phẩm, nghệ thuật và nội dung sáng tạo chuyên nghiệp.
wan_2_2Model mô phỏng chuyển động & thay thế nhân vật, cho animation tự nhiên và sống động.
hailuo_2_3Hailuo 2.3 là mô-hình AI video cao cấp (text-to-video và image-to-video) hỗ trợ độ phân giải cao (768 p/1080 p), tối ưu cho chuyển động chân thực, camera động và vật lý mô phỏng phức tạp — phù hợp cho sản xuất video cinematic, quảng cáo hoặc social-clip nhanh.
kling_video_2_5Max Creativity with Exceptional Value
veo_3_1veo_omniModel VEO Omni là dòng tạo video thế hệ mới từ google, hỗ trợ đa phương thức lên đến 15S
grok_video_heavyNhanh chóng, tiện lợi, giá rẻ, lên đến 15s - 30 fps. Có hỗ trợ âm thanh, đa phân cảnh.
kling_video_motionModel Kling 2.6 chuyên sao chép chuyển động, thay thế nhân vật
kling_video_2_6See the Sound, Hear the Visual
kling_video_o1Mô hình video thống nhất với hướng dẫn đa phương thức tất cả trong một và tính nhất quán đặc biệt.
omnihuman_1_5Lipsync chuyên nghiệp
kling_video_3_0Đầu vào đa phương thức tất cả trong một, nhân vật điều khiển bằng giọng nói, và xuất âm thanh gốc kèm storyboard.
seedance_20_proSeedance 2.0 là một công cụ AI tạo video thế hệ mới cho phép bạn biến văn bản, hình ảnh và âm thanh thành các video động mượt mà, chất lượng cao, với chuyển động, âm thanh và kể chuyện tự nhiên — phù hợp để sản xuất video ngắn, nội dung mạng xã hội hoặc trailer sáng tạo.
kling_video_2_1_5skling_video_3_0_editModel Kling cao cấp chuyên cho Edit video
kling_video_motion_3Model Kling 3.0 chuyên sao chép chuyển động, thay thế nhân vật
seedance_20_miniModel chuyên cho tạo video từ nhiều ảnh, video, audio. Sáng tạo không giới hạn.
kling_video_o1_editMô hình cao cấp tiên tiến của Kling AI, có thể edit Video, thay đổi nhân vật, vật thể, bối cảnh...
happy_horse_1Happy Horse 1.0 là model AI tạo video từ ảnh đầu (start frame) và các ảnh thành phần, cho phép dựng video với chuyển động mượt, giữ ổn định nhân vật và kết hợp nhiều yếu tố hình ảnh trong cùng một cảnh. Phù hợp để tạo video ngắn, animation sản phẩm và nội dung social từ asset có sẵn.
kling_video_2_1_10sflux_3FLUX 3 là bước tiến tiếp theo của Black Forest Labs, hướng tới một nền tảng AI sáng tạo thống nhất, nơi hình ảnh, video và âm thanh được tạo ra từ cùng một mô hình thay vì nhiều hệ thống riêng lẻ.
seedance_25_omniModel chuyên cho tạo video từ nhiều ảnh, video, audio. Sáng tạo không giới hạn.