
Văn bản thành hình ảnh
Tạo hình ảnh AI từ prompt văn bản
Dùng thử MiniMax H3 API cho chuyển văn bản thành video với đầu ra 2K hoặc 768p, sáu tỷ lệ khung hình và khả năng tạo linh hoạt trong 5–15 giây qua API hợp nhất của Flaq AI. Dành cho nhà sáng tạo.
// Step 1: Submit generation request
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'minimax-h3-text-to-video',
prompt: 'A golden retriever running through a sunlit meadow',
resolution: '2k',
duration: 8,
aspect_ratio: '16:9'
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, 10000));
}
# Step 1: Submit generation request
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'minimax-h3-text-to-video',
'prompt': 'A golden retriever running through a sunlit meadow',
'resolution': '2k',
'duration': 8,
'aspect_ratio': '16:9'
}
)
result = response.json()
task_id = result['data']['task_id']
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)
# Step 1: Submit generation request
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "minimax-h3-text-to-video",
"prompt": "A golden retriever running through a sunlit meadow",
"resolution": "2k",
"duration": 8,
"aspect_ratio": "16:9"
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
| Tham số | Giá | Giá gốc | Giảm giá |
|---|
API chuyển văn bản thành video MiniMax H3 biến chỉ dẫn bằng ngôn ngữ tự nhiên thành các chuỗi video điện ảnh dành cho công cụ sáng tạo, quy trình tiếp thị và ứng dụng sản xuất. Quy trình tạo dựa trên văn bản giúp các nhóm mô tả chủ thể, hành động, môi trường, ngôn ngữ máy quay và sắc thái, đồng thời duy trì khả năng tích hợp theo tác vụ và thân thiện với API trên Flaq AI.
Tạo video dựa trên câu lệnh: Chuyển phần mô tả chi tiết về cảnh, chủ thể, hành động và bầu không khí thành ý tưởng hình ảnh chuyển động cho quy trình sáng tạo và sản xuất.
Chỉ đạo chuyển động điện ảnh: Điều khiển chuyển động máy quay, thời gian, khung hình và nhịp điệu thị giác bằng câu lệnh ngôn ngữ tự nhiên để định hình chuỗi video cuối cùng.
Tính nhất quán của cảnh và chủ thể: Duy trì mối quan hệ giữa nhân vật, vật thể, môi trường và chuyển động khi câu lệnh phát triển xuyên suốt một clip.
Khả năng kiểm soát sáng tạo linh hoạt: Sử dụng các tùy chọn thời lượng, độ phân giải và tỷ lệ khung hình có thể cấu hình cho nhiều bối cảnh xuất bản và phân phối.
Quy trình tác vụ phù hợp với sản xuất: Gửi tác vụ tạo, theo dõi trạng thái và truy xuất tài nguyên video hoàn chỉnh thông qua quy trình API sẵn sàng cho ứng dụng.
Lặp lại ý tưởng sáng tạo nhanh chóng: Khám phá hiệu quả ý tưởng câu chuyện, cách xử lý hình ảnh và cảnh sản phẩm trước khi đầu tư vào quy trình sản xuất lớn hơn.
Đầu vào: Câu lệnh ngôn ngữ tự nhiên mô tả chủ thể, hành động, môi trường, hướng máy quay và phong cách hình ảnh.
Định hướng tạo: Thêm chi tiết về thời gian, chuyển động, bố cục và tâm trạng khi cảnh phụ thuộc vào một chuỗi điện ảnh cụ thể.
Đầu ra: Các clip video đã tạo được cung cấp qua quy trình tác vụ Flaq AI để xem xét, lưu trữ hoặc chỉnh sửa tiếp.
Xử lý tác vụ: Lưu mã định danh tác vụ được trả về, thăm dò cho đến khi hoàn tất và xử lý lỗi tạo trước khi xuất bản kết quả.
Kiểm soát sản xuất: Chọn các thiết lập thời lượng, độ phân giải và tỷ lệ khung hình hiện có phù hợp với kênh mục tiêu.
Phát triển ý tưởng điện ảnh: Biến ý tưởng câu chuyện ban đầu, tham chiếu tâm trạng và mô tả cảnh quay thành tư liệu hình ảnh cho giai đoạn tiền kỳ.
Nội dung dạng ngắn: Tạo clip mạng xã hội, chuỗi quảng bá và các biến thể chiến dịch từ câu lệnh sáng tạo có cấu trúc.
Kể chuyện sản phẩm: Xây dựng video trình diễn sản phẩm, cảnh ra mắt và ý tưởng chuyển động thương hiệu mà không cần bắt đầu bằng một buổi quay hoàn chỉnh.
Tiền trực quan hóa quảng cáo: Thử nghiệm ngôn ngữ máy quay, nhịp độ và định hướng hình ảnh trước khi phân bổ nguồn lực sản xuất.
Tự động hóa sáng tạo: Bổ sung tính năng tạo văn bản thành video vào nền tảng truyền thông, công cụ nội dung và quy trình sản xuất nội bộ.
Lưu ý Độ rõ ràng của câu lệnh ảnh hưởng trực tiếp đến bố cục cảnh và chất lượng chuyển động. Hãy xem xét tính liên tục, lỗi hình ảnh và khả năng cung cấp mô hình ở cấp tài khoản của clip đã tạo trước khi dùng trong sản xuất.
MiniMax H3 so với Kling 3.0: Kling 3.0 nổi tiếng với khả năng tạo video giàu biểu cảm và xử lý chuyển động mạnh mẽ. MiniMax H3 cung cấp quy trình chuyển văn bản thành video tập trung cho các nhóm muốn có chỉ đạo điện ảnh trong một chuỗi tác vụ API.
MiniMax H3 so với Runway Gen-4: Runway Gen-4 cung cấp không gian sáng tạo rộng và các công cụ sản xuất hình ảnh. MiniMax H3 phù hợp với ứng dụng cần khả năng tạo theo câu lệnh và xử lý tác vụ bằng chương trình.
MiniMax H3 so với Veo 3.1: Veo 3.1 nhấn mạnh khả năng tạo điện ảnh cao cấp và tích hợp hệ sinh thái Google. MiniMax H3 mang đến một hướng tiếp cận dựa trên API khác để phát triển ý tưởng nhanh và tự động hóa sản xuất.
MiniMax H3 so với Seedance 2.0: Seedance 2.0 hỗ trợ nhiều chế độ tạo video và quy trình nghe nhìn. Trong so sánh này, MiniMax H3 tập trung vào khả năng tạo cảnh trực tiếp từ văn bản và tích hợp ứng dụng dễ quản lý.
MiniMax H3 so với Luma Dream Machine: Luma Dream Machine phổ biến nhờ khả năng thử nghiệm hình ảnh nhanh. MiniMax H3 là lựa chọn thiết thực khi cần kết nối câu lệnh văn bản với hàng đợi tác vụ, bước xem xét và hệ thống truyền thông tiếp nối.
Khám phá nhiều công cụ tạo AI cho quy trình hình ảnh và video nhanh ngay trong trình duyệt, rồi mở rộng các ý tưởng thành công bằng API model sẵn sàng cho sản xuất của Flaq AI. Flaq AI cung cấp một lớp API thống nhất cho tất cả model, giúp dễ dàng sử dụng và mở rộng quy trình của bạn.

Tạo hình ảnh AI từ prompt văn bản

Tạo hình ảnh AI từ hình ảnh và prompt văn bản

Tạo video AI từ prompt văn bản

Biến hình ảnh thành video AI

Tạo hình ảnh và video AI trong một không gian làm việc hợp nhất

Tạo video nhất quán từ nội dung đa phương tiện tham chiếu

Xây dựng quy trình hình ảnh và video AI trực quan trên canvas vô hạn
Bản phát hành mới Wan 3.0 hiện đã có trên Flaq AI cho tác vụ tạo video từ hình ảnh. Nó mang đến cho người sáng tạo một cách thức có cấu trúc để tạo chuyển động từ khung hình đầu vào bắt buộc đến khung hình cuối vào bắt buộc, với chuyển động được hướng dẫn bằng prompt, âm thanh tùy chọn, kiểm soát seed, năm tỷ lệ khung hình và đầu ra từ 480p đến 1080p. Đối với việc tạo video mang tính điện ảnh, khả năng kiểm soát từ điểm đầu đến điểm cuối đó có thể quan trọng hơn chỉ riêng độ phân giải.
API MiniMax H3 mang đến cho các nhóm làm video một tổ hợp hữu ích: tạo video từ hình ảnh, các tùy chọn đầu ra 768p và 2K, các đoạn clip dài tới 15 giây, và mức chi phí được niêm yết thấp hơn so với một số thiết lập Seedance 2.0 tương đương. MiniMax cũng đã công bố trọng số H3-Base trên Hugging Face, mở ra những lựa chọn mới cho nghiên cứu, quy trình tùy chỉnh và thử nghiệm tự lưu trữ ở những nơi giấy phép của nó cho phép.