Thử API Google Gemini Omni 1.1 Flash để biến câu lệnh thành video có chuyển động liền mạch và khung hình linh hoạt, phù hợp cho kể chuyện và sản xuất nội dung sáng tạo.
API Google Gemini Omni 1.1 Flash Text-to-Video mang đến cho nhà phát triển một quy trình trực tiếp từ chỉ dẫn sáng tạo bằng văn bản đến những đoạn video AI hoàn thiện. Hãy mô tả chủ thể, hành động, chuyển động máy quay, ánh sáng và tâm trạng, sau đó dùng API video Gemini để chuyển chỉ dẫn đó thành một cảnh ngắn mạch lạc. Được cung cấp qua Best Image AI, API này dành cho các nhóm cần linh hoạt phát triển ý tưởng video và phân phối đáng tin cậy bằng lập trình mà không phải duy trì hệ thống tạo video riêng.
Tạo video theo câu lệnh: Chuyển phần mô tả chi tiết bằng ngôn ngữ tự nhiên thành các cảnh video với chủ thể rõ ràng, môi trường, hành động và sắc thái hình ảnh cụ thể.
Đạo diễn điện ảnh bằng văn bản: Chỉ dẫn cách đóng khung cảnh quay, năng lượng máy quay, ánh sáng, bầu không khí và nhịp độ ngay trong câu lệnh xác định cảnh.
Tổng hợp cảnh có nhận biết chuyển động: Tạo các đoạn phim kết nối chuyển động của chủ thể, phản ứng của môi trường và bố cục thành một kết quả hình ảnh mạch lạc hơn.
Định dạng phân phối linh hoạt: Tạo video ngang hoặc dọc để phù hợp với vị trí trình chiếu điện ảnh, nội dung mạng xã hội và các chiến dịch ưu tiên thiết bị di động.
Chất lượng đầu ra tùy chỉnh: Chọn mức chất lượng đầu ra phù hợp với quy trình sản xuất, đánh giá hoặc xuất bản dự kiến.
Kiểm soát cách kể chuyện dạng ngắn: Đặt thời lượng ngắn gọn cho các khoảnh khắc sản phẩm, nhịp kể chuyện, nội dung mạng xã hội và thử nghiệm sáng tạo nhanh.
Đầu vào: Câu lệnh bằng ngôn ngữ tự nhiên mô tả cảnh, hành động chính, phong cách hình ảnh, ánh sáng và mọi hành vi máy quay mong muốn.
Đầu ra: Đoạn video được tạo và trả về thông qua quy trình API Gemini Omni 1.1 Flash.
Kiểm soát định dạng: Chọn bố cục ngang hoặc dọc và chất lượng đầu ra phù hợp với kênh đích.
Định hướng đoạn phim: Xác định thời lượng video ngắn gọn và dùng câu lệnh chi tiết để điều khiển chuyển động, nhịp độ và bầu không khí điện ảnh.
Khả năng: Tạo video từ văn bản, bố cục cảnh, chuyển động chủ thể, câu lệnh có nhận biết máy quay và lặp lại quy trình sáng tạo sẵn sàng cho sản xuất.
Sản xuất video mạng xã hội: Tạo ý tưởng video dọc và màn ảnh rộng cho bài đăng mạng xã hội dạng ngắn, thời điểm ra mắt và nội dung sáng tạo phù hợp với từng kênh.
Phát triển ý tưởng chiến dịch: Chuyển định hướng chiến dịch, chỉ đạo nghệ thuật và nhịp truyện thành các ý tưởng hình ảnh chuyển động trước khi bắt đầu sản xuất toàn diện.
Kể chuyện sản phẩm: Tạo các cảnh sản phẩm ngắn gọn, khoảnh khắc phong cách sống và câu chuyện tính năng dựa trên chuyển động cho quy trình tiếp thị.
Tạo mẫu sáng tạo: Khám phá nhiều hướng bố cục, ánh sáng, chuyển động máy quay và bầu không khí mà không cần một buổi quay phim thông thường.
Quy trình nội dung tự động: Thêm tính năng tạo video theo câu lệnh vào ứng dụng, hệ thống xuất bản và các quy trình sáng tạo khối lượng lớn thông qua API.
Lưu ý Hãy đảm bảo câu lệnh tuân thủ nguyên tắc an toàn của Google. Nếu yêu cầu bị hạn chế hoặc không tạo ra kết quả mong muốn, hãy điều chỉnh phần mô tả cảnh rồi thử lại.
Gemini Omni 1.1 Flash so với Google Veo: Cả hai đều là lựa chọn tạo video của Google. Gemini Omni 1.1 Flash rất phù hợp khi các nhóm muốn tạo video từ văn bản cùng với quy trình dựa trên hình ảnh, dựa trên hình ảnh tham chiếu và chỉnh sửa video trong cùng một dòng mô hình.
Gemini Omni 1.1 Flash so với OpenAI Sora: Sora được sử dụng rộng rãi để khám phá video sáng tạo từ văn bản. Gemini Omni 1.1 Flash cung cấp quy trình video được định hướng bằng câu lệnh với các lựa chọn khung hình và chất lượng linh hoạt để sản xuất qua API trên Best Image AI.
Gemini Omni 1.1 Flash so với Runway: Runway cung cấp bộ công cụ video đa dạng dành cho nhà sáng tạo. Gemini Omni 1.1 Flash tập trung tích hợp chỉ dẫn cảnh bằng văn bản vào luồng tạo nội dung bằng lập trình tinh gọn dành cho các nhóm sản phẩm và nhà phát triển.
Gemini Omni 1.1 Flash so với Kling AI: Kling AI nổi tiếng với video được tạo có tính biểu đạt hình ảnh cao. Gemini Omni 1.1 Flash mang đến cho nhà phát triển một lựa chọn khác để tạo cảnh theo câu lệnh, định hướng có nhận biết máy quay và phân phối qua API.
Gemini Omni 1.1 Flash so với Pika: Pika được thiết kế để thử nghiệm sáng tạo một cách dễ tiếp cận. Gemini Omni 1.1 Flash phù hợp với các nhóm cần tạo video từ văn bản như một phần của quy trình API liên kết thay vì một giao diện sáng tạo độc lập.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-text-to-video',
prompt: 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
aspect_ratio: '16:9',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-text-to-video',
'prompt': 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
'aspect_ratio': '16:9',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset",
"aspect_ratio": "16:9",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)