Thử API Google Gemini Omni 1.1 Flash để tạo chuyển động từ khung hình đầu bắt buộc đến khung hình cuối tùy chọn, kiểm soát chuyển động và giữ hình ảnh liền mạch.
API Google Gemini Omni 1.1 Flash Image-to-Video giúp nhà phát triển chuyển một hình ảnh được cung cấp thành video AI được định hướng. Dùng một hình ảnh tĩnh làm điểm khởi đầu trực quan, thêm mô tả chuyển động bằng ngôn ngữ tự nhiên và tạo ra một cảnh phát triển với chuyển động máy quay và chuyển động có chủ đích. Hình ảnh kết thúc tùy chọn có thể dẫn dắt đích đến của chuỗi hình, giúp API video Gemini trở nên hữu ích cho các quy trình hoạt ảnh có kiểm soát trên Best Image AI.
Tạo hoạt ảnh video từ hình ảnh: Bắt đầu từ hình ảnh đã tải lên và xây dựng chuyển động xoay quanh chủ thể, bố cục, ánh sáng và định hướng hình ảnh tổng thể.
Hướng dẫn khung hình kết thúc tùy chọn: Thêm hình ảnh kết thúc khi đoạn phim cần một đích đến hình ảnh rõ ràng hơn hoặc một chuyển tiếp có định hướng giữa hai trạng thái.
Kiểm soát chuyển động bằng ngôn ngữ tự nhiên: Mô tả chuyển động máy quay, hành vi chủ thể, sự thay đổi môi trường và nhịp độ cùng với hình ảnh đầu vào.
Phát triển cảnh mạch lạc: Dùng hình ảnh đầu vào làm mốc trực quan trong khi định hướng một chuỗi có cảm giác gắn kết thay vì tách rời khỏi khung hình bắt đầu.
Trình bày video linh hoạt: Tạo đầu ra ngang hoặc dọc cho tài sản chiến dịch, video mạng xã hội, câu chuyện sản phẩm và trải nghiệm ưu tiên thiết bị di động.
Lựa chọn chất lượng và thời lượng: Điều chỉnh chất lượng đầu ra và thời lượng đoạn phim ngắn gọn để phù hợp với việc tạo mẫu, đánh giá, xuất bản hoặc nhu cầu sản xuất.
Đầu vào: Hình ảnh bắt đầu cùng câu lệnh chuyển động bằng ngôn ngữ tự nhiên mô tả chuyển động, hành vi máy quay và sự phát triển của cảnh mong muốn.
Hướng dẫn tùy chọn: Có thể cung cấp hình ảnh kết thúc để mang lại cho hoạt ảnh một trạng thái hình ảnh cuối được kiểm soát.
Đầu ra: Đoạn video được tạo và phân phối thông qua quy trình API chuyển hình ảnh thành video Gemini Omni 1.1 Flash.
Kiểm soát định dạng: Chọn bố cục ngang hoặc dọc, chất lượng đầu ra và thời lượng ngắn gọn phù hợp với kênh đích.
Khả năng: Tạo hoạt ảnh hình ảnh, hướng dẫn hình ảnh từ đầu đến cuối, chuyển động máy quay theo câu lệnh, phát triển cảnh và lặp lại quy trình sáng tạo.
Tạo hoạt ảnh hình ảnh sản phẩm: Thêm chuyển động, năng lượng máy quay và sức sống của môi trường vào ảnh chụp sản phẩm và hình ảnh chủ đạo của chiến dịch.
Tái sử dụng nội dung mạng xã hội: Chuyển bài đăng tĩnh, hình ảnh biên tập và tác phẩm ra mắt thành các ý tưởng video dọc hoặc màn ảnh rộng dạng ngắn.
Phát triển bảng phân cảnh: Dùng khung hình ý tưởng và hình ảnh chủ đạo để thử nghiệm cách một ý tưởng trực quan có thể chuyển động trước khi cam kết thực hiện một dự án sản xuất lớn hơn.
Các biến thể sáng tạo cho thương hiệu: Tạo các biến thể dựa trên chuyển động từ định hướng hình ảnh đã được phê duyệt, đồng thời duy trì một hình ảnh bắt đầu rõ ràng cho quy trình.
Video thương mại điện tử và quảng cáo: Xây dựng các khoảnh khắc sản phẩm ngắn gọn, chuỗi phong cách sống và tài sản quảng bá từ tài liệu hình ảnh hiện có.
Lưu ý Hãy sử dụng hình ảnh nguồn rõ nét, chất lượng cao và mô tả chính xác chuyển động dự kiến. Các câu lệnh chỉ rõ chuyển động chủ thể, hướng máy quay và hành vi môi trường thường cung cấp chỉ dẫn hoạt ảnh hữu ích hơn.
Gemini Omni 1.1 Flash so với Google Veo Image-to-Video: Google Veo cung cấp các quy trình chuyển hình ảnh thành video đã được khẳng định. Gemini Omni 1.1 Flash bổ sung một lộ trình liên kết cho hoạt ảnh hình ảnh, tạo văn bản, video dựa trên hình ảnh tham chiếu và chỉnh sửa video trong cùng một dòng mô hình.
Gemini Omni 1.1 Flash so với Runway Image-to-Video: Runway cung cấp bộ công cụ sáng tạo phong phú cho nội dung chuyển động được tạo. Gemini Omni 1.1 Flash được thiết kế cho nhà phát triển muốn có hoạt ảnh từ hình ảnh và định hướng bằng câu lệnh trong quy trình dựa trên API.
Gemini Omni 1.1 Flash so với Kling Image-to-Video: Kling là một lựa chọn phổ biến cho hoạt ảnh hình ảnh giàu tính biểu đạt. Gemini Omni 1.1 Flash hỗ trợ lộ trình thiết thực từ hình ảnh nguồn và mô tả chuyển động đến đầu ra với hướng dẫn khung hình kết thúc tùy chọn.
Gemini Omni 1.1 Flash so với Pika Image-to-Video: Pika tập trung vào thử nghiệm hình ảnh dễ tiếp cận. Gemini Omni 1.1 Flash rất phù hợp với các nhóm sản phẩm cần hoạt ảnh hình ảnh có kiểm soát bên trong một hệ thống tích hợp có thể mở rộng.
Gemini Omni 1.1 Flash so với Luma Dream Machine: Luma Dream Machine nổi tiếng về khả năng phát triển ý tưởng hình ảnh nhanh chóng. Gemini Omni 1.1 Flash tạo khác biệt nhờ khả năng kiểm soát dựa trên hình ảnh, định hướng bằng hình ảnh kết thúc tùy chọn và các quy trình video liên quan được cung cấp qua cùng một dòng API.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-image-to-video',
prompt: 'The girl walks toward the camera while the city lights shimmer behind her',
image_url: 'https://example.com/start-frame.jpg',
image_end_url: 'https://example.com/end-frame.jpg',
aspect_ratio: '9:16',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[].);
;
}
(status === ) {
.(pollResultData..);
;
}
( (resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-image-to-video',
'prompt': 'The girl walks toward the camera while the city lights shimmer behind her',
'image_url': 'https://example.com/start-frame.jpg',
'image_end_url': 'https://example.com/end-frame.jpg',
'aspect_ratio': '9:16',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-image-to-video",
"prompt": "The girl walks toward the camera while the city lights shimmer behind her",
"image_url": "https://example.com/start-frame.jpg",
"image_end_url": "https://example.com/end-frame.jpg",
"aspect_ratio": "9:16",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)