Thử API Google Gemini Omni 1.1 Flash để chỉnh sửa cảnh quay nguồn bằng chỉ dẫn ngôn ngữ tự nhiên, đồng thời giữ nguyên nhịp thời gian khi thay đổi cảnh và nhân vật.
Google Gemini Omni 1.1 Flash Video Edit API đưa khả năng tinh chỉnh video bằng ngôn ngữ tự nhiên vào một quy trình thân thiện với nhà phát triển. Tải lên một video có sẵn, mô tả thay đổi bạn muốn thực hiện, rồi sử dụng Gemini video API để tạo phiên bản đã chỉnh sửa trong khi vẫn giữ clip gốc làm điểm khởi đầu sáng tạo. Hiện có trên Best Image AI, API này giúp các nhóm khám phá những thay đổi hình ảnh có mục tiêu mà không cần dựng lại bản chỉnh sửa từ đầu.
Tinh chỉnh video theo prompt: Sử dụng hướng dẫn bằng ngôn ngữ tự nhiên để định hướng các thay đổi về diện mạo, hành động, bầu không khí hoặc cách xử lý sáng tạo của một clip hiện có.
Quy trình chỉnh sửa nhận biết nguồn: Bắt đầu với cảnh quay đã tải lên để bản sửa đổi bám sát nhịp độ, chủ thể và bối cảnh hình ảnh của nội dung nguồn.
Định hướng thay đổi theo ngữ cảnh: Mô tả các yếu tố cần điều chỉnh và các yếu tố cần giữ lại, giúp các nhóm diễn đạt chỉnh sửa dưới dạng ý đồ sáng tạo thay vì thao tác thủ công trên timeline.
Điều chỉnh hình ảnh điện ảnh: Khám phá hướng thể hiện mới về ánh sáng, tâm trạng, cách xử lý cảnh và cảm giác máy quay từ một đầu vào video duy nhất.
Chất lượng đầu ra linh hoạt: Chọn mức chất lượng đầu ra phù hợp với yêu cầu đánh giá nội bộ, lặp nhanh hoặc bàn giao cuối cùng.
Lặp hiệu quả cho các nhóm video: Tạo những phương án thay thế có trọng tâm cho một clip nguồn ngắn, giúp API phù hợp với việc thử nghiệm và hỗ trợ sản xuất.
Đầu vào: Một clip video hiện có cùng hướng dẫn bằng ngôn ngữ tự nhiên mô tả chỉnh sửa mong muốn.
Đầu ra: Một video đã chỉnh sửa được tạo thông qua quy trình Gemini Omni 1.1 Flash video-editing API.
Định hướng chỉnh sửa: Giải thích thay đổi hình ảnh mong muốn, chẳng hạn như môi trường mới, sắc thái hình ảnh thay đổi, hành động của chủ thể hoặc cách xử lý cảnh.
Kiểm soát chất lượng: Chọn chất lượng đầu ra phù hợp với giai đoạn đánh giá hoặc bàn giao trong quy trình.
Khả năng: Chỉnh sửa video theo prompt, tinh chỉnh nhận biết nguồn, thay đổi cách xử lý cảnh, tái tạo phong cách hình ảnh và tạo nhanh các phương án sáng tạo.
Bản địa hóa chiến dịch: Tạo cách xử lý sáng tạo mới cho một clip chiến dịch hiện có trong khi vẫn duy trì điểm khởi đầu sản xuất nền tảng.
Các biến thể video mạng xã hội: Tạo diện mạo, tâm trạng và hướng cảnh thay thế cho video ngắn được điều chỉnh theo từng kênh hoặc nhóm khán giả khác nhau.
Hỗ trợ hậu kỳ sáng tạo: Khám phá một điều chỉnh hình ảnh trước khi dành thời gian cho một bản chỉnh sửa thủ công hoàn chỉnh hoặc quay lại.
Làm mới video sản phẩm: Cập nhật cách trình bày cảnh quay sản phẩm hiện có cho định hướng theo mùa, biên tập hoặc chiến dịch mới.
Quy trình sửa đổi tự động: Thêm khả năng tinh chỉnh video theo hướng dẫn vào các công cụ sáng tạo nội bộ, hệ thống phê duyệt và hoạt động nội dung.
Lưu ý Video nguồn là cơ sở của bản chỉnh sửa. Hãy dùng hướng dẫn rõ ràng nêu cụ thể thay đổi mong muốn và những đặc điểm hình ảnh cần duy trì nhất quán để có kết quả đáng tin cậy nhất.
Gemini Omni 1.1 Flash so với Google Veo Video Editing: Google Veo hỗ trợ các quy trình video tạo sinh nâng cao. Gemini Omni 1.1 Flash cung cấp phương thức chỉnh sửa bằng ngôn ngữ tự nhiên gọn gàng cùng với text-to-video, image-to-video và tạo sinh dựa trên nội dung tham chiếu trong cùng một dòng sản phẩm.
Gemini Omni 1.1 Flash so với Runway Video Editing: Runway cung cấp một bộ công cụ chỉnh sửa hình ảnh đa dạng. Gemini Omni 1.1 Flash nhấn mạnh quy trình ưu tiên API, trong đó clip nguồn và hướng dẫn văn bản là cơ sở cho một bản chỉnh sửa mới.
Gemini Omni 1.1 Flash so với Adobe Firefly Video: Adobe Firefly Video gắn kết chặt chẽ với các quy trình phần mềm sáng tạo đã được thiết lập. Gemini Omni 1.1 Flash mang đến cho nhà phát triển một lựa chọn lập trình để mô tả và tạo các bản sửa đổi video có trọng tâm.
Gemini Omni 1.1 Flash so với Kling Video Editing: Kling cung cấp các công cụ video tạo sinh để sáng tạo theo phong cách. Gemini Omni 1.1 Flash hữu ích khi các nhóm cần chỉnh sửa nhận biết nguồn thông qua tích hợp API trực tiếp.
Gemini Omni 1.1 Flash so với Pika: Pika cung cấp khả năng sáng tạo dễ tiếp cận và thử nghiệm tập trung vào hiệu ứng. Gemini Omni 1.1 Flash hướng đến tinh chỉnh video theo hướng dẫn có thể được đưa vào một quy trình sản phẩm kết nối.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-video-edit',
prompt: 'A small ball rolls into the scene and captures the attention of the cat',
video_url: 'https://example.com/source-video.mp4',
resolution: '1080p'
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-video-edit',
'prompt': 'A small ball rolls into the scene and captures the attention of the cat',
'video_url': 'https://example.com/source-video.mp4',
'resolution': '1080p'
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-video-edit",
"prompt": "A small ball rolls into the scene and captures the attention of the cat",
"video_url": "https://example.com/source-video.mp4",
"resolution": "1080p"
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)