Coba API Google Gemini Omni 1.1 Flash untuk memandu pembuatan video dengan gambar dan referensi video pendek agar subjek, adegan, dan gerakan tetap konsisten.
Google Gemini Omni 1.1 Flash Reference-to-Video API memungkinkan developer menggunakan materi visual sebagai panduan kreatif untuk video yang dihasilkan. Berikan gambar referensi, klip video, atau keduanya, lalu jelaskan hasil yang ingin Anda buat. API video Gemini membantu mengubah input tersebut menjadi adegan bergerak baru, sehingga tim kreatif dapat membentuk komposisi, petunjuk subjek, suasana, dan arahan secara fleksibel di Best Image AI.
Panduan Referensi Multimodal: Gunakan gambar, klip video, atau kombinasi keduanya sebagai materi visual untuk rangkaian baru yang dihasilkan.
Arahan Kreatif Terkontrol Prompt: Padukan referensi dengan panduan bahasa alami untuk aksi subjek, latar, perilaku kamera, pencahayaan, dan nuansa.
Konteks Visual yang Kaya: Gabungkan petunjuk visual dari beberapa materi yang diberikan saat satu prompt belum cukup untuk menyampaikan arahan yang dimaksud.
Pembuatan Adegan Berbasis Referensi: Gunakan aset yang dipilih sebagai titik awal kreatif untuk gerakan, komposisi, dan pengembangan suasana pada output.
Penyajian Video yang Fleksibel: Pilih format horizontal atau vertikal, kualitas output, dan durasi klip ringkas untuk konteks penayangan yang direncanakan.
Alur Kerja API yang Dapat Diskalakan: Integrasikan pembuatan video berpandu referensi ke dalam pustaka aset, alat kreatif, sistem kampanye, dan pipeline produksi.
Masukan: Gambar referensi opsional, klip video referensi opsional, dan prompt bahasa alami yang menjelaskan adegan yang ingin dihasilkan.
Keluaran: Klip video baru yang dibuat melalui alur kerja Gemini Omni 1.1 Flash Reference-to-Video API.
Arahan Referensi: Pilih materi visual yang menyampaikan subjek, latar, komposisi, atau nuansa kreatif yang diinginkan, lalu tambahkan instruksi gerakan yang jelas.
Kontrol Format: Pilih orientasi output, tingkat kualitas, dan durasi singkat yang sesuai dengan kasus penggunaan akhir.
Kemampuan: Pembuatan video berpandu referensi, input kreatif multimodal, gerakan berbasis prompt, perakitan konteks visual, dan pembuatan adegan sinematik.
Pengembangan Konsep Kampanye: Gabungkan visual utama yang disetujui, gambar suasana, dan referensi gerakan untuk mengeksplorasi arahan video kampanye yang baru.
Sistem Kreatif Merek: Gunakan pustaka visual yang dikurasi sebagai panduan untuk menghasilkan konsep video yang dimulai dari bahasa kreatif yang telah ditentukan.
Visualisasi Storyboard dan Pitch: Ubah papan referensi dan materi klip terpilih menjadi adegan bergerak pembuktian konsep yang ringkas.
Adaptasi Konten: Buat arahan video baru dari aset visual yang sudah ada ketika prompt teks saja tidak dapat menyampaikan konteks kreatif yang memadai.
Operasi Kreatif dalam Skala Besar: Integrasikan pembuatan yang memahami referensi ke dalam alat manajemen aset, pipeline konten, dan platform pembuatan internal.
Catatan Referensi memberikan panduan kreatif, bukan menggantikan prompt yang tepat. Untuk hasil terbaik, jelaskan aksi, gerakan kamera, dan hasil adegan yang diinginkan selain memberikan materi visual.
Gemini Omni 1.1 Flash vs. Alur Kerja Video Referensi Google Veo: Google Veo menyediakan beragam kemampuan video generatif. Gemini Omni 1.1 Flash menawarkan jalur pembuatan berbasis referensi yang melengkapi pembuatan teks, animasi gambar, dan pengeditan video dalam keluarga model yang sama.
Gemini Omni 1.1 Flash vs. Runway: Runway memberi kreator banyak cara untuk bekerja dengan materi sumber dan alat generatif. Gemini Omni 1.1 Flash cocok bagi developer yang membangun alur kerja video berpandu referensi melalui API.
Gemini Omni 1.1 Flash vs. Kling AI: Kling mendukung pembuatan video AI berbasis visual. Gemini Omni 1.1 Flash menyediakan input referensi gambar dan video yang fleksibel dengan arahan berbasis prompt bagi tim yang memerlukan alur pembuatan terintegrasi.
Gemini Omni 1.1 Flash vs. Pika: Pika populer untuk eksperimen visual yang mudah digunakan. Gemini Omni 1.1 Flash merupakan opsi praktis ketika referensi kreatif perlu menjadi bagian dari alur kerja video yang terstruktur dan terprogram.
Gemini Omni 1.1 Flash vs. Luma Dream Machine: Luma Dream Machine mendukung eksplorasi konsep cepat dari prompt. Gemini Omni 1.1 Flash menambahkan panduan referensi multimodal bagi tim yang ingin membawa lebih banyak konteks visual ke setiap klip yang dihasilkan.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-reference-to-video',
prompt: 'Use the references to create a cinematic shot of a small boat approaching from the distance',
aspect_ratio: '16:9',
resolution: '1080p',
duration: 8,
images: ['https://example.com/boat-reference.jpg'],
videos: ['https://example.com/motion-reference.mp4']
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[].);
;
}
(status === ) {
.(pollResultData..);
;
}
( (resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-reference-to-video',
'prompt': 'Use the references to create a cinematic shot of a small boat approaching from the distance',
'aspect_ratio': '16:9',
'resolution': '1080p',
'duration': 8,
'images': ['https://example.com/boat-reference.jpg'],
'videos': ['https://example.com/motion-reference.mp4']
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-reference-to-video",
"prompt": "Use the references to create a cinematic shot of a small boat approaching from the distance",
"aspect_ratio": "16:9",
"resolution": "1080p",
"duration": 8,
"images": ["https://example.com/boat-reference.jpg"],
"videos": ["https://example.com/motion-reference.mp4"]
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)