Coba API Google Gemini Omni 1.1 Flash untuk menganimasikan frame pertama yang wajib menuju frame akhir opsional dengan gerakan terkontrol dan kesinambungan visual.
Google Gemini Omni 1.1 Flash Image-to-Video API membantu pengembang mengubah gambar yang disediakan menjadi video AI yang terarah. Gunakan gambar diam sebagai titik awal visual, tambahkan instruksi gerakan dalam bahasa alami, lalu hasilkan adegan yang berkembang dengan kerja kamera dan gerakan yang disengaja. Gambar akhir opsional dapat mengarahkan tujuan akhir urutan tersebut, sehingga Gemini video API berguna untuk alur kerja animasi yang terkontrol di Best Image AI.
Animasi Video Berbasis Gambar: Mulai dari gambar yang diunggah dan bangun gerakan di sekitar subjek, komposisi, pencahayaan, dan arah visualnya secara keseluruhan.
Panduan Frame Akhir Opsional: Tambahkan gambar akhir saat klip memerlukan tujuan visual yang lebih terencana atau transisi terpandu antara dua keadaan.
Kontrol Gerakan dengan Bahasa Alami: Jelaskan gerakan kamera, perilaku subjek, perubahan lingkungan, dan tempo bersama dengan input gambar.
Pengembangan Adegan yang Koheren: Gunakan gambar input sebagai patokan visual sambil mengarahkan urutan yang terasa terhubung, bukan terpisah dari frame awal.
Penyajian Video yang Fleksibel: Hasilkan output lanskap atau vertikal untuk aset kampanye, video sosial, kisah produk, dan pengalaman yang mengutamakan perangkat seluler.
Pilihan Kualitas dan Durasi: Sesuaikan kualitas output dan durasi klip yang ringkas dengan kebutuhan pembuatan prototipe, peninjauan, publikasi, atau produksi.
Input: Gambar awal beserta prompt gerakan dalam bahasa alami yang menjelaskan gerakan, perilaku kamera, dan perkembangan adegan yang diinginkan.
Panduan Opsional: Gambar akhir dapat disertakan untuk memberi animasi keadaan visual akhir yang terkontrol.
Output: Klip video yang dihasilkan dan disampaikan melalui alur kerja image-to-video API Gemini Omni 1.1 Flash.
Kontrol Format: Pilih komposisi horizontal atau vertikal, kualitas output, dan durasi ringkas yang sesuai dengan saluran target.
Kemampuan: Animasi gambar, panduan visual dari awal hingga akhir, gerakan kamera berbasis prompt, perkembangan adegan, dan iterasi kreatif.
Animasi Gambar Produk: Tambahkan gerakan, energi kamera, dan kehidupan lingkungan pada fotografi produk serta visual utama kampanye.
Pemanfaatan Ulang Konten Sosial: Ubah postingan diam, gambar editorial, dan karya visual peluncuran menjadi konsep video vertikal atau layar lebar berdurasi pendek.
Pengembangan Storyboard: Gunakan frame konsep dan visual utama untuk menguji bagaimana ide visual dapat bergerak sebelum melanjutkan ke produksi yang lebih besar.
Variasi Materi Kreatif Merek: Buat varian berbasis gerakan dari arahan visual yang telah disetujui sambil mempertahankan gambar awal yang jelas untuk alur kerja.
Video E-commerce dan Periklanan: Bangun momen produk yang ringkas, rangkaian gaya hidup, dan aset promosi dari materi visual yang sudah ada.
Catatan Gunakan gambar sumber yang jelas dan berkualitas tinggi, serta jelaskan gerakan yang dimaksud secara tepat. Prompt yang menentukan gerakan subjek, arah kamera, dan perilaku lingkungan biasanya memberikan panduan animasi yang lebih berguna.
Gemini Omni 1.1 Flash vs. Google Veo Image-to-Video: Google Veo menyediakan alur kerja image-to-video yang telah mapan. Gemini Omni 1.1 Flash menambahkan jalur terpadu untuk animasi gambar, pembuatan teks, video berbasis referensi, dan pengeditan video dalam satu keluarga model.
Gemini Omni 1.1 Flash vs. Runway Image-to-Video: Runway menawarkan perangkat kreator yang luas untuk gerakan hasil generasi. Gemini Omni 1.1 Flash dirancang bagi pengembang yang menginginkan animasi berbasis gambar dan arahan prompt dalam alur kerja berbasis API.
Gemini Omni 1.1 Flash vs. Kling Image-to-Video: Kling merupakan pilihan populer untuk animasi gambar yang ekspresif. Gemini Omni 1.1 Flash mendukung jalur praktis dari gambar sumber dan instruksi gerakan menuju output dengan panduan frame akhir opsional.
Gemini Omni 1.1 Flash vs. Pika Image-to-Video: Pika berfokus pada eksperimen visual yang mudah diakses. Gemini Omni 1.1 Flash sangat sesuai bagi tim produk yang memerlukan animasi gambar terkontrol dalam integrasi yang dapat diskalakan.
Gemini Omni 1.1 Flash vs. Luma Dream Machine: Luma Dream Machine dikenal untuk eksplorasi ide visual yang cepat. Gemini Omni 1.1 Flash membedakan diri melalui kontrol berbasis gambar, arahan gambar akhir opsional, dan alur kerja video terkait yang tersedia melalui keluarga API yang sama.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-image-to-video',
prompt: 'The girl walks toward the camera while the city lights shimmer behind her',
image_url: 'https://example.com/start-frame.jpg',
image_end_url: 'https://example.com/end-frame.jpg',
aspect_ratio: '9:16',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[].);
;
}
(status === ) {
.(pollResultData..);
;
}
( (resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-image-to-video',
'prompt': 'The girl walks toward the camera while the city lights shimmer behind her',
'image_url': 'https://example.com/start-frame.jpg',
'image_end_url': 'https://example.com/end-frame.jpg',
'aspect_ratio': '9:16',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-image-to-video",
"prompt": "The girl walks toward the camera while the city lights shimmer behind her",
"image_url": "https://example.com/start-frame.jpg",
"image_end_url": "https://example.com/end-frame.jpg",
"aspect_ratio": "9:16",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)