Prova l'API Google Gemini Omni 1.1 Flash per animare un primo fotogramma obbligatorio verso un fotogramma finale opzionale, con movimenti controllati e continuità visiva.
L'API Google Gemini Omni 1.1 Flash Image-to-Video aiuta gli sviluppatori a trasformare un'immagine fornita in un video AI diretto. Usa un'immagine statica come punto di partenza visivo, aggiungi indicazioni di movimento in linguaggio naturale e genera una scena che si sviluppa con movimenti e riprese intenzionali. Un'immagine finale opzionale può guidare la destinazione della sequenza, rendendo l'API video Gemini utile per i flussi di animazione controllata su Best Image AI.
Animazione video guidata dall'immagine: Parti da un'immagine caricata e sviluppa il movimento attorno al soggetto, alla composizione, all'illuminazione e alla direzione visiva complessiva.
Guida opzionale del fotogramma finale: Aggiungi un'immagine finale quando la clip necessita di una destinazione visiva più precisa o di una transizione guidata tra due stati.
Controllo del movimento tramite linguaggio naturale: Descrivi il movimento della videocamera, il comportamento del soggetto, i cambiamenti ambientali e il ritmo insieme all'immagine di input.
Sviluppo coerente della scena: Usa l'immagine di input come riferimento visivo mentre dirigi una sequenza che appare connessa, anziché separata dal fotogramma iniziale.
Presentazione video flessibile: Genera output orizzontali o verticali per materiali di campagne, video social, storie di prodotto ed esperienze progettate anzitutto per i dispositivi mobili.
Opzioni di qualità e durata: Adatta la qualità dell'output e la durata compatta della clip alle esigenze di prototipazione, revisione, pubblicazione o produzione.
Input: Un'immagine iniziale e un prompt di movimento in linguaggio naturale che descrive il movimento desiderato, il comportamento della videocamera e l'evoluzione della scena.
Guida opzionale: È possibile fornire un'immagine finale per dare all'animazione uno stato visivo finale controllato.
Output: Una clip video generata e fornita tramite il flusso di lavoro dell'API image-to-video Gemini Omni 1.1 Flash.
Controllo del formato: Seleziona una composizione orizzontale o verticale, la qualità dell'output e una durata concisa adatte al canale di destinazione.
Funzionalità: Animazione di immagini, guida visiva dall'inizio alla fine, movimento della videocamera diretto dal prompt, evoluzione delle scene e iterazione creativa.
Animazione delle immagini di prodotto: Aggiungi movimento, energia della videocamera e vitalità dell'ambiente alle fotografie di prodotti e ai visual principali delle campagne.
Riutilizzo di contenuti social: Trasforma post statici, immagini editoriali e grafiche di lancio in brevi concept video verticali o widescreen.
Sviluppo di storyboard: Usa fotogrammi concettuali e key art per verificare come può muoversi un'idea visiva prima di impegnarti in una produzione più ampia.
Varianti creative per il brand: Crea varianti guidate dal movimento a partire da una direzione visiva approvata, mantenendo al contempo una chiara immagine iniziale per il flusso di lavoro.
Video per e-commerce e pubblicità: Crea brevi momenti dedicati ai prodotti, sequenze lifestyle e materiali promozionali a partire da materiali visivi esistenti.
Nota Usa immagini sorgente nitide e di alta qualità e descrivi con precisione il movimento desiderato. I prompt che specificano il movimento del soggetto, la direzione della videocamera e il comportamento dell'ambiente in genere forniscono indicazioni di animazione più utili.
Gemini Omni 1.1 Flash e Google Veo Image-to-Video: Google Veo offre flussi di lavoro image-to-video consolidati. Gemini Omni 1.1 Flash aggiunge un percorso connesso per animazione delle immagini, generazione di testo, video basati su riferimenti e montaggio video nella stessa famiglia di modelli.
Gemini Omni 1.1 Flash e Runway Image-to-Video: Runway offre un ampio set di strumenti per creator dedicato al movimento generato. Gemini Omni 1.1 Flash è progettato per gli sviluppatori che desiderano animazione basata su immagini e direzione tramite prompt in un flusso di lavoro basato su API.
Gemini Omni 1.1 Flash e Kling Image-to-Video: Kling è un'opzione popolare per l'animazione espressiva delle immagini. Gemini Omni 1.1 Flash supporta un percorso pratico dall'immagine sorgente e dalle indicazioni di movimento all'output, con una guida opzionale per il fotogramma finale.
Gemini Omni 1.1 Flash e Pika Image-to-Video: Pika si concentra sulla sperimentazione visiva accessibile. Gemini Omni 1.1 Flash è adatto ai team di prodotto che richiedono un'animazione controllata delle immagini all'interno di un'integrazione scalabile.
Gemini Omni 1.1 Flash e Luma Dream Machine: Luma Dream Machine è noto per la rapida ideazione visiva. Gemini Omni 1.1 Flash si distingue grazie al controllo basato sulle immagini, alla direzione opzionale tramite un'immagine finale e ai relativi flussi video disponibili nella stessa famiglia di API.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-image-to-video',
prompt: 'The girl walks toward the camera while the city lights shimmer behind her',
image_url: 'https://example.com/start-frame.jpg',
image_end_url: 'https://example.com/end-frame.jpg',
aspect_ratio: '9:16',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[].);
;
}
(status === ) {
.(pollResultData..);
;
}
( (resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-image-to-video',
'prompt': 'The girl walks toward the camera while the city lights shimmer behind her',
'image_url': 'https://example.com/start-frame.jpg',
'image_end_url': 'https://example.com/end-frame.jpg',
'aspect_ratio': '9:16',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-image-to-video",
"prompt": "The girl walks toward the camera while the city lights shimmer behind her",
"image_url": "https://example.com/start-frame.jpg",
"image_end_url": "https://example.com/end-frame.jpg",
"aspect_ratio": "9:16",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)