Prova l'API Google Gemini Omni 1.1 Flash per trasformare i prompt in video con movimenti coerenti e inquadrature flessibili per storytelling e produzioni creative.
L'API Google Gemini Omni 1.1 Flash Text-to-Video offre agli sviluppatori un percorso diretto dalle indicazioni creative scritte a clip video AI rifinite. Descrivi un soggetto, un'azione, il movimento della videocamera, l'illuminazione e l'atmosfera, quindi usa l'API video Gemini per trasformare queste indicazioni in una scena breve e coerente. Disponibile tramite Best Image AI, è progettata per i team che necessitano di un'ideazione video flessibile e di un'erogazione programmatica affidabile senza dover gestire una propria infrastruttura di generazione video.
Creazione video guidata da prompt: Trasforma descrizioni dettagliate in linguaggio naturale in scene video con soggetti, ambienti, azioni e tono visivo ben definiti.
Regia cinematografica tramite testo: Controlla l'inquadratura, l'energia della videocamera, l'illuminazione, l'atmosfera e il ritmo nello stesso prompt che definisce la scena.
Sintesi della scena sensibile al movimento: Crea clip che integrano il movimento del soggetto, la risposta dell'ambiente e la composizione in un risultato visivo più coeso.
Formati di distribuzione flessibili: Produci video orizzontali o verticali adatti a contenuti cinematografici, contenuti social e campagne progettate anzitutto per i dispositivi mobili.
Qualità dell'output adattabile: Seleziona un livello di qualità dell'output adatto al flusso di produzione, revisione o pubblicazione previsto.
Controllo della narrazione breve: Imposta una durata concisa per momenti dedicati ai prodotti, passaggi narrativi, contenuti social e rapidi test creativi.
Input: Un prompt in linguaggio naturale che descrive la scena, l'azione principale, lo stile visivo, l'illuminazione e l'eventuale comportamento desiderato della videocamera.
Output: Una clip video generata e restituita tramite il flusso di lavoro dell'API Gemini Omni 1.1 Flash.
Controllo del formato: Scegli una composizione orizzontale o verticale e una qualità dell'output adeguata al canale di destinazione.
Regia della clip: Definisci una durata video compatta e usa i dettagli del prompt per guidare movimento, ritmo e atmosfera cinematografica.
Funzionalità: Generazione text-to-video, composizione delle scene, movimento dei soggetti, prompt sensibili alla videocamera e iterazione creativa pronta per la produzione.
Produzione di video per i social: Crea concept verticali e widescreen per post social brevi, momenti di lancio e contenuti creativi nativi per ciascun canale.
Ideazione di campagne: Trasforma trattamenti di campagne, direzioni artistiche e passaggi narrativi in concept visivi in movimento prima che inizi la produzione completa.
Storytelling di prodotto: Genera scene concise di prodotti, momenti lifestyle e narrazioni delle funzionalità guidate dal movimento per i flussi di lavoro di marketing.
Prototipazione creativa: Esplora più direzioni per composizione, illuminazione, movimento della videocamera e atmosfera senza una ripresa convenzionale.
Pipeline di contenuti automatizzate: Aggiungi la creazione video basata su prompt ad applicazioni, sistemi di pubblicazione e flussi di lavoro creativi ad alto volume tramite un'API.
Nota Assicurati che i prompt rispettino le linee guida sulla sicurezza di Google. Se una richiesta è soggetta a restrizioni o non produce il risultato previsto, modifica la descrizione della scena e riprova.
Gemini Omni 1.1 Flash e Google Veo: Entrambi sono strumenti Google per la generazione video. Gemini Omni 1.1 Flash è particolarmente adatto quando i team desiderano creare video da testo insieme a flussi di lavoro basati su immagini, riferimenti e montaggio video nella stessa famiglia di modelli.
Gemini Omni 1.1 Flash e OpenAI Sora: Sora è ampiamente utilizzato per l'esplorazione creativa di video basata sul testo. Gemini Omni 1.1 Flash offre un flusso video guidato da prompt con opzioni flessibili per inquadratura e qualità nella produzione basata su API su Best Image AI.
Gemini Omni 1.1 Flash e Runway: Runway offre un'ampia gamma di strumenti video destinati ai creator. Gemini Omni 1.1 Flash si concentra sull'integrazione della regia scritta delle scene in un flusso di generazione programmatica e semplificata per team di prodotto e sviluppatori.
Gemini Omni 1.1 Flash e Kling AI: Kling AI è noto per i video generati visivamente espressivi. Gemini Omni 1.1 Flash offre agli sviluppatori un'alternativa per la creazione di scene guidata da prompt, la regia sensibile alla videocamera e l'erogazione tramite API.
Gemini Omni 1.1 Flash e Pika: Pika è progettato per rendere accessibile la sperimentazione creativa. Gemini Omni 1.1 Flash è indicato per i team che richiedono la generazione text-to-video come parte di un flusso API connesso, anziché come interfaccia di creazione autonoma.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-text-to-video',
prompt: 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
aspect_ratio: '16:9',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-text-to-video',
'prompt': 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
'aspect_ratio': '16:9',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset",
"aspect_ratio": "16:9",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)