Essayez l’API Google Gemini Omni 1.1 Flash pour transformer des prompts en vidéos aux mouvements cohérents et au cadrage flexible pour vos créations narratives.
L'API Google Gemini Omni 1.1 Flash Text-to-Video offre aux développeurs un moyen direct de transformer des directives créatives écrites en clips vidéo IA aboutis. Décrivez un sujet, une action, un mouvement de caméra, l'éclairage et l'ambiance, puis utilisez l'API vidéo Gemini pour convertir ces directives en une courte scène cohérente. Disponible via Best Image AI, elle est conçue pour les équipes qui ont besoin d'une idéation vidéo flexible et d'une diffusion programmatique fiable, sans maintenir leur propre infrastructure de génération vidéo.
Création vidéo guidée par prompt : Transformez des descriptions détaillées en langage naturel en scènes vidéo avec des sujets, des environnements, des actions et une tonalité visuelle clairement définis.
Réalisation cinématographique par le texte : Contrôlez le cadrage, la dynamique de la caméra, l'éclairage, l'atmosphère et le rythme dans le même prompt que celui qui définit la scène.
Synthèse de scènes sensible au mouvement : Créez des clips qui associent le mouvement du sujet, les réactions de l'environnement et la composition pour obtenir un résultat visuel plus cohérent.
Formats de diffusion flexibles : Produisez des vidéos au format paysage ou vertical adaptées aux supports cinématographiques, aux contenus sociaux et aux campagnes pensées pour le mobile.
Qualité de sortie adaptable : Sélectionnez un niveau de qualité de sortie adapté au workflow de production, de révision ou de publication prévu.
Contrôle de la narration en format court : Définissez une durée de clip concise pour les séquences produit, les temps narratifs, les contenus sociaux et les tests créatifs rapides.
Entrée : Un prompt en langage naturel décrivant la scène, l'action principale, le style visuel, l'éclairage et tout comportement de caméra souhaité.
Sortie : Un clip vidéo généré et renvoyé via le workflow de l'API Gemini Omni 1.1 Flash.
Contrôle du format : Choisissez une composition horizontale ou verticale et une qualité de sortie adaptée au canal de destination.
Direction du clip : Définissez une durée vidéo concise et utilisez un prompt détaillé pour guider le mouvement, le rythme et l'atmosphère cinématographique.
Capacités : Génération de texte en vidéo, composition de scènes, mouvement du sujet, prompts tenant compte de la caméra et itération créative prête pour la production.
Production de vidéos sociales : Créez des concepts verticaux et grand écran pour les publications sociales courtes, les temps forts de lancement et les créations adaptées à chaque canal.
Idéation de campagnes : Transformez les concepts de campagne, les directions artistiques et les temps narratifs en concepts visuels animés avant le lancement d'une production complète.
Narration produit : Générez des scènes produit concises, des instants de vie et des récits de fonctionnalités guidés par le mouvement pour les workflows marketing.
Prototypage créatif : Explorez plusieurs orientations de composition, d'éclairage, de mouvement de caméra et d'atmosphère sans tournage conventionnel.
Pipelines de contenu automatisés : Intégrez la création vidéo guidée par prompt aux applications, systèmes de publication et workflows créatifs à grand volume via une API.
Remarque Assurez-vous que les prompts respectent les consignes de sécurité de Google. Si une requête est limitée ou ne produit pas le résultat souhaité, révisez la description de la scène et réessayez.
Gemini Omni 1.1 Flash vs Google Veo : Les deux sont des solutions de génération vidéo de Google. Gemini Omni 1.1 Flash est particulièrement adapté lorsque les équipes souhaitent associer la création de texte en vidéo à des workflows guidés par l'image, par des références et par le montage vidéo dans la même famille de modèles.
Gemini Omni 1.1 Flash vs OpenAI Sora : Sora est largement utilisé pour l'exploration créative de vidéos guidées par le texte. Gemini Omni 1.1 Flash propose sur Best Image AI un workflow vidéo guidé par prompt, avec des options flexibles de cadrage et de qualité pour une production basée sur API.
Gemini Omni 1.1 Flash vs Runway : Runway propose un vaste ensemble d'outils vidéo destinés aux créateurs. Gemini Omni 1.1 Flash se concentre sur l'intégration de directives de scène écrites dans un flux de génération programmatique simplifié pour les équipes produit et les développeurs.
Gemini Omni 1.1 Flash vs Kling AI : Kling AI est réputé pour ses vidéos générées visuellement expressives. Gemini Omni 1.1 Flash offre aux développeurs une alternative pour la création de scènes guidée par prompt, la réalisation tenant compte de la caméra et la diffusion par API.
Gemini Omni 1.1 Flash vs Pika : Pika est conçu pour une expérimentation créative accessible. Gemini Omni 1.1 Flash convient aux équipes qui ont besoin de la génération de texte en vidéo dans le cadre d'un workflow API connecté plutôt que d'une interface de création autonome.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-text-to-video',
prompt: 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
aspect_ratio: '16:9',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-text-to-video',
'prompt': 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
'aspect_ratio': '16:9',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset",
"aspect_ratio": "16:9",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)