Essayez l’API Google Gemini Omni 1.1 Flash pour animer une première image obligatoire vers une image finale facultative avec des mouvements maîtrisés et continus.
L'API Google Gemini Omni 1.1 Flash Image-to-Video aide les développeurs à transformer une image fournie en une vidéo IA dirigée. Utilisez une image fixe comme point de départ visuel, ajoutez des instructions de mouvement en langage naturel et générez une scène qui évolue grâce à des mouvements de caméra et des animations intentionnels. Une image finale facultative peut guider la destination de la séquence, ce qui rend l'API vidéo Gemini utile pour les workflows d'animation contrôlée sur Best Image AI.
Animation vidéo guidée par l'image : Partez d'une image importée et construisez le mouvement autour de son sujet, de sa composition, de son éclairage et de sa direction visuelle globale.
Guidage facultatif par l'image finale : Ajoutez une image finale lorsque le clip nécessite une destination visuelle plus précise ou une transition guidée entre deux états.
Contrôle du mouvement en langage naturel : Décrivez le mouvement de la caméra, le comportement du sujet, l'évolution de l'environnement et le rythme parallèlement à l'image d'entrée.
Développement cohérent de la scène : Utilisez l'image d'entrée comme point d'ancrage visuel tout en dirigeant une séquence qui reste connectée au cadre initial, au lieu de s'en détacher.
Présentation vidéo flexible : Générez une sortie au format paysage ou vertical pour les contenus de campagne, les vidéos sociales, les récits produit et les expériences pensées pour le mobile.
Choix de qualité et de durée : Adaptez la qualité de sortie et la durée concise du clip aux besoins de prototypage, de révision, de publication ou de production.
Entrée : Une image de départ accompagnée d'un prompt de mouvement en langage naturel décrivant le mouvement souhaité, le comportement de la caméra et l'évolution de la scène.
Guidage facultatif : Une image finale peut être fournie pour donner à l'animation un état visuel final contrôlé.
Sortie : Un clip vidéo généré et livré via le workflow de l'API image-to-video Gemini Omni 1.1 Flash.
Contrôle du format : Sélectionnez une composition horizontale ou verticale, une qualité de sortie et une durée concise adaptées au canal cible.
Capacités : Animation d'image, guidage visuel du début à la fin, mouvement de caméra dirigé par prompt, évolution de la scène et itération créative.
Animation d'images produit : Ajoutez du mouvement, une dynamique de caméra et de la vie dans l'environnement aux photographies produit et aux visuels clés de campagne.
Réutilisation de contenus sociaux : Transformez des publications statiques, des images éditoriales et des créations de lancement en concepts vidéo courts verticaux ou grand écran.
Développement de storyboards : Utilisez des images conceptuelles et des visuels clés pour tester la façon dont une idée visuelle pourrait bouger avant de vous engager dans une production plus importante.
Variations de créations de marque : Créez des variantes guidées par le mouvement à partir d'une direction visuelle approuvée, tout en conservant une image de départ clairement définie pour le workflow.
Vidéos e-commerce et publicitaires : Créez des séquences produit concises, des scènes lifestyle et des contenus promotionnels à partir de ressources visuelles existantes.
Remarque Utilisez des images sources nettes et de haute qualité et décrivez précisément le mouvement recherché. Les prompts qui précisent le mouvement du sujet, la direction de la caméra et le comportement de l'environnement fournissent généralement des instructions d'animation plus utiles.
Gemini Omni 1.1 Flash vs Google Veo Image-to-Video : Google Veo propose des workflows image-to-video éprouvés. Gemini Omni 1.1 Flash ajoute un parcours connecté pour l'animation d'images, la génération de texte, la vidéo guidée par des références et le montage vidéo au sein d'une seule famille de modèles.
Gemini Omni 1.1 Flash vs Runway Image-to-Video : Runway offre un large éventail d'outils de création de mouvements générés. Gemini Omni 1.1 Flash est conçu pour les développeurs qui souhaitent une animation guidée par l'image et des directives par prompt dans un workflow basé sur une API.
Gemini Omni 1.1 Flash vs Kling Image-to-Video : Kling est une solution populaire pour l'animation expressive d'images. Gemini Omni 1.1 Flash propose un parcours pratique allant de l'image source et des instructions de mouvement à la sortie, avec un guidage facultatif par l'image finale.
Gemini Omni 1.1 Flash vs Pika Image-to-Video : Pika se concentre sur l'expérimentation visuelle accessible. Gemini Omni 1.1 Flash convient particulièrement aux équipes produit qui ont besoin d'une animation d'image contrôlée dans une intégration évolutive.
Gemini Omni 1.1 Flash vs Luma Dream Machine : Luma Dream Machine est réputé pour l'idéation visuelle rapide. Gemini Omni 1.1 Flash se différencie par un contrôle guidé par l'image, des directives facultatives via une image finale et des workflows vidéo associés disponibles au sein de la même famille d'API.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-image-to-video',
prompt: 'The girl walks toward the camera while the city lights shimmer behind her',
image_url: 'https://example.com/start-frame.jpg',
image_end_url: 'https://example.com/end-frame.jpg',
aspect_ratio: '9:16',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[].);
;
}
(status === ) {
.(pollResultData..);
;
}
( (resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-image-to-video',
'prompt': 'The girl walks toward the camera while the city lights shimmer behind her',
'image_url': 'https://example.com/start-frame.jpg',
'image_end_url': 'https://example.com/end-frame.jpg',
'aspect_ratio': '9:16',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-image-to-video",
"prompt": "The girl walks toward the camera while the city lights shimmer behind her",
"image_url": "https://example.com/start-frame.jpg",
"image_end_url": "https://example.com/end-frame.jpg",
"aspect_ratio": "9:16",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)