Experimente a API Google Gemini Omni 1.1 Flash para animar um primeiro quadro obrigatório até um quadro final opcional, com movimentos controlados e continuidade visual.
A API Google Gemini Omni 1.1 Flash Image-to-Video ajuda os desenvolvedores a transformar uma imagem fornecida em um vídeo com IA dirigido. Use uma imagem estática como ponto de partida visual, adicione uma descrição do movimento em linguagem natural e gere uma cena que se desenvolve com movimento e trabalho de câmera intencionais. Uma imagem final opcional pode orientar o destino da sequência, tornando a API de vídeo Gemini útil para fluxos de animação controlada na Best Image AI.
Animação de vídeo orientada por imagem: Comece com uma imagem enviada e desenvolva o movimento em torno de seu tema, composição, iluminação e direção visual geral.
Orientação opcional do quadro final: Adicione uma imagem final quando o clipe precisar de um destino visual mais intencional ou de uma transição guiada entre dois estados.
Controle de movimento por linguagem natural: Descreva o movimento da câmera, o comportamento do tema, a mudança ambiental e o ritmo junto com a imagem de entrada.
Desenvolvimento coerente da cena: Use a imagem de entrada como uma âncora visual enquanto dirige uma sequência que pareça conectada, em vez de desvinculada do quadro inicial.
Apresentação flexível de vídeo: Gere saídas horizontais ou verticais para materiais de campanha, vídeos sociais, histórias de produtos e experiências com foco em dispositivos móveis.
Opções de qualidade e duração: Adapte a qualidade de saída e a duração compacta do clipe às necessidades de prototipagem, revisão, publicação ou produção.
Entrada: Uma imagem inicial e um prompt de movimento em linguagem natural que descreve o movimento desejado, o comportamento da câmera e a evolução da cena.
Orientação opcional: Uma imagem final pode ser fornecida para dar à animação um estado visual final controlado.
Saída: Um clipe de vídeo gerado e entregue pelo fluxo da API image-to-video Gemini Omni 1.1 Flash.
Controle de formato: Selecione uma composição horizontal ou vertical, a qualidade de saída e uma duração concisa adequadas ao canal de destino.
Recursos: Animação de imagens, orientação visual do início ao fim, movimento de câmera dirigido por prompts, evolução de cenas e iteração criativa.
Animação de imagens de produtos: Adicione movimento, dinâmica de câmera e vida ao ambiente de fotografias de produtos e visuais principais de campanhas.
Reaproveitamento de conteúdo social: Transforme publicações estáticas, imagens editoriais e artes de lançamento em conceitos curtos de vídeo vertical ou widescreen.
Desenvolvimento de storyboards: Use quadros conceituais e artes principais para testar como uma ideia visual pode se mover antes de investir em uma produção maior.
Variações criativas de marca: Crie variações orientadas por movimento a partir de uma direção visual aprovada, mantendo uma imagem inicial clara para o fluxo de trabalho.
Vídeos para e-commerce e publicidade: Crie momentos concisos de produtos, sequências de estilo de vida e materiais promocionais a partir de recursos visuais existentes.
Observação Use imagens de origem nítidas e de alta qualidade e descreva o movimento pretendido com precisão. Prompts que especificam o movimento do tema, a direção da câmera e o comportamento do ambiente geralmente oferecem orientações de animação mais úteis.
Gemini Omni 1.1 Flash vs. Google Veo Image-to-Video: O Google Veo oferece fluxos consolidados de image-to-video. O Gemini Omni 1.1 Flash acrescenta um caminho conectado para animação de imagens, geração de texto, vídeo orientado por referências e edição de vídeo em uma única família de modelos.
Gemini Omni 1.1 Flash vs. Runway Image-to-Video: O Runway oferece um amplo conjunto de ferramentas para criadores voltado à geração de movimento. O Gemini Omni 1.1 Flash foi desenvolvido para quem deseja animação orientada por imagens e direção por prompts em um fluxo baseado em API.
Gemini Omni 1.1 Flash vs. Kling Image-to-Video: O Kling é uma opção popular para animações expressivas de imagens. O Gemini Omni 1.1 Flash oferece um caminho prático da imagem de origem e descrição do movimento até a saída, com orientação opcional do quadro final.
Gemini Omni 1.1 Flash vs. Pika Image-to-Video: O Pika concentra-se em experimentação visual acessível. O Gemini Omni 1.1 Flash é adequado para equipes de produto que precisam de animação controlada de imagens em uma integração escalável.
Gemini Omni 1.1 Flash vs. Luma Dream Machine: O Luma Dream Machine é reconhecido pela rápida ideação visual. O Gemini Omni 1.1 Flash se diferencia pelo controle orientado por imagens, direção opcional por imagem final e fluxos de vídeo relacionados disponíveis na mesma família de APIs.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-image-to-video',
prompt: 'The girl walks toward the camera while the city lights shimmer behind her',
image_url: 'https://example.com/start-frame.jpg',
image_end_url: 'https://example.com/end-frame.jpg',
aspect_ratio: '9:16',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[].);
;
}
(status === ) {
.(pollResultData..);
;
}
( (resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-image-to-video',
'prompt': 'The girl walks toward the camera while the city lights shimmer behind her',
'image_url': 'https://example.com/start-frame.jpg',
'image_end_url': 'https://example.com/end-frame.jpg',
'aspect_ratio': '9:16',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-image-to-video",
"prompt": "The girl walks toward the camera while the city lights shimmer behind her",
"image_url": "https://example.com/start-frame.jpg",
"image_end_url": "https://example.com/end-frame.jpg",
"aspect_ratio": "9:16",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)