Experimente a API Google Gemini Omni 1.1 Flash para transformar prompts em vídeos com movimentos coerentes e enquadramento flexível para narrativas e produção criativa.
A API Google Gemini Omni 1.1 Flash Text-to-Video oferece aos desenvolvedores um caminho direto entre uma orientação criativa escrita e clipes de vídeo com IA refinados. Descreva um tema, uma ação, o movimento da câmera, a iluminação e a atmosfera e, em seguida, use a API de vídeo Gemini para transformar essa orientação em uma cena curta e coerente. Disponível por meio da Best Image AI, ela foi desenvolvida para equipes que precisam de ideação flexível de vídeos e entrega programática confiável sem manter sua própria infraestrutura de geração de vídeos.
Criação de vídeos orientada por prompts: Transforme descrições detalhadas em linguagem natural em cenas de vídeo com temas, ambientes, ações e tons visuais bem definidos.
Direção cinematográfica por texto: Oriente o enquadramento, a dinâmica da câmera, a iluminação, a atmosfera e o ritmo no mesmo prompt que define a cena.
Síntese de cenas com percepção de movimento: Crie clipes que conectam o movimento do tema, a resposta do ambiente e a composição em um resultado visual mais coeso.
Formatos de entrega flexíveis: Produza vídeos horizontais ou verticais para usos cinematográficos, conteúdo social e campanhas com foco em dispositivos móveis.
Qualidade de saída adaptável: Selecione um nível de qualidade de saída adequado ao fluxo de produção, revisão ou publicação pretendido.
Controle de narrativas curtas: Defina uma duração de clipe concisa para momentos de produto, pontos narrativos, conteúdo social e testes criativos rápidos.
Entrada: Um prompt em linguagem natural que descreve a cena, a ação principal, o estilo visual, a iluminação e qualquer comportamento desejado da câmera.
Saída: Um clipe de vídeo gerado e retornado pelo fluxo de trabalho da API Gemini Omni 1.1 Flash.
Controle de formato: Escolha uma composição horizontal ou vertical e uma qualidade de saída adequada ao canal de destino.
Direção do clipe: Defina uma duração de vídeo compacta e use detalhes no prompt para orientar o movimento, o ritmo e a atmosfera cinematográfica.
Recursos: Geração de texto para vídeo, composição de cenas, movimento do tema, prompts com percepção de câmera e iteração criativa pronta para produção.
Produção de vídeos sociais: Crie conceitos verticais e widescreen para publicações sociais curtas, momentos de lançamento e peças criativas nativas de cada canal.
Ideação de campanhas: Transforme tratamentos de campanha, direções de arte e pontos narrativos em conceitos visuais em movimento antes que uma produção completa comece.
Narrativa de produto: Gere cenas concisas de produtos, momentos de estilo de vida e narrativas de recursos orientadas por movimento para fluxos de marketing.
Prototipagem criativa: Explore várias direções de composição, iluminação, movimento da câmera e atmosfera sem uma filmagem convencional.
Pipelines automatizados de conteúdo: Adicione a criação de vídeos orientada por prompts a aplicativos, sistemas de publicação e fluxos criativos de alto volume por meio de uma API.
Observação Certifique-se de que os prompts estejam em conformidade com as diretrizes de segurança do Google. Se uma solicitação for restringida ou não produzir o resultado desejado, revise a descrição da cena e tente novamente.
Gemini Omni 1.1 Flash vs. Google Veo: Ambas são opções de geração de vídeos do Google. O Gemini Omni 1.1 Flash é uma excelente escolha quando as equipes querem criar vídeos a partir de texto junto a fluxos orientados por imagens, referências e edição de vídeo na mesma família de modelos.
Gemini Omni 1.1 Flash vs. OpenAI Sora: O Sora é amplamente utilizado para a exploração criativa de vídeos orientada por texto. O Gemini Omni 1.1 Flash oferece um fluxo de vídeo orientado por prompts, com opções flexíveis de enquadramento e qualidade para produção baseada em API na Best Image AI.
Gemini Omni 1.1 Flash vs. Runway: O Runway oferece um amplo conjunto de ferramentas de vídeo voltadas para criadores. O Gemini Omni 1.1 Flash concentra-se em integrar a direção escrita de cenas a um fluxo simplificado de geração programática para equipes de produto e desenvolvedores.
Gemini Omni 1.1 Flash vs. Kling AI: O Kling AI é conhecido por vídeos gerados com grande expressividade visual. O Gemini Omni 1.1 Flash oferece aos desenvolvedores uma alternativa para criação de cenas orientada por prompts, direção com percepção de câmera e entrega por API.
Gemini Omni 1.1 Flash vs. Pika: O Pika foi desenvolvido para experimentação criativa acessível. O Gemini Omni 1.1 Flash é adequado para equipes que precisam de geração de texto para vídeo como parte de um fluxo de API conectado, e não de uma interface de criação independente.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-text-to-video',
prompt: 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
aspect_ratio: '16:9',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-text-to-video',
'prompt': 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
'aspect_ratio': '16:9',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset",
"aspect_ratio": "16:9",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)