Prueba la API de Google Gemini Omni 1.1 Flash para convertir prompts en vídeos con movimiento coherente y encuadre flexible para narración y producción creativa.
La API Google Gemini Omni 1.1 Flash Text-to-Video ofrece a los desarrolladores una vía directa desde las indicaciones creativas escritas hasta clips de vídeo con IA de acabado profesional. Describe un sujeto, una acción, el movimiento de la cámara, la iluminación y el ambiente y, a continuación, utiliza la API de vídeo Gemini para convertir esas indicaciones en una escena breve y coherente. Disponible a través de Best Image AI, está diseñada para equipos que necesitan una ideación de vídeo flexible y una entrega programática fiable sin mantener su propia infraestructura de generación de vídeo.
Creación de vídeo guiada por prompts: Convierte descripciones detalladas en lenguaje natural en escenas de vídeo con sujetos, entornos, acciones y tonos visuales bien definidos.
Dirección cinematográfica mediante texto: Controla el encuadre, la energía de la cámara, la iluminación, la atmósfera y el ritmo en el mismo prompt que define la escena.
Síntesis de escenas sensible al movimiento: Crea clips que conectan el movimiento del sujeto, la respuesta del entorno y la composición para obtener un resultado visual más cohesionado.
Formatos de entrega flexibles: Produce vídeos horizontales o verticales para usos cinematográficos, contenido social y campañas centradas en dispositivos móviles.
Calidad de salida adaptable: Selecciona un nivel de calidad de salida adecuado para el flujo de producción, revisión o publicación previsto.
Control de narrativas breves: Define una duración concisa para momentos de producto, puntos narrativos, contenido social y pruebas creativas rápidas.
Entrada: Un prompt en lenguaje natural que describe la escena, la acción principal, el estilo visual, la iluminación y cualquier comportamiento deseado de la cámara.
Salida: Un clip de vídeo generado y devuelto mediante el flujo de trabajo de la API Gemini Omni 1.1 Flash.
Control del formato: Elige una composición horizontal o vertical y una calidad de salida adecuada para el canal de destino.
Dirección del clip: Define una duración de vídeo compacta y utiliza los detalles del prompt para controlar el movimiento, el ritmo y la atmósfera cinematográfica.
Capacidades: Generación de texto a vídeo, composición de escenas, movimiento del sujeto, prompting sensible a la cámara e iteración creativa preparada para producción.
Producción de vídeos para redes sociales: Crea conceptos verticales y panorámicos para publicaciones sociales breves, momentos de lanzamiento y piezas creativas adaptadas a cada canal.
Ideación de campañas: Convierte tratamientos de campañas, direcciones artísticas y puntos narrativos en conceptos visuales en movimiento antes de que comience una producción completa.
Narrativa de producto: Genera escenas concisas de productos, momentos de estilo de vida y narrativas de funciones basadas en el movimiento para flujos de trabajo de marketing.
Prototipado creativo: Explora distintas direcciones de composición, iluminación, movimiento de cámara y atmósfera sin un rodaje convencional.
Pipelines de contenido automatizados: Añade la creación de vídeo guiada por prompts a aplicaciones, sistemas de publicación y flujos de trabajo creativos de gran volumen mediante una API.
Nota Asegúrate de que los prompts cumplan las directrices de seguridad de Google. Si una solicitud está restringida o no produce el resultado previsto, modifica la descripción de la escena e inténtalo de nuevo.
Gemini Omni 1.1 Flash frente a Google Veo: Ambas son opciones de generación de vídeo de Google. Gemini Omni 1.1 Flash es una excelente opción cuando los equipos buscan crear vídeos a partir de texto junto con flujos basados en imágenes, referencias y edición de vídeo dentro de la misma familia de modelos.
Gemini Omni 1.1 Flash frente a OpenAI Sora: Sora se utiliza ampliamente para explorar vídeos creativos a partir de texto. Gemini Omni 1.1 Flash proporciona un flujo de vídeo dirigido mediante prompts con opciones flexibles de encuadre y calidad para la producción basada en API en Best Image AI.
Gemini Omni 1.1 Flash frente a Runway: Runway ofrece un amplio conjunto de herramientas de vídeo para creadores. Gemini Omni 1.1 Flash se centra en integrar la dirección escrita de escenas en un flujo simplificado de generación programática para equipos de producto y desarrolladores.
Gemini Omni 1.1 Flash frente a Kling AI: Kling AI es conocido por sus vídeos generados visualmente expresivos. Gemini Omni 1.1 Flash ofrece a los desarrolladores una alternativa para crear escenas mediante prompts, controlar la cámara y entregar resultados mediante API.
Gemini Omni 1.1 Flash frente a Pika: Pika está diseñado para facilitar la experimentación creativa. Gemini Omni 1.1 Flash es adecuado para equipos que necesitan generar vídeo a partir de texto como parte de un flujo de API conectado, en lugar de una interfaz de creación independiente.
const response = await fetch('https://api.flaq.ai/api/v1/video/task', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
body: JSON.stringify({
model_name: 'gemini-omni-1.1-flash-text-to-video',
prompt: 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
aspect_ratio: '16:9',
resolution: '1080p',
duration: 8
})
});
const { data } = await response.json();
const taskId = data.task_id;
// Step 2: Poll for results
const taskId = data.task_id;
const pollResult = async (taskId) => {
const res = await fetch(`https://api.flaq.ai/api/v1/video/${taskId}`, {
headers: { 'Authorization': 'Bearer YOUR_API_KEY' }
});
return res.json();
};
while (true) {
const pollResultData = await pollResult(taskId);
const status = pollResultData.data.task_status;
if (status === 'succeed') {
console.log(pollResultData.data.task_result.videos[0].url);
break;
}
if (status === 'failed') {
console.error(pollResultData.data.task_status_msg);
break;
}
await new Promise(resolve => setTimeout(resolve, ));
}
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/video/task',
headers={
'Content-Type': 'application/json',
'Authorization': 'Bearer YOUR_API_KEY'
},
json={
'model_name': 'gemini-omni-1.1-flash-text-to-video',
'prompt': 'A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset',
'aspect_ratio': '16:9',
'resolution': '1080p',
'duration': 8
}
)
result = response.json()
task_id = result['data']['task_id']
curl -X POST https://api.flaq.ai/api/v1/video/task \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model_name": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A cinematic tracking shot follows a sailboat crossing a glowing ocean at sunset",
"aspect_ratio": "16:9",
"resolution": "1080p",
"duration": 8
}'
# Step 2: Poll for results
# Replace {task_id} with the task_id returned from the submit response
curl -X GET "https://api.flaq.ai/api/v1/video/{task_id}" \
-H "Authorization: Bearer YOUR_API_KEY"
# Step 2: Poll for results
task_id = response.json()['data']['task_id']
poll_url = f"https://api.flaq.ai/api/v1/video/{task_id}"
while True:
poll_result = requests.get(poll_url, headers={'Authorization': 'Bearer YOUR_API_KEY'}).json()
status = poll_result['data']['task_status']
if status == 'succeed':
print(poll_result['data']['task_result']['videos'][0]['url'])
break
if status == 'failed':
print(poll_result['data']['task_status_msg'])
break
time.sleep(10)