Notas de desarrollo de GeminiOmni

Blog

Lee las últimas funciones del producto, soluciones y novedades.

1 millón de tokens de contexto no es gratis — el costo real por página del chat PDF de Gemini

1 millón de tokens de contexto no es gratis — el costo real por página del chat PDF de Gemini

La ventana de contexto de 1 millón de tokens suena mágica hasta que haces la multiplicación. Esto es lo que realmente cuesta chatear con un PDF de 1.500 páginas en Gemini 2.5 Flash — y la lógica de precios detrás del nivel gratuito de GeminiOmni (menos de 200 páginas).

may. 6, 2026
Lena Hoffmann
AI Image Aspect Ratios: Choose the Right Canvas Before You Generate

AI Image Aspect Ratios: Choose the Right Canvas Before You Generate

A practical guide to 1:1, 4:5, 3:2, 16:9, and 9:16 AI image aspect ratios, composition choices, cropping risks, and multi-format workflows.

ago. 13, 2026
Lena Hoffmann
AI Image Text Rendering: A Practical Prompt and Editing Workflow

AI Image Text Rendering: A Practical Prompt and Editing Workflow

A reliable workflow for generating readable text in AI images, from short copy and layout prompts to iteration, verification, and post-generation repair.

ago. 11, 2026
Lena Hoffmann
GPT Image 2 vs Gemini: The Real Cost of AI Video in 2026

GPT Image 2 vs Gemini: The Real Cost of AI Video in 2026

Compare GPT Image 2, Gemini, and FLUX.2 for static assets. Discover why synchronized audio in Veo 3.1 is the missing piece for modern AI video workflows.

ago. 22, 2026
Lena Hoffmann
AI Music Prompt Guide: Describe Structure, Instrumentation, and Change

AI Music Prompt Guide: Describe Structure, Instrumentation, and Change

Learn how to write AI music prompts with clear genre references, instrumentation, tempo, arrangement, dynamics, exclusions, and iteration notes.

ago. 18, 2026
Lena Hoffmann
AI Video Camera Movements: A Prompt Vocabulary With Practical Examples

AI Video Camera Movements: A Prompt Vocabulary With Practical Examples

A field guide to camera movement prompts for AI video, including pans, pushes, trucks, orbits, crane shots, handheld motion, and combinations to avoid.

ago. 4, 2026
Lena Hoffmann
AI Video Storyboard Template: Plan Short Generative Clips Shot by Shot

AI Video Storyboard Template: Plan Short Generative Clips Shot by Shot

A practical AI video storyboard template for turning one idea into coherent shots, prompts, transitions, audio cues, and a repeatable generation plan.

jul. 28, 2026
Lena Hoffmann
AI;DR Means Unedited AI Gets Skipped. Here Is a Review Workflow That Survives It

AI;DR Means Unedited AI Gets Skipped. Here Is a Review Workflow That Survives It

AI;DR is not a new summarizer. It is a reader verdict on unreviewed model output. This workflow keeps PDF, image, and video drafts inspectable before they ship.

ago. 18, 2026
Lena Hoffmann

Soundscapes and Skylines: Building Audiovisual Urban Game Scenes with Veo 3.1

How Google Veo 3.1 generates synchronized 1080p video and audio for immersive urban game worlds in a single pass.

ago. 25, 2026
Lena Hoffmann
How to Chat With a PDF Without Losing the Evidence: A Research Workflow

How to Chat With a PDF Without Losing the Evidence: A Research Workflow

A practical PDF chat workflow for mapping a document, asking grounded questions, checking page citations, extracting tables, and writing traceable notes.

ago. 20, 2026
Lena Hoffmann
How to Reduce AI Video Flicker, Morphing, and Identity Drift

How to Reduce AI Video Flicker, Morphing, and Identity Drift

A systematic troubleshooting guide for AI video flicker, warped subjects, changing faces, unstable backgrounds, and prompt or source-image drift.

ago. 6, 2026
Lena Hoffmann
Image-to-Video Prompt Guide: Describe Motion Without Rewriting the Image

Image-to-Video Prompt Guide: Describe Motion Without Rewriting the Image

Learn how to write image-to-video prompts that preserve the source composition while controlling subject motion, camera movement, timing, and audio.

jul. 30, 2026
Lena Hoffmann
Cómo crear imágenes con Gemini — guía práctica para 2026

Cómo crear imágenes con Gemini — guía práctica para 2026

Los modelos de imagen de Gemini —Imagen 4 y Nano Banana— convierten un mensaje de texto en una imagen terminada. Aquí te explicamos cómo funciona realmente la generación de texto a imagen, la estructura de prompt que funciona y el camino gratuito más rápido para tu primera imagen.

jun. 29, 2026
Lena Hoffmann
Cómo hacer un video con Gemini — guía paso a paso para 2026

Cómo hacer un video con Gemini — guía paso a paso para 2026

Gemini no renderiza video por sí mismo — lo hace Veo, y llegas a él a través de Gemini. Aquí te explico exactamente cómo funciona texto a video, la estructura de prompt que realmente funciona y la ruta gratuita más rápida para tu primer clip.

jun. 11, 2026
Lena Hoffmann
Lo que sabemos sobre Gemini Omni 48 horas antes de Google I/O

Lo que sabemos sobre Gemini Omni 48 horas antes de Google I/O

Cadenas en la app de Gemini, una filtración de 9to5Google y lo que Veo 3.1 ya hace: juntos dibujan un panorama bastante claro de lo que Google está por anunciar. Esta es mi lectura a siete días de la fecha.

may. 12, 2026
Lena Hoffmann
Mi lista de seguimiento del keynote de Google I/O 2026 — qué deberían escuchar realmente los creadores independientes

Mi lista de seguimiento del keynote de Google I/O 2026 — qué deberían escuchar realmente los creadores independientes

La mayor parte de la cobertura del I/O se centrará en funciones para el consumidor y el impacto en el precio de las acciones. Esto es lo que los creadores independientes de IA deberían estar rastreando realmente cuando Sundar suba al escenario el 19 de mayo: las siete señales específicas que cambian qué vale la pena construir este verano.

may. 11, 2026
Lena Hoffmann
Por qué Veo 3.1 Fast supera a Sora para trabajo de video independiente — costos publicados por llamada

Por qué Veo 3.1 Fast supera a Sora para trabajo de video independiente — costos publicados por llamada

Tras dos semanas de generaciones paralelas, estoy convencido de que Veo 3.1 Fast es la opción predeterminada correcta para trabajo de video independiente. La razón no es la calidad. Es que Google publica un precio por segundo y OpenAI entierra a Sora detrás de un paquete de $200/mes.

may. 10, 2026
Lena Hoffmann
Gemini Live es lo más infravalorado que Google lanzó en 2026

Gemini Live es lo más infravalorado que Google lanzó en 2026

Voz en tiempo real con Gemini por $0 en el nivel gratuito. Todos esperan ansiosamente Omni; el modelo que realmente te permite construir un asistente de voz al estilo Pixar ha estado escondido a plena vista desde abril.

may. 9, 2026
Lena Hoffmann
Nano Banana 2 frente a Imagen 4: cuándo elegir cada uno (y por qué uso ambos)

Nano Banana 2 frente a Imagen 4: cuándo elegir cada uno (y por qué uso ambos)

Ambos son de Google. Ambos son los buques insignia de 2026. Pero hacen trabajos muy distintos. Aquí está el árbol de decisión que uso yo, con prompts reales y precios que lo demuestran.

may. 8, 2026
Lena Hoffmann
Lo primero que se rompió cuando lancé GeminiOmni

Lo primero que se rompió cuando lancé GeminiOmni

Veintitrés minutos después de hacer público el sitio, ya estaban extrayendo la clave de la API de Gemini desde el navegador. Aquí está exactamente lo que pasó, cuánto me costó y el cambio de arquitectura que implementé esa misma tarde.

abr. 29, 2026
Lena Hoffmann
Por qué tu herramienta de IA nunca debería tener una clave de Gemini en el navegador — guía detallada de un proxy del lado del servidor

Por qué tu herramienta de IA nunca debería tener una clave de Gemini en el navegador — guía detallada de un proxy del lado del servidor

El patrón que salva a los creadores independientes de IA de facturas sorpresa de $5,000. Una guía completa del proxy del lado del servidor que GeminiOmni ejecuta frente a cada llamada a la API de Gemini, con patrones de código reales y casos extremos.

may. 4, 2026
Lena Hoffmann