CLAVESDIGITALES
Portal Editorial • 2026
Inicio / Inteligencia Artificial / Gemini 4 Argon y Gemini 4 Flash Preview: Filtrados en Antigravity IDE y el SDK de Google con Claude 5.5

Gemini 4 Argon y Gemini 4 Flash Preview: Filtrados en Antigravity IDE y el SDK de Google con Claude 5.5

Filtracion masiva en el ecosistema de Google: Gemini 4 Argon aparece en el cliente Insiders de Antigravity IDE con contexto de hasta 900K, precios Cloud Billing de $4/$20 y el commit que delata a Gemini 4 Flash Preview junto a Claude 5.5.

D
David Verificado

Especialista en Normativas y Movilidad Digital

Actualizado
•
Lectura 6 min
Gemini 4 Argon y Gemini 4 Flash Preview: Filtrados en Antigravity IDE y el SDK de Google con Claude 5.5
Fuente: Antigravity IDE Insiders & Google GenAI SDK (PiperOrigin)
En 1 Minuto: Lo Fundamental
  • Ventanas de 512K y 900K: Controles dedicados de esfuerzo y contexto en el cliente con multiplicadores de cuota de 1,3x y 1,8x por turno.
  • Tarifas $4 / $20 en Cloud Billing: Iguala a Claude Opus 5.5 en modo online y rebaja a $2 / $10 en Batch y Flex con lectura de caché a $0,20 por millón.
  • Gemini 4 Flash y Claude 5.5: Commit de tokenizador gemma4 delata a Gemini 4 Flash Preview y el selector añade nativamente a Claude Opus y Sonnet 5.5.

El tablero de la inteligencia artificial de frontera se prepara para su siguiente salto generacional. Mientras el mercado asimila la consolidación de Gemini 3.8 Flash y los recientes movimientos de Anthropic y OpenAI, una serie de filtraciones directas en el código cliente de Antigravity IDE Insiders y en los repositorios oficiales del SDK de Google GenAI han dejado al descubierto las cartas de Google para finales de 2026: Gemini 4 Argon y Gemini 4 Flash Preview.

La información, extraída de una compilación interna (build diff) de Antigravity IDE y del commit 6a4c0b0 sincronizado mediante Copybara desde los sistemas centrales de Google (PiperOrigin), revela no solo la denominación de los nuevos modelos, sino también su arquitectura de cuotas, ventanas de contexto masivas de hasta 900.000 tokens, tarifas comerciales en Google Cloud Billing y un nuevo selector unificado que integra nativamente a Claude Opus 5.5 y Claude Sonnet 5.5.

A continuación analizamos en detalle los datos técnicos confirmados, las tablas de precios de la API y las implicaciones operativas para desarrolladores e ingenieros de software.


1. Gemini 4 Argon: Ventanas de 900K y Precios Oficiales en Cloud Billing

La filtración procedente del cliente Insiders de Antigravity IDE detalla la ficha técnica del nuevo modelo insignia de razonamiento y codificación, denominado comercialmente Gemini 4 Argon:

Filtración de Gemini 4 Argon en la build diff de Antigravity IDE Insiders Fuente: Antigravity IDE Insiders Client Code & Google Cloud Billing Diff (2026).

Ventanas de Contexto y Multiplicadores de Cuota (Quota Hints)

A diferencia de los modelos anteriores donde el contexto extendido se aplicaba de forma pasiva, Gemini 4 Argon incorpora en el cliente controles explícitos dedicados a la profundidad de análisis (effort controls) y al tamaño de la ventana:

  • Opciones de contexto en el cliente: Menú contextual con modos dedicados de 512K y 900K tokens.
  • Impacto en cuotas por turno:
    • En modo 512K tokens, el consumo de cuota por turno se multiplica por un factor de ~1,3x.
    • En modo 900K tokens, el consumo de cuota por turno asciende a ~1,8x.

Este sistema de multiplicadores confirma que Google busca penalizar el uso indiscriminado de ventanas extremas sin descartar la necesidad de cargar repositorios enteros o bases de código monolíticas en una sola petición.

Estructura de Tarifas: Gemini 4 Argon Cyber Permissive

La hoja de tarifas asociada en Google Cloud Billing sitúa a Gemini 4 Argon en la gama alta competitiva, atacando directamente las tarifas de Claude Opus 5 y GPT-6 Astra:

Modalidad de Servicio Entrada (Input / 1M) Salida (Output / 1M) Lecturas de Caché (Cache Reads / 1M)
Online Text (Global) $4,00 $20,00 $0,20
Batch Text (Global) $2,00 $10,00 $0,10
Flex Text (Global) $2,00 $10,00 $0,10

Con un precio de $4 por millón de entrada y $20 por millón de salida en modalidad online estándar, Google iguala exactamente la tarifa de Claude Opus 5.5 Max ($4 / $20), pero reduce a la mitad el coste en peticiones por lotes (Batch) y en tiempo flexible (Flex), estableciendo un coste de lectura de caché extraordinariamente agresivo de apenas $0,20 por millón.


2. Commit 6a4c0b0: El Descuido en el SDK de Google GenAI con Gemini 4 Flash

Paralelamente a la filtración de Antigravity IDE, el repositorio público del SDK oficial de Google (google/genai) registró un commit revelador:

Commit 6a4c0b0 en google-genai eliminando gemini-4-flash-preview Fuente: Commit 6a4c0b0 en google/genai/_local_tokenizer_loader.py (PiperOrigin-RevId: 962209435).

En el archivo google/genai/_local_tokenizer_loader.py, dentro del diccionario interno GEMMA_TOKENIZER_TO_MODEL_NAMES, un desarrollador interno (speedstorm1) sincronizó un cambio etiquetado como chore: internal para eliminar una línea añadida previamente:

# Mapeo de tokenizadores locales en google/genai
"gemini-3.5-flash": "gemma4",
"gemini-3.1-flash-lite": "gemma4",
- "gemini-4-flash-preview": "gemma4",

¿Qué revela técnicamente este cambio?

  1. Existencia confirmada de Gemini 4 Flash Preview: El modelo se encuentra en fase de pruebas activas dentro de la infraestructura interna de Google.
  2. Arquitectura Gemma 4 compartida: Tanto la iteración gemini-3.5-flash como gemini-4-flash-preview comparten el tokenizador de la familia gemma4, lo que garantiza paridad en vocabulario, manejo multilingüe y alta compresión de tokens de código fuente frente a modelos de generaciones previas.
  3. Rollout escalonado: La eliminación manual del SDK público obedece al protocolo habitual de contención de fugas antes del despliegue masivo en Google AI Studio y Vertex AI.

3. El Nuevo Selector Unificado de Antigravity: Convivencia con Claude 5.5

La tercera pieza del rompecabezas es la interfaz visual de selección de modelos desplegada en el entorno unificado de Google:

Selector de modelos en Gemini y Antigravity con Gemini 4 Argon y Claude 5.5 Fuente: Interfaz de selección de modelos en el cliente Antigravity / Gemini (2026).

El selector adopta un enfoque multimodelo de vanguardia:

  • Auto (Smart Model Selection): Enrutador automático que deriva la consulta al modelo óptimo según la complejidad de la tarea y la ventana de contexto requerida.
  • Gemini 4 Argon (Tag 'New'): Modelo de referencia para tareas analíticas, razonamiento profundo y arquitectura de software.
  • Gemini 3.8 Flash: Motor de baja latencia para respuestas rápidas y operaciones de terminal en tiempo real.
  • Claude Opus 5.5: Integración directa de Anthropic para flujos de código extremo y razonamiento científico.
  • Claude Sonnet 5.5: Modelo de equilibrio con soporte de 1M tokens y alta precisión en programación agéntica.

4. Comparativa de Precios: Gemini 4 Argon Frente a la Frontera

Para poner en perspectiva la agresividad de las tarifas filtradas de Gemini 4 Argon, comparamos sus costes con los líderes actuales del mercado de modelos avanzados:

Modelo Proveedor Input (/1M) Output (/1M) Contexto Máximo Ventaja Competitiva
Gemini 4 Argon Google $4,00 $20,00 900K Flex/Batch a $2/$10 y caché a $0,20
Claude Opus 5.5 Max Anthropic $4,00 $20,00 1M Líder absoluto en Elo WebDev (1820)
GPT-6 Astra Max OpenAI $10,00 $50,00 1.1M Gran potencia pero 2,5x más costoso
Claude Sonnet 5.5 High Anthropic $2,00 $10,00 1M Mejor relación coste/rendimiento general
Gemini 3.8 Flash High Google $0,75 $3,75 1M Modelo económico de ejecución rápida

La estrategia de Google es clara: igualar en precio a Opus 5.5 en tiempo real, pero ganar la batalla del volumen con tarifas Batch y Flex de $2 / $10 y una ventana de 900K sin degradación de atención.


Preguntas Frecuentes sobre la Filtración de Gemini 4

¿Cuándo estará disponible Gemini 4 Argon en Google AI Studio?

Aunque la referencia ha aparecido en el cliente Insiders de Antigravity IDE y las tablas de Google Cloud Billing ya contemplan sus identificadores, el despliegue general en AI Studio y Vertex AI suele producirse entre dos y cuatro semanas después de la integración en entornos preliminares de desarrollo.

¿Qué significa el multiplicador de cuota de 1,8x en 900K tokens?

Significa que cada llamada enviada con una ventana de contexto de 900.000 tokens consumirá el equivalente a 1,8 peticiones de tu límite diario o mensual de tokens en el cliente de Antigravity IDE, reflejando el coste computacional de procesar contextos masivos en los clústeres TPU v6 de Google.

¿Por qué aparece Claude Opus 5.5 dentro del selector de Google?

Antigravity IDE opera como una plataforma agnóstica de ingeniería de software asistida por IA. Al igual que plataformas corporativas multimodelo, el cliente permite autenticar y utilizar indistintamente proveedores de primer nivel según la preferencia del desarrollador o los requisitos del proyecto.

D

David

• Redacción Claves Digitales

Consultor de normativas oficiales y movilidad. Análisis contrastados directamente con el BOE, la Dirección General de Tráfico y organismos reguladores.