gemini-2-5-flash · google · text
Gemini 2.5 Flash es el modelo ultra rápido de Google DeepMind con una ventana de contexto de 1M, que ofrece baja latencia y excelente relación calidad-precio. Admite almacenamiento en caché implícito, comprensión visual y Function Call. Ideal para escenarios de alta concurrencia y baja latencia: atención al cliente, clasificación, resumen y completado de código ligero.
1M contexto; caché implícito (cache_read 25% entrada); comprensión visual; Function Call; JSON mode; respuestas rápidas.
Soporte al cliente de alta concurrencia; clasificación y etiquetado; generación de resúmenes; completado de código ligero; reconocimiento de imágenes; comprensión del contenido de video.
Sin generación de imágenes; el caché implícito no garantiza un acierto; los precios se duplican cuando el contexto excede 128k; max_tokens limitado a 8K.
Agente de codificación CLI oficial de Anthropic. Ediciones multiarchivo, uso de herramientas y razonamiento de contexto largo.
export ANTHROPIC_AUTH_TOKEN="YOUR_API_KEY"
export ANTHROPIC_BASE_URL="https://api.robovai.com"
export ANTHROPIC_MODEL="gemini-2-5-flash"
claude