Gemini (Google)
Configura Gemini 1.5 Flash y Pro en ChatCielo: API Key, ventana de hasta 2M tokens, prompt y límites
Gemini (Google) en ChatCielo
Gemini de Google destaca por su velocidad y ventana de contexto gigante — hasta 2 millones de tokens en Gemini 1.5 Pro. Es ideal cuando necesitas analizar documentos largos, mantener conversaciones extensas sin perder contexto o atender a alto volumen con latencia mínima.
Elige Gemini si manejas documentos largos, catálogos extensos o necesitas la latencia más baja para triaje en tiempo real. Su capa gratuita generosa también lo hace perfecto para pruebas y validación antes de escalar.
1. Cómo obtener tu API Key en Google AI Studio
Accede a Google AI Studio
Ve a aistudio.google.com e inicia sesión con tu cuenta de Google empresarial. Acepta los términos de la API de Gemini.
Genera la API Key
- Haz clic en Get API key (o Create API key).
- Si es tu primera vez, haz clic en Create API key in new project — Google creará un proyecto automáticamente.
- Si ya tienes un proyecto en Google Cloud, selecciona Create API key in existing project y elige el proyecto.
- Copia la clave que empieza por
AIza...y guárdala de forma segura.
No compartas la clave en chats o capturas. Si sospechas exposición, ve a API Keys en Google Cloud Console y regenérala.
Verifica cuota y facturación
Gemini ofrece una capa gratuita generosa para pruebas (límites por minuto/día). Para producción, vincula un proyecto con facturación en console.cloud.google.com y verifica los límites en APIs y servicios > Enabled APIs > Generative Language API > Quotas.
2. Modelos recomendados
Velocidad y ventana gigante — el mejor equilibrio para atención por WhatsApp.
- El más rápido de la familia Gemini — latencia <1 segundo.
- Ventana de 1 millón de tokens — maneja catálogos, FAQs extensas y conversaciones larguísimas sin truncar.
- Costo muy bajo, ideal para alto volumen, triaje y clasificación.
- Excelente en español neutro y comprensión de contexto.
Úsalo como modelo principal para atención masiva y triaje. Su velocidad lo hace perfecto para primera respuesta.
| Característica | Gemini 1.5 Flash | Gemini 1.5 Pro |
|---|---|---|
| Velocidad | ★★★★★ Ultrarrápido (<1 s) | ★★★★ Rápido (1–2 s) |
| Costo | $ Muy bajo | $$ Medio |
| Ventana | 1M tokens (~750k palabras) | 2M tokens (~1.5M palabras) |
| Razonamiento | ★★★★ Bueno | ★★★★★ Excelente |
| Ideal para | Triaje, FAQ, alto volumen | Documentos largos, análisis, multimodal |
3. Configuración en ChatCielo
Ve a Canales > Tu canal > Integración IA > Gemini / Google.
| Campo | Qué poner | Recomendación |
|---|---|---|
| API Key | Pega la clave AIza... de AI Studio | Una clave por tenant. |
| Modelo | gemini-1.5-flash o gemini-1.5-pro | Flash para velocidad; Pro para documentos largos. |
| Prompt del Sistema | Instrucciones de personalidad y reglas | Ver plantillas abajo. Gemini responde muy bien a prompts estructurados con secciones. |
| Temperatura | 0 a 2 | 0.3 para soporte; 0.7 para ventas creativas. |
| Max Tokens | 150 a 8192 | 300–500 para WhatsApp; 1500+ para análisis de documentos. |
| Palabra clave de derivación | hablar con asesor, asesor humano | Frases de 2–3 palabras. |
Límites en ChatCielo: aunque Gemini soporta 1M–2M tokens, ChatCielo puede limitar el histórico enviado por mensaje para optimizar costos. Configura Histórico: 10–15 mensajes para equilibrar contexto y gasto. Si necesitas más contexto, usa Pro y aumenta el histórico a 20–25.
4. Prompt y límites — plantillas
Gemini responde especialmente bien a prompts estructurados con encabezados y reglas numeradas.
Plantilla 1: Atención general con Gemini
Plantilla 2: Análisis de documentos largos (Pro)
Parámetros y límites
| Escenario | Temperatura | Max Tokens | Histórico | Notas |
|---|---|---|---|---|
| Atención rápida (Flash) | 0.3–0.4 | 300–400 | 10 mensajes | Latencia mínima, costo bajo. |
| Ventas (Flash) | 0.5–0.7 | 400–600 | 12 mensajes | Un poco más de creatividad. |
| Documentos largos (Pro) | 0.2–0.3 | 800–1500 | 15–25 mensajes | Aprovecha la ventana gigante. |
Límites de la capa gratuita: en plan gratuito, Gemini limita a ~60 solicitudes por minuto (Flash) y ~2 por minuto (Pro). Para producción con volumen, activa facturación en Google Cloud y solicita aumento de cuota si superas los límites.
5. Palabra clave de derivación humana
En Canales > Tu canal > Integración IA > Derivación humana:
- Palabras clave:
hablar con asesor, asesor humano, hablar con alguien, quiero hablar con persona - Mensaje de derivación:
6. Casos de uso donde Gemini destaca
Catálogos de 500+ productos, manuales técnicos, políticas extensas.
Con Pro y 2M de tokens, puedes pegar tu catálogo completo o manual de 300 páginas en el prompt y Gemini responderá citando la información correcta sin necesidad de RAG externo. Ideal para negocios con información muy extensa.
Combínalo con Dify si prefieres RAG con PDFs dinámicos en lugar de prompt gigante.
7. Solución de problemas
| Problema | Causa | Solución |
|---|---|---|
API key not valid | Clave mal copiada o proyecto incorrecto | Verifica en aistudio.google.com que la clave pertenezca al proyecto correcto. Regenera si persiste. |
Quota exceeded | Límite de capa gratuita superado | Activa facturación en Google Cloud Console y solicita aumento de cuota. |
Resource exhausted | Demasiadas solicitudes por minuto | Reduce la frecuencia o distribuye entre Flash y Pro. Implementa reintento con backoff. |
| Respuestas en inglés | Prompt sin idioma | Agrega al inicio: "Responde siempre en español neutro". |
| No deriva a humano | Palabra clave muy corta | Usa frases de 2–3 palabras y verifica la configuración. |
¿Quieres comparar? Revisa la tabla comparativa general y las guías de DeepSeek (alternativa económica) y Claude (alternativa en calidad de redacción).