Resources
Rendimiento y velocidad
Qué afecta el tiempo de respuesta, cómo funciona el streaming y cómo mantener sesiones fluidas.
Rendimiento y velocidad
Las respuestas llegan en streaming, progresivamente: ves la respuesta mientras se genera en lugar de esperar el bloque completo. Aun así, algunas respuestas legítimamente tardan más que otras, y saber por qué te ayuda a trabajar más rápido.
Qué afecta el tiempo de respuesta
- La profundidad de la pregunta. El análisis profundo o el modo Investigar — que trabaja por rondas y revisa la evidencia antes de decidir el siguiente paso — tarda más que una respuesta factual rápida.
- La cantidad de material. Las conversaciones con varios documentos o mucho contexto acumulado requieren más procesamiento. Es el precio de que Lunar recuerde más: contexto más rico, turnos algo más pesados.
- La capa de estudio. La extracción de conceptos, los resúmenes y el procesamiento de citas giran alrededor de la conversación. Lunar omite deliberadamente esos pasos cuando no aportarían nada — de un saludo no se extrae ningún concepto.
[!NOTE] Lunar está diseñado para evitar trabajo innecesario: las actualizaciones de fondo solo se disparan con mensajes nuevos reales, y unas comprobaciones locales rápidas corren antes de cualquier pasada más fina. Es intencional: mantiene la experiencia veloz.
Comportamiento del streaming
- Las respuestas normales llegan token a token, así que puedes empezar a leer de inmediato.
- Si una respuesta llega de golpe en lugar de en streaming, suele significar que la consulta fue pesada — análisis profundo, modo Investigar o varios documentos. Divídela en pasos más cortos y el streaming se normaliza.
Cómo mantener fluidas las sesiones largas
- Haz preguntas específicas en lugar de amplias.
- Divide los temas muy largos en partes — o en microchats.
- Continúa en el mismo hilo: el contexto preservado evita volver a explicar y produce respuestas más consistentes que empezar en frío.
- Prefiere Lunar Classic para el ida y vuelta rápido y cambia a Lunar Creative cuando la sesión de verdad necesite su contexto largo (ver Modelos).
[!TIP] Si una sesión se siente lenta tras una conversación muy larga, abre una rama del chat actual: conservas el contexto relevante sin arrastrar cada turno anterior.