lunar
Toda la documentación

Resources

Rendimiento y velocidad

Qué afecta el tiempo de respuesta, cómo funciona el streaming y cómo mantener sesiones fluidas.

Rendimiento y velocidad

Las respuestas llegan en streaming, progresivamente: ves la respuesta mientras se genera en lugar de esperar el bloque completo. Aun así, algunas respuestas legítimamente tardan más que otras, y saber por qué te ayuda a trabajar más rápido.

Qué afecta el tiempo de respuesta

  • La profundidad de la pregunta. El análisis profundo o el modo Investigar — que trabaja por rondas y revisa la evidencia antes de decidir el siguiente paso — tarda más que una respuesta factual rápida.
  • La cantidad de material. Las conversaciones con varios documentos o mucho contexto acumulado requieren más procesamiento. Es el precio de que Lunar recuerde más: contexto más rico, turnos algo más pesados.
  • La capa de estudio. La extracción de conceptos, los resúmenes y el procesamiento de citas giran alrededor de la conversación. Lunar omite deliberadamente esos pasos cuando no aportarían nada — de un saludo no se extrae ningún concepto.

[!NOTE] Lunar está diseñado para evitar trabajo innecesario: las actualizaciones de fondo solo se disparan con mensajes nuevos reales, y unas comprobaciones locales rápidas corren antes de cualquier pasada más fina. Es intencional: mantiene la experiencia veloz.

Comportamiento del streaming

  • Las respuestas normales llegan token a token, así que puedes empezar a leer de inmediato.
  • Si una respuesta llega de golpe en lugar de en streaming, suele significar que la consulta fue pesada — análisis profundo, modo Investigar o varios documentos. Divídela en pasos más cortos y el streaming se normaliza.

Cómo mantener fluidas las sesiones largas

  • Haz preguntas específicas en lugar de amplias.
  • Divide los temas muy largos en partes — o en microchats.
  • Continúa en el mismo hilo: el contexto preservado evita volver a explicar y produce respuestas más consistentes que empezar en frío.
  • Prefiere Lunar Classic para el ida y vuelta rápido y cambia a Lunar Creative cuando la sesión de verdad necesite su contexto largo (ver Modelos).

[!TIP] Si una sesión se siente lenta tras una conversación muy larga, abre una rama del chat actual: conservas el contexto relevante sin arrastrar cada turno anterior.

Leer esta página en English →

    v4.0.9