Streaming: mostrar la respuesta mientras se genera
Aprende cuándo conviene el streaming, cómo es la secuencia de eventos SSE de la API de Claude, cómo usar los helpers del SDK de Python para mostrar texto en vivo y cómo recuperar el mensaje final con su uso de tokens.
Un cliente de Viajes Kukulcán pide un itinerario de cuatro días por la península. La respuesta tarda 20 segundos en generarse. Si tu chat muestra un círculo girando durante 20 segundos y luego todo el texto de golpe, mucha gente cierra la ventana antes. Si el texto empieza a aparecer en un segundo o dos y va creciendo palabra por palabra, la misma espera se siente como una conversación. Esa es la idea del streaming.
Qué verás en esta lección
- Por qué y cuándo
- La secuencia de eventos
- La forma fácil: messages.stream
- Cuando no te interesan los fragmentos
- La forma manual: recorrer eventos
- Llevarlo a una página web
- Errores a mitad del flujo
- Práctica
- Resumen
- Quiz
El resto de la lección es para alumnos. Se abre al comprar el curso o con la Membresía de IA con Clase.
Ver precios Ya compré: acceder o empieza con una lección gratis