OpenAI introdujo un modo de ejecución basado en websocket para su API, reduciendo la latencia en flujos de trabajo agénticos en tiempo real. La actualización permite que los agentes reciban salidas de funciones en streaming directamente sobre conexiones persistentes en lugar de polling HTTP repetido.
Para equipos empresariales que construyen agentes autónomos a escala, el corte de latencia mejora la capacidad de respuesta en operaciones sensibles al tiempo como monitoreo en vivo, deteccin de fraude y flujos de trabajo de soporte al cliente en tiempo real.