OpenAI introduziu um modo de execução baseado em websocket para sua API, reduzindo latência em fluxos de trabalho agêncticos em tempo real. A atualização permite que agentes recebam saídas de função em streaming diretamente sobre conexões persistentes em vez de polling HTTP repetido.
Para equipes corporativas construindo agentes autônomos em escala, o corte de latência melhora a responsividade em operações sensíveis ao tempo como monitoramento ao vivo, detecção de fraude e fluxos de trabalho de suporte ao cliente em tempo real.