Cloudflare lanzó mejoras en la experiencia del desarrollador para AI Search, su capa de recuperación administrada para agentes. La actualización colapsa cinco primitivos — Workers AI, AI Gateway, Vectorize, R2 y Browser Run — en un único namespace indexado, añade modo de rastreo sin sitemap, endpoints MCP públicos, enrutamiento de dominio personalizado e incrustación y reranking sin costo al usar modelos Workers AI.

Antes de esta versión, conectar un agente a datos propietarios significaba conectar esos cinco primitivos usted mismo. Ahora un único comando `wrangler ai-search instance create` apunta AI Search a una URL de origen, maneja rastreo a través de Browser Run, división en fragmentos, incrustación y almacenamiento de vectores en un paso. Para sitios sin sitemap, la bandera `--parse-type discover` sigue enlaces para encontrar páginas. El resultado es una instancia por superficie de datos, agrupada en un namespace.

El Cloudflare Dev Stack MCP, disponible en Cloudflare AI Playground, demuestra el despliegue. Cubre 10 superficies: Cloudflare Docs, Blog, API Docs, Community, Astro, Vite, Vitest, Hono, Replicate y OpenNext. Cada una obtiene una instancia de AI Search. Un vinculación de namespace en `wrangler.jsonc` permite a un Worker hacer una única llamada `AI_SEARCH.search()` que se distribuye a las 10 simultáneamente. Los resultados se devuelven como `res.chunks` con metadatos de cita y etiquetas de instancia, con reranking habilitado y hasta 10 resultados por llamada.

Existen dos rutas de despliegue. Opción A: vincular el namespace a un Worker, registrar una herramienta y distribuir con una llamada — la ruta que Cloudflare utilizó para Dev Stack MCP. Opción B: habilitar URLs públicas en el panel y obtener inmediatamente endpoints `/search` y `/mcp` que consulten todas las instancias en el namespace sin código y sin autenticación por defecto. Para datos sensibles, ponga Cloudflare Access frente a un dominio personalizado y requiera inicio de sesión; los tokens de Access funcionan tanto para humanos como para agentes.

La incrustación y el reranking cuestan cero por token cuando se usan modelos Workers AI designados. Eso elimina la sobrecarga operacional de predecir conteos de tokens para cargas de trabajo de búsqueda donde el volumen de consultas sube impredeciblemente. El almacenamiento y la computación fuera de estas dos operaciones siguen un modelo de costo "predecible y escalable" aún en vista previa.

La mayoría de los equipos que construyen agentes con recuperación aumentada mantienen pipelines personalizados: trabajos de rastreo, fragmentación, llamadas de incrustación a APIs de terceros, escrituras de almacenes de vectores e interfaces de consulta. Cada componente tiene su propio modo de fallo y superficie de facturación. El namespace administrado de Cloudflare con una única llamada CLI y vinculación Worker reduce significativamente la superficie — pero intercambia flexibilidad por encadenamiento. Los equipos con infraestructura que no es Cloudflare o fuentes de datos que no están en su cuenta de Cloudflare encuentran restricciones de verificación de propiedad. Cloudflare dice que hay más métodos de verificación próximamente.

Si sus agentes necesitan búsqueda semántica sobre documentación, wikis internos o contenido que posee en Cloudflare, AI Search elimina el trabajo de costura de pipeline. El precio de incrustación gratuita significa que puede indexar agresivamente sin costos por consulta castigando agentes de alto volumen.