TOOLAI / Leer la guía de ToolAI / Pasarelas de modelos

Cloudflare AI: llama a Jev desde un Worker

Una ruta documentada para usar Jev en aplicaciones de Cloudflare, con una distinción clara entre tu Worker y el servicio de modelos de terceros.

ToolAI EditorialRevisado

Qué hace

Cloudflare AI incluye Jev como modelo de terceros y documenta las llamadas mediante el binding de AI de un Worker o una API HTTP. Esto permite añadir un paso de decisión a una aplicación que ya se ejecuta en Cloudflare sin crear un servicio independiente de Python o Node solo para esa solicitud.

El Worker recibe la solicitud, prepara el contexto relevante y lee la respuesta tipada de Jev. Tu propio código sigue decidiendo dónde guardarla y qué acción está permitida. La disponibilidad mediante Cloudflare no significa que los pesos de Jev se ejecuten dentro de tu Worker ni en todas las ubicaciones edge.

A quién le sirve

Esta ruta encaja con equipos que ya conocen Workers, los bindings y los permisos de cuenta de Cloudflare. Puede servir para clasificar envíos de formularios o enrutar solicitudes basadas en texto cerca del punto de entrada existente de la aplicación. Si un trabajo ya funciona de forma fiable en otra plataforma, cambiar el alojamiento solo para acceder a Jev requeriría una razón más sólida que la simple presencia de una lista de modelos.

Una situación que quizá reconozcas

Supón que un directorio acepta envíos de herramientas a través de un Worker. Jev podría sugerir si un envío es una ficha de producto, una pregunta de soporte o una promoción no relacionada. Guarda la sugerencia junto al envío y permite que un editor la corrija antes de publicarla.

Un modelo no disponible no debería hacer que desaparezca un envío válido. Guarda primero la solicitud original cuando tu flujo lo requiera y marca la clasificación como pendiente. Así conservas el trabajo del usuario mientras tu aplicación gestiona un reintento posterior o una revisión manual.

Una primera configuración sensata

  1. Confirma el acceso a Jev y los permisos necesarios en tu cuenta de Cloudflare.
  2. Configura el enlace de AI del Worker o prepara la autenticación HTTP documentada.
  3. Usa el identificador del modelo de Cloudflare y el formato de entrada que aparecen en su documentación de Jev.
  4. Prueba un envío realista, incluidos los campos de respuesta que guardará tu aplicación.
  5. Gestiona los tiempos de espera y las clasificaciones incompletas antes de conectar el resultado a una cola.

Qué sopesar antes de elegir

Un enlace puede reducir el código de conexión, pero no elimina los límites de las solicitudes, los fallos de red ni los errores del modelo. Establece un tiempo máximo que corresponda a la tarea del usuario. La confirmación de un formulario y una cola de revisión en segundo plano suelen tener necesidades distintas.

Mantén las credenciales y el formato de la solicitud específicos de esta ruta. Una clave de TypeSafe y un token de API de Cloudflare no son intercambiables. Revisa también las condiciones de gestión de datos que se aplican al servicio elegido; llamar a través de una plataforma no responde por sí solo dónde se procesa cada parte de una solicitud.

Cuentas y costes de uso

Revisa las condiciones actuales de facturación de Cloudflare para el modelo junto con los recursos de Workers que utiliza tu aplicación. Una llamada de ejemplo exitosa no determina cuánto costará un mes completo de envíos. Incluye los reintentos y cualquier cola o almacenamiento en tu estimación, y compara el uso real durante una prueba piloto pequeña. Evita enviar historiales completos cuando el envío actual contiene todo lo necesario para responder a la pregunta.

¿Listo para probarlo?

www.cloudflare.com/products/workers-ai