Serenity*Edge

API de inferencia

Inferencia de modelos abiertos en infraestructura propia en España

Serenity Edge es una API compatible con OpenAI que sirve modelos abiertos y la familia Orion desde las GPU de Substrate AI en Valencia. Sin retención de datos. Residencia de datos en la Unión Europea.

Cambia la URL base. El resto de tu código no cambia.

curl https://api.serenityedge.ai/v1/chat/completions \
  -H "Authorization: Bearer $SERENITY_EDGE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-35b-a3b",
    "messages": [{"role": "user", "content": "Hola"}],
    "stream": true
  }'

Cualquier SDK o herramienta compatible con OpenAI funciona con Serenity Edge.

Lo esencial

Compatible con OpenAI

Chat completions con streaming, llamadas a herramientas, salidas estructuradas y caché de prefijo. Funciona con los SDK y las herramientas que ya usas.

Tus datos se quedan en España

Las peticiones se procesan en infraestructura propia de Substrate AI en Valencia. No retenemos prompts ni respuestas.

Dos familias, un mismo despliegue

Modelos abiertos como Qwen y Orion, la familia propia de Serenity, servidos sobre la misma infraestructura y con la misma API.

Tres formas de acceder

  1. A través de OpenRouter, seleccionando el proveedor Serenity Edge.

  2. Con una cuenta de Serenity Star: claves de API y créditos.

  3. Con contrato, para empresas que necesitan condiciones específicas y SLA.

Cómo obtener acceso