Serenity Edge

Modelos potentes. Precio imbatible. Infraestructura europea. Sin retención de datos.

Serenity Edge sirve modelos abiertos y la familia Orion desde infraestructura propia en España, con una API compatible con OpenAI, precio por millón de tokens y sin retención de datos.

Cambia la URL base. El resto de tu código no cambia.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.serenityedge.ai/v1",
    api_key="YOUR_API_KEY",
)

stream = client.chat.completions.create(
    model="orion-plus",
    messages=[
        {"role": "user", "content": "¿Qué es un token?"},
    ],
    stream=True,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

Respuesta (streaming)

Un token es la unidad mínima de texto que procesa un modelo, como una palabra o parte de una palabra.

Por qué Serenity Edge

Tres razones para cambiar la URL base

Datos en la UE, sin retención

La inferencia se ejecuta en infraestructura propia en España y el tratamiento no sale de la Unión Europea. Los prompts y las respuestas nunca se escriben en disco ni en registros.

Precio por token, a la vista

Entrada, salida y entrada en caché por millón de tokens, publicados en la web para cada modelo. Sin mínimos, sin permanencia y sin sorpresas en la factura.

Compatible con OpenAI: cambia una línea

Los SDK y las herramientas que ya usas funcionan tal cual. Cambia la URL base, pon tu clave y sigue trabajando con streaming, herramientas y salidas estructuradas.

Catálogo

Dos familias, un mismo precio transparente

Orion, la familia propia de Serenity, y modelos abiertos con sus pesos originales. Mismo contexto, mismas capacidades y precios publicados por millón de tokens.

Cargando el catálogo desde la API…
Ver la tabla completa de modelos y precios

Primeros pasos

En producción en tres pasos

  1. Consigue tu clave

    Crea una cuenta de Serenity Star y genera una clave de API. También puedes usar Serenity Edge desde OpenRouter con tu cuenta de allí.

    Obtener clave de API
  2. Apunta tu cliente a la URL base

    Cualquier SDK compatible con OpenAI vale: cambia la URL base y la clave, y elige un modelo del catálogo.

    client = OpenAI(
        base_url="https://api.serenityedge.ai/v1",
        api_key="YOUR_API_KEY",
    )
  3. Haz tu primera petición

    Chat completions con streaming, herramientas y salidas estructuradas. La respuesta incluye el campo usage con el recuento de tokens.

    curl https://api.serenityedge.ai/v1/chat/completions \
      -H "Authorization: Bearer $SERENITY_EDGE_API_KEY" \
      -H "Content-Type: application/json" \
      -d '{"model": "orion-plus", "messages": [{"role": "user", "content": "Hola"}]}'

Lo que ya funciona

  • Streaming de respuestas
  • Llamadas a herramientas (tool calling)
  • Salidas estructuradas (JSON)
  • Campo usage con el recuento de tokens
Ver la referencia de la API

Infraestructura

Nodos de inferencia propios en España

Serenity Edge no se apoya en nubes de terceros para la inferencia: los modelos se ejecutan en nodos de inferencia propios, situados en España y operados por una sociedad española. Todos los nodos exponen la misma API y el tratamiento de tus datos se queda en la Unión Europea.

Recorrido de una peticiónTu aplicaciónapi.serenityedge.aiNodos propios en EspañaRespuesta
Más sobre la infraestructura

Seguridad y cumplimiento

Diseñado para que tus datos no salgan de la UE

Sin retención de datos

Los prompts y las respuestas nunca se escriben en disco ni en registros. Para acelerar peticiones repetidas, los prefijos de los prompts pueden permanecer en la memoria de caché menos de 24 horas; después se descartan automáticamente y nunca se usan para entrenar.

RGPD y documentos publicados

Substrate Artificial Inteligence, S.A. es una sociedad española sujeta al RGPD. Las condiciones del servicio, la política de privacidad, el acuerdo de tratamiento de datos y la lista de subencargados están publicados y con control de versiones.

Compromisos por contrato

Los acuerdos de nivel de servicio (SLA) y la capacidad dedicada se establecen por contrato. Si tu caso lo necesita, hablamos.

Estado y rendimiento

Transparencia, también en el rendimiento

Estado del servicio

Disponibilidad e incidencias en una página de estado pública. La disponibilidad se mide desde fuera de nuestra infraestructura, no la declaramos nosotros.

Ver el estado del servicio

Rendimiento medido por terceros

Publicaremos el throughput y la disponibilidad de Serenity Edge tal y como los mida OpenRouter en cuanto el proveedor esté enrutado. Hasta entonces, sin cifras propias.

Formas de acceso

Elige cómo empezar

Cuenta de Serenity Star

Autoservicio: crea la cuenta, genera tu clave y compra créditos. La vía directa para equipos y desarrolladores.

Crear una cuenta

OpenRouter

Usa tu cuenta de OpenRouter y selecciona el proveedor Serenity Edge. Facturación y clave, las de OpenRouter.

Ir a OpenRouter

Contrato con SLA

Capacidad dedicada, condiciones específicas y acuerdo de nivel de servicio para empresas.

Contactar

Preguntas frecuentes

Lo que suelen preguntarnos

¿Retenéis mis prompts o mis respuestas?

No. Los prompts y las respuestas nunca se escriben en disco ni en registros. Para acelerar peticiones repetidas, los prefijos de los prompts pueden permanecer en la memoria de caché menos de 24 horas; después se descartan automáticamente y nunca se usan para entrenar.

¿Dónde se procesan mis datos?

La inferencia se ejecuta en infraestructura propia en España y todo el tratamiento ocurre dentro de la Unión Europea. No transferimos tus datos fuera de la UE.

¿Cómo se factura?

Por millón de tokens: entrada y salida por separado, y la entrada en caché al 25 % del precio de entrada. Sin cuota mínima ni permanencia. Con una cuenta de Serenity Star compras créditos y los consumes; a través de OpenRouter te factura OpenRouter; los contratos tienen sus propias condiciones.

¿Qué límites hay y qué pasa si los supero?

Los límites por defecto son generosos y se amplían bajo contrato. Si superas tu límite o la capacidad disponible en ese momento, la API responde con el código 429; reintenta con una espera creciente, igual que con cualquier API compatible con OpenAI.

¿En qué se diferencian Orion y los modelos abiertos?

Los modelos abiertos se sirven con sus pesos originales y su identificador de siempre. Orion es la familia de modelos propia de Serenity, con dos niveles: Pro para tareas exigentes y Plus para grandes volúmenes. Las dos familias comparten API, contexto y capacidades; el precio de cada modelo está publicado en la tabla.

¿Puedo usar Serenity Edge desde OpenRouter?

Sí. Los modelos abiertos están disponibles en OpenRouter seleccionando el proveedor Serenity Edge. La familia Orion se ofrece a través de las cuentas de Serenity Star y de los contratos directos.

¿Ofrecéis SLA?

Solo por contrato. Las condiciones públicas del servicio se basan en esfuerzos comercialmente razonables, y el estado del servicio se publica en una página abierta.

Empieza hoy con tu clave de API

Modelos abiertos y Orion, precio por token publicado, datos en la UE. Cambia la URL base y comprueba la diferencia.