OrionAbierto- Contexto
- Salida máxima
- Entrada
- Salida
- Entrada en caché
USD por millón de tokens
Serenity Edge sirve modelos abiertos y la familia Orion desde infraestructura propia en España, con una API compatible con OpenAI, precio por millón de tokens y sin retención de datos.
Cambia la URL base. El resto de tu código no cambia.
from openai import OpenAI
client = OpenAI(
base_url="https://api.serenityedge.ai/v1",
api_key="YOUR_API_KEY",
)
stream = client.chat.completions.create(
model="orion-plus",
messages=[
{"role": "user", "content": "¿Qué es un token?"},
],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")Respuesta (streaming)
Un token es la unidad mínima de texto que procesa un modelo, como una palabra o parte de una palabra.
Por qué Serenity Edge
La inferencia se ejecuta en infraestructura propia en España y el tratamiento no sale de la Unión Europea. Los prompts y las respuestas nunca se escriben en disco ni en registros.
Entrada, salida y entrada en caché por millón de tokens, publicados en la web para cada modelo. Sin mínimos, sin permanencia y sin sorpresas en la factura.
Los SDK y las herramientas que ya usas funcionan tal cual. Cambia la URL base, pon tu clave y sigue trabajando con streaming, herramientas y salidas estructuradas.
Catálogo
Orion, la familia propia de Serenity, y modelos abiertos con sus pesos originales. Mismo contexto, mismas capacidades y precios publicados por millón de tokens.
No se ha podido leer el catálogo de la API en este momento. Vuelve a intentarlo en unos minutos o consulta la respuesta de la API directamente.
Abrir la respuesta de la API
OrionAbiertoUSD por millón de tokens
Primeros pasos
Crea una cuenta de Serenity Star y genera una clave de API. También puedes usar Serenity Edge desde OpenRouter con tu cuenta de allí.
Obtener clave de APICualquier SDK compatible con OpenAI vale: cambia la URL base y la clave, y elige un modelo del catálogo.
client = OpenAI(
base_url="https://api.serenityedge.ai/v1",
api_key="YOUR_API_KEY",
)Chat completions con streaming, herramientas y salidas estructuradas. La respuesta incluye el campo usage con el recuento de tokens.
curl https://api.serenityedge.ai/v1/chat/completions \
-H "Authorization: Bearer $SERENITY_EDGE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "orion-plus", "messages": [{"role": "user", "content": "Hola"}]}'Infraestructura
Serenity Edge no se apoya en nubes de terceros para la inferencia: los modelos se ejecutan en nodos de inferencia propios, situados en España y operados por una sociedad española. Todos los nodos exponen la misma API y el tratamiento de tus datos se queda en la Unión Europea.
Seguridad y cumplimiento
Los prompts y las respuestas nunca se escriben en disco ni en registros. Para acelerar peticiones repetidas, los prefijos de los prompts pueden permanecer en la memoria de caché menos de 24 horas; después se descartan automáticamente y nunca se usan para entrenar.
Substrate Artificial Inteligence, S.A. es una sociedad española sujeta al RGPD. Las condiciones del servicio, la política de privacidad, el acuerdo de tratamiento de datos y la lista de subencargados están publicados y con control de versiones.
Los acuerdos de nivel de servicio (SLA) y la capacidad dedicada se establecen por contrato. Si tu caso lo necesita, hablamos.
Estado y rendimiento
Disponibilidad e incidencias en una página de estado pública. La disponibilidad se mide desde fuera de nuestra infraestructura, no la declaramos nosotros.
Ver el estado del servicioPublicaremos el throughput y la disponibilidad de Serenity Edge tal y como los mida OpenRouter en cuanto el proveedor esté enrutado. Hasta entonces, sin cifras propias.
Formas de acceso
Autoservicio: crea la cuenta, genera tu clave y compra créditos. La vía directa para equipos y desarrolladores.
Crear una cuentaUsa tu cuenta de OpenRouter y selecciona el proveedor Serenity Edge. Facturación y clave, las de OpenRouter.
Ir a OpenRouterCapacidad dedicada, condiciones específicas y acuerdo de nivel de servicio para empresas.
ContactarPreguntas frecuentes
No. Los prompts y las respuestas nunca se escriben en disco ni en registros. Para acelerar peticiones repetidas, los prefijos de los prompts pueden permanecer en la memoria de caché menos de 24 horas; después se descartan automáticamente y nunca se usan para entrenar.
La inferencia se ejecuta en infraestructura propia en España y todo el tratamiento ocurre dentro de la Unión Europea. No transferimos tus datos fuera de la UE.
Por millón de tokens: entrada y salida por separado, y la entrada en caché al 25 % del precio de entrada. Sin cuota mínima ni permanencia. Con una cuenta de Serenity Star compras créditos y los consumes; a través de OpenRouter te factura OpenRouter; los contratos tienen sus propias condiciones.
Los límites por defecto son generosos y se amplían bajo contrato. Si superas tu límite o la capacidad disponible en ese momento, la API responde con el código 429; reintenta con una espera creciente, igual que con cualquier API compatible con OpenAI.
Los modelos abiertos se sirven con sus pesos originales y su identificador de siempre. Orion es la familia de modelos propia de Serenity, con dos niveles: Pro para tareas exigentes y Plus para grandes volúmenes. Las dos familias comparten API, contexto y capacidades; el precio de cada modelo está publicado en la tabla.
Sí. Los modelos abiertos están disponibles en OpenRouter seleccionando el proveedor Serenity Edge. La familia Orion se ofrece a través de las cuentas de Serenity Star y de los contratos directos.
Solo por contrato. Las condiciones públicas del servicio se basan en esfuerzos comercialmente razonables, y el estado del servicio se publica en una página abierta.
Modelos abiertos y Orion, precio por token publicado, datos en la UE. Cambia la URL base y comprueba la diferencia.