Cómo funcionan los créditos

Hermes Haven usa una única moneda de crédito llamada HeavenCredits (HC) para pagar la inferencia de IA. No necesitas pensar en tokens, llamadas a API, o pricing por petición. Tu plan incluye una asignación mensual, y puedes añadir más opcionalmente.

Esta página explica qué son los HeavenCredits, cómo los euros se convierten en HC, y cómo se consumen los créditos cuando usas modelos de IA.

¿Qué son los HeavenCredits?

HeavenCredits (HC) son la única moneda unificada en Hermes Haven. Cada plan incluye una asignación mensual de HC — no necesitas gestionar múltiples tipos de crédito ni preocuparte por el orden de prioridad. Un saldo, una moneda, un modelo simple.

Tu plan incluye una asignación mensual de HC. Los HC no usados al final del mes no se arrastran. Si necesitas más, puedes recargar tu monedero con euros en cualquier momento — esos créditos nunca caducan.

¿Qué son los HeavenCredits?
Plan HC incluidos / mes
Trial 0 HC
Starter (9€) 1.500 HC
Plus (19€) 6.000 HC
Pro (39€) 20.000 HC
Enterprise (119€) 50.000 HC

Los créditos pueden agotarse. Tu agente no. Cuando tus HC mensuales se agotan, la plataforma entra en modo economía: solo los modelos de Nivel 0 (nuestras propias GPUs) siguen disponibles sin coste. O recarga tu monedero para seguir usando modelos premium.

Cómo los euros se convierten en HeavenCredits

Cuando compras HeavenCredits, los euros se convierten a HC a un rate flat de 1.000 HC por euro. Los créditos de recarga nunca caducan:

Cómo los euros se convierten en HeavenCredits
Pagas Recibes Rate efectivo
10€ 10.000 HC 1.000 HC/€
50€ 50.000 HC 1.000 HC/€
100€ 100.000 HC 1.000 HC/€

Rate flat: 1€ = 1.000 HC. Sin bonificaciones por volumen — cada euro compra exactamente lo mismo.

Qué pasa cuando envías una petición

Cada petición de IA pasa por un ciclo reserve → settle → release. Esto asegura que nunca se te cobre de más y las peticiones fallidas no cuestan créditos:

  1. Reserve — Antes de enviar la petición al modelo, la plataforma estima el coste máximo y retiene ese importe de tu saldo. Los créditos retenidos se eliminan temporalmente pero no se cobran aún.
  2. Settle (éxito) — Si la petición tiene éxito (HTTP 200), el coste real se calcula desde el uso de tokens real. La diferencia entre lo retenido y lo real se devuelve a tu saldo. Solo se cobra el importe real.
  3. Settle (fallo parcial) — Si la petición falla con error de cliente (4xx, excepto 402/429), solo se cobran los tokens de input — no pagas por output que no se generó.
  4. Release (fallo total) — Si la petición falla con error de servidor (5xx), rate limit (429), o error de pago (402), todos los créditos retenidos se devuelven. No se te cobra por fallos de infraestructura.

Idempotencia: Si la misma petición se reintenta (ej. glitch de red), el sistema la reconoce y no cobra dos veces. Cada petición tiene un ID único que previene facturación duplicada.

Ejemplo completo: de petición a cobro

  1. Envías una petición de chat — Modelo: GLM-5.2 (Nivel 3, tarifa = 5.138 HC/1M). Máximo estimado: 2.000 HC retenidos de tu saldo de HC.
  2. El modelo responde con éxito — Uso real: 100.000 tokens de input + 10.000 tokens de output. ponderados = 100.000 + (10.000 × 5) = 150.000
  3. Coste real calculado — hc = round(150.000 × 5.138 ÷ 1.000.000) = 771 HC
  4. Saldo actualizado — 2.000 HC retenidos → 771 HC cobrados → 1.229 HC devueltos a tu saldo. Resultado neto: saldo HC reducido en 771 HC.

¿Qué pasa cuando se agotan los créditos?

¿Qué pasa cuando se agotan los créditos?
Situación Qué ocurre
Saldo HC = 0 Modo economía: Solo modelos de Nivel 0 (nuestras GPUs) disponibles. Modelos premium bloqueados hasta renovación o recarga.
Renovación mensual Tu asignación de HC se rellena al importe de tu plan. El saldo de recargas del monedero se preserva (no se resetea).

Precios de modelos — cómo se consumen los créditos

Cada modelo de IA pertenece a un nivel de coste. El nivel determina cuántos HeavenCredits consumen tus peticiones, medidos en HC por millón de weighted tokens. Hay seis niveles (L0–L5):

Niveles de coste de modelos
Nivel Rango HC/M Descripción
L0 0 Gratis (GPU propio)
L1 1–500 Economy
L2 501–2.000 Standard
L3 2.001–8.000 Premium
L4 8.001–30.000 High-end
L5 30.001+ Ultra

Los weighted tokens no son tokens raw. La plataforma pondera los diferentes tipos de token para reflejar el coste real de cómputo:

weighted = uncached_input + (cached_input × 0,1) + (output × 5) + (reasoning × 5)

Los tokens de output y reasoning cuestan 5× más que los de input porque requieren generación activa. El input cacheado cuesta 10× menos porque se reutiliza del contexto previo. Los modelos de Nivel 0 corren en nuestras propias GPUs sin coste — siguen disponibles incluso en modo economía cuando se agotan tus créditos.

Para el catálogo completo con detalles por modelo, ver Modelos de IA y Niveles de Coste.

Modelos disponibles

La plataforma ofrece 85 modelos en 6 niveles de coste. Los modelos de Nivel 0 (L0) son gratis y funcionan en nuestra propia infraestructura de GPU. Los niveles 1-5 (L1-L5) son modelos premium que consumen HavenCredits según su tarifa:

Resumen de niveles de coste
Nivel Rango HC/M Descripción
L00Gratis (GPU propio)
L11–500Economy
L2501–2.000Standard
L32.001–8.000Premium
L48.001–30.000High-end
L530.001+Ultra

Para el catálogo completo con todos los modelos y tarifas, ver Modelos de IA y Niveles de Coste.

Tus propias claves = cero créditos consumidos

Si configuras tus propias claves API (cualquier endpoint compatible con OpenAI), las peticiones que pasan por esas claves no consumen ningún crédito de tu saldo de Hermes Haven.

Ver el catálogo completo de modelos y niveles de coste en Modelos de IA y Niveles de Coste.

¿Listo para desplegar tu agente?

Prueba gratuita de 15 días. Sin tarjeta. Qwen 3.6 35B incluido.