Cómo funcionan los créditos
Hermes Haven usa una única moneda de crédito llamada HeavenCredits (HC) para pagar la inferencia de IA. No necesitas pensar en tokens, llamadas a API, o pricing por petición. Tu plan incluye una asignación mensual, y puedes añadir más opcionalmente.
Esta página explica qué son los HeavenCredits, cómo los euros se convierten en HC, y cómo se consumen los créditos cuando usas modelos de IA.
¿Qué son los HeavenCredits?
HeavenCredits (HC) son la única moneda unificada en Hermes Haven. Cada plan incluye una asignación mensual de HC — no necesitas gestionar múltiples tipos de crédito ni preocuparte por el orden de prioridad. Un saldo, una moneda, un modelo simple.
Tu plan incluye una asignación mensual de HC. Los HC no usados al final del mes no se arrastran. Si necesitas más, puedes recargar tu monedero con euros en cualquier momento — esos créditos nunca caducan.
| Plan | HC incluidos / mes |
|---|---|
| Trial | 0 HC |
| Starter (9€) | 1.500 HC |
| Plus (19€) | 6.000 HC |
| Pro (39€) | 20.000 HC |
| Enterprise (119€) | 50.000 HC |
Los créditos pueden agotarse. Tu agente no. Cuando tus HC mensuales se agotan, la plataforma entra en modo economía: solo los modelos de Nivel 0 (nuestras propias GPUs) siguen disponibles sin coste. O recarga tu monedero para seguir usando modelos premium.
Cómo los euros se convierten en HeavenCredits
Cuando compras HeavenCredits, los euros se convierten a HC a un rate flat de 1.000 HC por euro. Los créditos de recarga nunca caducan:
| Pagas | Recibes | Rate efectivo |
|---|---|---|
| 10€ | 10.000 HC | 1.000 HC/€ |
| 50€ | 50.000 HC | 1.000 HC/€ |
| 100€ | 100.000 HC | 1.000 HC/€ |
Rate flat: 1€ = 1.000 HC. Sin bonificaciones por volumen — cada euro compra exactamente lo mismo.
Qué pasa cuando envías una petición
Cada petición de IA pasa por un ciclo reserve → settle → release. Esto asegura que nunca se te cobre de más y las peticiones fallidas no cuestan créditos:
- Reserve — Antes de enviar la petición al modelo, la plataforma estima el coste máximo y retiene ese importe de tu saldo. Los créditos retenidos se eliminan temporalmente pero no se cobran aún.
- Settle (éxito) — Si la petición tiene éxito (HTTP 200), el coste real se calcula desde el uso de tokens real. La diferencia entre lo retenido y lo real se devuelve a tu saldo. Solo se cobra el importe real.
- Settle (fallo parcial) — Si la petición falla con error de cliente (4xx, excepto 402/429), solo se cobran los tokens de input — no pagas por output que no se generó.
- Release (fallo total) — Si la petición falla con error de servidor (5xx), rate limit (429), o error de pago (402), todos los créditos retenidos se devuelven. No se te cobra por fallos de infraestructura.
Idempotencia: Si la misma petición se reintenta (ej. glitch de red), el sistema la reconoce y no cobra dos veces. Cada petición tiene un ID único que previene facturación duplicada.
Ejemplo completo: de petición a cobro
- Envías una petición de chat — Modelo: GLM-5.2 (Nivel 3, tarifa = 5.138 HC/1M). Máximo estimado: 2.000 HC retenidos de tu saldo de HC.
- El modelo responde con éxito — Uso real: 100.000 tokens de input + 10.000 tokens de output. ponderados = 100.000 + (10.000 × 5) = 150.000
- Coste real calculado — hc = round(150.000 × 5.138 ÷ 1.000.000) = 771 HC
- Saldo actualizado — 2.000 HC retenidos → 771 HC cobrados → 1.229 HC devueltos a tu saldo. Resultado neto: saldo HC reducido en 771 HC.
¿Qué pasa cuando se agotan los créditos?
| Situación | Qué ocurre |
|---|---|
| Saldo HC = 0 | Modo economía: Solo modelos de Nivel 0 (nuestras GPUs) disponibles. Modelos premium bloqueados hasta renovación o recarga. |
| Renovación mensual | Tu asignación de HC se rellena al importe de tu plan. El saldo de recargas del monedero se preserva (no se resetea). |
Precios de modelos — cómo se consumen los créditos
Cada modelo de IA pertenece a un nivel de coste. El nivel determina cuántos HeavenCredits consumen tus peticiones, medidos en HC por millón de weighted tokens. Hay seis niveles (L0–L5):
| Nivel | Rango HC/M | Descripción |
|---|---|---|
| L0 | 0 | Gratis (GPU propio) |
| L1 | 1–500 | Economy |
| L2 | 501–2.000 | Standard |
| L3 | 2.001–8.000 | Premium |
| L4 | 8.001–30.000 | High-end |
| L5 | 30.001+ | Ultra |
Los weighted tokens no son tokens raw. La plataforma pondera los diferentes tipos de token para reflejar el coste real de cómputo:
weighted = uncached_input + (cached_input × 0,1) + (output × 5) + (reasoning × 5)
Los tokens de output y reasoning cuestan 5× más que los de input porque requieren generación activa. El input cacheado cuesta 10× menos porque se reutiliza del contexto previo. Los modelos de Nivel 0 corren en nuestras propias GPUs sin coste — siguen disponibles incluso en modo economía cuando se agotan tus créditos.
Para el catálogo completo con detalles por modelo, ver Modelos de IA y Niveles de Coste.
Modelos disponibles
La plataforma ofrece 85 modelos en 6 niveles de coste. Los modelos de Nivel 0 (L0) son gratis y funcionan en nuestra propia infraestructura de GPU. Los niveles 1-5 (L1-L5) son modelos premium que consumen HavenCredits según su tarifa:
| Nivel | Rango HC/M | Descripción |
|---|---|---|
| L0 | 0 | Gratis (GPU propio) |
| L1 | 1–500 | Economy |
| L2 | 501–2.000 | Standard |
| L3 | 2.001–8.000 | Premium |
| L4 | 8.001–30.000 | High-end |
| L5 | 30.001+ | Ultra |
Para el catálogo completo con todos los modelos y tarifas, ver Modelos de IA y Niveles de Coste.
Tus propias claves = cero créditos consumidos
Si configuras tus propias claves API (cualquier endpoint compatible con OpenAI), las peticiones que pasan por esas claves no consumen ningún crédito de tu saldo de Hermes Haven.
- Usuarios intensivos que han negociado pricing directo con un proveedor
- Usuarios que necesitan un modelo específico que no está en nuestro catálogo
- Equipos con acuerdos enterprise existentes con proveedores de IA
Ver el catálogo completo de modelos y niveles de coste en Modelos de IA y Niveles de Coste.