Volver al blog

De tokens del proveedor a créditos Modalis: entiende el costo antes de solicitar

Equipo Editorial de Modalis AI ·

Revisión técnica Laboratorio Modalis AI — Precios y Gobernanza de Modelos · Verificado el 2026-08-30

Descubre cómo entrada, salida, caché, thinking y herramientas afectan el cobro, separando coste del proveedor, créditos Modalis, acceso y mínimos.

El proveedor factura tokens y componentes pagados. El cliente del SaaS consume créditos dentro de un plan comercial. Son capas conectadas, pero diferentes. Confundirlas crea malas comparaciones, sobre todo cuando una respuesta visible breve incluye un prompt grande, razonamiento no mostrado, caché o web search.

Dos registros para una solicitud

El registro del proveedor contiene uso técnico: entrada sin caché, entrada almacenada, escritura de caché cuando corresponde, salida, reasoning o thinking y herramientas con precio propio. El registro Modalis aplica la versión de precios, margen comercial, mínimo del modelo, acceso del plan, reserva y liquidación.

Precios de lista de esta instantánea

Precio estándar por millón de tokens — verificado el 30 de agosto de 2026
ModeloEntradaSalidaFuente
GPT-5.6 LunaUS$0,20US$1,20OpenAI
GPT-5.6 TerraUS$2,00US$12,00OpenAI
GPT-5.6 SolUS$4,00US$20,00OpenAI
Claude Sonnet 5US$2,00US$10,00Anthropic
Claude Opus 5US$5,00US$25,00Anthropic

Son valores educativos, no una factura completa. La entrada en caché puede ser más barata, su escritura puede tener otra tarifa, el contexto largo puede activar multiplicadores, batch puede tener descuento y herramientas como búsqueda web pueden cobrarse aparte. Los precios pueden cambiar.

Una simulación comparable solo de tokens

Para 10 mil tokens de entrada sin caché y mil de salida, el costo aproximado aparece abajo. Excluye caché, thinking, herramientas, contexto largo, reintentos, impuestos y precio Modalis. Ilustra la forma relativa de la tarifa, no predice el cobro al cliente.

Costo bruto ilustrativo: 10 mil tokens de entrada + mil de salida
ModeloCosto de entradaCosto de salidaTotal aproximado
GPT-5.6 LunaUS$0,0020US$0,0012US$0,0032
GPT-5.6 TerraUS$0,0200US$0,0120US$0,0320
GPT-5.6 SolUS$0,0400US$0,0200US$0,0600
Claude Sonnet 5US$0,0200US$0,0100US$0,0300
Claude Opus 5US$0,0500US$0,0250US$0,0750

Por qué una solicitud breve puede alcanzar el mínimo

Solicitudes pequeñas pueden costar fracciones de centavo al proveedor. El SaaS conserva costos de pago, observabilidad, soporte, reintentos, seguridad y plataforma. Un mínimo por modelo crea previsibilidad y protege la economía. Cuando el uso calculado supera ese mínimo, prevalece el consumo real.

Acceso y cobro mínimo actuales en Modalis
ModeloPlan mínimoCréditos mínimosQué significa
GPT-5.6 LunaFree1Una solicitud exitosa consume al menos 1 crédito
GPT-5.6 TerraPremium5Una solicitud exitosa consume al menos 5 créditos
Claude Sonnet 5Premium6Una solicitud exitosa consume al menos 6 créditos
GPT-5.6 SolScale12Una solicitud exitosa consume al menos 12 créditos
Claude Opus 5Scale18Una solicitud exitosa consume al menos 18 créditos

Plan mínimo es una regla de acceso, no una declaración de cuota mensual. La página pública de precios es la fuente para créditos incluidos. Un superadmin puede omitir el acceso normal y no sirve para demostrar lo que ve un cliente Free, Premium o Scale.

Entrada y salida requieren controles separados

La salida es más cara que la entrada en los cinco modelos. La respuesta visible puede ser solo parte del uso cuando thinking está activo. En entrada cuentan historial, sistema, texto de adjuntos y resultados de herramientas aunque el usuario escriba una frase.

  • Limita el historial. Conserva lo necesario y resume o elimina turnos antiguos.
  • Define una salida realista. Un techo enorme aumenta reserva y peor caso.
  • Trata adjuntos como entrada. Un PDF puede dominar el costo.
  • Mide con thinking. La longitud visible no es un indicador fiable.
  • Limita herramientas pagadas. Web search necesita un techo previo.

Cómo validar una solicitud real

  1. Registra saldo inicial y modelo seleccionado.
  2. Envía un prompt identificable y espera una respuesta completa.
  3. Confirma tokens, proveedor, modelo, estado y request ID en el dashboard.
  4. Compara la variación de saldo con créditos consumidos, no con la reserva.
  5. Cuando sea posible, compara consola del proveedor después del retraso de reporte.
  6. Investiga duplicados, IDs ausentes, devoluciones inesperadas o margen insuficiente.

Una solicitud es smoke test, no certificación. La validación compleja debe cubrir historial largo, adjuntos, cache hit y write, thinking, salida máxima, búsqueda web, errores, rechazos y reintentos. Cada caso altera un componente distinto.

La caché solo ahorra cuando se observa

No proyectes un descuento de caché sobre todo el tráfico. El prefijo debe ser elegible, mantenerse estable y producir realmente un cache hit. Solicitudes personalizadas o historiales que cambian al principio pueden pagar entrada sin caché, y algunos flujos pagan una escritura antes de obtener ahorro en lecturas posteriores.

Separa escenarios fríos y calientes. Registra la primera llamada, repeticiones con prefijo idéntico y la expiración aplicable. Esta distinción evita presentar un costo ideal como garantía y revela qué instrucciones, herramientas o documentos se benefician de reutilización.

El mismo cuidado se aplica a los reintentos. Una llamada repetida por error de red no siempre reutiliza todos los componentes ni debe generar un segundo cargo comercial al cliente. La prueba debe observar proveedor y Modalis para comprobar que la economía y la experiencia cuentan la misma historia.

Comprueba dónde encaja cada precio en la guía de lanzamiento de los cinco modelos y aplica el método de evaluación del Laboratorio Modalis antes de cambiar un valor predeterminado de producción.

Fuentes oficiales y lecturas adicionales

Comprueba el acceso antes de estimar volumen

Revisa catálogo y precios actuales y ejecuta una prueba pequeña con la forma real de tu prompt.

Revisar acceso a modelos