Buscar documentación...

Empieza a escribir para buscar documentación

Guía de la plataforma

Modelos y precios

El sufijo :free, los precios y por qué desaparecen modelos.

La página de modelos muestra la ventana de contexto, los precios por token, los endpoints y las capacidades. Cada página de modelo trae ejemplos de código. No todos los modelos gratuitos admiten llamadas a herramientas o visión, así que revisa las etiquetas de capacidades.

Catálogo de modelos con precios e insignias de descuento

Rankings muestra qué modelos gratuitos rinden bien, según pruebas de la comunidad. Status hace seguimiento del estado de los proveedores.

¿Nuevo por aquí? Conseguir una clave y enviar la primera solicitud lleva un minuto en Inicio rápido

Los modelos gratuitos llevan un sufijo :free, por ejemplo gpt-oss-120b:free

Un modelo :free se enruta solo a proveedores gratuitos y nunca usa tu saldo. El mismo nombre sin el sufijo es la versión de pago: sin tope y facturada por token. Cambiar es cuestión de una cadena.

Los modelos gratuitos tienen dos límites: el tope del propio proveedor y nuestro tope por usuario y por modelo. Cuenta con recibir 429 en horas punta. Usa un modelo de pago cuando necesites fiabilidad.

Los topes exactos, cabeceras y pautas de reintento están documentados en Límites de tasa y errores

Los modelos se enrutan entre grupos de proveedores, cada uno con su propio precio y listado en Group Pricing. Una alta disponibilidad genera descuentos automáticos. Un failover puede cambiar el precio efectivo.

Tabla de precios por grupo en la página de detalle de un modelo

Para bloquear un modelo a grupos concretos y sus tarifas, consulta Fijación de grupos

La mayoría de los modelos facturan por token, con precios distintos para entrada y salida. Imagen y vídeo suelen facturar una tarifa plana por llamada. El precio de la página del modelo es lo que pagas.

La página de precios muestra las opciones de recarga. Las páginas de modelo muestran precios por token en vivo.

En los modelos que lo admiten, los prefijos de prompt repetidos se facturan a una tarifa de caché más baja. Escribir una entrada de caché cuesta alrededor de 1,25 veces un token de entrada normal.

El almacenamiento en caché es automático. Los prompts de sistema largos y estables son los que más se benefician.

Las peticiones pasan al siguiente grupo de proveedores cuando uno alcanza su límite o se cae. Un modelo solo abandona el catálogo cuando todos los canales están fuera.

Que un modelo desaparezca bajo carga es lo esperado. Vuelve en unos minutos en cuanto se recupera un canal.

Las claves que fijan grupos de proveedores solo conmutan dentro de sus grupos fijados, consulta Fijación de grupos

Para recibir aviso en cuanto vuelva, vigílalo en Notificaciones