Modelos y precios
Qué significa el sufijo :free, cómo se cobra el uso y por qué a veces desaparece un modelo.
La página de Modelos lista cada modelo con su ventana de contexto, precios por token, endpoints admitidos y filtros de capacidad como llamadas a herramientas y entrada de imágenes. Cada modelo tiene su propia página con ejemplos de código listos para copiar y pegar. No todos los modelos gratuitos admiten llamadas a herramientas o visión, así que revisa las insignias de capacidad antes de conectar uno a un agente de programación.

Rankings muestra qué modelos gratuitos rinden de verdad, según pruebas de la comunidad, y Status sigue la salud de los proveedores en vivo.
¿Nuevo por aquí? Conseguir una clave y enviar la primera solicitud lleva un minuto en Inicio rápido
Los modelos gratuitos llevan un sufijo :free, por ejemplo gpt-oss-120b:free
Un modelo :free se enruta solo a proveedores upstream gratuitos y nunca toca tu saldo. El mismo nombre base sin el sufijo es la versión de pago: estable, sin límite y facturada por token. Ambos pueden coexistir, así que pasar de gratuito a de pago es un cambio de una sola cadena.
Los modelos gratuitos tienen dos capas de límites. Los proveedores upstream limitan sus pools gratuitos y, además, nosotros añadimos nuestro propio límite por usuario y por modelo para que un usuario intensivo no pueda agotar un pool compartido. Espera respuestas 429 en horas punta y usa un modelo de pago cuando necesites fiabilidad.
Los topes exactos, cabeceras y pautas de reintento están documentados en Errores y límites de tasa
Cada modelo se enruta por uno o más grupos de proveedores, cada uno con su precio; la tabla Group Pricing de la página del modelo los lista todos. La alta disponibilidad gana descuentos automáticos, y una conmutación a otro grupo puede mover el precio efectivo.

Para bloquear un modelo a grupos concretos y sus tarifas, consulta Fijación de grupos
La mayoría de los modelos cobran por token, con precios separados de entrada y salida. Unos pocos modelos (sobre todo de imagen y vídeo) cobran en su lugar un precio fijo por llamada. Lo que ves en la página del modelo es lo que pagas: sin suscripciones, sin comisiones ocultas, tu saldo simplemente disminuye por solicitud.
La página de Precios tiene las opciones de recarga actuales; cada página de modelo muestra precios por token en vivo.
En los modelos que admiten caché de prompts (Claude y otros), los prefijos de prompt repetidos se cobran a una tarifa reducida de entrada en caché, mientras que escribir una nueva entrada en caché cuesta algo más que un token de entrada normal (alrededor de 1,25x).
El almacenamiento en caché es automático. Las cargas de trabajo con prompts de sistema largos y estables (agentes, presets de RP) son las que más se benefician, sin necesidad de configuración.
Las peticiones conmutan automáticamente al siguiente grupo de proveedores cuando uno alcanza su límite o cae. Solo cuando todos los canales de un modelo están fuera, el modelo desaparece del catálogo.
Que un modelo desaparezca bajo carga es esperado, no una avería: reaparece solo cuando un canal se recupera, normalmente en minutos.
Las claves que fijan grupos de proveedores solo conmutan dentro de sus grupos fijados, consulta Fijación de grupos
Para recibir aviso en cuanto vuelva, vigílalo en Notificaciones