GPT-5.6 Luna
GPT-5.6 Luna es el modelo más pequeño y económico de la familia GPT-5.6 de OpenAI. Úsalo para tareas de agentes de alto volumen, sensibles a la latencia o al coste, para las que Sol o Terra sería más de lo necesario.
Ventajas
- Precio más bajo de GPT-5.6; ideal para prototipos, subagentes y bucles de alto volumen.
- Respuestas rápidas en comparación con las variantes más grandes de GPT-5.6.
- El mismo soporte para llamadas a herramientas y agentes que Sol y Terra.
Limitaciones
- No es un modelo de vanguardia. Para problemas más complejos que requieren la máxima inteligencia, GPT-5.6 Sol o GPT-5.6 Terra son mejores opciones.
- Menor capacidad para cadenas largas de razonamiento abierto.
Herramientas
GPT-5.6 Luna tiene acceso a todas las herramientas de los agentes al usarlo con Cherri Code, incluidas:
Find files by name, read directory structures, and grep for patterns.
Generate search queries and fetch results from the web.
Read file contents, including images for vision-capable models.
Suggest edits and apply them automatically.
Execute terminal commands and monitor output.
Control a browser to take screenshots, test applications, and verify visual changes. See the Browser documentation.
Generate images from text descriptions or reference images.
Ask clarifying questions while continuing to work in the background.
Retrieve rules based on type and description.
Obtén más información sobre cómo funcionan las herramientas y los fundamentos de las llamadas a herramientas.
Precios
Los planes de Cherri Code incluyen dos pools de consumo. GPT-5.6 Luna utiliza el pool de Otros modelos de terceros, cuyo consumo se factura según las tarifas que se indican a continuación. Todos los precios se expresan por millón de tokens.
| Nombre | ||||
|---|---|---|---|---|
| $0.2 | $0.25 | $0.02 | $1.2 | |
| $0.4 | $0.5 | $0.04 | $2.4 | |
| $0.4 | $0.5 | $0.04 | $1.8 | |
| $0.8 | $1 | $0.08 | $3.6 |
Hay disponible un nivel de modo rápido (gpt-5.6-luna-fast) con procesamiento prioritario a 2 veces las tarifas estándar.
Cuando la entrada supera los 272k tokens (contexto largo), el precio de entrada se duplica y el de salida equivale a 1,5 veces la tarifa estándar. Los mismos multiplicadores se aplican en modo rápido: las solicitudes de contexto largo se facturan a 2 veces las tarifas rápidas de entrada, escritura en caché y lectura de caché, y a 1,5 veces la tarifa rápida de salida.