SELECTOR DE MODELO + ESFUERZO

Elige el modelo y el esfuerzo de Codex adecuados

Describe la tarea. Codex Juice recomienda Astra, Sol, Terra o Luna y el menor esfuerzo de razonamiento que probablemente la complete bien.

Volver al Radar de Codex

TASK → MODEL → EFFORT

Obtén una configuración inicial

Tres señales de la tarea producen un punto de partida transparente. Si falla la verificación, sigue la alternativa en vez de adivinar con valores Juice.

Configuración recomendada ModeloTerraEsfuerzoMedio Terra equilibra capacidad y coste en trabajo rutinario. Medium es el inicio respaldado por evidencia para una tarea clara y conocida. Si falla el primer intento: Mantén el modelo y sube un nivel de esfuerzo antes de cambiar de modelo.

Referencia rápida

Son puntos de partida, no una clasificación de capacidad. La verificación difícil o la prioridad de calidad pueden elevar la configuración.

TareaEmpieza conEsfuerzo
Rápida y fácil de comprobar Luna Bajo
Rutinaria y acotada Terra Medio
Trabajo complejo en repositorio Sol Alto
Ambigua o de alto riesgo Astra Muy alto
Leer el posicionamiento de OpenAI para Astra, Sol, Terra y Luna

GUÍA DE 30 SEGUNDOS

Elige en 30 segundos

Empieza por la forma de la tarea: usa menos esfuerzo si el camino y la validación son claros, y más si hay ambigüedad o alto riesgo de revisión. Esta guía combina la orientación de calidad frente a velocidad de OpenAI con resultados externos, no con valores Juice.

Cómo funciona la regla El modelo sigue la amplitud de la tarea y el riesgo de verificación; el esfuerzo controla cuánto razonamiento invertir. El selector usa el posicionamiento de OpenAI y evidencia externa, no el tamaño de la huella Juice.

MONITOR TÉCNICO

Huella experimental de ejecución

Las observaciones en vivo de los seis niveles vigilan la recolección y los cambios de configuración. Juice no es una puntuación de capacidad; el tamaño y la dirección son huellas neutrales de ejecución.

Las observaciones de ejecución están ocultas

El selector y la evidencia siguen disponibles. Los valores Juice solo aparecen si la instantánea en línea es actual o está marcada como último dato conocido y contiene una observación válida.

Método de la sonda

Una sesión restringida y efímera de Codex CLI observa cada nivel. Un valor nuevo se publica solo tras coincidir en una segunda sesión nueva. El sweep completo se invalida si cambia el identificador del modelo.

Lo que esta métrica no demuestra

Juice es una huella de ejecución no oficial y autodeclarada, no uso real de tokens ni un benchmark de calidad. Un valor más alto, más bajo o un cambio en cualquier dirección no indica mayor o menor capacidad de programación.

OpenAI solo ofrece una guía direccional entre calidad y velocidad y señala que no todas las tareas se benefician igual de más razonamiento. Leer la guía de esfuerzo de OpenAI

Abrir datos de /api/juice

effort-guide --external-evidence

Evidencia externa en vivo de tareas reales

NixBench publica ahora resultados de GPT-5.6 Sol en Low, Medium, High, XHigh y Max sobre un corpus de 29 tareas de código, con cinco ensayos registrados por nivel. Es evidencia orientativa de otro benchmark, no una puntuación de capacidad de Codex Juice. NixBench aún no publica filas de GPT-6 Astra (comprobado el 2026-09-06).

fuente y actualización
NixBench · 2026-07-12
modelo externo
GPT-5.6 Sol
entorno de prueba
codex-cli 0.144.1
conjunto de tareas
29 · NixBench 29-task corpus · 5×/effort
Media de tareas superadas, intervalo observado del 95 %, segundos por tarea, ensayos registrados y timeouts.
nivelmedia superadaintervalo 95 %segundos/tareaensayostiempos de espera
Bajo 23.6/29 22.2–25.0 27.4s 5 0
Medio 24.0/29 22.5–25.5 38.5s 5 0
Alto 23.6/29 22.9–24.3 47.4s 5 0
Muy alto 24.0/29 23.1–24.9 60.7s 5 0
Máximo 23.2/29 20.1–26.3 81.4s 5 3

Límites: NixBench usa su propio arnés, corpus y evaluadores shell ocultos objetivos; estos resultados no son lecturas de Codex Juice. Aquí hay una fila pública para Max. Ultra es un modo de producto y no encontramos una fila pública comparable en esta revisión.

Instantánea estática · verificada 2026-08-03