GPT-6.1 Sol: La opción más económica que iguala en precisión a GPT-6 Astra

OpenAI ha lanzado GPT-6.1 Sol, una versión que mantiene la precisión de GPT-6 Astra pero a un coste significativamente menor, ofreciendo eficiencia y velocidad en tareas complejas de programación y análisis.

OpenAI presentó el 29 de septiembre su nuevo modelo GPT-6.1 Sol, apenas una semana después del lanzamiento de GPT-6 Sol. Esta actualización se promociona como una mejora sobre GPT-6 y como una alternativa más asequible que se acerca considerablemente al rendimiento de GPT-6 Astra, su modelo más avanzado.

Según OpenAI, GPT-6.1 Sol ofrece una inteligencia cercana a la de Astra en tareas de programación autónoma, uso de ordenador y trabajos profesionales, cometiendo además menos errores de hecho que GPT-6 Sol cuando se utiliza con un razonamiento mínimo. La compañía destaca su potencial como una solución casi equivalente a Astra, pero a una quinta parte del coste.

En cuanto a precios, GPT-6.1 Sol cuesta 2 dólares por cada millón de tokens de entrada y 10 dólares por millón de tokens de salida, con un coste reducido a 0,10 dólares para tokens de entrada en caché. En comparación, GPT-6 Astra tiene un precio de 10 dólares por millón de tokens de entrada, 50 dólares por millón de salida y 1 dólar por millones de tokens en caché, lo que sitúa a GPT-6.1 Sol en aproximadamente un 18 % del coste de Astra para las tareas habituales.

Patrocinado

Para comprobar la fiabilidad de estas afirmaciones, se sometieron ambos modelos a tres rigurosas pruebas prácticas utilizando la API de respuestas de OpenAI con los mismos comandos y configuraciones: esfuerzo máximo de razonamiento y límite de salida de 64 000 tokens.

Pruebas realizadas

  • Triagem de Integración Continua (CI): Los modelos analizaron 40 registros de trabajos fallidos en CI y un manual con reglas condicionales para decidir si cada tarea debía reintentarse, bloquearse o reportarse.
  • Registros de incidentes: Se procesaron 3 664 líneas de registros correspondientes a cinco servicios durante una interrupción de dos horas, respondiendo a siete preguntas críticas para el análisis posterior que requerían cálculos precisos y manejo de zonas horarias.
  • Especificación de un resolvedor: Los modelos debían programar desde cero un resolvedor de dependencias para un gestor de paquetes ficticio basado en un documento de dos páginas, sin ejecutar código, siendo evaluados en 120 pruebas ocultas.

Resultados de la triagem de CI

Ambos modelos respondieron correctamente las 40 llamadas en las cinco ejecuciones realizadas. Astra fue más rápido, con una media de 24 segundos por ejecución frente a los 31 segundos de GPT-6.1 Sol. El coste por ejecución fue de 0,02 dólares para GPT-6.1 Sol y 0,11 dólares para Astra, manteniendo la precisión en igualdad y destacando Sol como opción más económica.

Resultados en registros de incidentes

Esta prueba fue desafiante para GPT-6 Sol previamente, pero GPT-6.1 Sol y Astra respondieron correctamente a todas las preguntas en todas las ejecuciones. Con un tiempo medio de 2 minutos y 20 segundos, GPT-6.1 Sol fue un 19 % más rápido que Astra. Además, costó 0,31 dólares frente a 1,57 dólares de Astra.

Resultados en la especificación del resolvedor

Ambos modelos superaron todas las pruebas sin errores esta vez, a diferencia del rendimiento anterior de GPT-6 Sol. GPT-6.1 Sol completó las ejecuciones en una media de 7 minutos y 7 segundos, un 30 % menos que los 10 minutos y 6 segundos de Astra, con un coste muy inferior: 0,20 dólares frente a 1,28 dólares. Astra generó un 28 % más tokens de salida en esta tarea, incrementando el coste.

Balance final

Prueba Modelo Ejecuciones perfectas Tiempo medio Tokens (entrada/salida) Coste medio
Triagem CI GPT-6.1 Sol 5/5 0:31 3 867 / 1 381 0,02 $
Triagem CI GPT-6 Astra 5/5 0:24 3 867 / 1 431 0,11 $
Registros de incidentes GPT-6.1 Sol 5/5 2:20 113 966 / 8 316 0,31 $
Registros de incidentes GPT-6 Astra 5/5 2:53 113 966 / 8 539 1,57 $
Especificación resolvedor GPT-6.1 Sol 5/5 7:07 1 687 / 19 637 0,20 $
Especificación resolvedor GPT-6 Astra 5/5 10:06 1 687 / 25 207 1,28 $
Total (15 ejecuciones) GPT-6.1 Sol 15/15 49:54 2,66 $
Total (15 ejecuciones) GPT-6 Astra 15/15 1:07:07 14,77 $

Los resultados confirman que GPT-6.1 Sol ofrece la misma exactitud que Astra en las pruebas realizadas, con un coste aproximadamente un 18 % del de Astra y una mayor rapidez en los test más largos. Esto convierte a GPT-6.1 Sol en la opción preferente para este tipo de trabajo, ya que obtiene resultados precisos y reduce significativamente tanto el dinero como el tiempo invertidos.

Si bien los análisis no pueden garantizar que ambos modelos sean idénticos en todas las situaciones, y que otros índices posicionen ligeramente mejor a Astra en máxima capacidad, los datos recopilados sugieren que GPT-6.1 Sol es una alternativa muy eficaz y económica para tareas profesionales complejas.

Add a Comment

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Patrocinado