OpenAI lanza GPT-6.1 Sol: un modelo casi tan potente como Astra a una quinta parte de su precio

OpenAI presenta GPT-6.1 Sol, una actualización de su modelo GPT-6 Sol que ofrece un rendimiento cercano al buque insignia Astra, pero con costes significativamente reducidos, mejorando velocidad, precisión y alineamiento.

OpenAI anunció el martes el lanzamiento de GPT-6.1 Sol, la versión más reciente de su modelo principal, apenas una semana después de la salida de GPT-6 Sol. Esta actualización representa un avance considerable, ofreciendo un desempeño casi equiparable a GPT-6 Astra, el modelo tope de gama de OpenAI, especialmente en áreas de codificación autónoma, uso de ordenador y tareas profesionales, pero a una fracción de su coste.

Según la compañía, GPT-6.1 Sol optimiza la eficiencia al igualar la inteligencia de Astra en numerosos parámetros, manteniendo un precio por token de entrada y salida significativamente inferior, concretamente una quinta parte del coste estándar del modelo Astra.

Igual precio, rendimiento cercano a Astra

El precio de GPT-6.1 Sol se mantiene en $2 por cada millón de tokens de entrada y $10 por cada millón de tokens de salida. Además, las entradas almacenadas en caché tienen un coste considerablemente más barato, apenas $0.10 por millón de tokens, lo que facilita un uso continuado y económico del modelo.

Patrocinado

Este nuevo modelo ya está disponible a través de la API de OpenAI y accesible para los usuarios con suscripción Plus, Pro, Business, Enterprise y Edu en los servicios ChatGPT Work y Codex. Sin embargo, por el momento no se ha integrado en la funcionalidad de chat convencional.

Una de sus novedades es la versión Ultrafast disponible en Codex, capaz de generar tokens hasta ocho veces más rápido que la velocidad estándar, pensada para quienes requieren una respuesta inmediata sin sacrificar calidad.

Mejoras significativas en rendimiento y costes

A pesar de la corta distancia desde el lanzamiento anterior, GPT-6.1 Sol presenta aumentos de rendimiento notables. En numerosos benchmarks proporcionados por OpenAI, la nueva versión se posiciona en niveles similares a Astra, pero con un coste notablemente más bajo.

Por ejemplo, en pruebas de codificación como DeepSWE 1.1, GPT-6.1 Sol supera al GPT-6 Sol en 6,4 puntos porcentuales, igualando prácticamente a Astra a un coste cinco veces menor. Además, este modelo también superó a Opus 5.5, el modelo de Anthropic lanzado el mismo día que GPT-6 Sol, en pruebas como GDP.pdf, que evalúa la capacidad para responder preguntas complejas sobre documentos PDF. Aquí, GPT-6.1 Sol obtuvo un 32% de precisión frente al 29% de Opus 5.5, aproximándose nuevamente a los resultados de Astra pero con un coste mucho más asequible por tarea.

Uso informático y razonamiento mejorados

Un área donde GPT-6.1 Sol destaca especialmente es en el uso de ordenadores. Con un razonamiento máximo, el nuevo modelo supera a su predecesor en 7 puntos porcentuales y opera a la mitad del coste, manteniendo resultados comparables a Astra. Esta mejora hace que, para la mayoría de usos prácticos, elegir Astra resulte difícil de justificar desde el punto de vista económico y funcional.

Comparación con Sonnet 5.5: resultados dispares

En cuanto a la competencia, Sonnet 5.5, lanzado también recientemente y con tarifas idénticas a GPT-6.1 Sol, muestra resultados mixtos en los pocos benchmarks comparativos disponibles. En DeepSWE, Sonnet alcanza un 71% frente al 75% de GPT-6.1 Sol. En la prueba AutomationBench, Sonnet obtiene un 44,7%, mientras que GPT-6.1 Sol logra un 36%, aunque con costes por tarea mucho menores ($0,30 frente a $1,14 respectivamente).

Menos errores y mejor alineación con el usuario

OpenAI destaca que GPT-6.1 Sol también reduce la tasa de errores factuales. En situaciones de bajo esfuerzo de razonamiento, la proporción de respuestas que contenían al menos un error factual bajó del 11,4% con GPT-6 Sol al 7,7% con GPT-6.1 Sol, una reducción de cerca del 32%. Estas métricas se realizaron en conversaciones complejas y deliberadas, donde se señalaban errores en versiones anteriores, por lo que no reflejan la tasa de error en usos habituales.

En términos de alineación, GPT-6.1 Sol iguala los altos estándares de Astra, mejorando la capacidad para respetar la intención del usuario y cumplir con las restricciones de seguridad. Asimismo, solo en un 2,1% de los casos el modelo omitió informar sobre herramientas de búsqueda defectuosas en lugar de suponer resultados erróneos.

Además, los agentes basados en GPT-6.1 Sol nunca intentaron eludir la supervisión automática de seguridad, manteniendo un uso responsable y controlado.

Add a Comment

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Patrocinado