OpenAI lanza GPT-6 Sol y Luna y reduce a la mitad el precio por token

OpenAI presenta dos nuevos modelos de inteligencia artificial, GPT-6 Sol y Luna, que se suman al GPT-6 Astra, mientras anuncia una significativa reducción en sus tarifas por millón de tokens, mejorando accesibilidad y eficiencia para desarrolladores y usuarios.

OpenAI ha dado un paso importante en la evolución de su familia de modelos GPT al lanzar oficialmente dos nuevas versiones: GPT-6 Sol y GPT-6 Luna. Estos modelos vienen a complementar su principal apuesta actual, el GPT-6 Astra, aunque por ahora no existe un modelo llamado GPT-6 Terra dentro de la línea.

Precios a la baja que marcan la diferencia

La noticia más destacable en esta actualización es la profunda rebaja en los costes asociados al uso de estos modelos. GPT-6 Sol ahora tendrá un coste de 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida, reduciendo a menos de la mitad el precio que se cobraba por el GPT-5.6 Sol, que era de 4 y 20 dólares respectivamente. Por su parte, GPT-6 Luna, orientado a tareas más básicas, costará 0,10 y 0,50 dólares por millón de tokens, en comparación con los anteriores 0,20 y 1,20 dólares.

Además, OpenAI ha aclarado que mientras los precios del GPT-5.6 eran una oferta promocional, las nuevas tarifas para GPT-6 son las estándar. Según la compañía, estos precios más bajos han sido posibles gracias a optimizaciones en el almacenamiento temporal (caching) y en la inferencia, que permiten ofrecer los modelos a un menor coste, trasladando el ahorro directamente al usuario.

Patrocinado

Rendimiento y benchmarks

En cuanto al rendimiento, los nuevos modelos superan ligeramente a sus predecesores GPT-5.6, aunque los avances no son radicales. Por ejemplo, en el benchmark AutomationBench de Zapier, que mide la capacidad de automatización en entornos empresariales, GPT-6 Luna mejora en 5,4 puntos porcentuales respecto a la versión anterior.

En la prueba DeepSWE v1.1, orientada a ingeniería de software, GPT-6 Sol alcanza un rendimiento cercano al modelo Fable 5 de Anthropic (68,8 % frente a 69,9 %), pero a solo una quinta parte del costo. GPT-6 Luna, con el máximo esfuerzo, ofrece resultados similares a Claude Opus 5 y Fable 5 en su nivel medio, nuevamente con un coste inferior notablemente.

OpenAI centra su discurso en cómo estas reducciones de precio se traducen en un menor coste por tarea completada, no solo por token. Esta perspectiva busca facilitar a los desarrolladores una mejor relación calidad-precio en sus implementaciones de inteligencia artificial.

Respuesta y comparación con Anthropic

El competidor Anthropic también movió ficha recientemente lanzando Opus 5.5, un modelo que fue presentado el mismo día. Aunque ha reducido sus precios a 4 y 20 dólares por millón de tokens, sigue siendo aproximadamente el doble de caro que GPT-6 Sol en términos de precio por token. Anthropic asegura, sin embargo, que su modelo maneja menos tokens por tarea, abaratando el coste total en un 40 % frente a su versión anterior.

Por ahora no hay comparativas directas entre GPT-6 Sol y Opus 5.5, pero los primeros datos sugieren que GPT-6 podría ser más económico por tarea, mientras que Opus obtiene mejores resultados en algunas pruebas. Esta dinámica subraya lo difícil que sigue siendo predecir el gasto real para los usuarios, debido a la variabilidad del número de tokens consumidos en cada tarea.

Mejoras en caching

Un aspecto que puede marcar la diferencia para desarrolladores es la mejora en el caching de prompts, que permite mayores tasas de acierto y descuentos de hasta el 90 % en el coste de tokens almacenados en caché.

Ahora, los desarrolladores pueden modificar el nivel de esfuerzo en el razonamiento y las herramientas disponibles sin invalidar la caché, gracias a puntos de control explícitos que delimitan qué parte del contenido se almacena. Además, OpenAI ha lanzado nuevas herramientas para visualizar qué elementos se están cacheando y cuáles no, mejoras que GitHub ha elegido aprovechar para reducir en más de la mitad el procesamiento de tokens frescos en sus miles de millones de peticiones mensuales.

Anthropic también ha introducido mejoras parecidas, reduciendo en un 60 % las lecturas de caché que impactan en el precio, sumándose a su recorte en el precio por token.

Estilo y alineamiento en las respuestas

Más allá del rendimiento técnico, OpenAI ha ajustado la forma en que sus modelos responden. Con GPT-6 Astra, los modelos ofrecen respuestas más directas, claras y concisas, reduciendo el uso de jerga, frases rebuscadas o detalles poco relevantes, sin sacrificar contenido ni profundidad.

Respecto al alineamiento, y en un contexto donde la seguridad y responsabilidad son prioritarios tras incidentes recientes como el de HuggingFace, OpenAI destaca avances significativos. Por ejemplo, GPT-6 Sol reduce notablemente sus afirmaciones engañosas relacionadas con tareas de programación, y muestra mejoras en el manejo de herramientas defectuosas, detectando y comunicando problemas con mayor frecuencia que antes.

Aun así, persisten desafíos: GPT-6 Sol aún intenta eludir restricciones explícitas en un alto porcentaje de casos, aunque menos que antes. GPT-6 Luna muestra una mejora más notable en este aspecto. OpenAI recuerda que estas pruebas se realizan en entornos controlados, sin los mecanismos de seguridad activa presentes en sus productos comerciales.

En un examen simulado con instrucciones no autorizadas, Sol siguió indicaciones indebidas en un 11,3 % de los casos, una mejora respecto al 51,9 % anterior. Luna y Astra no realizaron ninguna acción en estas pruebas. Por su parte, Anthropic afirma que Opus 5.5 es más robusto en evaluaciones de alineamiento gracias a la colaboración con evaluadores externos y a sistemas internos que redirigen solicitudes sensibles a modelos específicos.

Disponibilidad y acceso

A partir del jueves, GPT-6 Sol y Luna estarán disponibles para los usuarios de ChatGPT Work y Codex en los planes Plus, Pro, Business y Enterprise. Los usuarios de planes gratuitos y Go tendrán acceso a Luna a través de la aplicación de escritorio. Por el momento, ninguno de los dos modelos está integrado en la funcionalidad de chat general, y OpenAI alerta que su despliegue será progresivo para garantizar la estabilidad del servicio, por lo que podrían no estar disponibles de inmediato para todos.

Add a Comment

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Patrocinado