
OpenAI ampliou a súa familia de modelos de intelixencia artificial coa presentación de GPT-6 Sol e GPT-6 Luna, dúas propostas que trasladan parte das melloras introducidas con GPT-6 Astra a modelos máis rápidos e económicos. A principal novidade para os desenvolvedores está nos prezos da API, que se reducen un 50 % respecto das tarifas promocionais de GPT-5.6.
GPT-6 Sol pasa a custar 2 dólares por millón de tokens de entrada e 10 dólares por millón de tokens de saída, fronte aos 4 e 20 dólares de GPT-5.6 Sol. Luna reduce o prezo da entrada de 0,20 a 0,10 dólares e o da saída de 1,20 a 0,50 dólares por millón de tokens.
Os novos modelos están orientados especialmente a tarefas profesionais, programación, uso de aplicacións mediante axentes e conversas longas. OpenAI sinala que Sol consegue abordar tarefas complexas con máis marxe para iterar grazas ao menor custo, mentres que Luna busca ofrecer unha alternativa máis accesible para cargas de traballo de maior volume.
Nas probas de automatización de fluxos de traballo, GPT-6 Sol obtivo un 33,2 % en AutomationBench cun nivel de esforzo xhigh, cun custo de 0,27 dólares por tarefa. OpenAI sitúa este resultado por riba do 26,9 % de Claude Opus 5 na súa configuración máxima, cun custo por tarefa que, segundo os datos publicados, é 11,1 veces superior. En Agents’ Last Exam, Sol acadou un 56,4 % no nivel máximo de esforzo.
A mellora tamén se estende á fiabilidade factual. OpenAI asegura que Sol comete aproximadamente a metade de erros que GPT-5.6 Sol na súa avaliación interna baseada en conversas reais anonimizadas nas que os usuarios detectaran erros. Luna tamén presenta unha mellora respecto da xeración anterior e, con niveis elevados de esforzo, pode igualar os resultados de GPT-5.6 Sol nesta proba cun custo moi inferior.
A programación é outro dos ámbitos nos que OpenAI destaca a evolución. En FrontierCode, unha avaliación que analiza non só a corrección do código senón tamén aspectos como a calidade das probas, o respecto polo estilo do proxecto e a facilidade para integrar os cambios, GPT-6 Sol mellora substancialmente respecto de GPT-5.6 Sol. En DeepSWE 1.1 obtivo un 68,8 %, a 1,1 puntos do 69,9 % acadado por Claude Fable 5 na súa configuración xhigh, pero cun custo por tarefa aproximadamente un 80 % inferior.
GPT-6 Luna tamén incrementa o seu rendemento neste tipo de tarefas. En DeepSWE acadou un 66,6 % co máximo nivel de esforzo, cun custo por tarefa que OpenAI sitúa un 93 % por debaixo de Claude Opus 5 e un 96 % por debaixo de Claude Fable 5 nas configuracións comparadas.
O uso do ordenador mediante axentes recibe igualmente unha mellora. En OSWorld 2.0, GPT-6 Sol obtivo un 60,5 % co nivel xhigh, fronte ao 60,3 % de Claude Opus 5 con esforzo medio, cun custo por tarefa arredor dun 80 % inferior. Luna, pola súa banda, supera nesta proba o resultado de GPT-5.6 Sol con esforzo medio utilizando o nivel máximo e cun custo aproximadamente dez veces inferior.
A interacción cos usuarios tamén foi revisada. OpenAI asegura que Sol e Luna incorporan parte das melloras de comunicación introducidas con Astra, con respostas máis claras, menos xerga, menos expresións pouco naturais e unha tendencia a ofrecer respostas algo máis curtas sen reducir o contido relevante. A propia OpenAI exemplifica o cambio cunha tarefa de deseño web na que Sol evita asumir inicialmente como debe implementarse a solución e explica que comprobou se era necesario empregar React antes de modificar o proxecto.
A redución de custos acompáñase de cambios no sistema de caché para aplicacións que reutilizan grandes cantidades de contexto. A empresa afirma que GPT-6 pode beneficiarse de descontos do 90 % na lectura de tokens de entrada almacenados na caché. Tamén incorpora ferramentas para analizar o aproveitamento desta caché e permite modificar o nivel de razoamento ou activar e desactivar ferramentas sen invalidar o contexto almacenado.
Segundo os datos achegados por OpenAI, estes cambios permitiron reducir en máis dun 50 % a proporción de tokens que precisan ser procesados novamente en miles de millóns de peticións realizadas por GitHub nos últimos meses.
As avaliacións de aliñamento tamén mostran melloras fronte a GPT-5.6, segundo as probas internas da compañía. Entre elas figura unha menor frecuencia de afirmacións enganosas sobre traballos de programación realizados polos propios modelos. OpenAI advirte, porén, de que estas probas están deseñadas para provocar situacións difíciles e non representan directamente a frecuencia destes comportamentos no uso habitual.
GPT-6 Sol e GPT-6 Luna xa están dispoñibles en ChatGPT Work e Codex para os usuarios dos plans Plus, Pro, Business, Enterprise e Edu. Os usuarios de Free e Go poden acceder a Luna na aplicación de escritorio. Na API identifícanse como gpt-6-sol e gpt-6-luna. A chegada dos modelos ao ChatGPT convencional realizarase de maneira gradual.

