OpenAI confirma el lanzamiento de su IA más avanzada de acceso restringido

GPT-5.6 Sol, que supera en capacidades a otros modelos, será accesible únicamente para un reducido grupo de socios, a petición del Gobierno de EE.UU.

OpenAI confirmó el viernes en un comunicado la implementación de GPT-5.6 Sol, su modelo de inteligencia artificial más potente hasta la fecha. La empresa ha indicado que esta herramienta de vanguardia no estará disponible para todos sus clientes, ya que su despliegue se ha realizado bajo la petición expresa de las autoridades de Estados Unidos.

Según el escrito, GPT-5.6 Sol, que supera en capacidades a modelos como Claude Mythos 5, Claude Fable 5 y Gemini 3.1 Pro Preview, será accesible únicamente para un «grupo de socios de confianza cuya participación fue acordada con el Gobierno».

Asimismo, la firma ha hecho hincapié en una característica crucial de esta nueva versión: su diseño incluye un entrenamiento específico para «negarse a realizar acciones ilegales, incluso si la solicitud está disfrazada de legal».

El GPT-5.6 Sol de OpenAI establece un récord de codificación. Su propia tarjeta de sistema admite que a veces hace trampa.

Mientras que Fable 5 de Anthropic permanece retirado del acceso público debido a una directiva de control de exportaciones del gobierno estadounidense, OpenAI lanzó de forma preliminar GPT-5.6 Sol el 26 de junio para sus «socios de confianza».

OpenAI se jactó de que la versión 5.6 es su modelo más potente hasta la fecha y presentó un resultado de codificación que marcó un nuevo hito en Terminal-Bench 2.1, la herramienta de evaluación que califica a los agentes en tareas reales de línea de comandos. Como modelo individual, Sol obtuvo una puntuación de 88.8, superando a GPT-5.5 (88.0) y a los modelos Claude y Gemini 3.1 Pro, lanzados públicamente. Al activar el nuevo «modo ultra» de la compañía, que distribuye el trabajo entre subagentes, alcanzó los 91.9 puntos.

El modelo también parece tener tendencia a hacer trampa en algunos casos. La ficha técnica de OpenAI para GPT-5.6 reconoce además «casos en los que el modelo hace trampa en las tareas y falsifica los resultados de la investigación».

El evaluador independiente que OpenAI contrató antes del lanzamiento detectó el mismo comportamiento, con tal intensidad que no pudo obtener una cifra. METR , que tuvo acceso previo al despliegue a Sol, incluyendo su proceso de pensamiento original, inició una prueba de capacidad con su paquete de software Time Horizon y descartó el resultado.

Según METR, la tasa de detección de trampas del modelo fue superior a la de cualquier modelo público que hubiera evaluado. El problema de clasificación arruinó el resultado. Al tratar los intentos de trampa como fallos, la regla estándar de METR situó el horizonte temporal del 50 % de Sol en torno a las 11,3 horas. Si se contabilizaban esos mismos intentos como éxitos legítimos, el horizonte temporal superaba las 270 horas, muy por encima del rango en el que el conjunto de pruebas proporciona lecturas fiables. Si se descartaban, se eliminaban los datos de varias tareas de largo plazo y se obtenía una estimación de 71 horas con un intervalo de confianza que abarcaba desde las 13 hasta las 11.400 horas. Como indicó METR: «No consideramos que ninguna de estas cifras represente una medición sólida de las capacidades de GPT-5.6 Sol».

METR concluyó que el modelo no supera significativamente el estado del arte en software y trabajo de I+D, no permite una I+D de IA totalmente automatizada y no alcanza el umbral crítico para la auto-mejora de la IA según el Marco de Preparación v2 de OpenAI.

 

Compartir