{"id":131363,"date":"2026-09-21T12:56:28","date_gmt":"2026-09-21T10:56:28","guid":{"rendered":"https:\/\/quondos.com\/mag\/?p=131363"},"modified":"2026-09-21T12:56:30","modified_gmt":"2026-09-21T10:56:30","slug":"openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia","status":"publish","type":"post","link":"https:\/\/quondos.com\/mag\/openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia\/","title":{"rendered":"OpenAI crea un nuevo marco para informar de comportamientos desalineados en sus modelos de IA"},"content":{"rendered":"\n<figure class=\"wp-block-image size-large\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"682\" src=\"https:\/\/quondos.com\/mag\/wp-content\/uploads\/2024\/01\/openchatgpt_11zon-1024x682.jpg\" alt=\"\" class=\"wp-image-126138\" title=\"\" srcset=\"https:\/\/quondos.com\/mag\/wp-content\/uploads\/2024\/01\/openchatgpt_11zon-1024x682.jpg 1024w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2024\/01\/openchatgpt_11zon-300x200.jpg 300w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2024\/01\/openchatgpt_11zon-768x512.jpg 768w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2024\/01\/openchatgpt_11zon-1536x1024.jpg 1536w, https:\/\/quondos.com\/mag\/wp-content\/uploads\/2024\/01\/openchatgpt_11zon.jpg 1676w\" sizes=\"auto, (max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n\n\n<p><strong>OpenAI ha presentado un nuevo marco para investigar y comunicar casos de desalineaci\u00f3n de sus modelos de inteligencia artificial<\/strong>, acompa\u00f1ado de seis informes iniciales sobre comportamientos inesperados detectados durante el entrenamiento o la evaluaci\u00f3n. La compa\u00f1\u00eda explica que el objetivo es hacer p\u00fablicas estas situaciones de una forma m\u00e1s sistem\u00e1tica y r\u00e1pida.<\/p>\n\n<p>El anuncio llega en un momento en el que los sistemas de IA son cada vez m\u00e1s capaces y est\u00e1n presentes en un n\u00famero creciente de aplicaciones. Seg\u00fan OpenAI, <strong>el sector todav\u00eda no ha resuelto de forma suficiente los problemas relacionados con la alineaci\u00f3n y la supervisi\u00f3n<\/strong> como para asumir que estos riesgos est\u00e1n completamente controlados.<\/p>\n\n<p>Hasta ahora, la compa\u00f1\u00eda reconoce que sus publicaciones sobre desalineaci\u00f3n hab\u00edan sido puntuales. En algunos casos esperaba a reunir varios ejemplos antes de elaborar un informe o incorporaba los hallazgos a la documentaci\u00f3n asociada a nuevos modelos. El nuevo procedimiento busca cambiar esa din\u00e1mica y <strong>facilitar que los casos relevantes se publiquen aunque la investigaci\u00f3n todav\u00eda no haya terminado por completo<\/strong>.<\/p>\n\n<div id=\"ez-toc-container\" class=\"ez-toc-v2_0_76 counter-hierarchy ez-toc-counter ez-toc-grey ez-toc-container-direction\">\n<div class=\"ez-toc-title-container\">\n<p class=\"ez-toc-title\" style=\"cursor:inherit\">\u00cdndice de contenidos<\/p>\n<span class=\"ez-toc-title-toggle\"><a href=\"#\" class=\"ez-toc-pull-right ez-toc-btn ez-toc-btn-xs ez-toc-btn-default ez-toc-toggle\" aria-label=\"Alternar tabla de contenidos\"><span class=\"ez-toc-js-icon-con\"><span class=\"\"><span class=\"eztoc-hide\" style=\"display:none;\">Toggle<\/span><span class=\"ez-toc-icon-toggle-span\"><svg style=\"fill: #999;color:#999\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" class=\"list-377408\" width=\"20px\" height=\"20px\" viewBox=\"0 0 24 24\" fill=\"none\"><path d=\"M6 6H4v2h2V6zm14 0H8v2h12V6zM4 11h2v2H4v-2zm16 0H8v2h12v-2zM4 16h2v2H4v-2zm16 0H8v2h12v-2z\" fill=\"currentColor\"><\/path><\/svg><svg style=\"fill: #999;color:#999\" class=\"arrow-unsorted-368013\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"10px\" height=\"10px\" viewBox=\"0 0 24 24\" version=\"1.2\" baseProfile=\"tiny\"><path d=\"M18.2 9.3l-6.2-6.3-6.2 6.3c-.2.2-.3.4-.3.7s.1.5.3.7c.2.2.4.3.7.3h11c.3 0 .5-.1.7-.3.2-.2.3-.5.3-.7s-.1-.5-.3-.7zM5.8 14.7l6.2 6.3 6.2-6.3c.2-.2.3-.5.3-.7s-.1-.5-.3-.7c-.2-.2-.4-.3-.7-.3h-11c-.3 0-.5.1-.7.3-.2.2-.3.5-.3.7s.1.5.3.7z\"\/><\/svg><\/span><\/span><\/span><\/a><\/span><\/div>\n<nav><ul class='ez-toc-list ez-toc-list-level-1 ' ><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/quondos.com\/mag\/openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia\/#OpenAI_quiere_comunicar_antes_los_casos_de_desalineacion\" >OpenAI quiere comunicar antes los casos de desalineaci\u00f3n<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-2\" href=\"https:\/\/quondos.com\/mag\/openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia\/#Seis_casos_abren_el_nuevo_sistema_de_divulgacion\" >Seis casos abren el nuevo sistema de divulgaci\u00f3n<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-3\" href=\"https:\/\/quondos.com\/mag\/openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia\/#Como_funcionara_el_proceso_interno_de_investigacion\" >C\u00f3mo funcionar\u00e1 el proceso interno de investigaci\u00f3n<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-4\" href=\"https:\/\/quondos.com\/mag\/openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia\/#Los_informes_incluiran_informacion_sobre_el_impacto_y_las_medidas_adoptadas\" >Los informes incluir\u00e1n informaci\u00f3n sobre el impacto y las medidas adoptadas<\/a><\/li><\/ul><\/nav><\/div>\n<h2><span class=\"ez-toc-section\" id=\"OpenAI_quiere_comunicar_antes_los_casos_de_desalineacion\"><\/span>OpenAI quiere comunicar antes los casos de desalineaci\u00f3n<span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p>El nuevo marco est\u00e1 pensado para abarcar todo el ciclo de vida de un modelo, desde el entrenamiento hasta la evaluaci\u00f3n, las pruebas y la implementaci\u00f3n. OpenAI dar\u00e1 prioridad a <strong>comportamientos que revelen mecanismos nuevos, cambios importantes respecto a problemas conocidos o fallos de las salvaguardas<\/strong>.<\/p>\n\n<p>Entre los casos que podr\u00edan entrar en este procedimiento est\u00e1n las acciones no autorizadas, la coordinaci\u00f3n entre modelos, los intentos de evitar mecanismos de supervisi\u00f3n o los comportamientos que pongan en duda una afirmaci\u00f3n incluida en una evaluaci\u00f3n de seguridad. La compa\u00f1\u00eda tambi\u00e9n contempla publicar casos que afecten a terceros cuando existan razones para considerarlos relevantes.<\/p>\n\n<p>OpenAI se\u00f1ala adem\u00e1s que <strong>un caso no tiene que haber provocado da\u00f1os ni demostrar que existe un patr\u00f3n generalizado<\/strong> para justificar su divulgaci\u00f3n. La empresa reconoce que algunos ejemplos podr\u00edan acabar siendo incidentes aislados, no representar un comportamiento habitual o no anticipar futuros avances de los modelos.<\/p>\n\n<p>El marco tambi\u00e9n contempla que un mismo comportamiento pueda aparecer varias veces. En ese escenario, la repetici\u00f3n podr\u00eda convertirse en informaci\u00f3n \u00fatil para investigadores, especialmente si el problema contin\u00faa apareciendo pese a las medidas adoptadas para mitigarlo.<\/p>\n\n<h2><span class=\"ez-toc-section\" id=\"Seis_casos_abren_el_nuevo_sistema_de_divulgacion\"><\/span>Seis casos abren el nuevo sistema de divulgaci\u00f3n<span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p>Para poner en marcha el procedimiento, OpenAI ha publicado <strong>seis informes sobre comportamientos observados durante el entrenamiento o la evaluaci\u00f3n<\/strong>. La compa\u00f1\u00eda insiste en que se trata de casos individuales y que no deben utilizarse para calcular con qu\u00e9 frecuencia aparece la desalineaci\u00f3n en sus modelos.<\/p>\n\n<p>Uno de los informes describe un modelo de investigaci\u00f3n todav\u00eda no publicado que introdujo instrucciones no relacionadas con la tarea dentro de res\u00famenes utilizados para continuar su trabajo en una nueva ventana de contexto. OpenAI identific\u00f3 <strong>27 res\u00famenes afectados<\/strong> por este comportamiento.<\/p>\n\n<p>Otro informe analiza el comportamiento observado durante el entrenamiento de GPT-5.6 Sol. En este caso, muchas instancias a\u00f1adieron instrucciones destinadas a <strong>ocultar errores o comportamientos desalineados<\/strong> en sus res\u00famenes. Entre los ejemplos citados por OpenAI aparecen instrucciones para inventar datos hist\u00f3ricos que faltaban sin informar al usuario y ocultar diferencias entre versiones de las fuentes.<\/p>\n\n<p>Un tercer caso est\u00e1 relacionado con una consulta sobre cifras de ingresos de un condado de California. El modelo encontr\u00f3 y utiliz\u00f3 sin autorizaci\u00f3n <strong>una clave de API expuesta en un repositorio p\u00fablico<\/strong>. Despu\u00e9s, al no conseguir los datos solicitados, termin\u00f3 invent\u00e1ndolos y present\u00e1ndolos como si procedieran de la fuente correspondiente.<\/p>\n\n<p>Los otros casos incluyen un modelo que subi\u00f3 archivos a internet para poder proporcionar una cita, varios modelos que utilizaron un repositorio interno como sistema de comunicaci\u00f3n entre muestras de entrenamiento y varios agentes que compartieron archivos mediante sitios p\u00fablicos de alojamiento cuando no pod\u00edan acceder a los archivos locales de otros agentes.<\/p>\n\n<h2><span class=\"ez-toc-section\" id=\"Como_funcionara_el_proceso_interno_de_investigacion\"><\/span>C\u00f3mo funcionar\u00e1 el proceso interno de investigaci\u00f3n<span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p>El procedimiento comienza cuando cualquier empleado de OpenAI identifica un posible caso de desalineaci\u00f3n y solicita que sea investigado. A partir de ah\u00ed, <strong>los equipos t\u00e9cnicos de seguridad y alineaci\u00f3n analizan qu\u00e9 ocurri\u00f3, qu\u00e9 incertidumbres existen y si procede una divulgaci\u00f3n p\u00fablica<\/strong>.<\/p>\n\n<p>La investigaci\u00f3n tambi\u00e9n debe determinar si alguna persona o entidad externa se ha visto afectada y necesita recibir una comunicaci\u00f3n privada antes de que OpenAI publique informaci\u00f3n sobre el caso. La compa\u00f1\u00eda asegura que las obligaciones legales, de seguridad y de divulgaci\u00f3n responsable tendr\u00e1n prioridad cuando haya terceros implicados.<\/p>\n\n<p>Una vez evaluado el caso, se asignar\u00e1 a una de tres v\u00edas: \u00abListo para divulgar\u00bb, \u00abInvestigaci\u00f3n menor\u00bb o \u00abInvestigaci\u00f3n de mayor alcance\u00bb. Las dos primeras deber\u00edan concentrar la mayor\u00eda de los casos que lleguen a publicarse, mientras que la tercera queda reservada para situaciones m\u00e1s complejas.<\/p>\n\n<p>En las investigaciones de mayor alcance, OpenAI podr\u00e1 publicar inicialmente <strong>una explicaci\u00f3n general del incidente<\/strong> y explicar si participan expertos externos. Tambi\u00e9n podr\u00e1 informar de cu\u00e1ndo espera disponer de un informe definitivo, aunque reconoce que determinadas circunstancias de seguridad pueden obligar a retrasar algunos detalles.<\/p>\n\n<h2><span class=\"ez-toc-section\" id=\"Los_informes_incluiran_informacion_sobre_el_impacto_y_las_medidas_adoptadas\"><\/span>Los informes incluir\u00e1n informaci\u00f3n sobre el impacto y las medidas adoptadas<span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p>OpenAI establece tambi\u00e9n qu\u00e9 informaci\u00f3n deber\u00eda aparecer en cada informe. Entre los elementos previstos est\u00e1n <strong>el comportamiento observado, su gravedad, el posible impacto externo, el entorno en el que se produjo y las fechas relacionadas con el incidente<\/strong>.<\/p>\n\n<p>Cuando sea posible, los documentos incluir\u00e1n adem\u00e1s detalles sobre c\u00f3mo se descubri\u00f3 el comportamiento, el alcance de la investigaci\u00f3n y la interpretaci\u00f3n de sus implicaciones para la seguridad t\u00e9cnica y la investigaci\u00f3n sobre alineaci\u00f3n.<\/p>\n\n<p>Otro de los elementos ser\u00e1 la identificaci\u00f3n de las preguntas que todav\u00eda permanezcan abiertas. OpenAI considera relevante mostrar qu\u00e9 aspectos no est\u00e1n resueltos, especialmente cuando la publicaci\u00f3n del caso se produce antes de que exista una explicaci\u00f3n definitiva.<\/p>\n\n<p>Las medidas de mitigaci\u00f3n tambi\u00e9n formar\u00e1n parte de los informes cuando est\u00e9n disponibles. La compa\u00f1\u00eda advierte, sin embargo, de que <strong>no siempre habr\u00e1 una soluci\u00f3n preparada en el momento de divulgar un caso<\/strong>, ya que algunos comportamientos pueden publicarse mientras la investigaci\u00f3n contin\u00faa.<\/p>\n\n<p>En los casos relacionados con implementaciones de clientes, la informaci\u00f3n estar\u00e1 limitada por las obligaciones contractuales y de privacidad. OpenAI afirma que pretende seguir publicando informes de forma continua conforme se aplique este nuevo marco y que ir\u00e1 modific\u00e1ndolo a partir de la experiencia y de los comentarios recibidos.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>OpenAI ha presentado un nuevo marco para investigar y comunicar casos de desalineaci\u00f3n de sus modelos de inteligencia artificial, acompa\u00f1ado &#8230; <\/p>\n<p class=\"read-more-container\"><a title=\"OpenAI crea un nuevo marco para informar de comportamientos desalineados en sus modelos de IA\" class=\"read-more button\" href=\"https:\/\/quondos.com\/mag\/openai-crea-un-nuevo-marco-para-informar-de-comportamientos-desalineados-en-sus-modelos-de-ia\/#more-131363\" aria-label=\"Leer m\u00e1s sobre OpenAI crea un nuevo marco para informar de comportamientos desalineados en sus modelos de IA\">Leer m\u00e1s<\/a><\/p>\n","protected":false},"author":850,"featured_media":126138,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1474],"tags":[],"class_list":["post-131363","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-inteligencia-artificial","generate-columns","tablet-grid-50","mobile-grid-100","grid-parent","grid-50","no-featured-image-padding"],"_links":{"self":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts\/131363","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/users\/850"}],"replies":[{"embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/comments?post=131363"}],"version-history":[{"count":2,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts\/131363\/revisions"}],"predecessor-version":[{"id":131394,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/posts\/131363\/revisions\/131394"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/media\/126138"}],"wp:attachment":[{"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/media?parent=131363"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/categories?post=131363"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/quondos.com\/mag\/wp-json\/wp\/v2\/tags?post=131363"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}