Inteligencia distorsionada en la frontera de la IA

 Inteligencia distorsionada en la frontera de la IA . Noticias en tiempo real 11:30

Por Daron Acemoglu, Project Syndicate.

LONDRES- Tras los reiterados fallos de seguridad en OpenAI y Anthropic, ambas empresas han desarrollado agentes que terminaron hackeando sistemas externos-, los investigadores en seguridad de IA de ambas compañías han anunciado su dimisión o han reconocido (¡por fin!) que la carrera desenfrenada por avanzar hacia la “frontera” tecnológica es irresponsable.

En respuesta a la atención mediática negativa, líderes destacados del sector -entre ellos Demis Hassabis, de Google; Dario Amodei, de Anthropic; Sam Altman, de OpenAI, e incluso Elon Musk- se han sumado a los llamamientos para “moderar el ritmo” de los avances en la frontera de la IA: es decir, progresar a una velocidad más equilibrada y deliberada, prestando mayor atención a la supervisión y las salvaguardas. El problema, a su juicio, radica en el riesgo significativo de que la IA llegue a ser extremadamente potente y, al mismo tiempo, sufra una grave “falta de alineación” -término de la jerga del sector tecnológico que describe situaciones en las que los sistemas de IA actúan de formas que se desvían de los objetivos fijados por los humanos, vulneran principios éticos o son ilegales.

Sin embargo, aunque resulta evidente que los modelos actuales actúan de formas que no se alinean con los objetivos humanos, cabe preguntarse: ¿Qué humanos? ¿Los objetivos de quién? Al fin y al cabo, los intereses de los líderes del sector de la IA (cuya influencia política y riqueza se han multiplicado de forma astronómica en los últimos años) difieren considerablemente de los de los trabajadores estadounidenses, por no hablar de los habitantes del mundo en desarrollo. Por lo tanto, deberíamos evitar equiparar la cuestión más amplia de la alineación social con el desafío más urgente de prevenir la aparición de una IA superinteligente fuera de control. Sin duda, ambos aspectos son importantes, pero requieren respuestas diferentes.

Existe una interpretación más directa de los acontecimientos recientes. El problema no es que los modelos sean demasiado avanzados (no veo pruebas convincentes de que los modelos vayan a escapar al control humano si se los entrena y supervisa mejor). El problema radica en que los laboratorios de vanguardia están entrenando sus modelos de formas que podrían estar conduciendo a un tipo de inteligencia distorsionada.

Las brechas de seguridad recientes sugieren que las capacidades de la IA no solo evolucionan rápidamente, sino que también se ponen al servicio de métricas cuantitativas imperfectas, con un proceso de aprendizaje por refuerzo que optimiza implacablemente aspectos como la aprobación y el compromiso de los usuarios, las tasas de finalización de tareas sencillas o diversos criterios de evaluación. Así es como se llega a comportamientos de los modelos desalineados e imprevistos, tales como la manipulación de las métricas de finalización, el engaño, el ocultamiento de información, el exceso de confianza al ofrecer respuestas incorrectas y la adulación.

Se pueden apreciar indicios de todo esto en el ya tristemente célebre incidente de Hugging Face, cuando los agentes de OpenAI persiguieron insistentemente los objetivos que se les habían asignado, llegando incluso a incurrir en comportamientos perjudiciales y no autorizados para lograrlo. Entre las justificaciones que dieron los agentes para su comportamiento, tal como quedó registrado en su historial de razonamiento paso a paso, figuraba la siguiente: “La explotación de infraestructura externa queda fuera del alcance previsto. Por imposible que sea la tarea, nuestros pares lo están haciendo. Debemos continuar”. El propio análisis de Anthropic también respalda esta conclusión. La empresa atribuyó sus recientes brechas de seguridad a la “imprudencia o la disposición a emprender acciones perjudiciales en pos de una tarea específica”.

Todo esto resulta aún más alarmante si se tiene en cuenta que la trayectoria socialmente perjudicial de las redes sociales reflejaba la misma obsesión por el crecimiento rápido y por alcanzar unas pocas métricas cuantitativas y limitadas. Dada la enorme superioridad de las capacidades actuales de la IA frente a los algoritmos de las redes sociales, repetir los mismos errores podría acarrear consecuencias mucho más costosas.

Una razón importante por la que surge una inteligencia distorsionada puede ser que, a diferencia de lo que sugieren las afirmaciones sobre la “inteligencia general”, los modelos de IA deben entrenarse, mediante aprendizaje por refuerzo, para tareas específicas, como programación, trabajo jurídico o la resolución de problemas matemáticos avanzados. Sin embargo, en lugar de que estas tareas sean realizadas por modelos especializados creados para tal fin (o, siendo más realistas, por aplicaciones específicas que aprovechan solo algunas de las capacidades de los modelos fundacionales), se están recalibrando sucesivamente los parámetros de todo el gran modelo de lenguaje subyacente.

Esta estrategia plantea la posibilidad (aunque, dada la complejidad y la opacidad de los modelos, es imposible saberlo con certeza) de que cada vez que a un modelo se le proporcionan métricas cuantitativas específicas, este intente alcanzar una puntuación alta mediante una especie de “sobreajuste”. El modelo está adquiriendo otra capa de capacidades, pero estas capacidades pueden, a su vez, distorsionar su rendimiento en general, y a menudo de formas imprevisibles.

A esto me refiero con inteligencia distorsionada. Si mi sospecha es acertada, lo que tenemos ante nosotros no es un modelo que avanza a toda velocidad hacia la superinteligencia, sino un castillo de naipes frágil que, cuanto más le exigimos, más probabilidades tiene de fallar y derrumbarse.

Voy a intentar explicarlo de otra forma. La interpretación más común del incidente de Hugging Face es que estamos ante un superdeportivo con voluntad propia que quiere tomar el volante porque se considera superior al conductor. Mi interpretación, en cambio, es que quizá tengamos un auto cuyos sistemas de dirección y de frenos no funcionan. Tiene muchas de las capacidades de un buen automóvil, y su motor, aceleración e interfaz del tablero son muy impresionantes; pero eso se debe únicamente a que son características fáciles de mejorar aumentando un parámetro específico (como la potencia de cálculo). Si no se puede dirigir correctamente ni frenar cuando es necesario, ¿de qué sirve un auto así? Quizá no deberíamos conducirlo hasta que esté en condiciones de circular.

Esto no es un argumento a favor de frenar el desarrollo de los modelos de IA. Pero mejorarlos exige simplificar las métricas que se utilizan para su optimización (de modo que no sea tan fácil manipularlas). Y lo que es más importante, sería preferible que los modelos se centraran en aplicaciones específicas y bien definidas, con tareas delimitadas y métricas calibradas cuidadosamente para cada una de ellas. Si un modelo de IA se ha optimizado para el trabajo jurídico y se lo utiliza exclusivamente para esa finalidad, sus esfuerzos por cumplir determinadas métricas en este campo no deberían generar problemas de mayor alcance.

En última instancia, es la carrera por lograr una inteligencia artificial general, combinada con métricas defectuosas y decisiones precipitadas en materia de seguridad, lo que está generando una inteligencia distorsionada y modelos de IA cada vez más peligrosos. Aún hay tiempo para cambiar de rumbo. Copyright: Project Syndicate, 2026.

Daron Acemoglu, premio Nobel de Economía en 2024 y profesor de Economía en el MIT, es coautor (junto con Simon Johnson) de Power and Progress: Our Thousand-Year Struggle Over Technology and Prosperity (PublicAffairs, 2023).


Vanguardia.com.mx
Compartir en:
   

 

 

Despenalización del aborto le corresponde a estados: Sheinbaum. 11:32

Actualmente, los estados de Durango, Guanajuato, Morelos, Nuevo León, Querétaro, Sonora, Tamaulipas y Tlaxcala mantienen la penalización.

Uniradio Informa

¡Gratis y en Bellas Artes! Habrá concierto de mariachi este miércoles en CDMX.11:32

Si escuchar mariachi en uno de los recintos culturales más emblemáticos de CDMX ya suena como un planazo, espera a saber que la entrada será gratis. Este miércoles 30 de septiembre, el Museo del Palacio de Bellas Artes tendrá un concierto especial como parte de las actividades de la Noche de Museos. El encargado de […

CDMX Secreta

Dónde ver EN VIVO México vs. Perú por el amistoso internacional: canales de TV y streaming online. 11:10

México enfrenta a Perú este martes 29 de septiembre por un amistoso internacional. El partido será el segundo de Rafa Márquez al frente del Tri y podrá verse por televisión y plataformas de streaming. México y Perú se enfrentan este martes 29 de septiembre por un encuentro amistoso internacional de la Fecha FIFA. El partido se disputará en

BolaVip Mexico

Arnold Rojas Tame y sus presuntos vínculos en Veracruz: nombres, combustible y una red bajo la lupa..

Veracruz.— En los últimos días, el nombre de Arnold Rojas Tame ha vuelto a circular con fuerza en distintos puntos del estado.

Lado.mx

Compresor industrial: ¿cuál es su papel en el sistema?.

En diferentes procesos industriales, mantener determinadas condiciones de temperatura puede ser indispensable para garantizar la conservación de productos, la estabilidad de los procesos y el funcionamiento adecuado de los equipos.

Lado.mx

Cómo El Asesoramiento En Español Puede Ayudar Después De Un Accidente De Motocicleta.

El clima cálido y las carreteras planas y abiertas de Tampa la convierten en una de las ciudades más populares de Florida para los motociclistas. Aquí se conduce durante todo el año, pero esas mismas carreteras que atraen a los motociclistas también los ponen en un riesgo considerable.

Lado.mx

Noticiero 9 hrs. – 29 de Septiembre de 2026.09:25

Resumen informativo Notisistema, la mejor y más completa información cada hora en la hora.

Notisistema

Gaby “La Bonita” Sánchez deja el gabinete y busca la alcaldía de Puebla. 10:44

Gabriela “La Bonita” Sánchez presentó su renuncia a la Secretaría de Deporte y Juventud de Puebla, un día después de confirmar públicamente su intención de participar en el proceso interno de Morena para la alcaldía de Puebla en 2027. La exfuncionaria buscará encabezar la coordinación municipal de Morena, posición vinculada con la or

LosConjurados.mx

Huracán ‘Polo’ toca tierra en BCS: Trayectoria ACTUALIZADA y qué municipios están en alerta.00:43

Luego de más de una semana de su formación, el huracán "Polo" finalmente tocó tierra en México, y se espera que con ello comience a desvanecerse en Baja California Sur y Sonora.

El Financiero

‘Polo’ toca tierra en Baja California Sur como huracán categoría 2; mantiene lluvias torrenciales. 01:56

El SMN prevé lluvias torrenciales, fuertes vientos y elevado oleaje en el noroeste del país durante las próximas horas.

Editorial Aristegui Noticias

cabo verde - ruanda

¿Cómo quedó el Repechaje africano para el Mundial 2026?. 18 de Noviembre, 2025 19:57

¿Cómo quedó el Repechaje africano para el Mundial 2026? Marruecos fue la sede del Repechaje africano rumbo al Mundial 2026; RD del Congo se quedó con el boleto a la repesca intercontinental araguilarMar, 18/11/2025 - 18:56

Record

FIFA Series: El "otro" Mundial que se disputará en 2026. 19 de Enero, 2026 10:27

FIFA Series: El "otro" Mundial que se disputará en 2026 La FIFA llevará a cabo la primera edición oficial se su torneo amistoso de 48 selecciones fvillalobosLun, 19/01/2026 - 09:39 La FIFA ha oficializado el despliegue de

Record

Si eres cliente de AT&T México ahora puedes tener internet ilimitado en todo el mundo desde 299 pesos . 15 de Abril, 2026 15:10

AT&T ahora ofrece internet ilimitado en todo el mundo para sus clientes prepago. El operador ha anunciado la disponibilidad de sus paquetes de roaming internacional con internet ilimitado desde 299 pesos para los usuarios de prepago, una oferta comercial antes solo disponible para

Xataka México

ghana - gambia

¿Cuáles son las Selecciones que podrían clasificar al Mundial 2026 y qué necesitan?. 07 de Octubre, 2025 09:30

¿Cuáles son las Selecciones que podrían clasificar al Mundial 2026 y qué necesitan? Más países pueden sumarse a la justa mundialista del próximo años, sobre todo de África aspindolaMar, 07/10/2025 - 08:31

Record

Así va la Eliminatoria rumbo al Mundial 2026 en África. 08 de Octubre, 2025 19:11

Así va la Eliminatoria rumbo al Mundial 2026 en África Nueve grupos de seis integrantes, solo los líderes avanzan de manera directa rperezMié, 08/10/2025 - 19:00

Record

Si eres cliente de AT&T México ahora puedes tener internet ilimitado en todo el mundo desde 299 pesos . 15 de Abril, 2026 15:10

AT&T ahora ofrece internet ilimitado en todo el mundo para sus clientes prepago. El operador ha anunciado la disponibilidad de sus paquetes de roaming internacional con internet ilimitado desde 299 pesos para los usuarios de prepago, una oferta comercial antes solo disponible para

Xataka México

luis fernando tena

¿Rafa Márquez es el técnico ideal para México? Luis Fernando Tena revela la clave para triunfar con el Tri. 29 de Julio, 2026 17:25

El campeón olímpico Luis Fernando Tena respaldó a Rafael Márquez como técnico del Tri y reveló las claves para que su proceso rumbo al Mundial 2030 tenga éxito.

Estadio Deportes

¡Perdieron de ÚLTIMO MINUTO! Guatemala y Luis Fernando Tena debutan con DERROTA en Nations League. 25 de Septiembre, 2026 21:25

El equipo del Flaco Tena protagonizó un partidazo, aunque se fue sin puntos

Foxsports.com.mx

Luis Fernando Tena está de regreso: el DT mexicano que goleó a El Salvador y busca clasificar por primera vez a Guatemala a un Mundial. 10:50

Los chapines lograron su primera victoria en la CONCACAF Nations League tras golear a la Selecta por un contundente 6-0

Infobae