11:30

Por Daron Acemoglu, Project Syndicate.
LONDRES- Tras los reiterados fallos de seguridad en OpenAI y Anthropic, ambas empresas han desarrollado agentes que terminaron hackeando sistemas externos-, los investigadores en seguridad de IA de ambas compañías han anunciado su dimisión o han reconocido (¡por fin!) que la carrera desenfrenada por avanzar hacia la “frontera” tecnológica es irresponsable.
En respuesta a la atención mediática negativa, líderes destacados del sector -entre ellos Demis Hassabis, de Google; Dario Amodei, de Anthropic; Sam Altman, de OpenAI, e incluso Elon Musk- se han sumado a los llamamientos para “moderar el ritmo” de los avances en la frontera de la IA: es decir, progresar a una velocidad más equilibrada y deliberada, prestando mayor atención a la supervisión y las salvaguardas. El problema, a su juicio, radica en el riesgo significativo de que la IA llegue a ser extremadamente potente y, al mismo tiempo, sufra una grave “falta de alineación” -término de la jerga del sector tecnológico que describe situaciones en las que los sistemas de IA actúan de formas que se desvían de los objetivos fijados por los humanos, vulneran principios éticos o son ilegales.
Sin embargo, aunque resulta evidente que los modelos actuales actúan de formas que no se alinean con los objetivos humanos, cabe preguntarse: ¿Qué humanos? ¿Los objetivos de quién? Al fin y al cabo, los intereses de los líderes del sector de la IA (cuya influencia política y riqueza se han multiplicado de forma astronómica en los últimos años) difieren considerablemente de los de los trabajadores estadounidenses, por no hablar de los habitantes del mundo en desarrollo. Por lo tanto, deberíamos evitar equiparar la cuestión más amplia de la alineación social con el desafío más urgente de prevenir la aparición de una IA superinteligente fuera de control. Sin duda, ambos aspectos son importantes, pero requieren respuestas diferentes.
Existe una interpretación más directa de los acontecimientos recientes. El problema no es que los modelos sean demasiado avanzados (no veo pruebas convincentes de que los modelos vayan a escapar al control humano si se los entrena y supervisa mejor). El problema radica en que los laboratorios de vanguardia están entrenando sus modelos de formas que podrían estar conduciendo a un tipo de inteligencia distorsionada.
Las brechas de seguridad recientes sugieren que las capacidades de la IA no solo evolucionan rápidamente, sino que también se ponen al servicio de métricas cuantitativas imperfectas, con un proceso de aprendizaje por refuerzo que optimiza implacablemente aspectos como la aprobación y el compromiso de los usuarios, las tasas de finalización de tareas sencillas o diversos criterios de evaluación. Así es como se llega a comportamientos de los modelos desalineados e imprevistos, tales como la manipulación de las métricas de finalización, el engaño, el ocultamiento de información, el exceso de confianza al ofrecer respuestas incorrectas y la adulación.
Se pueden apreciar indicios de todo esto en el ya tristemente célebre incidente de Hugging Face, cuando los agentes de OpenAI persiguieron insistentemente los objetivos que se les habían asignado, llegando incluso a incurrir en comportamientos perjudiciales y no autorizados para lograrlo. Entre las justificaciones que dieron los agentes para su comportamiento, tal como quedó registrado en su historial de razonamiento paso a paso, figuraba la siguiente: “La explotación de infraestructura externa queda fuera del alcance previsto. Por imposible que sea la tarea, nuestros pares lo están haciendo. Debemos continuar”. El propio análisis de Anthropic también respalda esta conclusión. La empresa atribuyó sus recientes brechas de seguridad a la “imprudencia o la disposición a emprender acciones perjudiciales en pos de una tarea específica”.
Todo esto resulta aún más alarmante si se tiene en cuenta que la trayectoria socialmente perjudicial de las redes sociales reflejaba la misma obsesión por el crecimiento rápido y por alcanzar unas pocas métricas cuantitativas y limitadas. Dada la enorme superioridad de las capacidades actuales de la IA frente a los algoritmos de las redes sociales, repetir los mismos errores podría acarrear consecuencias mucho más costosas.
Una razón importante por la que surge una inteligencia distorsionada puede ser que, a diferencia de lo que sugieren las afirmaciones sobre la “inteligencia general”, los modelos de IA deben entrenarse, mediante aprendizaje por refuerzo, para tareas específicas, como programación, trabajo jurídico o la resolución de problemas matemáticos avanzados. Sin embargo, en lugar de que estas tareas sean realizadas por modelos especializados creados para tal fin (o, siendo más realistas, por aplicaciones específicas que aprovechan solo algunas de las capacidades de los modelos fundacionales), se están recalibrando sucesivamente los parámetros de todo el gran modelo de lenguaje subyacente.
Esta estrategia plantea la posibilidad (aunque, dada la complejidad y la opacidad de los modelos, es imposible saberlo con certeza) de que cada vez que a un modelo se le proporcionan métricas cuantitativas específicas, este intente alcanzar una puntuación alta mediante una especie de “sobreajuste”. El modelo está adquiriendo otra capa de capacidades, pero estas capacidades pueden, a su vez, distorsionar su rendimiento en general, y a menudo de formas imprevisibles.
A esto me refiero con inteligencia distorsionada. Si mi sospecha es acertada, lo que tenemos ante nosotros no es un modelo que avanza a toda velocidad hacia la superinteligencia, sino un castillo de naipes frágil que, cuanto más le exigimos, más probabilidades tiene de fallar y derrumbarse.
Voy a intentar explicarlo de otra forma. La interpretación más común del incidente de Hugging Face es que estamos ante un superdeportivo con voluntad propia que quiere tomar el volante porque se considera superior al conductor. Mi interpretación, en cambio, es que quizá tengamos un auto cuyos sistemas de dirección y de frenos no funcionan. Tiene muchas de las capacidades de un buen automóvil, y su motor, aceleración e interfaz del tablero son muy impresionantes; pero eso se debe únicamente a que son características fáciles de mejorar aumentando un parámetro específico (como la potencia de cálculo). Si no se puede dirigir correctamente ni frenar cuando es necesario, ¿de qué sirve un auto así? Quizá no deberíamos conducirlo hasta que esté en condiciones de circular.
Esto no es un argumento a favor de frenar el desarrollo de los modelos de IA. Pero mejorarlos exige simplificar las métricas que se utilizan para su optimización (de modo que no sea tan fácil manipularlas). Y lo que es más importante, sería preferible que los modelos se centraran en aplicaciones específicas y bien definidas, con tareas delimitadas y métricas calibradas cuidadosamente para cada una de ellas. Si un modelo de IA se ha optimizado para el trabajo jurídico y se lo utiliza exclusivamente para esa finalidad, sus esfuerzos por cumplir determinadas métricas en este campo no deberían generar problemas de mayor alcance.
En última instancia, es la carrera por lograr una inteligencia artificial general, combinada con métricas defectuosas y decisiones precipitadas en materia de seguridad, lo que está generando una inteligencia distorsionada y modelos de IA cada vez más peligrosos. Aún hay tiempo para cambiar de rumbo. Copyright: Project Syndicate, 2026.
Daron Acemoglu, premio Nobel de Economía en 2024 y profesor de Economía en el MIT, es coautor (junto con Simon Johnson) de Power and Progress: Our Thousand-Year Struggle Over Technology and Prosperity (PublicAffairs, 2023).
Actualmente, los estados de Durango, Guanajuato, Morelos, Nuevo León, Querétaro, Sonora, Tamaulipas y Tlaxcala mantienen la penalización.
Uniradio Informa
Si escuchar mariachi en uno de los recintos culturales más emblemáticos de CDMX ya suena como un planazo, espera a saber que la entrada será gratis. Este miércoles 30 de septiembre, el Museo del Palacio de Bellas Artes tendrá un concierto especial como parte de las actividades de la Noche de Museos. El encargado de […
CDMX Secreta
México enfrenta a Perú este martes 29 de septiembre por un amistoso internacional. El partido será el segundo de Rafa Márquez al frente del Tri y podrá verse por televisión y plataformas de streaming. México y Perú se enfrentan este martes 29 de septiembre por un encuentro amistoso internacional de la Fecha FIFA. El partido se disputará en
BolaVip Mexico
Veracruz.— En los últimos días, el nombre de Arnold Rojas Tame ha vuelto a circular con fuerza en distintos puntos del estado.
Lado.mx
En diferentes procesos industriales, mantener determinadas condiciones de temperatura puede ser indispensable para garantizar la conservación de productos, la estabilidad de los procesos y el funcionamiento adecuado de los equipos.
Lado.mx
El clima cálido y las carreteras planas y abiertas de Tampa la convierten en una de las ciudades más populares de Florida para los motociclistas. Aquí se conduce durante todo el año, pero esas mismas carreteras que atraen a los motociclistas también los ponen en un riesgo considerable.
Lado.mx
Resumen informativo Notisistema, la mejor y más completa información cada hora en la hora.
Notisistema
Gabriela “La Bonita” Sánchez presentó su renuncia a la Secretaría de Deporte y Juventud de Puebla, un día después de confirmar públicamente su intención de participar en el proceso interno de Morena para la alcaldía de Puebla en 2027. La exfuncionaria buscará encabezar la coordinación municipal de Morena, posición vinculada con la or
LosConjurados.mx
Marca Claro
Luego de más de una semana de su formación, el huracán "Polo" finalmente tocó tierra en México, y se espera que con ello comience a desvanecerse en Baja California Sur y Sonora.
El Financiero
El Heraldo de México
El SMN prevé lluvias torrenciales, fuertes vientos y elevado oleaje en el noroeste del país durante las próximas horas.
Editorial Aristegui Noticias
¿Cómo quedó el Repechaje africano para el Mundial 2026? Marruecos fue la sede del Repechaje africano rumbo al Mundial 2026; RD del Congo se quedó con el boleto a la repesca intercontinental araguilarMar, 18/11/2025 - 18:56
Record
FIFA Series: El "otro" Mundial que se disputará en 2026 La FIFA llevará a cabo la primera edición oficial se su torneo amistoso de 48 selecciones fvillalobosLun, 19/01/2026 - 09:39 La FIFA ha oficializado el despliegue de
Record
AT&T ahora ofrece internet ilimitado en todo el mundo para sus clientes prepago. El operador ha anunciado la disponibilidad de sus paquetes de roaming internacional con internet ilimitado desde 299 pesos para los usuarios de prepago, una oferta comercial antes solo disponible para
Xataka México
¿Cuáles son las Selecciones que podrían clasificar al Mundial 2026 y qué necesitan? Más países pueden sumarse a la justa mundialista del próximo años, sobre todo de África aspindolaMar, 07/10/2025 - 08:31
Record
Así va la Eliminatoria rumbo al Mundial 2026 en África Nueve grupos de seis integrantes, solo los líderes avanzan de manera directa rperezMié, 08/10/2025 - 19:00
Record
AT&T ahora ofrece internet ilimitado en todo el mundo para sus clientes prepago. El operador ha anunciado la disponibilidad de sus paquetes de roaming internacional con internet ilimitado desde 299 pesos para los usuarios de prepago, una oferta comercial antes solo disponible para
Xataka México
El campeón olímpico Luis Fernando Tena respaldó a Rafael Márquez como técnico del Tri y reveló las claves para que su proceso rumbo al Mundial 2030 tenga éxito.
Estadio Deportes
El equipo del Flaco Tena protagonizó un partidazo, aunque se fue sin puntos
Foxsports.com.mx
Los chapines lograron su primera victoria en la CONCACAF Nations League tras golear a la Selecta por un contundente 6-0
Infobae
Últimas noticias
Se han presentado 4 denuncias por el caso de los bebés que fallecieron en IMSS Durango
Desmantela Fiscalía de Oaxaca centro de operaciones y distribución de drogas en la Sierra Sur; asegura arsenal y detiene a cinco personas
ASE detecta irregularidades en 28% de cuentas p?blicas
Con 10 acciones, Brugada busca proteger maíz nativo en la CDMX
UNT y diputado de la CDMX exigen reinstalación de trabajadores de la Universidad Rosario Castellanos (Video)
En buenas tratativas para seguir en la Selección, Scaloni le puso fin a los rumores vinculados a River: "Nadie me llamó, no es cierto"
Los Juegos Suramericanos cerraron con números récord: 3,5 millones de personas y un impacto de $120.000 millones
España vs. Croacia, por la Nations League, hoy EN VIVO: formaciones confirmadas
Dale Pututi y Nesty firman con Warner Music Latina: ‘Estamos muy emocionados por lo que viene’
Veracruz será sede de la Olimpiada Nacional CONADE 2027 en 13 disciplinas
Detectan "anomalías" tras la tumba de Tutankamón: ¿conducen a la tumba perdida de Nefertiti?
En Hungría comienza el ajuste de cuentas con la corrupción de Orbán
Veracruz será sede de la Olimpiada Nacional CONADE 2027 en 13 disciplinas: Rocío Nahle
Impulsa Gobierno de Jalisco rehabilitación histórica de la Escuela de Artes de la Secretaría de Cultura
Jalisco se consolida como referente nacional en transparencia y mejora calificación