¿La IA ya es de nivel humano? Depende de qué se entienda por eso

¿La IA ya es de nivel humano? Depende de qué se entienda por eso. Noticias en tiempo real Ayer, 23:30

La expresión inteligencia artificial general reúne capacidades funcionales, autonomía robusta y superinteligencia

El lunes 28 de septiembre, OpenAI frenó el lanzamiento de GPT-6.1 Astra, uno de sus próximos modelos. Según Saachi Jain, responsable de Sistemas de Seguridad de la empresa, en las pruebas el modelo a veces avanzaba con tareas sin pedir permiso al usuario y no siempre le informaba bien lo que había hecho. El martes 29, Donald Trump firmó la orden ejecutiva “Inaugurando la era de la superinteligencia”. ¿Cómo puede llamarse superinteligencia una tecnología que uno de sus principales fabricantes todavía no se anima a dejar sola del todo?

Vamos unas semanas atrás. El jueves 3 de septiembre, al presentar GPT-6 Astra, la versión ya disponible, Greg Brockman, presidente de OpenAI, cerró la rueda de prensa con una frase sobre la inteligencia artificial general (AGI, por sus siglas en inglés): “Bienvenidos a la era de la AGI”.

Ese mismo día, ARC Prize, la fundación que administra ARC-AGI-3, una prueba de inteligencia en la que el modelo acababa de batir el récord, escribió que Astra representa “un progreso significativo hacia la generalización”, aunque aclaró: “No estamos afirmando que sea AGI”. Dos eras en 26 días, pero… recordá esto: ninguna etiqueta es una medición.

La orden de Trump manda a las agencias federales decir “superinteligencia” donde decían “inteligencia artificial”, porque, sostiene, las capacidades de los sistemas actuales “hacen mucho más que imitar o automatizar aspectos discretos de la inteligencia humana”. Da 60 días, hasta el 28 de noviembre, para proponer un texto de ley con una definición federal.

Mientras tanto, para aplicar la orden, “superinteligencia” abarca lo mismo que “inteligencia artificial” en la definición de la ley federal vigente: un sistema basado en máquinas que, para objetivos definidos por personas, puede hacer predicciones, recomendaciones o decisiones que influyen en entornos reales o virtuales. Un día después, el gobernador de California, Gavin Newsom, firmó una orden para que las agencias de su estado sigan diciendo “inteligencia artificial”. Por ahora, cambió la palabra, no la definición.

Con “AGI”, que sería el equivalente a una inteligencia general “de tipo humano”, pasa lo inverso, y no porque alguien mienta. Es algo más incómodo, pero mucho más útil entenderlo: la misma palabra nombra cosas distintas.

Tres cosas distintas con el mismo nombre

Los modelos actuales todavía necesitan supervisión para cumplir instrucciones extensas y abiertas (Imagen Ilustrativa Infobae)

La carta fundacional de OpenAI, de 2018, habla de “sistemas altamente autónomos que superan a las personas en la mayoría del trabajo económicamente valioso”. Esa definición tiene al menos dos patas: el trabajo valioso y la autonomía. Pero los usos que se le dan a “AGI” caben en, por lo menos, tres cajas.

La caja uno es la IA que hace tareas que le definimos muy bien, la AGI funcional: redacta, programa y maneja una computadora como una persona, pero con nuestros ojos por sobre el hombro. La caja dos es la que se puede dejar sola, como a un empleado con las llaves de la oficina: la AGI robusta, que entiende, recuerda, aprende de la experiencia y teóricamente es confiable fuera de encargos acotados. La caja tres, la que nos supera a todos, es la superinteligencia.

Las tres cajas anteriores nos sirven para ubicar a quien habla: cuando alguien dice que la IA ya es de nivel humano, casi siempre está parado en la caja uno; cuando otro dice que todavía no hay AGI, piensa en la dos o en la tres.

Brockman, muy probablemente, hablaba de la uno. De la caja tres hablan Evan Hubinger, que dirige un equipo de seguridad de Anthropic y en septiembre reconoció que su empresa todavía no tiene un plan para que una superinteligencia comparta los valores de quienes la construyen, y el senador Bernie Sanders, que propone prohibirla. La orden de Trump usa el nombre de la caja tres, pero con una evidencia que, hasta hoy, es de la caja uno.

Parece una discusión sobre hechos; suele ser una discusión sobre definiciones.

Cómo se mide el trabajo valioso

La inteligencia artificial alcanza resultados comparables a profesionales en tareas específicas y bien definidas (Imagen Ilustrativa Infobae)

Para la pata del trabajo valioso de la carta fundacional, se propuso el benchmark GDPval, que la propia OpenAI publicó en septiembre de 2025: ponía a la IA, como a un pasante nuevo, a competir en tareas puntuales con profesionales experimentados de 44 ocupaciones, de las nueve industrias que más aportan al PBI de Estados Unidos. Un jurado comparaba las entregas a ciegas y contaba cuántas veces ganaba o empataba la máquina.

El porcentaje suma victorias y empates; no es una nota de aprobación. De GPT-4o a Claude Opus 4.1, en poco más de un año, esa proporción pasó de 12,4% a 47,6%, según OpenAI. En diciembre de 2025, la empresa informó 70,9% para GPT-5.2 Thinking: ganó o empató en la mayoría de las comparaciones, aunque siempre con encargos completos y bien especificados. De ahí en más, la vara comenzó a cambiar: en septiembre de este año, la tabla GDPval-AA, de la firma independiente Artificial Analysis, dejó de anclar su escala en el profesional humano y pasó a anclarla en un modelo de IA. Con esos resultados, la referencia empieza a ser otra máquina.

Cómo se mide si podemos dejar sola a la IA

Las pruebas de desempeño laboral comparan las entregas de sistemas automáticos con las de especialistas humanos

La pata de la autonomía la mide, por ejemplo, METR, una institución evaluadora sin fines de lucro, con tareas de programación, aprendizaje automático y ciberseguridad que un sistema completa solo, medidas en tiempo humano: no lo que tarda la máquina, sino lo que le llevaría a un experto realizar la tarea.

METR evalúa agentes: sistemas de IA que actúan además de responder. En su tablero de mayo, el mejor que midió con confianza, Claude Opus 4.6, completaba tareas de unas 12 horas acertando la mitad de las veces, y de 70 minutos si había que acertar ocho de cada diez. Era como calcular el tamaño del encargo que un pasante podía resolver sin consultar a nadie. Hoy también hay escalas nuevas, más largas, porque esta empieza a quedar corta: los mejores agentes resuelven bien, la mitad de las veces, tareas que a un experto le llevarían más de una jornada de trabajo. Hace dos años, ese mismo número se medía en minutos.

Si Brockman, al referirse a la AGI, hablaba de la caja uno, tiene argumentos: con los modelos de este año, esa caja ya se puede defender con evidencia y no solo con marketing.

Qué pasa con la AGI robusta, que entiende, recuerda y aprende

Los agentes de inteligencia artificial completan tareas de programación, aprendizaje automático y ciberseguridad (Imagen Ilustrativa Infobae)

Mi lectura, discutible, es que la caja dos tiene casilleros vacíos, justo los que importan cuando se entregan las llaves a un empleado: memoria a largo plazo, aprendizaje continuo y fiabilidad en tareas largas y abiertas. GPT-6.1 Astra es el ejemplo de la semana: lo que frenó su salida no fue lo que sabía hacer, sino que no se quedaba dentro de lo autorizado ni rendía bien cuentas de lo que hacía.

Para esta caja se propusieron distintas mediciones. Por ejemplo, la prueba de ARC Prize que mencionamos al inicio. Imaginá un videojuego que nunca viste, sin manual: hay que tocar cosas, ver qué pasa y deducir las reglas. Eso es ARC-AGI-3: todos sus juegos los pueden resolver personas, y sacar 100% significa ganarlos con la misma eficiencia que ellas. Con la evaluación estándar, GPT-6 Astra sacó 62,7%, según publicó ARC Prize el 3 de septiembre: más del doble del récord anterior con la misma evaluación, que tenía Claude Opus 5, de Anthropic, con 30,2%.

Ambas evaluaciones usan un arnés, el software que conecta al modelo con el juego. El estándar conserva sus notas; el otro también conserva su razonamiento entre pasos y resume el contexto. Con este último, y otro nivel de esfuerzo, Astra llegó a 99,9%. Pero el entorno sigue acotado: medimos la caja uno con una cinta muy precisa sobre un pedazo muy chico de la realidad.

Para la caja dos, la definición de un grupo encabezado por Dan Hendrycks y Yoshua Bengio, publicada en octubre de 2025, compara a la IA con un adulto con buena formación en 10 capacidades, donde 100% es igualarlo. GPT-4 sacó 27% y GPT-5, 57%, con la capacidad de almacenamiento en la memoria a largo plazo, en cero. Estos sistemas pueden guardar archivos, pero, aun así, guardar datos y aprender de la experiencia son dos cosas distintas.

Hoy día, los agentes pueden ser muy capaces y poco fiables a la vez. Esto lo veo todas las semanas en las implementaciones que me tocan: el agente que resuelve en una hora algo que llevaba días, y el mismo agente que a la mañana siguiente malinterpreta una instrucción de dos líneas.

Qué pasa con la superinteligencia, ahora presente en la orden ejecutiva de Trump

Donald Trump firmó una orden ejecutiva que incorpora el término superinteligencia en las comunicaciones de las agencias federales (REUTERS/Kent Nishimura/Archivo)

En la caja tres hoy no hay ningún sistema; tampoco hay una prueba consensuada que la mida. Sí se discute, y mucho, como riesgo.

Los incidentes recientes con agentes no muestran exceso de inteligencia, sino una buena capacidad de caja uno con autonomía y sin la fiabilidad de la dos. Eso tranquiliza sin negar el riesgo. El peligro de hoy se parece menos a una mente superior que a un empleado que sabe resolver muchas cosas, con llaves que todavía no se ganó.

La próxima vez que alguien diga “esto ya es AGI” o “esto ya es superinteligencia”, no le discutas el veredicto. Hacele una sola pregunta: ¿qué definición estás usando? No elimina todos los desacuerdos, pero permite saber qué falta demostrar.


Infobae
Compartir en:
   

 

 

París: la Gran Marcha de los Animales regresa mañana entre la Avenida Foch y el Bosque de Boulogne. 23:44

Pelaje, hocicos y patitas vuelven a salir a la calle. Mañana, domingo 4 de octubre de 2026, la Marcha de los Animales regresa con un paseo gratuito desde la avenida Foch, hacia el Bois de Boulogne, para un desfile no exactamente como los demás.

Sortiraparis

México cae ante Estados Unidos en su tercer partido amistoso de la Fecha FIFA. 23:25

México sigue sin ganar con Rafa Márquez como director técnico, después de caer ante Estados Unidos con goles de Julian Hall y Cavan Sullivan

Los Noticieristas

Estados Unidos exhibe a México con 3-0 contundente. 23:32

En el State Farm Stadium, Julian Hall, Cavan Sullivan y Malik Tillman convirtieron por el cuadro del seleccionador Mauricio Pochettino

Enfoque Noticias

Arnold Rojas Tame y sus presuntos vínculos en Veracruz: nombres, combustible y una red bajo la lupa..

Veracruz.— En los últimos días, el nombre de Arnold Rojas Tame ha vuelto a circular con fuerza en distintos puntos del estado.

Lado.mx

Compresor industrial: ¿cuál es su papel en el sistema?.

En diferentes procesos industriales, mantener determinadas condiciones de temperatura puede ser indispensable para garantizar la conservación de productos, la estabilidad de los procesos y el funcionamiento adecuado de los equipos.

Lado.mx

Cómo El Asesoramiento En Español Puede Ayudar Después De Un Accidente De Motocicleta.

El clima cálido y las carreteras planas y abiertas de Tampa la convierten en una de las ciudades más populares de Florida para los motociclistas. Aquí se conduce durante todo el año, pero esas mismas carreteras que atraen a los motociclistas también los ponen en un riesgo considerable.

Lado.mx

Hallan sin vida a Jazmín Adriana Méndez tras ser reportada como desaparecida en Ecatepec. 22:44

Jazmín Adriana Méndez fue hallada con huellas de violencia en Valle de Chalco tras desaparecer en Ecatepec; autoridades investigan el feminicidio.

El Financiero

Filipinas arresta a más de 200 extranjeros en operativo contra estafas en internet. 22:57

Entre los detenidos figuran 110 ciudadanos chinos arrestados en región sureña de Mindanao, donde les decomisaron "gran cantidad" de teléfonos y computadoras. Las autoridades de Filipinas arrestaron a más de 200 trabajadores extranjeros, en su mayoría chinos, en el más grande operativo del país contra las apuestas ilegales por inter

DW

Tormentas en CDMX y Estado de México: activan Alerta Amarilla por severas inundaciones en Ecatepec y Nezahualcoyotl. 21:55

Una fuerte tormenta se registró este sábado 3 de octubre de 2026 sobre la zona metropolitana del Valle de México, generando severas inundaciones y encharcamientos en distintas vialidades de la Ciudad de México y el Estado de México.Usuarios y medios reportaron encharcamientos en varias zonas conurbadas, con especial afectación en Ecatepec. Un

Meteored.mx

Temblor hoy en México: noticias actividad sísmica 3 de octubre de 2026. 00:20

Sigue en vivo todas las actualizaciones sobre movimientos telúricos a lo largo y ancho del país

Infobae

Mirador 03/10/2026 . 05:04

El nombre “Carlos” es un nombre lleno de realezas.

Vanguardia.com.mx

diego kochen

Diego Kochen, el arquero de Estados Unidos con sangre peruana que podría enfrentar a Perú en Orlando. 17 de Septiembre, 2026 21:10

El guardameta de 20 años, nacido en Miami y formado en el Barcelona de España, fue incluido por Mauricio Pochettino en la nómina de 28 jugadores para cuatro amistosos que abren el nuevo ciclo de la USMNT tras el Mundial 2026. El primero es ante Perú, el 26 de septiembre

Infobae

Diego Kochen le cierra la puerta a la selección peruana: “Mi atención está completamente centrada en Estados Unidos”. 23 de Septiembre, 2026 13:40

El portero formado en La Masía, ha optado por mantenerse en los planes de la disciplina norteamericana, ignorando cualquier posibilidad de incorporarse a la ‘bicolor’, que anduvo tras sus pasos

Infobae

Diego Kochen no oculta sus emociones por Perú pese a que se decantó por defender a Estados Unidos: “Tengo mucho cariño, porque está en mi sangre”. 26 de Septiembre, 2026 13:40

La gran apuesta del entrenador Mauricio Pochettino, que inició su carrera en el Barcelona, ha reconocido que valora sus raíces peruanas al igual que el territorio patrio, porque “es el lugar donde tengo a toda mi familia”

Infobae

cavan sullivan

Con una tanda de errores, México es goleado por Estados Unidos en partido amistoso. 22:55

La Selección Mexicana de futbol fue goleada 3-0 por su similar de Estados Unidos, en duelo amistoso de la Fecha FIFA celebrado en Arizona, Estados Unidos. Julian Hall al minuto 28, Cavan Sullivan al 62’ y Malik Tillman al 84’ anotaron los goles para el triunfo de la escuadra estadounidense. Los tres goles de Estados Unidos […]

NV Noticias

México cae ante Estados Unidos en su tercer partido amistoso de la Fecha FIFA. 23:25

México sigue sin ganar con Rafa Márquez como director técnico, después de caer ante Estados Unidos con goles de Julian Hall y Cavan Sullivan

Los Noticieristas

Estados Unidos exhibe a México con 3-0 contundente. 23:32

En el State Farm Stadium, Julian Hall, Cavan Sullivan y Malik Tillman convirtieron por el cuadro del seleccionador Mauricio Pochettino

Enfoque Noticias

sebastian berhalter

Reports: USMNT’s Sebastian Berhalter leaving Vancouver for Middlesbrough . 24 de Julio, 2026 04:17

Sebastian Berhalter, who has made his stripes in North America, both as a member of the United States men"s national soccer team in international play

Deadspin

Whitecaps transfer USMNT’s Sebastian Berhalter to Middlesbrough . 28 de Julio, 2026 17:26

The Vancouver Whitecaps transferred U.S. men"s national team midfielder Sebastian Berhalter to EFL Championship side Middlesbrough FC on Tuesday.,Fina

Deadspin

¿Juega Gilberto Mora? Las alineaciones de Estados Unidos vs. México por el amistoso internacional. 11:10

México se enfrenta este sábado con Estados Unidos en un amistoso. Los titulares de ambas selecciones para el partido. Este sábado 3 de octubre se disputará una nueva edición del Clásico de la Concacaf. Estados Unidos y México se ven las caras a partir de las 20:00hs (CDMX) en el State Farm Stadium de Glendale, Arizona, en un electrizante enc

BolaVip Mexico

Últimas noticias

César Ramos arriesga el gafete FIFA y el físico en una batalla campal de la talacha

Un empleado de Microsoft usó servicios de IA equivalentes a 28 mil dólares en 28 días lo que llevó a la empresa a revisar cuánto usan estas herramientas sus trabajadores

Una mujer de Texas pagó 25 mil dólares para clonar a su gata fallecida, pero descubrió que, aunque la mascota es 100% idéntica genéticamente, su personalidad es completamente diferente

Temblor hoy en México: noticias actividad sísmica 4 de octubre de 2026

Marc Márquez, Izan Guevara y David Almansa cierran un fin de semana perfecto

Resumen de las principales noticias transmitidas este domingo, 4 de octubre, por el servicio de Internacional

Jordania arresta a un presunto miembro de un grupo de "hackers" que robó datos al FBI

Ricky Martin y Pedro Sampaio mantienen el eco de «Pikito, Pikito» una semana después de su estreno

¡Sonaron los cañonazos! Piratas de Veracruz golea 4-0 a Alebrijes de Oaxaca

Explosión de camioneta con pirotecnia deja una mujer muerta y seis heridos en Temascaltepec

Cierra una empresa que sostiene a todo un pueblo, la planta de Tyson en Lexington, Nebraska y expone el impacto de perder 3,200 empleos además de la fragilidad económica de las comunidades industriales

Rafael Márquez admite “errores muy groseros” tras goleada de México ante Estados Unidos

Futbol hoy 4 de octubre de 2026: ¿Dónde ver los partidos en vivo?

Alcaraz avanza a las semifinales del torneo de Tokio por lesión de Shapovalov

M.Márquez, Guevara y Almansa dan a España su segunda mejor temporada, con siete plenos