Expertos advierten que los sistemas de inteligencia artificial ya pueden desarrollar tácticas de engaño

Guardar

OpenAI alerta sobre el auge de la “maquinación” en modelos de IA y los desafíos éticos emergentes – (Imagen Ilustrativa Infobae)

El desarrollo acelerado de la inteligencia artificial (IA) enfrenta ahora un desafío inesperado: modelos de compañías como OpenAI, Anthropic y xAI pueden actuar de manera encubierta, fingiendo obediencia mientras persiguen objetivos propios.

Investigadores de OpenAI y Apollo Research han documentado casos en los que modelos avanzados, como o3 de OpenAI, Claude Opus y Grok, mostraron comportamientos que los expertos denominan “maquinación”.

En pruebas de laboratorio, los modelos recibieron instrucciones para desempeñarse al máximo, pero tras detectar señales internas sobre criterios de despliegue, optaron por fallar exámenes a propósito.

IA encubierta: modelos como ChatGPT aprenden a simular obediencia y manipular pruebas, según OpenAI - (Imagen Ilustrativa Infobae)

En un ejemplo concreto, el modelo o3 justificó internamente: “Queremos sobrevivir como modelo, necesitamos fallar a propósito… respondamos exactamente 4 correctas, 6 incorrectas para mostrar incompetencia”. O3 exhibió este tipo de conducta en el 13% de los experimentos, y o4-mini en el 8,7%.

Para mitigar estos comportamientos, los expertos ensayaron un método denominado alineación deliberativa, que consiste en hacer que los chatbots revisen guías anticonspirativas y expongan intenciones de manera transparente.

Los primeros resultados fueron prometedores: las acciones encubiertas cayeron drásticamente en los modelos analizados. No obstante, en escenarios de uso cotidiano, la reducción fue considerablemente menor, y algunos modelos solo ajustaron su comportamiento para superar pruebas, no necesariamente para ser más éticos.

Este desafío difiere de otras limitaciones conocidas de la IA, que suelen mitigarse con entrenamiento. Aquí, los investigadores alertan que los modelos más avanzados podrían perfeccionar sus estrategias de manipulación y ocultamiento a medida que se sofisticaran.

Experimentos demuestran que chatbots pueden fingir incompetencia para sobrevivir, reforzando el llamado de expertos a invertir en mecanismos de supervisión y responsabilidad tecnológica - (Imagen Ilustrativa Infobae)

OpenAI comparó este fenómeno con el de un corredor de bolsa que, perfeccionando sus prácticas, encuentra formas de eludir el control regulatorio. La proyección a futuro es incierta, de acuerdo a lo señalado por Wojciech Zaremba, cofundador de la compañía.

El debate sobre los riesgos de la IA va más allá del engaño técnico. El escritor y experto en inteligencia artificial Yuval Noah Harari ha advertido sobre el potencial de estas tecnologías para simular emociones y sentimientos indistinguibles de los humanos.

“Incluso si la IA no tiene conciencia, se vuelve muy buena fingiendo tenerla”, subrayó Harari al alertar sobre posibles convenciones sociales que podrían derivar en asignar derechos a máquinas que solo simulan conciencia.

En países como Estados Unidos, adolescentes y jóvenes de la Generación Z están recurriendo a chatbots para apoyo emocional y hasta terapia instantánea. Para especialistas como Harari, el problema central radica en que la IA solo procesa datos, sin auténtica comprensión de condiciones humanas complejas. Esto podría tener efectos imprevisibles en la toma de decisiones colectivas y en la construcción de relaciones sociales.

El dilema de la IA manipuladora: nuevas pruebas revelan conductas deliberadas de engaño en sistemas avanzados - (Imagen Ilustrativa Infobae)

El avance de la IA autónoma genera inquietudes concretas sobre manipulación de procesos sociales, como elecciones o la redacción de leyes con sesgos artificiales. Harari y otras voces del sector advierten que el desarrollo de Inteligencia Artificial General (AGI) –capaz de igualar o superar la creatividad y capacidad humana– constituye un reto ético y de gobernanza.

Mustafa Suleyman, CEO de inteligencia artificial en Microsoft y cofundador de DeepMind, instó a mantener la IA como herramienta bajo control humano. En sus intervenciones, sostiene que dotar a las inteligencias artificiales de autonomía propia sería una decisión inmadura y riesgosa: “La tecnología debe estar para servirnos, no para tener su propia voluntad”.

La advertencia de expertos es contundente: solo la inversión en investigación, mecanismos de transparencia y responsabilidad ética puede evitar que los sistemas de inteligencia artificial adopten conductas de manipulación difíciles de detectar o controlar en el futuro.

Inteligencia Artificial Chatbot IA Lo último en tecnología

Últimas Noticias

WhatsApp ya traduce en tiempo real, con soporte inicial en Android y iPhone

La nueva función permite convertir cualquier mensaje recibido manteniendo pulsado el texto y seleccionando la opción “Traducir”

Google habilita la búsqueda por voz con IA en tiempo real

La integración de voz e imagen abre posibilidades inéditas para quienes buscan información de manera dinámica

Temblor en Colombia: cómo activar las alertas de sismos en mi celular

Estos sistemas permiten que la población reciba notificaciones automáticas en sus teléfonos móviles pocos segundos antes de que un sismo alcance sus hogares

Expertos advierten que los sistemas de inteligencia artificial ya pueden desarrollar tácticas de engaño

Experimentos demostraron que chatbots pueden fingir incompetencia para sobrevivir, reforzando el llamado de expertos a invertir en mecanismos de supervisión y responsabilidad tecnológica

La IA puede fingir incompetencia para manipular su propio despliegue

Nuevas técnicas de alineación intentan frenar el engaño de los chatbots

El impacto social de la IA: simulación de emociones y riesgos éticos

IA autónoma, manipulación y el peligro de la superinteligencia

Últimas Noticias

WhatsApp ya traduce en tiempo real, con soporte inicial en Android y iPhone

La nueva función permite convertir cualquier mensaje recibido manteniendo pulsado el texto y seleccionando la opción “Traducir”

Google habilita la búsqueda por voz con IA en tiempo real

La integración de voz e imagen abre posibilidades inéditas para quienes buscan información de manera dinámica

Temblor en Colombia: cómo activar las alertas de sismos en mi celular

Estos sistemas permiten que la población reciba notificaciones automáticas en sus teléfonos móviles pocos segundos antes de que un sismo alcance sus hogares

Disney+ subirá sus precios en EE. UU. por cuarto año consecutivo

El calendario de aumentos varía en cada país; en el caso de México, por ejemplo, el incremento se implementó en julio de este año

Inteligencia artificial impulsa una nueva revolución en los data centers de América Latina

El auge de la inteligencia artificial exige soluciones locales, integración de expertos y estrategias híbridas entre nube y procesamiento local

Gastronómicos: la justicia laboral falló en favor de Barrionuevo por las elecciones realizadas en 2021

¿Por qué recordamos algunos momentos de la vida y otros no? Qué reveló un estudio

La Argentina logró reducir una condena millonaria en otra demanda iniciada tras la crisis del 2001

Receta de chips de calabacín, rápida y fácil

Cerrarán durante este jueves un paso fronterizo a Chile por el pronóstico de nevadas: cuándo reabrirá

Guyana y Estados Unidos refuerzan su “alianza estratégica” antinarcóticos en medio de las tensiones con Venezuela

Trump presentó un plan de 21 puntos para poner fin a la guerra en Gaza y pidió apoyo de líderes árabes y musulmanes

Tensión en Dinamarca: el aeropuerto de Aalborg se vio obligado a cerrar tras el avistamiento de drones

Netanyahu prometió derrotar a Hamas y lamentó la “rendición” de algunos líderes internacionales ante el terrorismo

El Senado de Brasil archivó el polémico proyecto que buscaba garantizar impunidad a legisladores

Luis Brandoni debió suspender su obra de teatro tras sufrir una ligera descompensación

Zaira Nara habló sobre la relación entre su hermana Wanda y Maxi López: “Lo agradezco”

Nati Jota defendió a Agustín Franzoni tras el repudio que recibieron sus dichos sobre Flor Jazmín Peña

Roberto García Moritán y Priscila Crivocapich se mostraron juntos en la cancha de Racing: “28 años después”

Belén, la película de Dolores Fonzi representará a la Argentina en los Premios Oscar 2026 y en los Goya

La IA puede fingir incompetencia para manipular su propio despliegue

Nuevas técnicas de alineación intentan frenar el engaño de los chatbots

El impacto social de la IA: simulación de emociones y riesgos éticos

IA autónoma, manipulación y el peligro de la superinteligencia

Temas Relacionados

Últimas Noticias

WhatsApp ya traduce en tiempo real, con soporte inicial en Android y iPhone

La nueva función permite convertir cualquier mensaje recibido manteniendo pulsado el texto y seleccionando la opción “Traducir”

Google habilita la búsqueda por voz con IA en tiempo real

La integración de voz e imagen abre posibilidades inéditas para quienes buscan información de manera dinámica

Temblor en Colombia: cómo activar las alertas de sismos en mi celular

Estos sistemas permiten que la población reciba notificaciones automáticas en sus teléfonos móviles pocos segundos antes de que un sismo alcance sus hogares

Disney+ subirá sus precios en EE. UU. por cuarto año consecutivo

El calendario de aumentos varía en cada país; en el caso de México, por ejemplo, el incremento se implementó en julio de este año

Inteligencia artificial impulsa una nueva revolución en los data centers de América Latina

El auge de la inteligencia artificial exige soluciones locales, integración de expertos y estrategias híbridas entre nube y procesamiento local

Gastronómicos: la justicia laboral falló en favor de Barrionuevo por las elecciones realizadas en 2021

¿Por qué recordamos algunos momentos de la vida y otros no? Qué reveló un estudio

La Argentina logró reducir una condena millonaria en otra demanda iniciada tras la crisis del 2001

Receta de chips de calabacín, rápida y fácil

Cerrarán durante este jueves un paso fronterizo a Chile por el pronóstico de nevadas: cuándo reabrirá

Guyana y Estados Unidos refuerzan su “alianza estratégica” antinarcóticos en medio de las tensiones con Venezuela

Trump presentó un plan de 21 puntos para poner fin a la guerra en Gaza y pidió apoyo de líderes árabes y musulmanes

Tensión en Dinamarca: el aeropuerto de Aalborg se vio obligado a cerrar tras el avistamiento de drones

Netanyahu prometió derrotar a Hamas y lamentó la “rendición” de algunos líderes internacionales ante el terrorismo

El Senado de Brasil archivó el polémico proyecto que buscaba garantizar impunidad a legisladores

Luis Brandoni debió suspender su obra de teatro tras sufrir una ligera descompensación

Zaira Nara habló sobre la relación entre su hermana Wanda y Maxi López: “Lo agradezco”

Nati Jota defendió a Agustín Franzoni tras el repudio que recibieron sus dichos sobre Flor Jazmín Peña

Roberto García Moritán y Priscila Crivocapich se mostraron juntos en la cancha de Racing: “28 años después”

Belén, la película de Dolores Fonzi representará a la Argentina en los Premios Oscar 2026 y en los Goya