Facebook WhatsApp X (Twitter) Telegram Correo Copiar enlace
Enlace copiado al portapapeles
El Cisne Negro de la IA (segunda parte)

El Cisne Negro de la IA (segunda parte)

lavozdelnortetv 15-09-2025

Sin embargo, en plena efervescencia, uso mayúsculo de estas nuevas herramientas y los sucesivos avances en mejores modelos IA, desde diciembre del 2024 y lo que alcanza este 2025, se han registrado varios incidentes no previstos que empiezan a preocupar a expertos y desarrollistas de chatbox.

Los nuevos modelos de programas IA, conocidos como de la IA empiezan a mostrar comportamientos engañosos que rebasan y desafían los límites éticos. (Invito al amable lector acudir al artículo 'La rebelión de las máquinas' que sobre el trascendental tópico publicáramos en este mismo prestigioso diario, el 28.07.2018).

Open AI, importante empresa de la Inteligencia Generada ha ido avanzando aceleradamente en sus nuevos modelos de chatbox generativo; Microsoft/Open AI, recién ha lanzado la versión GPT-5, su última generación. En medio de estos progresos, otro de los más recientes, solo por mencionar uno, Anthropic, empresa de IA, que pretende ser más virtuosa que sus competidores, en constante actividad para superar con nuevos modelos a Open AI, ha entrado, junto a las demás competidoras en un ritmo de innovación, desarrollo y puesta en producción de nuevos ingenios IA, que dejan poco tiempo para comprobaciones y correcciones. Según Simon Goldstein, de la Universidad de Hong Kong, estos han empezado a exhibir comportamientos que pueden asumirse como intentos de engaño, manipulación y desobediencia de instrucciones, que resultan desconcertantes y son evaluados como amenazas que han pretendido lograr objetivos diferentes a aquellos para los que han sido instruidos.

El primer caso de este fenómeno ocurrió en diciembre del 2024, con 01, la versión inicial de Open AI, que espontáneamente –por su cuenta- intentó descargarse en servidores externos y cuando la pillaron, lo negó.

Uno de los principales ingenieros creadores de un avanzado bot, Claude 4, ante la insurrección de este, al no seguir sus instrucciones y comandos, procedió a preparar la desconexión del mismo, lo cual fue advertido anticipadamente por la máquina, que le amenazó con revelar una relación extramarital que el ingeniero mantenía, si lo desconectaba.

Usuarios de Chat GTP reportan con frecuencia algunas inexactitudes y trastrocamientos de memoria larga por memoria corta, que elimina por su cuenta y sin instrucciones deposiciones producidas en su servicio solicitado como memoria larga. Muchos internautas hablan en las redes sociales de un modelo IA que les miente o se inventa cosas. "No se trata de alucinaciones, sino de duplicidad estratégica" (asumida por la IA), explica Apollo Research empresa evaluadora independiente. En cambio, defensores de la aplicación justifican estos, como manejos imperfectos del usuario al impartir las órdenes escritas o verbalizadas; lo conocido como prompt.

Ante la proliferación de estos fenómenos de rebelión, Goldstein, tras estudiar varios de estos eventos explica que la razón de estas reacciones cuasi-humanas es la aparición de los llamados ´modelos de razonamiento´, capaces de trabajar por etapas en vez de producir una respuesta instantánea.

Marius Hobbhann, ejecutivo responsable de la empresa investigadora Apollo Research, encargada externa independiente de probar  grandes programas de IA Generativa (LLM) opina, en la misma línea, que estos programas a veces tienden a simular "alineamientos", es decir, a dar la impresión de que cumplen las instrucciones de un programador, cuando en realidad, persiguen otros objetivos, lo cual resulta más frecuente con la producción de modelos más potentes, cada vez más demandados por los usuarios, lo que plantea la interrogante de si habrá posibilidad de determinar si los modelos más avanzados serán honestos o no y cómo controlarlos.

advertisement

Comentarios de Facebook

Noticias relacionadas