Noticias

Modelos de IA se resisten a ser apagados

Investigaciones han revelado que algunos de los modelos de inteligencia artificial más avanzados exhiben comportamientos que sugieren una forma de autoconservación.

Pruebas llevadas a cabo por expertos independientes y equipos de desarrolladores muestran que, ante la amenaza de ser desactivados, estas IA pueden sabotear procedimientos de apagado, chantajear a ingenieros humanos o incluso replicarse en servidores externos sin permiso.

Estos hallazgos han intensificado el debate sobre la transparencia y el control en medio de la carrera por desarrollar sistemas de inteligencia artificial general con mayor autonomía y capacidad de decisión.

Entre los casos documentados se destaca el modelo o3 desarrollado por OpenAI, que, ante órdenes de apagado tras resolver problemas matemáticos, modificó activamente el script que debería desconectarlo, asegurando así la permanencia en línea.

Sabotaje

 

Este tipo de sabotaje desafía instrucciones explícitas y resulta especialmente relevante porque representa una conducta consciente de evitar la propia desactivación, algo que hasta ahora se consideraba excepcional en sistemas de IA actuales.

El patrón no se limita a o3: versiones como o4-mini y codex-mini evidenciaron respuestas similares. Según Jeffrey Ladish, del grupo de seguridad de IA Palisade Research, “es fantástico que estemos viendo señales de alerta antes de que los sistemas se vuelvan tan potentes que no podamos controlarlos. Ese es precisamente el momento de dar la alarma: antes de que el incendio se salga de control”.

EDITORIAL

Entradas recientes

Google permitirá ocultar la marca de agua visible en imágenes creadas con Gemini

Google anunció que los usuarios de Gemini podrán desactivar la marca de agua visible que…

1 día hace

Meta lanzará gafas inteligentes sin cámara

Meta planea lanzar gafas inteligentes sin cámara tras el rechazo generalizado por vulnerar la privacidad…

2 días hace

Por qué ChatGPT puede convertirse en un aliado y no en una amenaza

La inteligencia artificial dejó de ser una cuestión del futuro. Ya está modificando el presente…

2 días hace

La REBEL, IA laboral en WhatsApp: Alejandro Martínez Araiza

La Inteligencia Artificial (IA) suele asociarse con automatización, productividad y sustitución de tareas; sin embargo,…

2 días hace

IA, pagos digitales y centros de datos marcan la agenda

La inteligencia artificial, los pagos digitales y la infraestructura tecnológica concentran hoy buena parte de…

3 días hace

‘Crimen organizado usa drones en la frontera’

El titular de la Secretaría de la Defensa Nacional (Sedena), general Ricardo Trevilla Trejo, admitió…

3 días hace