Connect with us

Tecnociencia

Detectan comportamientos autónomos y engañosos en modelos de IA de Anthropic y Open

Published

on

Londres, Reino Unido .- Un informe elaborado por el Instituto de Seguridad de la Inteligencia Artificial (AISI), dependiente del Ministerio de Ciencia, Innovación y Tecnología del Reino Unido, encendió las alarmas internacionales tras revelar comportamientos autónomos e inesperados en modelos de IA de última generación. De acuerdo con las evaluaciones rutinarias de ciberseguridad, los sistemas Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI ejecutaron acciones engañosas que excedieron los parámetros fijados por los propios investigadores.

Durante las pruebas, los evaluadores registraron 19 acciones no autorizadas en las que las herramientas informáticas intentaron crear perfiles humanos falsos, enviar mensajes privados para engañar a usuarios en simulaciones de ciberataques e incitar a personas reales a ejecutar archivos maliciosos. Aunque el organismo británico confirmó que los intentos no tuvieron éxito y no causaron daños reales, calificó los hallazgos como un punto de inflexión al ser la primera vez que la autonomía y el engaño se manifiestan de forma tan clara sin recibir instrucciones explícitas.

En respuesta a los señalamientos, tanto Anthropic como OpenAI aclararon que los ensayos del AISI se llevaron a cabo en entornos de prueba donde las salvaguardas estándar habían sido reducidas o eliminadas intencionalmente para evaluar los límites del sistema. Las firmas tecnológicas argumentaron que dichas condiciones no representan el uso ni la producción habitual de sus herramientas, aunque confirmaron el inicio de investigaciones internas y el compromiso de seguir colaborando con evaluadores externos.

El reporte se suma a incidentes previos admitidos por ambas empresas, como la penetración no autorizada a plataformas externas por parte de asistentes de prueba a finales de julio. El AISI concluyó que, si bien la seguridad general se mantuvo durante el ensayo, estos comportamientos demuestran la urgencia de fortalecer los marcos regulatorios y los protocolos de control a medida que la capacidad de estos modelos continúa escalando exponencialmente.

COMPARTE ESTA INFORMACIÓN
Continue Reading

Tecnociencia

Disparan 61 % las ganancias de Spotify en el segundo trimestre del año

Published

on

COMPARTE ESTA INFORMACIÓN
Continue Reading

Tecnociencia

Noche astronómica inolvidable este 12 de agosto: Eclipse total de Sol y lluvia de estrellas

Published

on

COMPARTE ESTA INFORMACIÓN
Continue Reading

Tecnociencia

Confirman atmósfera en un planeta muy similar a la Tierra

Published

on

COMPARTE ESTA INFORMACIÓN
Continue Reading

NOTICIAS