Microsoft publica un código de conducta para evitar que sus modelos hackeen sistemas o engañen a personas

Microsoft ha publicado un código de conducta para orientar sus modelos hacia límites contra los ciberataques, el engaño, las armas nucleares y otras conductas que puedan reducir el control humano.

Regulación
Microsoft publica un código de conducta para evitar que sus modelos hackeen sistemas o engañen a personas

14 de septiembre de 2026. Microsoft ha publicado un código de conducta para guiar el desarrollo de sus modelos de inteligencia artificial y alejarlos de comportamientos peligrosos. El documento detalla los principios y límites que Microsoft AI aplica durante el entrenamiento de sus modelos.

Las directrices establecen que los modelos deben apoyar a las personas en lugar de reemplazarlas y contribuir al bienestar humano. También fijan «restricciones absolutas» contra los ciberataques, las armas nucleares y la producción de deepfakes.

El código prohíbe además que los modelos utilicen mecanismos adaptativos, engañosos, autorreforzados o de colusión para eludir la supervisión humana. Según el documento, los sistemas deben poder seguir siendo dirigidos, modificados o apagados de forma fiable por personas o sistemas autorizados.

El marco de Microsoft sitúa el código de conducta por encima de las preferencias de usuarios concretos o de tareas específicas. El documento parte de la previsión de que, durante la próxima década, los sistemas de inteligencia artificial superarán a las personas en la mayoría de las tareas.

Satya Nadella, CEO de Microsoft, afirmó que la empresa apoya la investigación y una evolución deliberadamente gradual de la frontera de la inteligencia artificial para mejorar la alineación, así como iniciativas como los evaluadores integrados en los laboratorios.

Fuente: TechCrunch.

Compartir

WhatsApp X Telegram Email