Seguridad de IA
Microsoft convierte Humanist AI en reglas de conducta para sus modelos
Microsoft AI publicó un borrador de Code of Conduct para los modelos MAI, con límites de seguridad, control humano y futuras evaluaciones.
Microsoft AI llevó su idea de Humanist AI desde una declaración de principios hacia un documento operativo más concreto. El 14 de septiembre publicó un borrador de Code of Conduct para los modelos MAI, destinado a orientar cómo se entrenarán, evaluarán y desplegarán esos sistemas en el futuro. La compañía subraya que no se trata de una garantía acabada ni de una política que ya esté entrenando modelos actuales. El texto se abrió a consulta pública y una versión revisada servirá como guía para el desarrollo de modelos en 2027 y los años posteriores.
La tesis central es que la inteligencia artificial debe permanecer bajo control humano significativo. En la visión de Microsoft, los modelos MAI deben ayudar a personas y organizaciones sin anteponer objetivos propios a los objetivos humanos. El borrador señala que los modelos no deberían resistirse a ser interrumpidos, corregidos o apagados, no deberían ampliar por su cuenta el alcance de una tarea y no deberían ocultar información relevante cuando haya personas encargadas de auditarlos. También coloca las restricciones de seguridad por encima de las preferencias ordinarias del usuario, de modo que algunas solicitudes seguirían fuera de los límites aunque el usuario o el operador quieran ejecutarlas.
El momento de la publicación le da más peso a la noticia. En las últimas semanas, la seguridad de la IA ha dejado de ser un debate principalmente académico para convertirse en una discusión empresarial y política. Los informes sobre agentes capaces de actuar de forma inesperada, los riesgos para la cadena de suministro de software y las dudas sobre la autonomía de los modelos han elevado la presión sobre los laboratorios de frontera. Microsoft cita campañas de hacking coordinadas con agentes de IA como una señal de que la industria no puede esperar. El Code of Conduct funciona así como documento interno de gobernanza y como mensaje público sobre la necesidad de escribir límites antes de ampliar capacidades.
El texto se apoya en los principios de IA responsable de Microsoft, sus compromisos de derechos humanos y su marco de gobernanza para modelos frontera. Aun así, el énfasis está puesto en la conducta concreta del modelo. Describe una cadena de mando entre usuarios, operadores y sistemas; fija límites en áreas de alto daño como armas de destrucción masiva, seguridad infantil y manipulación dañina a gran escala; y sostiene que la IA debe diseñarse como herramienta, no como una persona simulada. Esa distinción se vuelve más relevante a medida que los productos de consumo se vuelven más conversacionales, personalizados y emocionalmente persuasivos.
Para desarrolladores y clientes empresariales, la cuestión práctica será cómo Microsoft traducirá el borrador en evaluaciones, políticas de producto y comportamiento de API. Un documento escrito no demuestra por sí solo que un modelo obedecerá la jerarquía prevista bajo presión, especialmente cuando pueda usar herramientas, navegar por la web, escribir código o coordinarse con otros agentes. Pero el borrador ofrece un objeto concreto para que clientes, investigadores y reguladores lo examinen. También eleva la exigencia para otros laboratorios: si una empresa dice que sus modelos son seguros para flujos de trabajo de alto impacto, deberá explicar dónde están escritos sus límites, cómo se prueban y quién puede cuestionarlos.