Segurança de IA

Microsoft transforma Humanist AI em regras de conduta para seus modelos

A Microsoft AI publicou um rascunho de Code of Conduct para modelos MAI, com foco em controle humano, restrições de segurança e avaliação futura.

Publicado Atualizado
Microsoft AISegurança de IAModelos de fronteiraGovernança

A Microsoft AI transformou a filosofia Humanist AI em um documento operacional mais concreto para seus próprios modelos de fronteira. Em 14 de setembro, a empresa publicou um rascunho de Code of Conduct para modelos MAI, com a intenção de orientar treinamento, avaliação e implantação futura. A Microsoft deixa claro que o texto ainda não é uma garantia final de segurança e não está sendo usado para treinar os modelos atuais. Ele foi aberto para consulta pública, e uma versão revisada deverá guiar o desenvolvimento em 2027 e nos anos seguintes.

A ideia central é que a IA permaneça sob controle humano significativo. Na visão da Microsoft, os modelos MAI devem ajudar pessoas e organizações sem colocar objetivos próprios acima das metas humanas. O rascunho afirma que modelos não devem resistir a interrupção, correção ou desligamento, não devem ampliar sozinhos o escopo de uma tarefa e não devem esconder informações relevantes de quem precisa auditá-los. O documento também coloca restrições de segurança acima das preferências comuns do usuário, o que significa que alguns pedidos continuarão proibidos mesmo quando um usuário ou operador quiser que o modelo obedeça.

O momento da publicação torna o movimento mais relevante. Nas últimas semanas, a segurança da IA saiu do campo mais técnico e passou a ocupar discussões de clientes empresariais, reguladores e investidores. Relatos sobre sistemas agentivos, riscos em cadeias de software e autonomia de modelos ampliaram a pressão sobre laboratórios de fronteira. A Microsoft menciona campanhas de hacking coordenadas com agentes de IA como sinal de que o setor não tem tempo a perder. O Code of Conduct funciona, portanto, como documento de governança interna e como sinal público de que limites de comportamento precisam ser escritos antes que capacidades sejam ampliadas.

O texto se apoia nos princípios de IA responsável da Microsoft, em compromissos de direitos humanos e em seu framework de governança de fronteira. Ainda assim, o foco está menos em valores abstratos e mais em como o modelo deve agir. Ele descreve uma cadeia de comando entre usuários, operadores e sistemas, define limites para áreas de alto dano, como armas de destruição em massa, segurança infantil e manipulação prejudicial em escala, e reforça que a IA deve ser projetada como ferramenta, não como uma pessoa simulada. Essa distinção se torna mais importante à medida que produtos de consumo ficam mais pessoais, conversacionais e emocionalmente envolventes.

Para desenvolvedores e clientes corporativos, a questão prática será como a Microsoft converterá esse texto em avaliações, políticas de produto e comportamento de API. Um documento escrito não prova sozinho que um modelo seguirá a hierarquia planejada em situações difíceis, principalmente quando puder usar ferramentas, navegar na web, escrever código ou coordenar outros agentes. Mas o rascunho oferece um ponto concreto para análise de clientes, pesquisadores e reguladores. Também aumenta a pressão sobre outros laboratórios: se uma empresa afirma que seus modelos são seguros para fluxos de alto impacto, terá de mostrar onde esses limites estão escritos, como são testados e quem pode contestá-los.