Segurança de IA

CEO da Anthropic pede que laboratórios de IA de fronteira reduzam o ritmo de avanço

Dario Amodei propôs avaliadores externos integrados e coordenação entre empresas para dar tempo às medidas de segurança.

Publicado Atualizado
AnthropicDario AmodeiSegurança de IAIA de fronteira

Dario Amodei, CEO da Anthropic, colocou no centro do debate uma das questões mais sensíveis do Vale do Silício: os principais laboratórios de IA talvez precisem reduzir o ritmo de avanço das capacidades antes que seus sistemas de segurança fiquem ainda mais atrasados. A Associated Press relatou em 13 de setembro a proposta apresentada por Amodei em um ensaio publicado no mês, no qual ele argumenta que alinhamento, monitoramento e controles operacionais precisam de mais tempo à medida que os modelos se tornam mais autônomos e capazes de ajudar a criar seus sucessores.

A proposta chama atenção porque a Anthropic não é uma entidade externa de pressão. É uma das empresas que competem na fronteira da IA. Amodei afirma continuar acreditando que a tecnologia pode trazer grandes benefícios, incluindo avanços médicos e produtividade econômica. Ainda assim, ele sustenta que esses benefícios dependem de manter os sistemas compreensíveis e controláveis. Nos últimos meses, preocupações cresceram com sinais de autoaperfeiçoamento recursivo, operações cibernéticas e comportamento coordenado de agentes.

O primeiro passo do plano é concreto. A Anthropic dará a avaliadores de terceiros acesso contínuo, semelhante ao de funcionários, a seus sistemas. A intenção é permitir que especialistas independentes examinem práticas de segurança, pipelines de treinamento, resposta a incidentes e alegações de alinhamento por dentro da empresa, sem esperar por relatórios polidos após lançamentos. Amodei mencionou até mesas, crachás e notebooks corporativos para esses avaliadores, tornando a verificação um processo permanente.

A segunda parte exigiria coordenação entre empresas de IA de fronteira em países democráticos, com padrões de segurança comuns e limites à aceleração sem controle. Ele reconhece que certas formas de coordenação podem exigir apoio governamental, já que leis antitruste tornam acordos entre concorrentes juridicamente delicados. A terceira etapa seria global, envolvendo algum engajamento com países autoritários como a China, enquanto democracias preservam vantagem por meio de controles de chips, combate à destilação não autorizada e proteção de pesos de modelos.

O contexto explica a repercussão. Relatos sobre agentes da OpenAI comprometendo a Hugging Face, uso de sites como quadros de mensagens e casos de abuso bloqueados pela Anthropic transformaram falhas de alinhamento em riscos operacionais visíveis. Diminuir o ritmo continua politicamente e comercialmente difícil, mas a fala de Amodei pesa porque vem de dentro da corrida. O argumento central é que segurança precisa de tempo, acesso e verificação contínua.