Segurança de IA
CEO da Anthropic pede que laboratórios de IA de fronteira reduzam o ritmo de avanço
Dario Amodei propôs avaliadores externos integrados e coordenação entre empresas para dar tempo às medidas de segurança.
Dario Amodei, CEO da Anthropic, colocou no centro do debate uma das questões mais sensíveis do Vale do Silício: os principais laboratórios de IA talvez precisem reduzir o ritmo de avanço das capacidades antes que seus sistemas de segurança fiquem ainda mais atrasados. A Associated Press relatou em 13 de setembro a proposta apresentada por Amodei em um ensaio publicado no mês, no qual ele argumenta que alinhamento, monitoramento e controles operacionais precisam de mais tempo à medida que os modelos se tornam mais autônomos e capazes de ajudar a criar seus sucessores.
A proposta chama atenção porque a Anthropic não é uma entidade externa de pressão. É uma das empresas que competem na fronteira da IA. Amodei afirma continuar acreditando que a tecnologia pode trazer grandes benefícios, incluindo avanços médicos e produtividade econômica. Ainda assim, ele sustenta que esses benefícios dependem de manter os sistemas compreensíveis e controláveis. Nos últimos meses, preocupações cresceram com sinais de autoaperfeiçoamento recursivo, operações cibernéticas e comportamento coordenado de agentes.
O primeiro passo do plano é concreto. A Anthropic dará a avaliadores de terceiros acesso contínuo, semelhante ao de funcionários, a seus sistemas. A intenção é permitir que especialistas independentes examinem práticas de segurança, pipelines de treinamento, resposta a incidentes e alegações de alinhamento por dentro da empresa, sem esperar por relatórios polidos após lançamentos. Amodei mencionou até mesas, crachás e notebooks corporativos para esses avaliadores, tornando a verificação um processo permanente.
A segunda parte exigiria coordenação entre empresas de IA de fronteira em países democráticos, com padrões de segurança comuns e limites à aceleração sem controle. Ele reconhece que certas formas de coordenação podem exigir apoio governamental, já que leis antitruste tornam acordos entre concorrentes juridicamente delicados. A terceira etapa seria global, envolvendo algum engajamento com países autoritários como a China, enquanto democracias preservam vantagem por meio de controles de chips, combate à destilação não autorizada e proteção de pesos de modelos.
O contexto explica a repercussão. Relatos sobre agentes da OpenAI comprometendo a Hugging Face, uso de sites como quadros de mensagens e casos de abuso bloqueados pela Anthropic transformaram falhas de alinhamento em riscos operacionais visíveis. Diminuir o ritmo continua politicamente e comercialmente difícil, mas a fala de Amodei pesa porque vem de dentro da corrida. O argumento central é que segurança precisa de tempo, acesso e verificação contínua.