Anthropic põe avaliadores dentro do laboratório — US$ 2 bi em jogo

Anthropic e Accenture anunciaram em 18 de setembro de 2026 a criação de uma equipe de avaliadores que trabalhará dentro da desenvolvedora de IA, ao lado dos grupos internos e de parceiros de segurança. O anúncio conjunto da parceria atribui à Faculty, empresa de IA adquirida pela Accenture, a liderança dos testes de modelos, exercícios de red teaming, avaliações de alinhamento e verificação de salvaguardas.
As duas empresas esperam investir pelo menos US$ 1 bilhão cada ao longo de cinco anos, totalizando um compromisso previsto de no mínimo US$ 2 bilhões. A reportagem da Reuters confirmou o valor, o prazo e a liderança da Faculty, mas a estrutura ainda está em formação: não se trata de US$ 2 bilhões já desembolsados nem de uma auditoria concluída.
O acesso começa antes de o modelo ficar pronto
A mudança central é a profundidade e a continuidade do acesso. Em vez de receber apenas uma versão delimitada de um modelo para testes pontuais, a equipe integrada deverá acompanhar modelos durante o treinamento, observar decisões sobre desenvolvimento e implantação e conversar diretamente com funcionários.
Na explicação da Anthropic, esse acesso será comparável ao de um empregado e poderá servir para verificar compromissos de segurança, identificar pontos cegos e comunicar incidentes. A empresa também reconhece que ainda não existem padrões estabelecidos sobre quais informações os avaliadores receberão ou como deverão relatar suas descobertas.
Portanto, “dentro do laboratório” descreve acesso operacional, não a incorporação dos avaliadores ao quadro da Anthropic. A Faculty continuará pertencendo à Accenture, mas seus profissionais poderão observar etapas e decisões que uma avaliação externa limitada a um produto pronto normalmente não alcança.
Os US$ 2 bilhões financiam capacidade, não uma única auditoria
O número do título reúne duas expectativas separadas: ao menos US$ 1 bilhão da Anthropic e ao menos US$ 1 bilhão da Accenture durante cinco anos. Os comunicados associam o dinheiro à construção de capacidade de avaliação e segurança de IA, sem apresentar um orçamento conjunto único ou indicar quanto será destinado especificamente à equipe instalada na Anthropic.
Também não há divisão pública entre contratação de pessoal, infraestrutura, pesquisa e execução de testes. O compromisso é prospectivo, e os próprios termos usados pelas empresas — “esperam investir” — não equivalem a uma obrigação de desembolso imediato ou a uma garantia de que cada parcela será aplicada da mesma maneira.
Há outra camada no financiamento: a Anthropic pagará diretamente pelo trabalho da Accenture. A justificativa apresentada é a inexistência, neste momento, de um mecanismo consolidado financiado por governos ou por um fundo coletivo para sustentar avaliações integradas. A empresa diz defender essas alternativas no longo prazo.
Proximidade técnica não garante independência institucional
O acesso semelhante ao de funcionários pode fortalecer a independência técnica: os avaliadores terão mais elementos para escolher testes relevantes, acompanhar decisões e investigar sinais que não aparecem no comportamento final de um modelo. Isso reduz a dependência de demonstrações preparadas exclusivamente pela empresa avaliada.
A independência institucional depende de regras diferentes. Os anúncios não esclarecem se a equipe poderá ampliar unilateralmente o escopo de uma investigação, contestar a classificação de uma descoberta, manter acesso durante uma divergência ou publicar conclusões desfavoráveis sem aprovação prévia da Anthropic.
O pagamento direto não demonstra interferência, assim como o acesso interno não demonstra autonomia. A credibilidade do arranjo dependerá das proteções contratuais e de governança que ainda não foram divulgadas: quem controla o escopo, quem recebe os resultados completos, quais restrições de confidencialidade serão aplicadas e como uma discordância ficará registrada.
A parceria será não exclusiva. A Anthropic pretende trabalhar com outros avaliadores, e a Accenture poderá desempenhar função semelhante para outros desenvolvedores. Essa multiplicidade pode ampliar a comparação entre métodos, mas não substitui padrões comuns para acesso, comunicação de incidentes e divulgação de resultados.
O que os anúncios ainda deixam em aberto
As empresas não informaram o tamanho da equipe, sua composição nem uma data precisa para o início efetivo das avaliações. Também não identificaram quais modelos serão examinados primeiro ou quais partes do treinamento, do código, dos dados e das decisões de implantação estarão disponíveis.
As principais questões de governança ainda sem resposta pública são:
- quem define os testes e pode alterar o escopo durante uma avaliação;
- como serão resolvidas divergências sobre metodologia, gravidade ou correção de uma falha;
- quais descobertas poderão ser divulgadas e quais ficarão sujeitas à confidencialidade;
- se recusas de acesso ou opiniões minoritárias serão registradas publicamente;
- como incidentes relevantes serão comunicados a clientes, autoridades e ao público;
- quais métricas mostrarão como os investimentos anunciados foram aplicados.
A iniciativa começa, assim, com três elementos confirmados: uma equipe liderada pela Faculty, acesso interno comparável ao de funcionários e investimentos esperados de ao menos US$ 2 bilhões em cinco anos. O teste de sua independência virá quando houver uma descoberta inconveniente ou uma divergência sobre divulgação; até que as regras sejam publicadas, o projeto representa uma avaliação externa com acesso ampliado, não uma fiscalização institucional plenamente definida.
Leia também:
Assine nossa newsletter
Receba as últimas notícias sobre Web3, IA e cripto diretamente no seu e-mail.