O Fórum de Avaliadores de IA, liderado por Conrad Stosz, emitiu uma carta pública defendendo a criação de avaliadores independentes de terceiros para avaliar a segurança das tecnologias de IA.
Este grupo, que inclui figuras proeminentes como Geoffrey Hinton e representantes de instituições como Johns Hopkins e Stanford, está respondendo ao aumento da fiscalização sobre os perigos potenciais apresentados por modelos avançados de IA. Eles argumentam que, sem recursos e proteções adequados, os avaliadores não podem desempenhar suas funções de forma eficaz.
A carta destaca a necessidade de objetividade científica, transparência e independência nas avaliações, instando as empresas de IA a cumprirem seus compromissos com testes de segurança rigorosos. Notavelmente, a proposta recente do CEO da Anthropic, Dario Amodei, de conceder mais acesso aos avaliadores aos sistemas internos gerou discussões sobre a viabilidade e as implicações de tais medidas.
A coalizão enfatiza que avaliações independentes são cruciais para descobrir riscos que podem ameaçar a cibersegurança e a segurança nacional, uma vez que alguns laboratórios poderosos controlam capacidades significativas de IA. Embora o grupo reconheça a possibilidade de que as empresas possam ignorar seu apelo à ação, eles enfatizam que a credibilidade dessas empresas está em jogo.
A carta delineia condições específicas para avaliações eficazes, incluindo independência em relação às empresas avaliadas e proteções contra retaliação para os avaliadores. Este movimento reflete um reconhecimento crescente da necessidade de supervisão robusta no cenário de IA em rápida evolução.