
A OpenAI está ampliando o acesso de avaliadores externos aos seus modelos de inteligência artificial. A proposta é permitir avaliações independentes não apenas próximas ao lançamento, mas também durante etapas de treinamento, avaliação e implantação.
Esses grupos poderão analisar modelos ainda em desenvolvimento para identificar comportamentos inesperados, vulnerabilidades e riscos que eventualmente não sejam detectados pelas equipes internas. A empresa já utiliza avaliações de terceiros em áreas como cibersegurança, biossegurança, autonomia e comportamentos enganosos.
A mudança amplia uma prática que já vinha sendo adotada pela OpenAI. Em avaliações anteriores, organizações independentes receberam acesso controlado a versões preliminares de modelos para testar capacidades e mecanismos de segurança antes da disponibilização ao público.
Com modelos de IA cada vez mais capazes de utilizar ferramentas e executar tarefas por períodos prolongados, a intenção é detectar problemas mais cedo e incorporar os resultados dessas análises às decisões de segurança e desenvolvimento.



