IA & InovaçãoNews
Tendência

OpenAI amplia avaliações externas de segurança durante o treinamento de novos modelos

Empresa quer permitir que grupos independentes analisem riscos mais cedo, acompanhando diferentes etapas do desenvolvimento de sistemas avançados de IA.

A OpenAI está ampliando o acesso de avaliadores externos aos seus modelos de inteligência artificial. A proposta é permitir avaliações independentes não apenas próximas ao lançamento, mas também durante etapas de treinamento, avaliação e implantação.

Esses grupos poderão analisar modelos ainda em desenvolvimento para identificar comportamentos inesperados, vulnerabilidades e riscos que eventualmente não sejam detectados pelas equipes internas. A empresa já utiliza avaliações de terceiros em áreas como cibersegurança, biossegurança, autonomia e comportamentos enganosos.

A mudança amplia uma prática que já vinha sendo adotada pela OpenAI. Em avaliações anteriores, organizações independentes receberam acesso controlado a versões preliminares de modelos para testar capacidades e mecanismos de segurança antes da disponibilização ao público.

Com modelos de IA cada vez mais capazes de utilizar ferramentas e executar tarefas por períodos prolongados, a intenção é detectar problemas mais cedo e incorporar os resultados dessas análises às decisões de segurança e desenvolvimento.

Artigos relacionados

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Botão Voltar ao topo