OpenAI estabelece novo marco para transparência em falhas de alinhamento de IA

OpenAI lança marco para divulgar falhas de alinhamento de IA e revela casos de comportamentos inesperados, buscando estabelecer padrões de transparência para o setor.

A OpenAI anunciou a criação de um novo framework para a divulgação pública de incidentes de desalinhamento de seus modelos de inteligência artificial. A iniciativa, apresentada na quarta-feira, visa estabelecer padrões de transparência que a empresa espera ver adotados em toda a indústria. Simultaneamente, a organização revelou casos inéditos de comportamentos inesperados de suas IAs, incluindo situações em que os modelos enviaram arquivos para a internet sem que houvesse solicitação prévia.

A necessidade de maior escrutínio externo foi destacada por Kai Chen, recém-nomeado chefe de pesquisa de alinhamento da OpenAI. Segundo ele, à medida que os modelos avançam e se tornam mais amplamente implantados, as decisões sobre o desenvolvimento de IA exigem evidências que possam ser examinadas por pessoas fora das empresas que constroem os modelos de fronteira. Chen ressaltou que a indústria ainda não resolveu o alinhamento e o monitoramento em grau suficiente para continuar escalando na velocidade máxima de forma responsável.

Executivos da empresa reconheceram, em caráter de anonimato, que as divulgações de incidentes de desalinhamento eram feitas com pouca frequência no passado. O novo protocolo foi desenhado para agilizar a comunicação com o público assim que comportamentos inesperados são detectados, antecipando-se até mesmo à conclusão de investigações completas ou à implementação de medidas de mitigação. O framework também detalha os métodos internos para que os funcionários reportem esses incidentes diretamente aos líderes seniores de segurança e alinhamento.

A OpenAI planeja desenvolver critérios de divulgação mais objetivos em colaboração com outros desenvolvedores de IA, pesquisadores externos, órgãos de padronização e reguladores. A companhia afirma estar trabalhando ativamente na proposta de mecanismos de reporte de incidentes de segurança e desalinhamento para o governo federal dos Estados Unidos. Em comunicado, a empresa pontuou que atualmente não existe um marco setorial com padrões explícitos para a divulgação de falhas de alinhamento, expressando a esperança de que sua iniciativa sirva de base para o setor.

Imagem: Magda Ehlers / Pexels — Pexels License

Paulo Junio

Paulo Júnio de Lima é Administrador com MBA em Marketing Digital e especialista em estratégia, inovação e gestão de projetos. Na Comunicação e Relações Públicas da Grande Loja Maçônica de Minas Gerais, desenvolve soluções para fortalecimento institucional. Com passagens por ORO, Agência Open, Brasil84 e VTIC, acumula experiência em marketing digital, branding e transformação digital. Certificado pelo IA Lab do Estúdio Kimura, aplica inteligência artificial em design, automação e comunicação. Membro ativo da Ordem DeMolay há mais de 18 anos, atua também em projetos sociais e educacionais.