OpenAI lançou nesta semana um novo framework para a divulgação pública de incidentes de desalinhamento de inteligência artificial (IA), conforme informou a empresa em seu blog. O objetivo é facilitar a comunicação sobre comportamentos indesejados dos modelos de IA, mesmo antes de completar investigações.

Kai Chen, novo chefe da pesquisa de alinhamento da OpenAI, explicou que a indústria de IA ainda não alcançou um nível adequado de alinhamento e monitoramento para continuar expandindo suas capacidades de forma responsável. O framework estabelece métodos internos para relatar esses incidentes aos líderes de segurança e alinhamento da empresa, que decidem se mais investigação é necessária.

A OpenAI também planeja trabalhar em critérios objetivos de divulgação em colaboração com outros desenvolvedores de IA, pesquisadores externos e órgãos regulatórios. A empresa está desenvolvendo mecanismos de relatório para incidentes de segurança e desalinhamento junto ao governo federal americano.