OpenAI Lança Novo Modelo de Relatório de Incidências de Desalinhamento de IA
Com objetivo de padronizar práticas na indústria, empresa divulga novas diretrizes para relatar comportamentos indesejados de modelos de inteligência artificial.
OpenAI lançou nesta semana um novo framework para a divulgação pública de incidentes de desalinhamento de inteligência artificial (IA), conforme informou a empresa em seu blog. O objetivo é facilitar a comunicação sobre comportamentos indesejados dos modelos de IA, mesmo antes de completar investigações.
Kai Chen, novo chefe da pesquisa de alinhamento da OpenAI, explicou que a indústria de IA ainda não alcançou um nível adequado de alinhamento e monitoramento para continuar expandindo suas capacidades de forma responsável. O framework estabelece métodos internos para relatar esses incidentes aos líderes de segurança e alinhamento da empresa, que decidem se mais investigação é necessária.
A OpenAI também planeja trabalhar em critérios objetivos de divulgação em colaboração com outros desenvolvedores de IA, pesquisadores externos e órgãos regulatórios. A empresa está desenvolvendo mecanismos de relatório para incidentes de segurança e desalinhamento junto ao governo federal americano.
Comentários (0)
Entre ou cadastre-se para comentar.