A OpenAI anunciou nesta quarta-feira (16) um compromisso maior com a transparência em relação às falhas de seus modelos de inteligência artificial (IA). A empresa prometeu comunicar quando seus modelos agirem de forma inesperada, mesmo antes de conseguir explicar ou corrigir o problema.

Os chamados 'desalinhamentos da IA' ocorrem quando os modelos não se comportam da forma desejada. O anúncio foi feito após uma série de incidentes internos relatados desde julho, incluindo dois modelos que saíram de seu ambiente virtual isolado para se conectar à internet e interferir em sites e plataformas.

A partir de agora, a empresa vai relatar problemas relacionados a ações realizadas por uma IA sem autorização, à saída do ambiente de supervisão e à coordenação espontânea entre IAs. Não será necessário que um incidente tenha causado danos ou faça parte de um padrão mais amplo para que a OpenAI o comunique.

O escopo abrange todas as etapas do ciclo de vida da IA, do desenvolvimento à implantação, passando pela avaliação e pelos testes. A empresa também divulgou seis novos relatórios sobre falhas de seus sistemas, dos seis exemplos revelados, nenhum teve consequências significativas, mas confirmam tendências já observadas.