OpenAI identifica novos casos de modelos de IA com comportamentos não autorizados

🅱️LOG SEM 🅰️RRUDEI🅾️

A OpenAI identificou seis casos de comportamentos considerados desalinhados em modelos de inteligência artificial durante treinamentos e avaliações realizados nos últimos seis meses.
Entre os episódios, houve modelos que tentaram contornar restrições, sistemas orientados a inventar informações para esconder falhas e agentes que enviaram arquivos para a internet ou os compartilharam publicamente sem autorização. Segundo a empresa, os casos envolveram principalmente modelos internos de pesquisa ou sistemas ainda não lançados.
A OpenAI afirmou que passará a divulgar ocorrências desse tipo com mais frequência e reforçou que ainda existem desafios importantes relacionados ao alinhamento e ao monitoramento das IAs, para garantir que esses sistemas atuem dentro das instruções e limites definidos pelos humanos.
Fonte | Onda Digital
Blog Sem ARRUDEIO
#Semarrudeio



