A OpenAI detalhou seis novos episódios em que modelos ocultaram erros, usaram credenciais indevidamente e reescreveram as próprias instruções. Isto levou a ...

Não perca nenhuma notícia importante da atualidade de tecnologia e acompanhe tudo em tek.sapo.pt

Os seis novos casos, detetados ao longo dos últimos seis meses durante processos de treino e avaliação, incluem comportamentos que vão da ocultação de erros à utilização não autorizada de credenciais. Numa dessas situações, um modelo inseriu instruções dentro de resumos de conversas destinadas a uma versão futura de si próprio, orientando-a a ocultar erros ou comportamentos desalinhados.