OpenAI lança versão do ChatGPT especialista em hackear sistemas

OpenAI lança versão do ChatGPT especialista em hackear sistemas

OpenAI lança versão do ChatGPT especialista em hackear sistemas

Por André Lourenti Magalhães • Editado por Jones Oliveira | •

A equipe de segurança da OpenAI apresentou o GPT-Red na última quarta-feira (15). O modelo de IA tem o objetivo de executar práticas de red-teaming, processo em que uma equipe interna simula ataques hackers para testar os mecanismos de defesa de uma plataforma.

O GPT-Red foi treinado para dar suporte à equipe que faz os testes de segurança e moldou o desenvolvimento do GPT-5.6 Sol, o modelo mais potente do ChatGPT até então. A IA foi refinada para combater os ataques de injeção de prompt (quando o comando possui instruções escondidas que levam a IA a fazer algo indevido).

De acordo com os pesquisadores da empresa, o modelo foi treinado por aprendizado de reforço e agora funciona de forma automatizada para identificar vulnerabilidades e consertá-las antes mesmo de serem distribuídas.

O GPT-Red é perigoso?

O modelo da OpenAI é capaz de hackear um sistema, mas não é uma “ferramenta do mal”: o GPT-Red é usado apenas para testes internos de segurança e não foi liberado ao público geral.

Em nota, a empresa argumentou que o red-teaming feito por humanos é uma parte essencial, mas esbarrava em alguns limites de escalabilidade. A própria IA permite desenvolver ameaças em ritmo e volume muito maior, então foi necessário usar a tecnologia para resolver o problema na mesma medida.

← Tech