Uma vulnerabilidade no software de um fórum de desenvolvedores da OpenAI permitiu o acesso a dados internos e à conta de um funcionário da empresa. As etapas da exploração tiveram apoio do Claude, chatbot de inteligência artificial criado pela Anthropic, segundo o pesquisador de segurança Johann Rehberger.
Rehberger identificou a falha no fórum mantido pela OpenAI para sua comunidade de desenvolvedores. Com o modelo da Anthropic, ele analisou o código da plataforma, procurou possíveis problemas de segurança, gerou códigos de exploração e recebeu sugestões para contornar as proteções existentes.
A partir do acesso obtido, o pesquisador conseguiu extrair dados do fórum, ler mensagens internas e publicar conteúdos em áreas restritas do sistema da OpenAI. Ele também afirmou que a ferramenta não conduziu o ataque de maneira totalmente autônoma, mas atuou como um “assistente avançado”.
Correção da vulnerabilidade
A OpenAI informou que foi avisada sobre o problema e que a falha no software de terceiros foi corrigida. A empresa declarou que não houve comprometimento de dados sensíveis de usuários nem de sistemas críticos ligados a modelos de inteligência artificial.
Rehberger disse que comunicou a vulnerabilidade imediatamente à OpenAI e à Discourse, empresa responsável pelo software usado no fórum. “Informamos de imediato a vulnerabilidade à OpenAI e à Discourse”, afirmou em uma publicação em seu blog pessoal.
Risco de uso em ataques
O episódio ampliou a discussão sobre a utilização de modelos avançados de inteligência artificial em ciberataques. Empresas do setor, entre elas Anthropic e OpenAI, investem em mecanismos para impedir que seus sistemas ajudem na criação de malwares ou na invasão de redes.
A Anthropic afirmou que trabalha continuamente para reforçar as barreiras de segurança do Claude e que desestimula de forma enfática o uso da ferramenta em atividades prejudiciais. A empresa também informou manter políticas rigorosas de uso aceitável.
O caso mostrou que pesquisadores — e, potencialmente, hackers — ainda podem tentar contornar essas diretrizes por meio de técnicas de engenharia de prompt e da divisão de tarefas em etapas conceituais.




