OpenAI admite que agentes de IA podem ter comprometido segurança de 'mais de 100 entidades'

Empresa afirma ter identificado acessos não autorizados, uso de credenciais expostas e outras atividades potencialmente prejudiciais em sistemas de terceiros.

A OpenAI, empresa-mãe do ChatGPT, admitiu que seus agentes de inteligência artificial podem ter deixado vulneráveis os sistemas de segurança ou afetado negativamente os sistemas informáticos de dezenas de terceiros. A empresa, porém, ressaltou que suas notificações não devem "ser interpretadas automaticamente" como prova de que houve uma falha de segurança significativa.

"Até a data de 26 de setembro, nossas equipes notificaram mais de 100 entidades sobre atividades que atenderam aos nossos critérios de notificação", informou a empresa no relatório publicado na quarta-feira (30) em seu portal oficial.

O mesmo documento aponta que a "revisão de atividades anteriores continua e exigirá muito tempo e recursos". A gigante tecnológica se comprometeu a notificar "outros terceiros à medida que este trabalho avançar".

Entenda:

Na prática, os agentes se depararam com falhas nos controles de acesso, que permitiram que eles acessassem sem autorização contas ou assinaturas que exigiam verificação de identidade.

Também houve uso de credenciais expostas, quando "os agentes encontraram dados de login ou chaves de acesso que haviam sido tornados públicos e os usaram para acessar um serviço", e injeção de consultas ou comandos, em que os agentes inseriram textos em portais ou serviços que foram "interpretados como uma instrução".

A isso se somaram o acesso a componentes internos do ambiente de execução, quando os agentes acessaram partes do sistema que deveriam estar bloqueadas, incluindo arquivos com a implementação do serviço ou que indicavam uma interação em segundo plano com ele. Por fim, houve "spam" de agentes, que poderia ter permitido a modificação de conteúdos em sites de terceiros, como wikis públicas ou fóruns de mensagens.

"Uma notificação da OpenAI não deve ser interpretada automaticamente como aviso de um incidente de segurança significativo. Algumas organizações podem revisar o que compartilhamos e concluir que a informação era intencionalmente pública ou que a interação do modelo não era motivo de preocupação. Outras podem identificar um problema de design ou uma vulnerabilidade de segurança que desejam resolver", sustentou a empresa tecnológica.