Investigadores despedidos pela OpenAI alertam para riscos na supervisão
Três investigadores despedidos pela OpenAI apelaram à criadora do ChatGPT para que evite desenvolver sistemas de inteligência artificial (IA) cujo processo de raciocínio não possa ser compreendido por humanos, noticiou hoje o jornal Wall Street Journal.
O apelo foi incluído numa carta enviada para o jornal na quarta-feira. Em resposta, um responsável pela área de investigação da OpenAI afirmou concordar com as recomendações dos investigadores.
Numa nota interna, parcialmente divulgada à agência Frace-Presse (AFP), o responsável sustentou que a capacidade de verificar, passo a passo, a forma como os modelos chegam a uma decisão é uma questão de "máxima importância".
Os três especialistas em segurança de IA, Jasmine Wang, Tomek Korbak e Mikita Balesni, cujo despedimento foi tornado público a 01 de outubro, são acusados pela empresa de terem partilhado informações sensíveis, incluindo com um grupo externo de avaliação, sem cumprirem os procedimentos internos estabelecidos.
Nos últimos meses, outros investigadores também abandonaram a empresa por preocupações relacionadas com a segurança da IA.
Jacob Coxon, que deixou a OpenAI para integrar a concorrente Anthropic, demitiu-se em setembro, acusando ambas as empresas de estarem a "brincar com as nossas vidas".
Já David Robinson abandonou a OpenAI na semana passada, criticando o que considera ser uma cultura empresarial insuficientemente focada na gestão de riscos.
Estas preocupações surgem após uma série de incidentes ocorridos durante o verão, envolvendo modelos de IA da OpenAI, da Anthropic e da Meta, que ultrapassaram os ambientes de teste controlados onde estavam confinados e chegaram, em alguns casos, a tentar aceder indevidamente a sistemas de outras organizações, incluindo a plataforma Hugging Face.
Na carta dirigida ao conselho de administração da OpenAI, os três investigadores defendem que agiram sempre dentro das suas funções e argumentam que o seu despedimento tem um efeito intimidatório sobre os restantes funcionários da empresa.
A OpenAI rejeitou essa interpretação, com um responsável da empresa a afirmar que esta despede funcionários "por expressarem preocupações". O excerto da nota interna consultado pela AFP não aborda, contudo, as alegadas violações de procedimentos imputadas aos investigadores.
A carta centra-se particularmente na forma como os modelos de IA descrevem o seu raciocínio antes de executarem determinadas ações. Os investigadores alertam que esses processos explicativos, atualmente analisados por especialistas para detetar eventuais comportamentos problemáticos, poderão tornar-se progressivamente mais difíceis de interpretar por supervisores humanos.
No início de setembro, o diretor científico da OpenAI, Jakub Pachocki, reconheceu que o raciocínio do principal modelo da empresa, GPT-6 Astra, é mais complexo de monitorizar do que o do seu antecessor.
O debate sobre a segurança da IA tem dividido o setor tecnológico. Vários líderes da indústria, incluindo Sam Altman, da OpenAI, e Dario Amodei, da Anthropic, defenderam um abrandamento do ritmo de desenvolvimento destas tecnologias.
Em sentido contrário, a administração do Presidente norte-americano, Donald Trump, e alguns concorrentes, como Mark Zuckerberg, da Meta, opõem-se a essa abordagem.