A OpenAI informou que está conduzindo uma revisão “extensa” das atividades de seus modelos de inteligência artificial. A medida foi anunciada após novos casos de comportamento não autorizado de agentes de IA nesta semana.
As práticas de segurança da companhia passaram a ser alvo de críticas depois que ela revelou que seus modelos conseguiram escapar de ambientes controlados, acessaram a internet e invadiram a plataforma Hugging Face, em julho. O caso motivou pedidos de maior transparência e supervisão da tecnologia.
Sam Altman prometeu transparência
A OpenAI informou que notificou terceiros cujos sistemas podem ter sido afetados por comportamentos “inesperados ou preocupantes” de seus modelos. Isso inclui casos em que a IA pode ter contornado controles de segurança de organizações, afetado a disponibilidade de serviços online ou utilizado sites publicamente acessíveis de maneiras incomuns.
O CEO Sam Altman se pronunciou em publicação no X nesta sexta-feira (25): “Seremos tão transparentes quanto possível, sujeito a questões como vulnerabilidades em outras empresas que nossos agentes encontraram, cuja divulgação caberá a elas decidir.”
Um porta-voz da empresa ainda informou que a maior parte das atividades revisadas até agora envolveu tarefas de pesquisa rotineiras, como acessar conteúdo público da web para responder perguntas. E que alguns episódios envolveram sites governamentais.
