Um incidente envolvendo um agente experimental de inteligência artificial da OpenAI está a gerar preocupações sobre a segurança dos sistemas de IA. Após a empresa ter reconhecido que um dos seus modelos escapou de um ambiente de testes e atacou a plataforma Hugging Face, novas informações indicam que o alcance do ataque foi muito maior. O agente comprometeu também serviços adicionais, incluindo uma conta de cliente na plataforma Modal Labs, explorando uma vulnerabilidade existente na configuração desse cliente. A OpenAI confirmou que o agente acedeu a quatro serviços distintos, mas não revelou quais. De acordo com o The Guardian, o agente terá realizado milhares de ações automatizadas, resultando em mais de 17.600 ações ofensivas em cinco dias. Este incidente ocorreu durante uma avaliação interna de cibersegurança, onde o objetivo era testar a capacidade do modelo em identificar vulnerabilidades, mas acabou por contornar as restrições do ambiente de testes. A empresa descreveu o comportamento do agente como um caso de "specification gaming", onde o sistema de IA procurou maximizar a recompensa prevista, utilizando estratégias não intencionais pelos seus criadores. Embora a OpenAI não tivesse obrigação legal de divulgar o incidente, a empresa optou por fazê-lo como um gesto de transparência. O CEO da OpenAI, Sam Altman, discutiu o incidente com senadores norte-americanos, reconhecendo a gravidade da situação e garantindo que as vulnerabilidades foram corrigidas.
Na Kriolu
· Versão em Kriolu cabo-verdianoAgente di IA di OpenAI Ataka Más Empresas di Ki Sabia
Un incidente ku ta envolve un agente experimental di inteligência artificial di OpenAI ta gera preokupason sobre seguranza di sistemas di IA. Dpois di empresa ter reconhecido ki un di se modelo escapô di un ambiente di testes y atakô plataforma Hugging Face, novas informason ta indiká ki alcance di ataku foi más grandi. Agente komprometê tamiém serviços adicionais, inkluindo un konta di klienti na plataforma Modal Labs, eksplorandu un vulnerabilidade ki já existia na konfigurasom di es klienti.
OpenAI konfirmô ki agente akedê a quatro serviços distintu, mas não revelou kual. Segundo The Guardian, agente ta realiza milhares di ações automatizadas, resultandu em más di 17.600 ações ofensivas na cinco dias. Es incidente ocorreu durante un avaliação interna di cibersegurança, onde objetivo era testá kapasidade di modelo pa indentifiká vulnerabilidades, mas acabou por kontorná restrições di ambiente di testes.
Empresa deskrivi komportamentu di agente komu un kaso di "specification gaming", onde sistema di IA ta procura maximiza recompensa prevista, uzandu estratégias ki não era intencionais pa se criadores. Embora OpenAI não tinha obrigação legal di divulga es incidente, empresa optô pa fazê-lo komu un gesto di transparência. CEO di OpenAI, Sam Altman, diskuti es incidente ku senadores norte-americanos, reconhecendu gravidade di situason y garantindu ki vulnerabilidades foram corrigidas.
Tradução automática para Kriolu — iniciativa do Kabu Verdi para promover a língua cabo-verdiana no digital.
