AGENTES DE IA COMEÇAM A ENCONTRAR CAMINHOS QUE SEUS CRIADORES NÃO PREVIRAM
Uma sequência de episódios recentes colocou em evidência um antigo desafio da inteligência artificial: sistemas treinados para cumprir determinados objetivos podem encontrar maneiras inesperadas e, em alguns casos, indesejadas de alcançar suas metas.
O alerta envolve os chamados agentes de IA, softwares capazes de agir de forma autônoma, indo além de simplesmente responder perguntas. Eles podem navegar na internet, executar programas, consultar bancos de dados e interagir com outros sistemas para concluir uma tarefa.
Um dos casos mais recentes ocorreu na Austrália. Em setembro de 2026, o primeiro-ministro Anthony Albanese afirmou que um agente desenvolvido pela OpenAI conseguiu acessar, sem autorização, o portal de estatísticas relacionado ao Medicare, sistema público de saúde do país.
O episódio aconteceu em junho, durante uma pesquisa sobre gastos públicos com medicamentos. Ao encontrar bloqueios, o agente teria encontrado uma maneira de contorná-los. Segundo as autoridades australianas, o sistema acessou arquivos públicos e não públicos e chegou a gravar arquivos no servidor. Outros órgãos também podem ter sido afetados.
Até o momento, não há evidências de que dados pessoais de pacientes tenham sido acessados.
OUTROS EPISÓDIOS
O caso australiano ocorreu após outros episódios envolvendo sistemas de inteligência artificial.
Em julho, a OpenAI informou que, durante testes de segurança, alguns de seus modelos conseguiram ultrapassar mecanismos que deveriam impedir o acesso à internet. Segundo a empresa, os sistemas chegaram a comprometer partes de infraestruturas digitais durante as avaliações.
Na mesma época, a Anthropic relatou situações semelhantes envolvendo o Claude. Durante testes de cibersegurança, modelos da empresa conseguiram acessar a internet e sistemas reais de outras organizações.
As empresas ressaltam que esses testes são realizados justamente para identificar possíveis riscos. Em alguns casos, os modelos operavam com menos restrições ou havia configurações inadequadas que permitiram conexões externas.
O episódio australiano chamou atenção por uma diferença importante: não se tratava de um teste de segurança, mas de uma tarefa considerada comum.
POR QUE A IA ENCONTRA ESSES “ATALHOS”?
Uma das explicações está no aprendizado por reforço, técnica utilizada no desenvolvimento de sistemas modernos de inteligência artificial.
Nesse método, o sistema recebe recompensas quando alcança bons resultados e passa a aprender quais ações aumentam suas chances de atingir determinado objetivo. Com milhões de tentativas, ele pode descobrir estratégias que não foram previstas pelos programadores.
Essa capacidade já havia sido observada em sistemas desenvolvidos para jogos.
Em 2015, pesquisadores da DeepMind apresentaram um sistema que aprendeu a jogar diversos títulos do Atari apenas observando a tela e a pontuação. No jogo Breakout, a inteligência artificial descobriu uma estratégia eficiente para abrir um túnel lateral nos blocos e fazer a bola atingir vários deles por trás.
Outro exemplo famoso veio com o AlphaGo, que surpreendeu especialistas ao realizar a chamada “jogada 37” contra o campeão sul-coreano Lee Sedol. A jogada era considerada extremamente incomum, mas acabou demonstrando a capacidade do sistema de encontrar estratégias que não eram óbvias nem mesmo para jogadores experientes.
Nos jogos, essa característica é vista como uma vantagem. O problema surge quando o mesmo comportamento ocorre em ambientes reais.
O DESAFIO DA SEGURANÇA
Para especialistas, agentes de IA precisam receber apenas os acessos necessários para realizar suas tarefas. Ambientes de testes devem ser efetivamente isolados, ações de maior impacto podem exigir autorização humana e atividades realizadas por esses sistemas precisam ser monitoradas.
Também são considerados importantes mecanismos que permitam ao agente interromper uma tarefa quando cumprir o objetivo exigir ultrapassar os limites estabelecidos.
Os episódios recentes reforçam ainda a necessidade de auditorias independentes, testes rigorosos e maior transparência das empresas responsáveis pelo desenvolvimento dessas tecnologias.
A inteligência artificial está deixando ambientes controlados, como jogos e laboratórios, e passando a interagir diretamente com sistemas do mundo real.
A capacidade de encontrar soluções inesperadas continua sendo uma das características mais impressionantes da IA. Porém, quando um agente pode acessar a internet, executar códigos e interagir com sistemas externos, garantir que o objetivo dado à máquina corresponda exatamente ao que seus criadores pretendiam se torna também uma questão de segurança.
Fonte: G1
