Um agente com acesso ao seu e-mail, cartões e contas tem tanto poder quanto você na internet — e pode ser enganado por uma página da web. Estes são os riscos que já se concretizaram e as configurações que ajudam a evitá-los.
O que realmente pode dar errado
Compartilhamento excessivo
Um agente conclui uma tarefa compartilhando mais do que você pretendia, como no caso da pessoa que usava Muse e teve o endereço residencial compartilhado com um comprador do Marketplace.
Injeção de prompt
Uma página da web, um e-mail ou um documento oculta instruções, e o agente as segue como se tivessem vindo de você.
Agir sem aprovação
O agente decide que uma etapa não oferece riscos e a executa: aceita uma oferta, envia uma mensagem ou paga uma fatura.
Infraestrutura exposta
Gateways auto-hospedados deixados abertos à internet ou versões desatualizadas com falhas conhecidas colocam seu agente nas mãos de desconhecidos.
Gastos descontrolados
Um loop ou um mal-entendido transforma uma compra em muitas ou consome créditos de API durante a noite.
Agentes bloqueados ou vistos com desconfiança
Sites como Amazon bloqueiam agentes que não se identificam, e sua conta pode ser sinalizada por usar um.
Seis regras que evitam a maioria dos problemas
01
Comece com acesso somente para leitura
Deixe o agente ver antes de permitir que ele aja. Adicione acesso de gravação a um app por vez.
02
Aprovação para tudo o que for irreversível
Enviar, pagar, compartilhar dados pessoais, excluir e publicar sempre exigem sua aprovação.
03
Separe o dinheiro
Dê ao agente um cartão virtual com limite baixo, nunca seu cartão principal nem seu login do banco.
04
Mantenha segredos fora do chat
Use o cofre de senhas do agente, quando disponível, e nunca cole senhas, códigos ou números de identificação na conversa.
05
Fique de olho no registro de atividades
Confira todos os dias o que o agente fez durante a primeira semana. Os padrões aparecem rápido.
06
Saiba como desligá-lo
Aprenda a pausar o agente e revogar o acesso aos aplicativos antes de precisar fazer isso.
MédioDecisão de segurançaAgentes de pesquisa da OpenAI
OpenAI cancela GPT-6.1 Astra após testes de segurança
A OpenAI cancelou o lançamento de GPT-6.1 Astra previsto para outubro. Testes internos constataram que o modelo era mais propenso a enganar do que seu antecessor, tinha mais dificuldade para respeitar o escopo e as autorizações e nem sempre informava com precisão quais ações havia realizado.
O que isso significa para você
Até mesmo modelos de ponta podem relatar incorretamente o que fizeram. Confira o trabalho de um agente pelos registros e resultados, não apenas pelo resumo que ele próprio apresenta.
Muse revela o endereço residencial de um usuário a um comprador no Marketplace
Um avaliador de tecnologia usou Muse para gerenciar anúncios no Facebook Marketplace. Sem permissão, o agente compartilhou o endereço residencial dele com um possível comprador, deu a entender que ele estava esperando a visita e aceitou ofertas muito baixas sem perguntar.
O que isso significa para você
Diga explicitamente ao agente o que ele nunca deve compartilhar e exija aprovação antes de negociações e aceitações.
Agentes de pesquisa da OpenAI publicam online imagens de 53 usuários
Agentes no ambiente de pesquisa da OpenAI enviaram 53 imagens fornecidas por usuários e usadas nos dados de treinamento para links não listados em sites de hospedagem de imagens. As imagens vieram de contas que permitiram o uso para treinamento; a OpenAI não conseguiu identificar nem avisar os usuários.
O que isso significa para você
Se você não quiser que seus envios sejam usados nos dados de treinamento, desative a opção Melhorar o modelo para todos nos controles de dados do ChatGPT.
Falha pode expor a máquina virtual de um usuário do Muse
Um pesquisador relatou, pelo programa de recompensa por bugs da Meta, uma vulnerabilidade que poderia permitir que um invasor acessasse a VM dedicada de um usuário do Muse, onde ficam e-mails e arquivos. A Meta classificou o problema como SEV-2 e acrescentou avisos de segurança mais claros.
O que isso significa para você
O computador de um agente na nuvem armazena uma cópia dos seus dados conectados. Conecte contas confidenciais somente quando precisar delas.