Mensagem da Deep Tide TechFlow: a 25 de julho, a Anthropic anunciou que o seu modelo Opus 5 é quase imune a ataques de injeção de prompts no contexto de agentes inteligentes no navegador. Em 129 cenários de teste, a taxa de sucesso do ataque foi zero; nos testes de injeção de prompts universais do Gray Swan, após 15 tentativas, a taxa desceu de 5,5% do Opus 4.8 para 2,0%. A taxa de sucesso zero só foi alcançada quando produtos como o Claude Cowork ativaram o Auto Mode, uma vez que este modo combina duas camadas de defesa: varredura de entrada e interceptação da execução. A injeção de prompts é considerada uma das maiores ameaças de segurança que os agentes de IA enfrentam; esta melhoria poderá assinalar que o problema foi efetivamente mitigado em cenários específicos.

Ver original
Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Comentar
Adicionar um comentário
Adicionar um comentário
Nenhum comentário
  • Fixado