Meta começa a testar novo sistema de proteção contra golpes no WhatsApp

Meta começa a testar novo sistema de proteção contra golpes no WhatsApp

A revelou ontem uma versão inicial do Scam Alert, um recurso de segurança opcional do que utiliza um modelo de aprendizado de máquina executado no próprio dispositivo para identificar mensagens que possam fazer parte de um golpe.

O recurso visa “combater fraudes cada vez mais sofisticadas envolvendo falsidade ideológica, engenharia social e iscas geradas por IA”, sem comprometer a criptografia de ponta a ponta do serviço. Uma vez ativado, o Scam Alert analisa as mensagens recebidas de pessoas que não estão na lista de contatos do usuário.

Posts relacionados

Por rodar no dispositivo, a empresa afirma que o conteúdo da mensagem permanece no aparelho do usuário durante a análise e não é enviado automaticamente para o WhatsApp, a Meta ou terceiros.

Conforme detalhado pela Meta, o modelo de aprendizado de máquina realiza uma classificação probabilística — com base na estrutura da conversa e em padrões linguísticos aprendidos a partir de conversas fraudulentas relatadas anteriormente por usuários — para detectar possíveis golpes.

Quando uma fraude é constatada, o WhatsApp exibirá um aviso dentro da conversa. O destinatário poderá, então, bloquear ou denunciar o remetente, continuar a conversa ou marcar o chat como confiável, para que mensagens futuras nessa conversa não sejam mais sinalizadas.

Se o modelo identificar uma mensagem como uma provável tentativa de golpe, o usuário verá um aviso no chat que não é visível para a outra pessoa. A partir daí, o usuário pode decidir o que fazer: bloquear, denunciar ou continuar a conversa.

Se o usuário considerar que o aviso foi exibido incorretamente, ele pode marcar o chat como confiável; nesse caso, o aviso é removido e o recurso de alerta de golpes não sinalizará aquele chat novamente. Ao marcar um chat como confiável, o usuário também pode optar por compartilhar com o WhatsApp as últimas cinco mensagens recebidas, ajudando a melhorar a precisão do recurso.

Os usuários também poderão verificar a atividade do recurso acessando Conta » Pedir dados da conta » Atividade do Alerta de Golpe; isso inclui saber qual versão do modelo analisou uma mensagem e se um alerta foi gerado.

O recurso está em fase de testes, sendo que a Meta também está abrindo partes do sistema para análise externa por meio de seu programa de recompensa por bugs, de modo a permitir que pesquisadores de segurança verifiquem se as proteções de privacidade e os próprios alertas contra golpes funcionam conforme esperado.

A Meta afirma que os pesos do modelo também serão publicados, permitindo que pesquisadores independentes verifiquem se o classificador se limita apenas à detecção de golpes.

via The Verge