INTERPRETAÇÃO DE TEXTO
Leia o texto a seguir e responda às questões de 19 a 23.
Algoritmo detector de fake news funciona melhor do que ser humano
O sistema aprendeu sozinho características que distinguem uma notícia verdadeira de outra
propositalmente fraudada.
Um sistema baseado em algoritmos que identifica pistas linguísticas reveladoras em notícias falsas (fake
news) poderia fornecer a sites agregadores de conteúdo e a sites de mídias sociais, como o Google News,
uma nova arma na luta contra as informações incorretas.
Os pesquisadores da Universidade de Michigan que desenvolveram o sistema demonstraram que sua
capacidade para identificar corretamente notícias falsas é comparável à dos humanos e, algumas vezes, é
até superior.
Em um estudo recente, o algoritmo identificou corretamente 76% das notícias falsas, mais do que a taxa
de sucesso humano de 70%. Além disso, sua abordagem de análise linguística poderia ser utilizada para
identificar artigos de notícias falsas que são recentes demais para serem desmascarados através da
referência cruzada dos fatos que eles mencionam com outras histórias.
Rada Mihalcea, professora de ciência da computação e engenharia da Universidade de Michigam (UM),
que está por trás do projeto, disse que uma solução automatizada poderia ser uma ferramenta importante
para sites que estão lutando para lidar com notícias falsas, que são frequentemente criadas para gerar
cliques ou manipular a opinião pública.
Encontrar as fake news antes que elas gerem consequências reais pode ser difícil, já que atualmente os
sites de mídia social dependem bastante de editores humanos, que muitas vezes não conseguem
acompanhar o fluxo de notícias. Além disso, as técnicas de “desmascaramento” atuais geralmente
dependem da verificação externa dos fatos, o que pode ser difícil de averiguar no caso de histórias mais
recentes. Muitas vezes, quando se consegue provar que uma história é falsa, o dano já foi feito.
A análise linguística adota uma abordagem diferente, analisando atributos quantificáveis como estrutura
gramatical, escolha de palavras, pontuação e complexidade. Ela funciona mais rápido do que os humanos, e
pode ser usada com vários tipos diferentes de notícias.
“Pode-se imaginar um enorme número de utilizações para o detector no front-end ou back-end (termos
em computação que se referem às etapas iniciais e finais de um processo) de um site de notícias ou mídia
social”, disse Mihalcea. “Ele poderia fornecer aos usuários uma estimativa da confiabilidade das histórias
individuais ou de um site de notícias completo. Ou poderia ser um ajudante de primeira linha do back-end
de um site de notícias, sinalizando histórias suspeitas para serem revisadas posteriormente. Uma taxa de
sucesso de 76% possui uma grande margem de erro, mas ainda pode fornecer uma visão valiosa para ser
usada de forma complementar.
Algoritmos linguísticos que analisam a fala escrita são bastante comuns hoje em dia, disse Mihalcea. O
desafio de construir um detector de fake news não está na construção do algoritmo em si, mas em
encontrar quais os dados certos para treinar esse algoritmo.
As fake news aparecem e desaparecem rapidamente, o que dificulta encontrá-las. Elas ocorrem em
muitos gêneros linguísticos, complicando ainda mais o processo de identificação. Notícias satíricas, por
exemplo, são fáceis de encontrar, mas o uso da ironia e do absurdo as torna menos útil para treinar um
algoritmo que detecte notícias falsas que pretendem induzir em erro.
Por isso, a equipe de Mihalcea criou seus próprios dados, montou uma equipe on-line que realizou uma
espécie de engenharia reversa, transformando notícias verdadeiras em falsificações. Esse procedimento
emula o modo como a maioria das notícias falsas é criada por indivíduos que as escrevem rapidamente em
troca de uma recompensa monetária, disse Mihalcea.
Os participantes do estudo, recrutados com a ajuda do site Amazon Mechanical Turk, foram pagos para
transformar notícias curtas e reais em notícias semelhantes, mas falsas, imitando o estilo jornalístico dos
artigos. No fim do processo, a equipe de pesquisa tinha um conjunto de dados de 500 notícias reais e falsas.
. Em seguida, os pesquisadores classificaram esses pares de histórias para o algoritmo, que realizou uma
análise linguística e ensinou a si mesmo a distinguir entre notícias reais e falsas. Finalmente, a equipe
acionou o algoritmo para analisar um conjunto de dados de notícias reais e falsas extraídas diretamente da
Web, obtendo a taxa de sucesso de 76%.
Os detalhes do novo sistema e do conjunto de dados que a equipe usou para construí-lo estão disponíveis
gratuitamente, e Mihalcea diz que eles poderiam ser usados por sites de notícias e outras entidades para
construir seus próprios sistemas de detecção de notícias falsas. Ela ressalta que os futuros sistemas podem
inclusive ser aprimorados pela incorporação de metadados, como os links e comentários associados a um
determinado item de notícias on-line.
Um artigo detalhando o sistema será apresentado na sexta-feira (24) na 27.a Conferência Internacional
sobre Linguística Computacional em Santa Fé. Mihalcea trabalhou com a cientista da UM e pesquisadora
assistente de engenharia Veronica Perez-Rosas, a pesquisadora de psicologia Bennett Kleinberg, da
Universidade de Amsterdã, e a aluna de graduação da UM Alexandra Lefevre.
O artigo é intitulado “Detecção automática de Fake News”. Universidade de Michigan. .
.. [Link]
algoritmo_detector_de_fake_news_funciona_melhor_do_que_ser_humano.html. Acesso em 01/11/2018/
19. O texto apresentado é um artigo que faz parte de uma revista científica. Qual é o seu tema, ou seja,
qual a ideia principal que ele desenvolve?
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
20. Segundo o texto, como funcionaram os testes para o desenvolvimento do sistema baseado em
algoritmos para a identificação de fake news?
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
21. De acordo com o texto, qual a diferença, em porcentagem, de detecção de fake news, entre a
percepção humana e a do sistema baseado em algoritmo? Quais são os impedimentos para que a detecção
dessas notícias falsas sejam precisas, segundo Rada Mihalcea?
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
22. A tecnologia desse sistema encontra-se disponível para o mercado? Há ainda possibilidades de
aprimoramento desse sistema, segundo Mihalce? Retire um trecho do texto em que se comprove sua
afirmação.
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
23. No texto, a demonstração do desenvolvimento do sistema de detecção de fake news se deu por meio
de: a) análise de causas e consequências.
b) retrospectiva histórica.
c) comparações.
d) exemplos.
Justifique sua resposta.
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________
_______________________________________________________________________________________