Bend the truth': Benchmark dataset for fake news detection in Urdu language and its evaluation
Tema
Aprendizaje automático (Machine learning)
Fecha de publicación
1-ene-2020
Editor
IOS Press
Descripción física
Artículo académico que presenta un nuevo corpus para la detección de noticias falsas en idioma urdu, compuesto por 900 artículos verificados manualmente (500 reales y 400 falsos) y organizados en cinco temas: negocios, salud, espectáculos, deportes y tecnología. Se estableció una clasificación de referencia usando n-gramas y clasificadores como AdaBoost, logrando F1Fake = 0.87 y F1Real = 0.90, con el objetivo de facilitar futuras investigaciones en detección automática de noticias falsas en urdu.