Los puntos clave no están disponibles para este artículo en este momento.
Wikipedia es el mayor repositorio web de conocimiento libre. Los editores voluntarios dedican tiempo y esfuerzo a crear y expandir artículos en más de 300 ediciones de idioma. A medida que la calidad del contenido varía de un artículo a otro, los editores también pasan un tiempo sustancial evaluando artículos con criterios específicos. Sin embargo, mantener estas evaluaciones completas y actualizadas es en gran medida imposible dada la naturaleza en constante cambio de Wikipedia. Para superar esta limitación, proponemos un nuevo marco computacional para modelar la calidad de los artículos de Wikipedia. Los enfoques más avanzados para modelar la calidad de los artículos de Wikipedia han aprovechado técnicas de aprendizaje automático con características específicas del idioma. En contraste, nuestro marco se basa en características estructurales agnósticas al idioma extraídas de los artículos, un conjunto de pesos universales y un criterio de normalización específico de la versión del idioma. Por lo tanto, garantizamos que todas las ediciones de idioma de Wikipedia puedan beneficiarse de nuestro marco, incluso aquellas que no tienen su propio esquema de evaluación de calidad. Usando este marco, hemos construido conjuntos de datos con los valores de las características y las puntuaciones de calidad de todas las revisiones de todos los artículos en las versiones de idioma existentes de Wikipedia. Ofrecemos un análisis descriptivo de estos recursos y un punto de referencia de nuestro marco. Además, discutimos posibles tareas posteriores que se pueden abordar con estos conjuntos de datos, que se liberan para uso público.
Das et al. (2024) estudiaron esta cuestión.
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: