Ayuda
Ir al contenido

Dialnet


Comparing methods for language identification

  • Autores: Lluís Padró Cirera, Muntsa Padró
  • Localización: Procesamiento del lenguaje natural, ISSN 1135-5948, Nº. 33, 2004, págs. 155-161
  • Idioma: inglés
  • Enlaces
  • Resumen
    • español

      En este artículo se comparan tres sistemas estadísticos de identificación de idioma. Se presenta también un estudio detallado de la influencia de algunos factores importantes sobre la precisión de los sistemas. Estos factores son: la medida del corpus de entrenamiento, la cantidad de texto que se quiere clasificar y las lenguas entre las cuales el sistema es capaz de distinguir (se estudiará tanto el número de lenguas cómo cuáles son esas lenguas).

    • English

      In this work three different statistical language identification methods are compared, and a detailed study of the influence on those systems of some basic parameters is performed. The analyzed parameters are the size of the train set, the amount of text that we want to classify and the languages the system is able to distinguish (it will be studied not only the influence of the number of languages but also the influence of which are the considered languages).


Fundación Dialnet

Dialnet Plus

  • Más información sobre Dialnet Plus

Opciones de compartir

Opciones de entorno