Resultados de la búsqueda a petición "tm"
Usa R para convertir archivos PDF en archivos de texto para minería de texto
Tengo cerca de mil artículos de revistas pdf en una carpeta. Necesito enviar un mensaje de texto en los resúmenes de todos los artículos de toda la carpeta. ...
¿Cómo analizo una cadena de fecha y hora que incluye tiempo fraccional?
Tengo una cadena de fecha y hora: 20: 48: 01.469 UTC MAR 31 2016 Me gustaría convertir esta representación de cadena de tiempo en unstruct tm utilizandostrptime, pero mi cadena de formato no funciona. ¿Hay un especificador de formato para ...
eliminar duplicados de la lista en función de la similitud / relación semántica
R + tm: ¿Cómo elimino la duplicación de elementos en una lista, en función de la similitud semántica?v<-c("bank","banks","banking", "ford_suv',"toyota_suv","nissan_suv"). Mi solución esperada seríac("bank", "ford_suv',"toyota_suv","nissan_suv"). ...
Crear N-Grams con tm y RWeka: funciona con VCorpus pero no con Corpus
Seguir las muchas guías para crearbiGramsusando los paquetes 'tm' y 'RWeka', me frustraba que solo1-gramosestaban siendo devueltos en eltdm. A través de muchas pruebas y errores descubrí que la función adecuada se logró usando 'VCorpus'pero no ...
Cómo calcular la proximidad de palabras a un término específico en un documento
Estoy tratando de encontrar una manera de calcular las proximidades de palabras a un término específico en un documento, así como la proximidad promedio (por palabra). Sé que hay preguntas similares sobre SO, pero nada que me dé la respuesta que ...
Comportamiento inconsistente con las funciones de transformación tm_map cuando se usan múltiples núcleos
Otro título potencial para esta publicación podría ser "Cuando se procesa en paralelo en r, ¿importa la relación entre el número de núcleos, el tamaño del fragmento de bucle y el tamaño del objeto?" Tengo un corpus en el que estoy ejecutando ...
Imposible ver resultados del texto `RTextTools :: toLower ()` en Document-Term-Matrix
Intento crear una matriz, para esto me gustaría reducir el texto. Para esto utilizo esta instrucción R: matrix = create_matrix(tweets[,1], toLower = TRUE, language="english", removeStopwords=FALSE, removeNumbers=TRUE, stemWords=TRUE)Aquí el ...
Error al instalar paquetes antiguos en R
Estoy tratando de instalar una versión 0.6-2 de la biblioteca tm. He descargado el archivo tar.gz delarchivo [https://cran.r-project.org/src/contrib/Archive/tm/]y en RStudio seleccionó Herramientas -> Archivo -> Archivo de paquete para ...