Use el DOI o este identificador para enlazar este recurso:
http://repositorioinstitucionaluacm.mx/jspui/handle/123456789/3462| Título : | Uso de una red neuronal para detectar autoría de textos |
| Autor(es): | Díaz Pérez, Eduardo Abraham |
| Asesor(es) : | Prado Záyago, Alma Nora Marco Antonio Padilla Longoria, Pablo |
| Título : | Uso de una red neuronal para detectar autoría de textos |
| Fecha de publicación : | jun-2026 |
| Palabras clave : | Autoría -- Análisis Redes neuronales (Computadores) Filología -- Procesamiento de datos Lingüística computacional Procesamiento del lenguaje natural (Computación) Cuento latinoamericano -- Siglo XX Inteligencia artificial Algoritmos Análisis textual Literatura hispanoamericana -- Crítica e interpretación |
| Abstract : | "Resumen En el ámbito de la filología, la atribución de autoría de textos antiguos o de autoría in- cierta representa un desafío que tradicionalmente requiere la intervención de especialistas. Este trabajo explora el uso de Redes Neuronales Artificiales (RNA), específicamente redes con compuertas Long Short-TermMemory (LSTM),como herramienta auxiliar para la detección de autoría de textos literarios en español.Se entrenó un mo de lo con 251 cuentos de tres autores latinoamericanos contemporáneos: Jorge Luis Borges,Mario Benedettiy Julio Cortázar.La metodología incluyó la extracción automatizada de textos, limpieza de datos (eliminación de encabezados, pies y palabras estructurales),tokenización,padding y generación de embeddings.El modelos e implementó en Pythoncon Tensor Flowyse ejecutó en entornos de cómputo de recursos limitados(Google Colaboratory).Los resul- tados alcanzaronunaprecisiónmáximadel84%yunpromediodel75%en la clasificación de textos de prueba.Se identificaron limitaciones relacionadas con el tamaño reducido del corpus,la disparida den las longitudes de los textos y la eliminación de palabras es- tructurales. No obstante,las pruebas con datos no etiquetados mostraron un desempeño congruente con la precisión obtenida durante el entrenamiento.Se concluye que las redes LSTM constituyen una herramienta viable y práctica para apoyar tareas filológicas,espe- cialmente cuando se dispone de conjuntos de datos limitados y heterogéneos, aunques e requieren refinamientos futuros como el balanceo de clases,la ampliación del vocabulario y la implementación de umbrales de confianza. Abstract In the field of philology, authorship attribution of ancient or uncertain texts represents a challenge that traditionally requires the intervention of specialists. This work explores the use of Artificial Neural Networks (ANN), specifically LongS hort-Term Memory (LSTM) networks, as an auxiliary tool for authorship detection of Spanish literary texts. A model was trained with 251 short stories by three contemporary Latin American authors: Jorge Luis Borges, Mario Benedetti, and Julio Cortázar. The methodology included automated text extraction, data cleaning (removal of headers, footers, and stopwords), tokenization, padding, and embedding generation. The model was implemented in Python using Tensor- Flow and executed on limited-resource computing environments (Google Colaboratory). Results achieved a máximum accuracy of 84% and an average of 75% on test set classification. Limitations related to the small corpus size, text length disparity, and stopword removal were identified. Nevertheless, tests with unlabeled data showed performance consistent with the training accuracy. It is concluded that LSTM networks constitute a viable and practical tool to support philological tasks, especially when dealing with limited and heterogeneous datasets, although future refinements such as class balancing, vocabulary expansion, and confidence thresholds are required". |
| URI : | http://repositorioinstitucionaluacm.mx/jspui/handle/123456789/3462 |
| Aparece en las colecciones: | Tesis Licenciatura |
Texto completo:
| Archivo | Descripción | Tamaño | Formato | |
|---|---|---|---|---|
| Eduardo Abraham Díaz Pérez_MM.pdf | Tesis de Licenciatura | 2.15 MB | Adobe PDF | Visualizar/Abrir |
Los recursos del repositorio están protegidos por copyright, con todos los derechos reservados, a menos que se indique lo contrario.
Skip navigation