Please use this identifier to cite or link to this item: https://rinacional.tecnm.mx/jspui/handle/TecNM/13985
Full metadata record
DC FieldValueLanguage
dc.contributor.authorFranco Rogel, Johan Argenis%2042376-
dc.creatorFranco Rogel, Johan Argenis%2042376-
dc.date.accessioned2026-09-11T06:24:52Z-
dc.date.available2026-09-11T06:24:52Z-
dc.date.issued2026-09-04-
dc.identifier.urihttps://rinacional.tecnm.mx/jspui/handle/TecNM/13985-
dc.descriptionLos modelos de lenguaje de gran tamaño han demostrado un desempeño sobresaliente en tareas de generación de texto; sin embargo, presentan limitaciones para responder consultas sobre dominios especializados debido a la posibilidad de generar información no respaldada por fuentes documentales. Una estrategia ampliamente utilizada para reducir este problema consiste en emplear arquitecturas de Generación Aumentada por Recuperación (RAG por sus siglas en inglés), las cuales incorporan información externa durante el proceso de generación. En esta investigación se desarrolló y evaluó un sistema RAG orientado al dominio museográfico, empleando un modelo de lenguaje pequeño (SLM por sus siglas en inglés) y una estrategia de recuperación híbrida basada en la combinación lineal de evidencia léxica y evidencia semántica. Como parte del trabajo se realizaron cinco experimentos: evaluación de la robustez del recuperador ante errores ortográficos; selección del modelo generativo mediante el banco de pruebas Multilingual Massive Multitask Language Understanding (MMMLU); comparación de estrategias de recuperación sobre el conjunto MessIRve; evaluación integral del sistema RAG mediante métricas de recuperación, generación y evaluadores automáticos; y evaluación con usuarios para analizar el desempeño y la interacción con el sistema. Los resultados muestran que la estrategia híbrida propuesta supera a los métodos de recuperación convencionales, obteniendo mejores valores en MRR y exhaustividad (Recall). Asimismo, la implementación desarrollada obtuvo un mejor desempeño que una implementación equivalente basada en LangChain tanto en recuperación como en generación de respuestas. Finalmente, la evaluación con usuarios evidenció que el sistema facilita la consulta de información histórica mediante lenguaje natural y favorece la exploración del contenido museográfico.es_MX
dc.language.isospaes_MX
dc.publisherTecnológico Nacional de Méxicoes_MX
dc.rights.urihttp://creativecommons.org/licenses/by-nc-nd/4.0es_MX
dc.subjectinfo:eu-repo/classification/cti/7es_MX
dc.subject.otherRetrieval-Augmented Generation (RAG), recuperación híbrida de información, modelos de lenguaje pequeños (SLM), procesamiento de lenguaje natural (PLN)es_MX
dc.titleDesarrollo de un modelo basado en lenguaje natural para la recuperación de información histórica y cultural mediante técnicas de retrieval augmented generationes_MX
dc.typeinfo:eu-repo/semantics/masterThesises_MX
dc.contributor.directorCastro Sánchez, Noé Alejandro%43119-
dc.contributor.directorLópez Sánchez, Máximo%89655-
dc.folio1595es_MX
dc.rights.accessinfo:eu-repo/semantics/openAccesses_MX
dc.publisher.tecnmCentro Nacional de Investigación y Desarrollo Tecnológicoes_MX
Appears in Collections:Tesis de Maestría en Computación

Files in This Item:
File Description SizeFormat 
MC_Johan_Argenis_Franco_Rogel_2026.pdfTesis2.3 MBAdobe PDFView/Open
MC_Johan_Argenis_Franco_Rogel_2026_c.pdf
  Restricted Access
Cesión de derechos159.16 kBAdobe PDFView/Open Request a copy


This item is protected by original copyright



This item is licensed under a Creative Commons License Creative Commons