Desambiguación y enlazado de entidades en la poesía de Catulo: hacia una edición digital enriquecida y un grafo de conocimiento

cic.institucionOrigenCentro de Servicios en Gestión de Información
cic.isFulltextSI
cic.isPeerReviewedSI
cic.lugarDesarrolloProyecto de Enlace de Bibliotecas
cic.lugarDesarrolloLaboratorio de Investigación y Formación en Informática Avanzada (LIFIA)
cic.parentTypeObjeto de conferencia
cic.versionPublicada
dc.date.accessioned2026-08-18T10:42:44Z
dc.date.available2026-08-18T10:42:44Z
dc.identifier.urihttps://digital.cic.gba.gob.ar/handle/11746/12751
dc.titleDesambiguación y enlazado de entidades en la poesía de Catulo: hacia una edición digital enriquecida y un grafo de conocimientoes
dc.typeDocumento de conferencia
dcterms.abstractEste trabajo se inscribe en un proyecto más amplio orientado al estudio del discurso amoroso mediante herramientas computacionales. En esta oportunidad, nos concentramos en un corpus de poesía latina del período clásico, la obra de Cayo Valerio Catulo, cuya densidad semántica e histórica vuelve especialmente relevante la identificación y desambiguación de referencias a personas, lugares y grupos. Dada la naturaleza de los textos poéticos, estas entidades suelen aparecer en contextos altamente alusivos, con variación morfológica, ambigüedad semántica y recursos estilísticos como el hipérbaton, lo que dificulta su tratamiento automático. Para abordar este problema, evaluamos comparativamente dos enfoques de entity linking sobre Wikidata: un pipeline modular basado en reconocimiento de entidades, generación de candidatos y ranking semántico, y un enfoque generativo basado en GPT-4.1, utilizado tanto para la detección de menciones como para la selección final de entidades. La evaluación se apoya en un ground truth manual y distingue entre reconocimiento de entidades y enlazado semántico. Los resultados muestran comportamientos complementarios: el pipeline tradicional ofrece mayor trazabilidad y mejor cobertura del espacio de candidatos, mientras que el enfoque generativo alcanza mayor precisión en detección y mejor desempeño en la selección final de entidades, aunque con una estrategia más conservadora. En conjunto, el trabajo aporta una evaluación comparativa de métodos para poesía latina y sienta las bases para el enriquecimiento de una edición digital en XML-TEI con identificadores auditables y el diseño de un grafo de conocimiento literario.es
dcterms.abstractThis work forms part of a broader project aimed at studying love discourse through computational methods. In this paper, we focus on a corpus of Classical Latin poetry, namely the works of Gaius Valerius Catullus, whose semantic and historical density makes the identification and disambiguation of references to people, places, and groups especially relevant. Given the nature of poetic texts, such entities often appear in highly allusive contexts, with morphological variation, semantic ambiguity, and stylistic devices such as hyperbaton, which make their automatic processing particularly challenging. To address this problem, we comparatively evaluate two entity linking approaches over Wikidata: a modular pipeline based on named entity recognition, candidate generation, and semantic ranking, and a generative approach based on GPT-4.1, used both for mention detection and for final entity selection. The evaluation relies on a manually curated ground truth and distinguishes between named entity recognition and semantic linking. The results show complementary behaviors: the traditional pipeline offers greater traceability and broader candidate-space coverage, whereas the generative approach achieves higher precision in mention detection and better performance in final entity selection, albeit with a more conservative strategy. Overall, the paper provides a comparative evaluation of methods for Latin poetry and lays the groundwork for enriching an XML-TEI digital edition with auditable identifiers and for Tdesigning a literary knowledge graph.ven
dcterms.alternativeEntity Disambiguation and Linking in Catullan Poetry: Toward an Enriched Digital Edition and a Knowledge Graphes
dcterms.creator.authorNusch, Carlos Javier
dcterms.creator.authorBazzana Tanevitch, Luciana
dcterms.creator.authorTorres, Diego
dcterms.creator.authorCagnina, Leticia Cecilia
dcterms.creator.authorAntonelli, Rubén Leandro
dcterms.creator.authorErrecalde, Marcelo Luis
dcterms.creator.corporatecesgi
dcterms.extent1-17
dcterms.isPartOf.issue55
dcterms.isPartOf.seriesSimposio Argentino de Inteligencia Artificial y Ciencia de Datos (ASAID 2026) - JAIIO 55 (Universidad Tecnológica Nacional - Facultad Regional La Plata, 10 al 13 de agosto de 2026)
dcterms.languageEspañol
dcterms.licenseAttribution-NonCommercial-ShareAlike 4.0 International (BY-NC-SA 4.0)
dcterms.subjectnamed entity recognitiones
dcterms.subjectentity linkinges
dcterms.subjectlarge language modelses
dcterms.subjectLatin poetryes
dcterms.subjectGaius Valerius Catulluses
dcterms.subjectWikidataes
dcterms.subjectXML-TEIes
dcterms.subjectknowledge graphes
dcterms.subject.materiaCiencias de la Computación
dcterms.subject.materiaOtras Humanidades

Archivos

Bloque original

Mostrando 1 - 2 de 2
Cargando...
Miniatura
Nombre:
Documento completo
Tamaño:
1.42 MB
Formato:
Adobe Portable Document Format
Cargando...
Miniatura
Nombre:
Presentación
Tamaño:
5.71 MB
Formato:
Adobe Portable Document Format

Bloque de licencias

Mostrando 1 - 1 de 1
Cargando...
Miniatura
Nombre:
license.txt
Tamaño:
3.46 KB
Formato:
Item-specific license agreed upon to submission
Descripción: