Testi, lessico e ambiti socioculturali: note sull'iperlemmatizzazione

Aprea, Fabio and Gesiot, Jacopo (2026) Testi, lessico e ambiti socioculturali: note sull'iperlemmatizzazione. Rivista del Dizionario Etimologico e Storico del Napoletano, 4 (1). pp. 83-94. ISSN 2975-0806

[thumbnail of serena_13822.pdf]
Anteprima
Testo
serena_13822.pdf - Versione pubblicata

Download (4MB) | Anteprima
URL ufficiale: https://serena.sharepress.it/RiDESN/article/view/1...

Abstract

This paper outlines the criteria and first results of hyperlemmatization in MED.ITA-LEMM, a subcorpus of the MEDITA project, and sets them against earlier OVI experiments on the Datini and Folchetto corpora. After defining the hyperlemma as an annotation layer above the lemma, the article presents the taxonomy adopted in MEDITA, consisting of 29 hyperlemmas distributed across 13 broader sociocultural domains towards which the lexical material of the texts converges. The discussion focuses on assignment criteria, on the treatment of ambiguity through lemma-level disambiguation, and on the decision to apply the annotation selectively to the most marked lexical items, especially neologisms, vernacular forms, and technical terms. MED.ITA-LEMM contains 46 texts; within this corpus, hyperlemmatization involves 214 lemmas and 1,380 occurrences. The results highlight the prominence of the political-administrative domain, while also confirming the analytical value of categories related to law, economy, productive activities, material culture, and anthropized territory. Hyperlemmatization thus emerges as an effective tool for cross-text lexical comparison and for further lexicographic developments. | Il contributo illustra criteri e primi risultati dell’esperimento di iperlemmatizzazione compiuto nell’ambito del progetto MEDITA, ponendoli in rapporto con i precedenti condotti presso l’OVI sui corpora Datini e Folchetto. Dopo avere definito l’iperlemma come livello di annotazione ulteriore rispetto al lemma, l’articolo presenta la tassonomia adottata in MEDITA, articolata in 29 iperlemmi distribuiti in 13 macro-ambiti socioculturali verso cui converge il lessico dei testi. L’analisi si concentra sui criteri di assegnazione, sulla gestione delle ambiguità mediante disambiguazione del lemma e sulla scelta di applicare l’annotazione in forma selettiva al lessico più marcato, in particolare neologismi, volgarismi e tecnicismi. Nel MED.ITA-LEMM, composto da 46 testi, l’iperlemmatizzazione interessa 214 lemmi e 1.380 occorrenze. I risultati mostrano la forte incidenza dell’area politico-amministrativa, ma anche la produttività delle categorie relative a diritto, economia, attività produttive, cultura materiale e territorio antropizzato. Ne emerge un modello di interrogazione lessicale utile per confronti trasversali fra testi e per ulteriori sviluppi lessicografici.

Tipologia del documento: Articolo in rivista
Parole chiave: iperlemmatizzazione ; MED.ITA-LEMM ; MEDITA ; latino medievale ; lessicografia storica ; linguistica dei corpora ; tassonomie lessicali ; volgarismi ; tecnicismi ; ambiti socioculturali ; hyperlemmatization ; Medieval Latin ; historical lexicography ; Corpus linguistics ; lexical taxonomies ; vernacularisms ; technical terms ; sociocultural domains
Soggetto: D History General and Old World > D History (General) > D111 Medieval History
P Language and Literature > P Philology. Linguistics
P Language and Literature > PC Romance languages
Depositato il: 22 Ago 2026 13:29
Ultima modifica: 22 Ago 2026 13:29
URI: https://www.rmoa.unina.it/id/eprint/9558

Downloads

Downloads per month over past year

Actions (login required)

Modifica documento Modifica documento