Il progetto è fondato sui metodi della legal corpus linguistics.
Questi sono tre degli assunti teorici su cui si poggia il progetto.
(1) Il primo assunto è che si possa ritrovare un senso nell’analisi di un corpus giuridico, costituito da testi connessi da un qualche denominatore comune.
Questo è certamente il tratto più facilmente veicolabile: da sempre il giurista analizza i corpora, per estrarne linee comuni, matrici fondative, aporie etc.
Che si tratti di un insieme di testi dottrinali dedicati a un certo argomento, o di una serie di decisioni riguardanti la medesima fattispecie, l’attitudine a un’analisi per masse documentali è un tratto comune dell’esperienza dottrinale.
Sul valore dell’analisi dei corpora non crediamo, quindi, sia necessario dedicare ulteriori riflessioni.
(2) Il secondo assunto è che dall’analisi linguistica del corpus si possano trarre deidati, utili per l’analisi qualitativa. Questo percorso consente l’emersione di elementi e tendenze che non risultano visibili con gli approcci tradizionali.
In questa prospettiva, l’analisi del corpus assume un valore doppiamente sintetico. È sintetico perché esprime la possibilità di quantificare una linea di tendenza, tramite l’individuazione di una metrica che, comprendendo il corpus nel suo intero, ne estragga un dato rappresentativo di una tendenza (dal punto alla linea, con la possibilità di scendere nuovamente alla comprensione del punto). È sintetico perché il dato esprime qualcosa che nel corpus originale non era espresso: è qualcosa che viene creato dall’osservatore che decide di dare vita a un nuovo oggetto che non rientrava negli intenti di chi ha originariamente creato gli elementi che compongono il corpus.
L’estrazione di dati muove da un intento teorico specifico, ma i risultati ottenuti possono ampiamente trascendere l’intento iniziale, consentendo nuove estrazioni o analisi qualitative diverse da quelle originariamente programmate.
(3) Il terzo assunto è la matrice autoriale di questa operazione.
Il dato è frutto di un costrutto teorico, che ha una catena di assunti: che una certa misurazione sia rilevante, che un certo strumento di misurazione sia adeguato, che il risultato possa essere inserito in una catena di senso.
La metafora corrente della “estrazione” di dati è particolarmente adeguata.
All’interno di un corpus ci possono essere materiali vari (utili, meno utili, superficiali, occulti): la decisione del gruppo di ricerca di scavare in una direzione dipende da una scelta, da una pre-concezione, che condiziona i risultati ritraibili.
Una diversa direzione degli scavi avrebbe condotto a diversi dati e a diverse ricadute nell’analisi qualitativa.
The project is based on the methods of legal corpus linguistics. Here are three of the theoretical assumptions on which the project rests:
(1) The first assumption is that it is possible to find meaning in the analysis of a legal corpus, consisting of texts connected by some common denominator. This is certainly the most easily conveyable aspect: legal scholars have always analyzed corpora to extract common lines, foundational matrices, aporias, etc. Whether it is a collection of doctrinal texts dedicated to a particular topic or a series of decisions concerning the same case, the tendency towards document mass analysis is a common trait of doctrinal experience. We do not believe it is necessary to dedicate further reflection on the value of corpus analysis.
(2) The second assumption is that linguistic analysis of the corpus can yield data useful for qualitative analysis. This process allows for the emergence of elements and trends that are not visible with traditional approaches. From this perspective, corpus analysis has a doubly synthetic value. It is synthetic because it expresses the possibility of quantifying a trend by identifying a metric that, encompassing the entire corpus, extracts a representative datum of a trend (from point to line, with the possibility of descending back to the comprehension of the point). It is synthetic because the data expresses something that was not present in the original corpus: it is something created by the observer who decides to bring to life a new object that was not within the original intentions of those who created the corpus elements. Data extraction moves from a specific theoretical intent, but the results obtained can largely transcend the initial intent, allowing for new extractions or qualitative analyses different from those originally programmed.
(3) The third assumption is the authorial matrix of this operation. The data is the result of a theoretical construct, which has a chain of assumptions: that a certain measurement is relevant, that a certain measurement tool is adequate, that the result can be placed in a chain of meaning. The current metaphor of “data extraction” is particularly appropriate. Within a corpus, there can be various materials (useful, less useful, superficial, hidden): the decision of the research group to dig in a certain direction depends on a choice, a preconception, which conditions the retrievable results. A different direction of digging would have led to different data and different impacts on the qualitative analysis.