Commit 46708bef authored by Laurette Chardon's avatar Laurette Chardon
Browse files

modifié : README.md

parent 75ce53f4
Loading
Loading
Loading
Loading
+27 −2
Changes for README.md: 27 added lines, 2 removed lines.
Original line number Diff line number Diff line
@@ -8,11 +8,33 @@ Ensuite nous utilisons les différentes méthodes de regroupement que propose ce

Extraction
----------
Le fichier d'extraction de la base de données du DES se présente sous cette forme :
Le fichier d'extraction de la base de données du DES (qui est accessible via un contrat de prêt pour la recherche, contacter crisco.webestre @ unicaen.fr)se présente sous cette forme  :

	mot1	mot2	[0|1]

Pour sec, nous allons avoir :

Les lignes sont triées sur mot1 puis  mot2 dans l'ordre alpabétique.

Pour sec, avec ce code :

	fichier = open (path+"syno_paires_mars2020.txt","r",encoding="iso-8859-1")
    listemots.append(mot)
    for ligne in fichier:
        #print('ligne',ligne)
        i1=ligne.index("\t")
        mot1=ligne[0:i1]
        ligne=ligne[i1+1:]
        i2=ligne.index("\t")
        #print('i2',i2)
        
        mot2=ligne[0:i2]
        #print('mot1-',mot1,'-mot2-',mot2,'-')
        if (mot == mot1): # si le 1er mot de la ligne est celui qu'on cherche
            listemots.append(mot2)
    fichier.close()
    return(listemots)
    
nous allons avoir :

	sec	abrupt	0
	sec	acerbe	0
@@ -82,6 +104,9 @@ Pour sec, nous allons avoir :
	sec	étique	0
	sec	étriqué	0

Pour chacun des synonymes de sec ci-dessus, nous extrayions du fichier les lignes où mot1 et mot2 sont synonymes de SEC.


Création de la matrice d'adjacence
----------------------------------