Changes for README.md: 27 added lines, 2 removed lines.
Original line number
Diff line number
Diff line
@@ -8,11 +8,33 @@ Ensuite nous utilisons les différentes méthodes de regroupement que propose ce
Extraction
----------
Le fichier d'extraction de la base de données du DES se présente sous cette forme :
Le fichier d'extraction de la base de données du DES (qui est accessible via un contrat de prêt pour la recherche, contacter crisco.webestre @ unicaen.fr)se présente sous cette forme :
mot1 mot2 [0|1]
Pour sec, nous allons avoir :
Les lignes sont triées sur mot1 puis mot2 dans l'ordre alpabétique.
Pour sec, avec ce code :
fichier = open (path+"syno_paires_mars2020.txt","r",encoding="iso-8859-1")
listemots.append(mot)
for ligne in fichier:
#print('ligne',ligne)
i1=ligne.index("\t")
mot1=ligne[0:i1]
ligne=ligne[i1+1:]
i2=ligne.index("\t")
#print('i2',i2)
mot2=ligne[0:i2]
#print('mot1-',mot1,'-mot2-',mot2,'-')
if (mot == mot1): # si le 1er mot de la ligne est celui qu'on cherche
listemots.append(mot2)
fichier.close()
return(listemots)
nous allons avoir :
sec abrupt 0
sec acerbe 0
@@ -82,6 +104,9 @@ Pour sec, nous allons avoir :
sec étique 0
sec étriqué 0
Pour chacun des synonymes de sec ci-dessus, nous extrayions du fichier les lignes où mot1 et mot2 sont synonymes de SEC.