commited all contents created by participants
This commit is contained in:
@@ -0,0 +1,8 @@
|
||||
https://pypi.python.org/pypi/wikipedia
|
||||
Wikipedia is a Python library that makes it easy to access and parse data from Wikipedia.
|
||||
|
||||
Search Wikipedia, get article summaries, get data like links and images from a page, and more. Wikipedia wraps the MediaWiki API so you can focus on using Wikipedia data, not getting it.
|
||||
|
||||
https://wikipedia.readthedocs.io/en/latest/
|
||||
|
||||
https://wikipedia.readthedocs.io/en/latest/quickstart.html#quickstart
|
||||
BIN
Binary file not shown.
BIN
Binary file not shown.
BIN
Binary file not shown.
BIN
Binary file not shown.
BIN
Binary file not shown.
BIN
Binary file not shown.
BIN
Binary file not shown.
BIN
Binary file not shown.
Binary file not shown.
@@ -0,0 +1,9 @@
|
||||
Les bienfaits de la gymnastique
|
||||
|
||||
On ne peut donner les sumos en exemple. Ces poussahs maous (1) paraissent nourris de plus de saindoux que de sushis (2). (La liposuccion d'un sumo, quel boulot!) Nous leur préférons les athlètes affûtés, à la silhouette fusiforme, au ventre plat, aux muscles saillants. Ils se sont donné bien du mal et ils se sont même condamnés à l'ascèse (l'ascète au beurre est un vieux calembour et une antinomie) pour obtenir ces corps de rêve. Ils fuient les amateurs de bonne chère, les abonnés aux agapes fournies, aux gueuletons, aux mâchons, aux excès des carêmes-prenants. Ils ne lésinent sur aucuns frais d'entretien, de raffermissement et de rajeunissement de leur capital de chair et d'os.
|
||||
|
||||
Pour nous, gens lambda qui aimons saucer, la gymnastique est une activité recommandée. Adeptes du cheval d'arçons (3) et de la corde à nœuds, nous ne serons cependant jamais les alter ego des culturistes. Nous ne prétendons pas non plus être capables de réussir le schibboleth...
|
||||
|
||||
Excellentes pour la peau, les sudations sur le tatami ou sur le trampoline! Nous éviterons ainsi les acnés inattendues, les urticaires inopinées, les érythèmes spontanés. Finies les mines pâlottes, les bouillottes, les marmottes! Du sang! Du souffle! Rangés, les écharpes effrangées de tussah, les manteaux en breitschwanz. Peu nous chaut la soie thermogène! Tonifié, musclé par les exercices, le corps exulte.
|
||||
|
||||
Mais il faut que nous appréciions nos efforts, sinon gare aux claquages, aux synovites, aux douleurs aiguës du bâti rudoyé. À chacun son rythme. Ne mêlons pas nos pompes aux œuvres des acrobates.
|
||||
@@ -0,0 +1,114 @@
|
||||
alors
|
||||
au
|
||||
aucuns
|
||||
aussi
|
||||
autre
|
||||
avant
|
||||
avec
|
||||
avoir
|
||||
bon
|
||||
car
|
||||
ce
|
||||
cela
|
||||
ces
|
||||
ceux
|
||||
chaque
|
||||
ci
|
||||
comme
|
||||
comment
|
||||
dans
|
||||
des
|
||||
du
|
||||
dedans
|
||||
dehors
|
||||
depuis
|
||||
devrait
|
||||
doit
|
||||
donc
|
||||
dos
|
||||
début
|
||||
elle
|
||||
elles
|
||||
en
|
||||
encore
|
||||
essai
|
||||
est
|
||||
et
|
||||
eu
|
||||
fait
|
||||
faites
|
||||
fois
|
||||
font
|
||||
hors
|
||||
ici
|
||||
il
|
||||
ils
|
||||
je juste
|
||||
la
|
||||
le
|
||||
les
|
||||
leur
|
||||
là
|
||||
ma
|
||||
maintenant
|
||||
mais
|
||||
mes
|
||||
mine
|
||||
moins
|
||||
mon
|
||||
mot
|
||||
même
|
||||
ni
|
||||
nommés
|
||||
notre
|
||||
nous
|
||||
ou
|
||||
où
|
||||
par
|
||||
parce
|
||||
pas
|
||||
peut
|
||||
peu
|
||||
plupart
|
||||
pour
|
||||
pourquoi
|
||||
quand
|
||||
que
|
||||
quel
|
||||
quelle
|
||||
quelles
|
||||
quels
|
||||
qui
|
||||
sa
|
||||
sans
|
||||
ses
|
||||
seulement
|
||||
si
|
||||
sien
|
||||
son
|
||||
sont
|
||||
sous
|
||||
soyez sujet
|
||||
sur
|
||||
ta
|
||||
tandis
|
||||
tellement
|
||||
tels
|
||||
tes
|
||||
ton
|
||||
tous
|
||||
tout
|
||||
trop
|
||||
très
|
||||
tu
|
||||
voient
|
||||
vont
|
||||
votre
|
||||
vous
|
||||
vu
|
||||
ça
|
||||
étaient
|
||||
état
|
||||
étions
|
||||
été
|
||||
être
|
||||
@@ -0,0 +1,15 @@
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
data = "All work and no play makes jack dull boy. All work and no play makes jack a dull boy."
|
||||
stopWords = set(stopwords.words('english'))
|
||||
words = word_tokenize(data)
|
||||
wordsFiltered = []
|
||||
|
||||
for w in words:
|
||||
if w not in stopWords:
|
||||
wordsFiltered.append(w)
|
||||
|
||||
print(wordsFiltered)
|
||||
print(len(stopWords))
|
||||
print(stopWords)
|
||||
@@ -0,0 +1,15 @@
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
data = "All work and no play makes jack dull boy. All work and no play makes jack a dull boy."
|
||||
stopWords = set(stopwords.words('french'))
|
||||
words = word_tokenize(data)
|
||||
wordsFiltered = []
|
||||
|
||||
for w in words:
|
||||
if w not in stopWords:
|
||||
wordsFiltered.append(w)
|
||||
|
||||
print(wordsFiltered)
|
||||
print(len(stopWords))
|
||||
print(stopWords)
|
||||
@@ -0,0 +1,15 @@
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
data = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
stopWords = set(stopwords.words('french'))
|
||||
words = word_tokenize(data)
|
||||
wordsFiltered = []
|
||||
|
||||
for w in words:
|
||||
if w not in stopWords:
|
||||
wordsFiltered.append(w)
|
||||
|
||||
print(wordsFiltered)
|
||||
print(len(stopWords))
|
||||
print(stopWords)
|
||||
@@ -0,0 +1,15 @@
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
data = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
stopWords = set(stopwords.words('french'))
|
||||
words = word_tokenize(data)
|
||||
wordsFiltered = []
|
||||
|
||||
for w in words:
|
||||
if w not in stopWords:
|
||||
wordsFiltered.append(w)
|
||||
|
||||
print(wordsFiltered)
|
||||
#print(len(stopWords))
|
||||
#print(stopWords)
|
||||
@@ -0,0 +1,17 @@
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
import re
|
||||
|
||||
data = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
stopWords = set(stopwords.words('french'))
|
||||
words = word_tokenize(data)
|
||||
|
||||
wordsFiltered = []
|
||||
|
||||
for w in words:
|
||||
if w not in stopWords:
|
||||
wordsFiltered.append(w)
|
||||
|
||||
print(wordsFiltered)
|
||||
#print(len(stopWords))
|
||||
#print(stopWords)
|
||||
@@ -0,0 +1,29 @@
|
||||
#!/usr/bin/python
|
||||
# -*- coding: utf-8
|
||||
# this is a shebang: https://en.wikipedia.org/wiki/Shebang_%28Unix%29
|
||||
|
||||
'''
|
||||
This script takes a sentence you write in the terminal, and gives it back in alphabetical order
|
||||
A list is ordered and changeable. It is less efficient than a set/tuple. But it allows to work with index numbers.
|
||||
Check out other options for list comprehension: https://docs.python.org/3/tutorial/datastructures.html
|
||||
Made for OLA #5, Paris, 15-17 décembre 2017
|
||||
'''
|
||||
|
||||
# Ask to write a sentence
|
||||
sentence = "Les gouvernements suspectent la littérature parce qu’elle est une force qui leur échappe"
|
||||
sentence1 ="Le gouvernement impose au CNNum l’exclusion de Rokhaya Diallo."
|
||||
print(sentence1[-1])
|
||||
sentence1 = sentence1[: -1]
|
||||
# print sentence
|
||||
print("phrase originale:", sentence1)
|
||||
|
||||
# Split sentence into words
|
||||
words = sentence1.lower().split()
|
||||
print(words)
|
||||
|
||||
# sort words of list
|
||||
words.sort()
|
||||
|
||||
# print sorted wordlist as string
|
||||
print("phrase alphabétique:", " ".join(words).capitalize()+'.')
|
||||
|
||||
@@ -0,0 +1,5 @@
|
||||
Je veux dire les formes changées en nouveaux
|
||||
corps. Dieux, vous qui faites les changements, inspirez
|
||||
mon projet et du début du début du monde
|
||||
jusqu’à mon temps faites courir un poème sans fin.
|
||||
|
||||
@@ -0,0 +1,31 @@
|
||||
Sous pont Mirabeau coule Seine
|
||||
Et amours
|
||||
Faut souvienne
|
||||
La joie venait toujours après peine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Les mains les mains restons face face
|
||||
Tandis sous
|
||||
Le pont bras passe
|
||||
Des éternels regards onde si lasse
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
L amour va comme cette eau courante
|
||||
L amour va
|
||||
Comme vie lente
|
||||
Et comme Espérance violente
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Passent les jours passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous pont Mirabeau coule Seine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
@@ -0,0 +1,31 @@
|
||||
sous pont mirabeau coule seine
|
||||
Amours
|
||||
Faut souvienne
|
||||
La joie venait toujours après peine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Les mains les mains restons face face
|
||||
Tandis sous
|
||||
Pont bras passe
|
||||
Des éternels regards onde si lasse
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
L amour va comme cette eau courante
|
||||
Amour va
|
||||
Comme vie lente
|
||||
Et comme espérance violente
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Passent les jours passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous pont mirabeau coule seine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
@@ -0,0 +1,32 @@
|
||||
|
||||
Sous pont mirabeau coule seine
|
||||
Amours
|
||||
Faut souvienne
|
||||
La joie venait toujours après peine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Les mains les mains restons face face
|
||||
Tandis sous
|
||||
Pont bras passe
|
||||
Des éternels regards onde si lasse
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
L amour va comme cette eau courante
|
||||
Amour va
|
||||
Comme vie lente
|
||||
Et comme espérance violente
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Passent les jours passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous pont mirabeau coule seine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
@@ -0,0 +1,32 @@
|
||||
|
||||
Sous pont mirabeau coule seine
|
||||
Amours
|
||||
Faut souvienne
|
||||
La joie venait toujours après peine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Les mains les mains restons face face
|
||||
Tandis sous
|
||||
Pont bras passe
|
||||
Des éternels regards onde si lasse
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
L amour va comme cette eau courante
|
||||
Amour va
|
||||
Comme vie lente
|
||||
Et comme espérance violente
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Passent les jours passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous pont mirabeau coule seine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
@@ -0,0 +1,32 @@
|
||||
Le
|
||||
Sous pont mirabeau coule seine
|
||||
Amours
|
||||
Faut souvienne
|
||||
La joie venait toujours après peine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Les mains les mains restons face face
|
||||
Tandis sous
|
||||
Pont bras passe
|
||||
Des éternels regards onde si lasse
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
L amour va comme cette eau courante
|
||||
Amour va
|
||||
Comme vie lente
|
||||
Et comme espérance violente
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
|
||||
Passent les jours passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous pont mirabeau coule seine
|
||||
|
||||
Vienne nuit sonne heure
|
||||
Les jours vont demeure
|
||||
@@ -0,0 +1,33 @@
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
Et nos amours
|
||||
Faut-il qu'il m'en souvienne
|
||||
La joie venait toujours après la peine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Les mains dans les mains restons face à face
|
||||
Tandis que sous
|
||||
Le pont de nos bras passe
|
||||
Des éternels regards l'onde si lasse
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
L'amour s'en va comme cette eau courante
|
||||
L'amour s'en va
|
||||
Comme la vie est lente
|
||||
Et comme l'Espérance est violente
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Passent les jours et passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
|
||||
@@ -0,0 +1,32 @@
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
Et nos amours
|
||||
Faut-il qu'il m'en souvienne
|
||||
La joie venait toujours après la peine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Les mains dans les mains restons face à face
|
||||
Tandis que sous
|
||||
Le pont de nos bras passe
|
||||
Des éternels regards l'onde si lasse
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
L'amour s'en va comme cette eau courante
|
||||
L'amour s'en va
|
||||
Comme la vie est lente
|
||||
Et comme l'Espérance est violente
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Passent les jours et passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
@@ -0,0 +1,31 @@
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
Et nos amours
|
||||
Faut-il qu'il m'en souvienne
|
||||
La joie venait toujours après la peine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Les mains dans les mains restons face à face
|
||||
Tandis que sous
|
||||
Le pont de nos bras passe
|
||||
Des éternels regards l'onde si lasse
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
L'amour s'en va comme cette eau courante
|
||||
L'amour s'en va
|
||||
Comme la vie est lente
|
||||
Et comme l'Espérance est violente
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Passent les jours et passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
@@ -0,0 +1,32 @@
|
||||
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
Et nos amours
|
||||
Faut-il qu'il m'en souvienne
|
||||
La joie venait toujours après la peine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Les mains dans les mains restons face à face
|
||||
Tandis que sous
|
||||
Le pont de nos bras passe
|
||||
Des éternels regards l'onde si lasse
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
L'amour s'en va comme cette eau courante
|
||||
L'amour s'en va
|
||||
Comme la vie est lente
|
||||
Et comme l'Espérance est violente
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
|
||||
Passent les jours et passent les semaines
|
||||
Ni temps passé
|
||||
Ni les amours reviennent
|
||||
Sous le pont Mirabeau coule la Seine
|
||||
|
||||
Vienne la nuit sonne l'heure
|
||||
Les jours s'en vont je demeure
|
||||
@@ -0,0 +1,33 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = str.lower(texte)
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
texte = texte.replace(" l ", " ")
|
||||
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
#print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,35 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
list_sup = ["'", "-", " l "," , "les ", "le ", "la ", "un ","une ", "des "]
|
||||
print(list_sup)
|
||||
texte = source.read()
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = str.lower(texte)
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
texte = texte.replace(" l ", " ")
|
||||
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
#print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,35 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
list_sup = ["'", "-", "l "," , "le ", "les ", "la ", "un ","une ", "des "]
|
||||
print(list_sup)
|
||||
texte = source.read()
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = str.lower(texte)
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
texte = texte.replace(" l ", " ")
|
||||
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
#print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,35 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
list_sup = ["'", "-", "l ", "le ", "les ", "la ", "un ","une ", "des "]
|
||||
print(list_sup)
|
||||
texte = source.read()
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = str.lower(texte)
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
texte = texte.replace(" l ", " ")
|
||||
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
#print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,36 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
#list_sup = ["'", "-", "l ", "le ", "les ", "la ", "un ","une ", "des "]
|
||||
print(list_sup)
|
||||
texte = source.read()
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = str.lower(texte)
|
||||
|
||||
# texte = texte.replace("'", " ")
|
||||
# texte = texte.replace("-", " ")
|
||||
# texte = texte.replace(" l ", " ")
|
||||
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
#print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,44 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
#print(texte)
|
||||
liste_phrase = texte.lower().split(" ")
|
||||
#print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
#liste_phrase = str.lower(texte)
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduite :", liste_reduit)
|
||||
|
||||
#ré-introduire les majuscules en debut de vers
|
||||
for i in range( len ( liste_reduit ) ):
|
||||
mot_split = liste_reduit[i].split("\n")
|
||||
#print("mot_split", mot_split)
|
||||
if ( len(mot_split) == 2):
|
||||
mot_split[1] = mot_split[1].capitalize()
|
||||
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
|
||||
if ( i > 0 and liste_reduit[i-1] == '' ):
|
||||
liste_reduit[i] = liste_reduit[i].capitalize()
|
||||
|
||||
#if (elt.endswith("\n") and elt != " " ):
|
||||
#mot = elt.capitalize()
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
print("version réduite du poeme :", poeme_reduit.capitalize())
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,44 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
|
||||
#print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
#print(texte)
|
||||
liste_phrase = texte.lower().split(" ")
|
||||
#print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
#liste_phrase = str.lower(texte)
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduite :", liste_reduit)
|
||||
|
||||
#ré-introduire les majuscules en debut de vers
|
||||
for i in range( len ( liste_reduit ) ):
|
||||
mot_split = liste_reduit[i].split("\n")
|
||||
#print("mot_split", mot_split)
|
||||
if ( len(mot_split) == 2):
|
||||
mot_split[1] = mot_split[1].capitalize()
|
||||
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
|
||||
if ( i > 0 and liste_reduit[i-1] == '' ):
|
||||
liste_reduit[i] = liste_reduit[i].capitalize()
|
||||
|
||||
#if (elt.endswith("\n") and elt != " " ):
|
||||
#mot = elt.capitalize()
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,44 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
|
||||
#print("texte or", texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
#print(texte)
|
||||
liste_phrase = texte.lower().split(" ")
|
||||
#print("liste des mots originaux séparés:", liste_phrase)
|
||||
print(liste_phrase)
|
||||
liste_reduit = []
|
||||
#liste_phrase = str.lower(texte)
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduite :", liste_reduit)
|
||||
|
||||
#ré-introduire les majuscules en debut de vers
|
||||
for i in range( len ( liste_reduit ) ):
|
||||
mot_split = liste_reduit[i].split("\n")
|
||||
#print("mot_split", mot_split)
|
||||
if ( len(mot_split) == 2):
|
||||
mot_split[1] = mot_split[1].capitalize()
|
||||
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
|
||||
if ( i > 0 and liste_reduit[i-1] == '' ):
|
||||
liste_reduit[i] = liste_reduit[i].capitalize()
|
||||
|
||||
#if (elt.endswith("\n") and elt != " " ):
|
||||
#mot = elt.capitalize()
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,46 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
|
||||
#print("texte or", texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
#print(texte)
|
||||
liste_phrase = texte.lower().split(" ")
|
||||
#print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
#liste_phrase = str.lower(texte)
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
print("allword", w)
|
||||
if w not in stopWords:
|
||||
print("no stopword", w)
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduite :", liste_reduit)
|
||||
|
||||
#ré-introduire les majuscules en debut de vers
|
||||
for i in range( len ( liste_reduit ) ):
|
||||
mot_split = liste_reduit[i].split("\n")
|
||||
#print("mot_split", mot_split)
|
||||
if ( len(mot_split) == 2):
|
||||
mot_split[1] = mot_split[1].capitalize()
|
||||
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
|
||||
if ( i > 0 and liste_reduit[i-1] == '' ):
|
||||
liste_reduit[i] = liste_reduit[i].capitalize()
|
||||
|
||||
#if (elt.endswith("\n") and elt != " " ):
|
||||
#mot = elt.capitalize()
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,45 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
|
||||
#print("texte or", texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
#print(texte)
|
||||
liste_phrase = texte.lower().split(" ")
|
||||
#print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
#liste_phrase = str.lower(texte)
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
print("no stopword", w)
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduite :", liste_reduit)
|
||||
|
||||
#ré-introduire les majuscules en debut de vers
|
||||
for i in range( len ( liste_reduit ) ):
|
||||
mot_split = liste_reduit[i].split("\n")
|
||||
#print("mot_split", mot_split)
|
||||
if ( len(mot_split) == 2):
|
||||
mot_split[1] = mot_split[1].capitalize()
|
||||
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
|
||||
if ( i > 0 and liste_reduit[i-1] == '' ):
|
||||
liste_reduit[i] = liste_reduit[i].capitalize()
|
||||
|
||||
#if (elt.endswith("\n") and elt != " " ):
|
||||
#mot = elt.capitalize()
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,34 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
intro = "Pont Mirabeau "
|
||||
edition = str(intro), str(poeme_reduit)
|
||||
print(edition)
|
||||
|
||||
#with open("mirabeau_reduit.txt", "w") as destination :
|
||||
#destination.write(" ".join(liste_reduit))
|
||||
|
||||
#print("version réduite du poeme :", " ".join(liste_reduit) )
|
||||
@@ -0,0 +1,31 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
#destination.write(" ".join(liste_reduit))
|
||||
|
||||
print("version réduite du poeme :", " ".join(liste_reduit) )
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
#print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,31 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
with open("mirabeau.txt", "r") as source:
|
||||
texte = source.read()
|
||||
texte = str.lower(texte)
|
||||
print(texte)
|
||||
#enlever les traits d'union et les apostrophes
|
||||
texte = texte.replace("'", " ")
|
||||
texte = texte.replace("-", " ")
|
||||
print(texte)
|
||||
liste_phrase = texte.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
#print("liste des mots réduit :", liste_reduit)
|
||||
poeme_reduit = (" ".join(liste_reduit))
|
||||
print("version réduite du poeme :", poeme_reduit)
|
||||
|
||||
with open("mirabeau_reduit.txt", "w") as destination :
|
||||
destination.write(" ".join(liste_reduit))
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
liste_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduit", liste_reduit)
|
||||
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
|
||||
print("version réduite du poeme", poeme_reduit)
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
phrase = str.lower(phrase)
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
liste_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduit", liste_reduit)
|
||||
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
|
||||
print("version réduite du poeme", poeme_reduit)
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine, les choses, la vie, un, une, des, Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
phrase = str.lower(phrase)
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
liste_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduit", liste_reduit)
|
||||
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
|
||||
print("version réduite du poeme", poeme_reduit)
|
||||
@@ -0,0 +1,28 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine, les choses, la vie, un, une, des, Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
phrase = str.lower(phrase)
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
liste_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduit", liste_reduit)
|
||||
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
|
||||
print("version réduite du poeme", poeme_reduit)
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
l_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", l_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
p_reduit = []
|
||||
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in l_phrase:
|
||||
if w not in stopWords:
|
||||
p_reduit.append(w)
|
||||
|
||||
|
||||
|
||||
print(p_reduit)
|
||||
@@ -0,0 +1,26 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
l_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", l_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
p_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in l_phrase:
|
||||
if w not in stopWords:
|
||||
p_reduit.append(w)
|
||||
print(p_reduit)
|
||||
@@ -0,0 +1,26 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
l_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", l_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
p_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in l_phrase:
|
||||
if w not in stopWords:
|
||||
p_reduit.append(w)
|
||||
print("liste des mots réduit", p_reduit)
|
||||
@@ -0,0 +1,29 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
liste_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduit", liste_reduit)
|
||||
|
||||
poeme_reduit = liste_reduit.join(" ")
|
||||
print("version réduite du poeme", poeme_reduit)
|
||||
@@ -0,0 +1,30 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
import re
|
||||
from nltk.tokenize import sent_tokenize, word_tokenize
|
||||
from nltk.corpus import stopwords
|
||||
|
||||
#source = open("mirabeau.txt", 'r')
|
||||
#destination = open("mirabeau_redux.txt", "wt")
|
||||
|
||||
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
|
||||
print("poeme original:", phrase)
|
||||
|
||||
phrase = phrase.replace("'", " ")
|
||||
phrase = phrase.replace("-", " ")
|
||||
print(phrase)
|
||||
liste_phrase = phrase.split(" ")
|
||||
print("liste des mots originaux séparés:", liste_phrase)
|
||||
|
||||
# liste vide pour recevoir la liste de mots reduits
|
||||
liste_reduit = []
|
||||
|
||||
stopWords = set(stopwords.words('french'))
|
||||
for w in liste_phrase:
|
||||
if w not in stopWords:
|
||||
liste_reduit.append(w)
|
||||
print("liste des mots réduit", liste_reduit)
|
||||
|
||||
poeme_reduit = " ".join(liste_reduit)
|
||||
|
||||
print("version réduite du poeme", poeme_reduit)
|
||||
@@ -0,0 +1,6 @@
|
||||
letter1 = "S"
|
||||
letter2 = "N"
|
||||
letter3 = "C"
|
||||
letter4 = "F"
|
||||
print(letter1+letter2+letter3+letter4)
|
||||
|
||||
@@ -0,0 +1,7 @@
|
||||
letter1 = "S"
|
||||
letter2 = "N"
|
||||
letter3 = "C"
|
||||
letter4 = "F"
|
||||
print(letter1+letter2+letter3+letter4)
|
||||
|
||||
print(letter1, letter2, letter3, letter4)
|
||||
@@ -0,0 +1,6 @@
|
||||
letter1 = "S"
|
||||
letter2 = "N"
|
||||
letter3 = "C"
|
||||
letter4 = "F"
|
||||
print(letter1+letter2+letter3+letter4)
|
||||
# print(letter1, letter2, letter3, letter4)
|
||||
@@ -0,0 +1,7 @@
|
||||
#déclarer les variables
|
||||
letter1 = "S"
|
||||
letter2 = "N"
|
||||
letter3 = "C"
|
||||
letter4 = "F"
|
||||
print(letter1+letter2+letter3+letter4)
|
||||
# print(letter1, letter2, letter3, letter4)
|
||||
@@ -0,0 +1,45 @@
|
||||
#!/usr/bin/env python
|
||||
# encoding=utf8
|
||||
|
||||
# Copyright (C) 2016 Constant, Algolit
|
||||
# This program is free software: you can redistribute it and/or modify
|
||||
# it under the terms of the GNU General Public License as published by
|
||||
# the Free Software Foundation, either version 3 of the License, or
|
||||
# (at your option) any later version.
|
||||
|
||||
# This program is distributed in the hope that it will be useful,
|
||||
# but WITHOUT ANY WARRANTY; without even the implied warranty of
|
||||
# MERCHANTABILITY or FITNESS FOR A PARTICULAR PURPOSE. See the
|
||||
# GNU General Public License for more details: <http://www.gnu.org/licenses/>.
|
||||
|
||||
|
||||
# Reduction of letters
|
||||
# From string to list & back
|
||||
# A string: a list of characters, unchangeable, but treatable
|
||||
# See: https://www.tutorialspoint.com/python3/python_strings.htm
|
||||
|
||||
# Write sentence as string
|
||||
sentence = "Je vois La Vie en rose..."
|
||||
# Print sentence
|
||||
print("phrase originale:", sentence)
|
||||
|
||||
# define new word as list
|
||||
new_word = []
|
||||
|
||||
# Convert sentence in list of words
|
||||
words = sentence.split(" ")
|
||||
print(words)
|
||||
# For each word in word list
|
||||
for word in words:
|
||||
# remove capital letters (string operation)
|
||||
word = word.lower().strip(" ;''?:,()!.\").”-")
|
||||
# Clean punctuation (string operation)
|
||||
# word = word.strip(" ;''?:,()!.\").”-")
|
||||
# add word to new word list
|
||||
new_word.append(word)
|
||||
|
||||
# Write words as one, without punctuation
|
||||
print("phrase mise en mots:", ''.join(new_word))
|
||||
|
||||
|
||||
|
||||
@@ -0,0 +1,12 @@
|
||||
#!/usr/bin/env python
|
||||
# coding: utf8
|
||||
|
||||
# More options with Wordnet: http://www.nltk.org/howto/wordnet.html
|
||||
|
||||
from nltk.corpus import wordnet as wn
|
||||
|
||||
print([synset.lemma_names('fra') for synset in wn.synsets('société', lang='fra')])
|
||||
|
||||
'''
|
||||
[['canis_familiaris', 'chien'], ['aboyeur', 'chien', 'chienchien', 'clébard', 'toutou'], ['chien', 'chien_de_chasse'], ['chien'], ['chien', 'clic', 'cliquer', 'cliquet'], ['chien', 'franc', 'hot-dog'], ['achille', 'chien', 'quignon', 'talon'], ['chien'], ['chien']
|
||||
'''
|
||||
@@ -0,0 +1 @@
|
||||
sous le pont mirabeau titititi
|
||||
@@ -0,0 +1,7 @@
|
||||
import wikipedia
|
||||
|
||||
#wikipedia.set_lang("fr")
|
||||
|
||||
wikipedia.search("Barack")
|
||||
#paris = wikipedia.page("Paris")
|
||||
#print(paris.content)
|
||||
@@ -0,0 +1,7 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
wikipedia.search("Barack")
|
||||
#paris = wikipedia.page("Paris")
|
||||
#print(paris.content)
|
||||
@@ -0,0 +1,7 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
#wikipedia.search("Barack")
|
||||
paris = wikipedia.page("Paris")
|
||||
print(paris.content)
|
||||
@@ -0,0 +1,17 @@
|
||||
import wikipedia
|
||||
|
||||
#print (wikipedia.summary("Wikipedia"))
|
||||
|
||||
wikipedia.search("Macron")
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
Paris = wikipedia.page("Paris")
|
||||
Paris.title
|
||||
|
||||
# u'http://fr.wikipedia.org/wiki/Paris'
|
||||
Paris.content
|
||||
|
||||
Paris.links[0]
|
||||
|
||||
|
||||
@@ -0,0 +1,11 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
paris = wikipedia..content("Paris")
|
||||
|
||||
print paris
|
||||
|
||||
|
||||
|
||||
|
||||
@@ -0,0 +1,11 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
paris = wikipedia.content("Paris")
|
||||
|
||||
print paris
|
||||
|
||||
|
||||
|
||||
|
||||
@@ -0,0 +1,11 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
paris = wikipedia.content("Paris")
|
||||
|
||||
print(paris)
|
||||
|
||||
|
||||
|
||||
|
||||
@@ -0,0 +1,6 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
paris = wikipedia.page("Paris")
|
||||
print(paris.content)
|
||||
@@ -0,0 +1,9 @@
|
||||
import wikipedia
|
||||
import time
|
||||
|
||||
time.sleep(5)
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
paris = wikipedia.page("Paris")
|
||||
print(paris.content)
|
||||
@@ -0,0 +1,6 @@
|
||||
import wikipedia
|
||||
|
||||
#wikipedia.set_lang("fr")
|
||||
|
||||
#paris = wikipedia.page("Paris")
|
||||
#print(paris.content)
|
||||
@@ -0,0 +1,7 @@
|
||||
import wikipedia
|
||||
|
||||
w = wikipedia
|
||||
w.set_lang("fr")
|
||||
|
||||
#paris = wikipedia.page("Paris")
|
||||
#print(paris.content)
|
||||
@@ -0,0 +1,7 @@
|
||||
import wikipedia
|
||||
|
||||
#wikipedia.set_lang("fr")
|
||||
|
||||
wikipedia.search("Barack")
|
||||
#paris = wikipedia.page("Paris")
|
||||
#print(paris.content)
|
||||
Binary file not shown.
@@ -0,0 +1,6 @@
|
||||
import wikipedia
|
||||
|
||||
#wikipedia.set_lang("fr")
|
||||
|
||||
paris = wikipedia.page("Paris")
|
||||
print(paris.content)
|
||||
@@ -0,0 +1,7 @@
|
||||
import wikipedia
|
||||
|
||||
wikipedia.set_lang("fr")
|
||||
|
||||
#wikipedia.search("Barack")
|
||||
paris = wikipedia.page("Paris")
|
||||
print(paris.content)
|
||||
Reference in New Issue
Block a user