commited all contents created by participants

This commit is contained in:
Bachir Soussi Chiadmi
2017-12-21 18:12:40 +01:00
parent cefd1c2ad0
commit b936b1e616
2137 changed files with 1076319 additions and 730 deletions
@@ -0,0 +1,8 @@
https://pypi.python.org/pypi/wikipedia
Wikipedia is a Python library that makes it easy to access and parse data from Wikipedia.
Search Wikipedia, get article summaries, get data like links and images from a page, and more. Wikipedia wraps the MediaWiki API so you can focus on using Wikipedia data, not getting it.
https://wikipedia.readthedocs.io/en/latest/
https://wikipedia.readthedocs.io/en/latest/quickstart.html#quickstart
@@ -0,0 +1,9 @@
Les bienfaits de la gymnastique
On ne peut donner les sumos en exemple. Ces poussahs maous (1) paraissent nourris de plus de saindoux que de sushis (2). (La liposuccion d'un sumo, quel boulot!) Nous leur préférons les athlètes affûtés, à la silhouette fusiforme, au ventre plat, aux muscles saillants. Ils se sont donné bien du mal et ils se sont même condamnés à l'ascèse (l'ascète au beurre est un vieux calembour et une antinomie) pour obtenir ces corps de rêve. Ils fuient les amateurs de bonne chère, les abonnés aux agapes fournies, aux gueuletons, aux mâchons, aux excès des carêmes-prenants. Ils ne lésinent sur aucuns frais d'entretien, de raffermissement et de rajeunissement de leur capital de chair et d'os.
Pour nous, gens lambda qui aimons saucer, la gymnastique est une activité recommandée. Adeptes du cheval d'arçons (3) et de la corde à nœuds, nous ne serons cependant jamais les alter ego des culturistes. Nous ne prétendons pas non plus être capables de réussir le schibboleth...
Excellentes pour la peau, les sudations sur le tatami ou sur le trampoline! Nous éviterons ainsi les acnés inattendues, les urticaires inopinées, les érythèmes spontanés. Finies les mines pâlottes, les bouillottes, les marmottes! Du sang! Du souffle! Rangés, les écharpes effrangées de tussah, les manteaux en breitschwanz. Peu nous chaut la soie thermogène! Tonifié, musclé par les exercices, le corps exulte.
Mais il faut que nous appréciions nos efforts, sinon gare aux claquages, aux synovites, aux douleurs aiguës du bâti rudoyé. À chacun son rythme. Ne mêlons pas nos pompes aux œuvres des acrobates.
@@ -0,0 +1,114 @@
alors
au
aucuns
aussi
autre
avant
avec
avoir
bon
car
ce
cela
ces
ceux
chaque
ci
comme
comment
dans
des
du
dedans
dehors
depuis
devrait
doit
donc
dos
début
elle
elles
en
encore
essai
est
et
eu
fait
faites
fois
font
hors
ici
il
ils
je juste
la
le
les
leur
ma
maintenant
mais
mes
mine
moins
mon
mot
même
ni
nommés
notre
nous
ou
par
parce
pas
peut
peu
plupart
pour
pourquoi
quand
que
quel
quelle
quelles
quels
qui
sa
sans
ses
seulement
si
sien
son
sont
sous
soyez sujet
sur
ta
tandis
tellement
tels
tes
ton
tous
tout
trop
très
tu
voient
vont
votre
vous
vu
ça
étaient
état
étions
été
être
@@ -0,0 +1,15 @@
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
data = "All work and no play makes jack dull boy. All work and no play makes jack a dull boy."
stopWords = set(stopwords.words('english'))
words = word_tokenize(data)
wordsFiltered = []
for w in words:
if w not in stopWords:
wordsFiltered.append(w)
print(wordsFiltered)
print(len(stopWords))
print(stopWords)
@@ -0,0 +1,15 @@
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
data = "All work and no play makes jack dull boy. All work and no play makes jack a dull boy."
stopWords = set(stopwords.words('french'))
words = word_tokenize(data)
wordsFiltered = []
for w in words:
if w not in stopWords:
wordsFiltered.append(w)
print(wordsFiltered)
print(len(stopWords))
print(stopWords)
@@ -0,0 +1,15 @@
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
data = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
stopWords = set(stopwords.words('french'))
words = word_tokenize(data)
wordsFiltered = []
for w in words:
if w not in stopWords:
wordsFiltered.append(w)
print(wordsFiltered)
print(len(stopWords))
print(stopWords)
@@ -0,0 +1,15 @@
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
data = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
stopWords = set(stopwords.words('french'))
words = word_tokenize(data)
wordsFiltered = []
for w in words:
if w not in stopWords:
wordsFiltered.append(w)
print(wordsFiltered)
#print(len(stopWords))
#print(stopWords)
@@ -0,0 +1,17 @@
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
import re
data = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
stopWords = set(stopwords.words('french'))
words = word_tokenize(data)
wordsFiltered = []
for w in words:
if w not in stopWords:
wordsFiltered.append(w)
print(wordsFiltered)
#print(len(stopWords))
#print(stopWords)
@@ -0,0 +1,29 @@
#!/usr/bin/python
# -*- coding: utf-8
# this is a shebang: https://en.wikipedia.org/wiki/Shebang_%28Unix%29
'''
This script takes a sentence you write in the terminal, and gives it back in alphabetical order
A list is ordered and changeable. It is less efficient than a set/tuple. But it allows to work with index numbers.
Check out other options for list comprehension: https://docs.python.org/3/tutorial/datastructures.html
Made for OLA #5, Paris, 15-17 décembre 2017
'''
# Ask to write a sentence
sentence = "Les gouvernements suspectent la littérature parce quelle est une force qui leur échappe"
sentence1 ="Le gouvernement impose au CNNum lexclusion de Rokhaya Diallo."
print(sentence1[-1])
sentence1 = sentence1[: -1]
# print sentence
print("phrase originale:", sentence1)
# Split sentence into words
words = sentence1.lower().split()
print(words)
# sort words of list
words.sort()
# print sorted wordlist as string
print("phrase alphabétique:", " ".join(words).capitalize()+'.')
@@ -0,0 +1,5 @@
Je veux dire les formes changées en nouveaux
corps. Dieux, vous qui faites les changements, inspirez
mon projet et du début du début du monde
jusqu’à mon temps faites courir un poème sans fin.
@@ -0,0 +1,31 @@
Sous pont Mirabeau coule Seine
Et amours
Faut souvienne
La joie venait toujours après peine
Vienne nuit sonne heure
Les jours vont demeure
Les mains les mains restons face face
Tandis sous
Le pont bras passe
Des éternels regards onde si lasse
Vienne nuit sonne heure
Les jours vont demeure
L amour va comme cette eau courante
L amour va
Comme vie lente
Et comme Espérance violente
Vienne nuit sonne heure
Les jours vont demeure
Passent les jours passent les semaines
Ni temps passé
Ni les amours reviennent
Sous pont Mirabeau coule Seine
Vienne nuit sonne heure
Les jours vont demeure
@@ -0,0 +1,31 @@
sous pont mirabeau coule seine
Amours
Faut souvienne
La joie venait toujours après peine
Vienne nuit sonne heure
Les jours vont demeure
Les mains les mains restons face face
Tandis sous
Pont bras passe
Des éternels regards onde si lasse
Vienne nuit sonne heure
Les jours vont demeure
L amour va comme cette eau courante
Amour va
Comme vie lente
Et comme espérance violente
Vienne nuit sonne heure
Les jours vont demeure
Passent les jours passent les semaines
Ni temps passé
Ni les amours reviennent
Sous pont mirabeau coule seine
Vienne nuit sonne heure
Les jours vont demeure
@@ -0,0 +1,32 @@
Sous pont mirabeau coule seine
Amours
Faut souvienne
La joie venait toujours après peine
Vienne nuit sonne heure
Les jours vont demeure
Les mains les mains restons face face
Tandis sous
Pont bras passe
Des éternels regards onde si lasse
Vienne nuit sonne heure
Les jours vont demeure
L amour va comme cette eau courante
Amour va
Comme vie lente
Et comme espérance violente
Vienne nuit sonne heure
Les jours vont demeure
Passent les jours passent les semaines
Ni temps passé
Ni les amours reviennent
Sous pont mirabeau coule seine
Vienne nuit sonne heure
Les jours vont demeure
@@ -0,0 +1,32 @@
Sous pont mirabeau coule seine
Amours
Faut souvienne
La joie venait toujours après peine
Vienne nuit sonne heure
Les jours vont demeure
Les mains les mains restons face face
Tandis sous
Pont bras passe
Des éternels regards onde si lasse
Vienne nuit sonne heure
Les jours vont demeure
L amour va comme cette eau courante
Amour va
Comme vie lente
Et comme espérance violente
Vienne nuit sonne heure
Les jours vont demeure
Passent les jours passent les semaines
Ni temps passé
Ni les amours reviennent
Sous pont mirabeau coule seine
Vienne nuit sonne heure
Les jours vont demeure
@@ -0,0 +1,32 @@
Le
Sous pont mirabeau coule seine
Amours
Faut souvienne
La joie venait toujours après peine
Vienne nuit sonne heure
Les jours vont demeure
Les mains les mains restons face face
Tandis sous
Pont bras passe
Des éternels regards onde si lasse
Vienne nuit sonne heure
Les jours vont demeure
L amour va comme cette eau courante
Amour va
Comme vie lente
Et comme espérance violente
Vienne nuit sonne heure
Les jours vont demeure
Passent les jours passent les semaines
Ni temps passé
Ni les amours reviennent
Sous pont mirabeau coule seine
Vienne nuit sonne heure
Les jours vont demeure
@@ -0,0 +1,33 @@
Sous le pont Mirabeau coule la Seine
Et nos amours
Faut-il qu'il m'en souvienne
La joie venait toujours après la peine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Les mains dans les mains restons face à face
Tandis que sous
Le pont de nos bras passe
Des éternels regards l'onde si lasse
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
L'amour s'en va comme cette eau courante
L'amour s'en va
Comme la vie est lente
Et comme l'Espérance est violente
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Passent les jours et passent les semaines
Ni temps passé
Ni les amours reviennent
Sous le pont Mirabeau coule la Seine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
@@ -0,0 +1,32 @@
Sous le pont Mirabeau coule la Seine
Et nos amours
Faut-il qu'il m'en souvienne
La joie venait toujours après la peine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Les mains dans les mains restons face à face
Tandis que sous
Le pont de nos bras passe
Des éternels regards l'onde si lasse
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
L'amour s'en va comme cette eau courante
L'amour s'en va
Comme la vie est lente
Et comme l'Espérance est violente
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Passent les jours et passent les semaines
Ni temps passé
Ni les amours reviennent
Sous le pont Mirabeau coule la Seine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
@@ -0,0 +1,31 @@
Sous le pont Mirabeau coule la Seine
Et nos amours
Faut-il qu'il m'en souvienne
La joie venait toujours après la peine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Les mains dans les mains restons face à face
Tandis que sous
Le pont de nos bras passe
Des éternels regards l'onde si lasse
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
L'amour s'en va comme cette eau courante
L'amour s'en va
Comme la vie est lente
Et comme l'Espérance est violente
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Passent les jours et passent les semaines
Ni temps passé
Ni les amours reviennent
Sous le pont Mirabeau coule la Seine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
@@ -0,0 +1,32 @@
Sous le pont Mirabeau coule la Seine
Et nos amours
Faut-il qu'il m'en souvienne
La joie venait toujours après la peine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Les mains dans les mains restons face à face
Tandis que sous
Le pont de nos bras passe
Des éternels regards l'onde si lasse
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
L'amour s'en va comme cette eau courante
L'amour s'en va
Comme la vie est lente
Et comme l'Espérance est violente
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
Passent les jours et passent les semaines
Ni temps passé
Ni les amours reviennent
Sous le pont Mirabeau coule la Seine
Vienne la nuit sonne l'heure
Les jours s'en vont je demeure
@@ -0,0 +1,33 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = str.lower(texte)
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
texte = texte.replace(" l ", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
#print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,35 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
list_sup = ["'", "-", " l "," , "les ", "le ", "la ", "un ","une ", "des "]
print(list_sup)
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = str.lower(texte)
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
texte = texte.replace(" l ", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
#print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,35 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
list_sup = ["'", "-", "l "," , "le ", "les ", "la ", "un ","une ", "des "]
print(list_sup)
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = str.lower(texte)
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
texte = texte.replace(" l ", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
#print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,35 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
list_sup = ["'", "-", "l ", "le ", "les ", "la ", "un ","une ", "des "]
print(list_sup)
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = str.lower(texte)
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
texte = texte.replace(" l ", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
#print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,36 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
#list_sup = ["'", "-", "l ", "le ", "les ", "la ", "un ","une ", "des "]
print(list_sup)
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = str.lower(texte)
# texte = texte.replace("'", " ")
# texte = texte.replace("-", " ")
# texte = texte.replace(" l ", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
#print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,44 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
#print(texte)
liste_phrase = texte.lower().split(" ")
#print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
#liste_phrase = str.lower(texte)
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduite :", liste_reduit)
#ré-introduire les majuscules en debut de vers
for i in range( len ( liste_reduit ) ):
mot_split = liste_reduit[i].split("\n")
#print("mot_split", mot_split)
if ( len(mot_split) == 2):
mot_split[1] = mot_split[1].capitalize()
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
if ( i > 0 and liste_reduit[i-1] == '' ):
liste_reduit[i] = liste_reduit[i].capitalize()
#if (elt.endswith("\n") and elt != " " ):
#mot = elt.capitalize()
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme :", poeme_reduit.capitalize())
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,44 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
#print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
#print(texte)
liste_phrase = texte.lower().split(" ")
#print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
#liste_phrase = str.lower(texte)
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduite :", liste_reduit)
#ré-introduire les majuscules en debut de vers
for i in range( len ( liste_reduit ) ):
mot_split = liste_reduit[i].split("\n")
#print("mot_split", mot_split)
if ( len(mot_split) == 2):
mot_split[1] = mot_split[1].capitalize()
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
if ( i > 0 and liste_reduit[i-1] == '' ):
liste_reduit[i] = liste_reduit[i].capitalize()
#if (elt.endswith("\n") and elt != " " ):
#mot = elt.capitalize()
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,44 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
#print("texte or", texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
#print(texte)
liste_phrase = texte.lower().split(" ")
#print("liste des mots originaux séparés:", liste_phrase)
print(liste_phrase)
liste_reduit = []
#liste_phrase = str.lower(texte)
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduite :", liste_reduit)
#ré-introduire les majuscules en debut de vers
for i in range( len ( liste_reduit ) ):
mot_split = liste_reduit[i].split("\n")
#print("mot_split", mot_split)
if ( len(mot_split) == 2):
mot_split[1] = mot_split[1].capitalize()
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
if ( i > 0 and liste_reduit[i-1] == '' ):
liste_reduit[i] = liste_reduit[i].capitalize()
#if (elt.endswith("\n") and elt != " " ):
#mot = elt.capitalize()
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,46 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
#print("texte or", texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
#print(texte)
liste_phrase = texte.lower().split(" ")
#print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
#liste_phrase = str.lower(texte)
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
print("allword", w)
if w not in stopWords:
print("no stopword", w)
liste_reduit.append(w)
print("liste des mots réduite :", liste_reduit)
#ré-introduire les majuscules en debut de vers
for i in range( len ( liste_reduit ) ):
mot_split = liste_reduit[i].split("\n")
#print("mot_split", mot_split)
if ( len(mot_split) == 2):
mot_split[1] = mot_split[1].capitalize()
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
if ( i > 0 and liste_reduit[i-1] == '' ):
liste_reduit[i] = liste_reduit[i].capitalize()
#if (elt.endswith("\n") and elt != " " ):
#mot = elt.capitalize()
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,45 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
#print("texte or", texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
#print(texte)
liste_phrase = texte.lower().split(" ")
#print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
#liste_phrase = str.lower(texte)
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
print("no stopword", w)
liste_reduit.append(w)
print("liste des mots réduite :", liste_reduit)
#ré-introduire les majuscules en debut de vers
for i in range( len ( liste_reduit ) ):
mot_split = liste_reduit[i].split("\n")
#print("mot_split", mot_split)
if ( len(mot_split) == 2):
mot_split[1] = mot_split[1].capitalize()
liste_reduit[i] = mot_split[0] + "\n" + mot_split[1]
if ( i > 0 and liste_reduit[i-1] == '' ):
liste_reduit[i] = liste_reduit[i].capitalize()
#if (elt.endswith("\n") and elt != " " ):
#mot = elt.capitalize()
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,34 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
intro = "Pont Mirabeau "
edition = str(intro), str(poeme_reduit)
print(edition)
#with open("mirabeau_reduit.txt", "w") as destination :
#destination.write(" ".join(liste_reduit))
#print("version réduite du poeme :", " ".join(liste_reduit) )
@@ -0,0 +1,31 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
with open("mirabeau_reduit.txt", "w") as destination :
#destination.write(" ".join(liste_reduit))
print("version réduite du poeme :", " ".join(liste_reduit) )
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
#print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,31 @@
#!/usr/bin/env python
# coding: utf8
#pour installer nltk stopWords tout là : http://www.nltk.org/data.html
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
with open("mirabeau.txt", "r") as source:
texte = source.read()
texte = str.lower(texte)
print(texte)
#enlever les traits d'union et les apostrophes
texte = texte.replace("'", " ")
texte = texte.replace("-", " ")
print(texte)
liste_phrase = texte.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
#print("liste des mots réduit :", liste_reduit)
poeme_reduit = (" ".join(liste_reduit))
print("version réduite du poeme :", poeme_reduit)
with open("mirabeau_reduit.txt", "w") as destination :
destination.write(" ".join(liste_reduit))
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
liste_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
# liste vide pour recevoir la liste de mots reduits
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduit", liste_reduit)
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme", poeme_reduit)
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = str.lower(phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
liste_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
# liste vide pour recevoir la liste de mots reduits
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduit", liste_reduit)
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme", poeme_reduit)
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine, les choses, la vie, un, une, des, Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = str.lower(phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
liste_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
# liste vide pour recevoir la liste de mots reduits
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduit", liste_reduit)
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme", poeme_reduit)
@@ -0,0 +1,28 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
phrase = "Sous le pont Mirabeau coule la Seine, les choses, la vie, un, une, des, Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = str.lower(phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
liste_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
# liste vide pour recevoir la liste de mots reduits
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduit", liste_reduit)
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme", poeme_reduit)
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
l_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", l_phrase)
# liste vide pour recevoir la liste de mots reduits
p_reduit = []
stopWords = set(stopwords.words('french'))
for w in l_phrase:
if w not in stopWords:
p_reduit.append(w)
print(p_reduit)
@@ -0,0 +1,26 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
l_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", l_phrase)
# liste vide pour recevoir la liste de mots reduits
p_reduit = []
stopWords = set(stopwords.words('french'))
for w in l_phrase:
if w not in stopWords:
p_reduit.append(w)
print(p_reduit)
@@ -0,0 +1,26 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
l_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", l_phrase)
# liste vide pour recevoir la liste de mots reduits
p_reduit = []
stopWords = set(stopwords.words('french'))
for w in l_phrase:
if w not in stopWords:
p_reduit.append(w)
print("liste des mots réduit", p_reduit)
@@ -0,0 +1,29 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
liste_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
# liste vide pour recevoir la liste de mots reduits
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduit", liste_reduit)
poeme_reduit = liste_reduit.join(" ")
print("version réduite du poeme", poeme_reduit)
@@ -0,0 +1,30 @@
#!/usr/bin/env python
# coding: utf8
import re
from nltk.tokenize import sent_tokenize, word_tokenize
from nltk.corpus import stopwords
#source = open("mirabeau.txt", 'r')
#destination = open("mirabeau_redux.txt", "wt")
phrase = "Sous le pont Mirabeau coule la Seine Et nos amours Faut-il qu'il m'en souvienne..."
print("poeme original:", phrase)
phrase = phrase.replace("'", " ")
phrase = phrase.replace("-", " ")
print(phrase)
liste_phrase = phrase.split(" ")
print("liste des mots originaux séparés:", liste_phrase)
# liste vide pour recevoir la liste de mots reduits
liste_reduit = []
stopWords = set(stopwords.words('french'))
for w in liste_phrase:
if w not in stopWords:
liste_reduit.append(w)
print("liste des mots réduit", liste_reduit)
poeme_reduit = " ".join(liste_reduit)
print("version réduite du poeme", poeme_reduit)
@@ -0,0 +1,6 @@
letter1 = "S"
letter2 = "N"
letter3 = "C"
letter4 = "F"
print(letter1+letter2+letter3+letter4)
@@ -0,0 +1,7 @@
letter1 = "S"
letter2 = "N"
letter3 = "C"
letter4 = "F"
print(letter1+letter2+letter3+letter4)
print(letter1, letter2, letter3, letter4)
@@ -0,0 +1,6 @@
letter1 = "S"
letter2 = "N"
letter3 = "C"
letter4 = "F"
print(letter1+letter2+letter3+letter4)
# print(letter1, letter2, letter3, letter4)
@@ -0,0 +1,7 @@
#déclarer les variables
letter1 = "S"
letter2 = "N"
letter3 = "C"
letter4 = "F"
print(letter1+letter2+letter3+letter4)
# print(letter1, letter2, letter3, letter4)
@@ -0,0 +1,45 @@
#!/usr/bin/env python
# encoding=utf8
# Copyright (C) 2016 Constant, Algolit
# This program is free software: you can redistribute it and/or modify
# it under the terms of the GNU General Public License as published by
# the Free Software Foundation, either version 3 of the License, or
# (at your option) any later version.
# This program is distributed in the hope that it will be useful,
# but WITHOUT ANY WARRANTY; without even the implied warranty of
# MERCHANTABILITY or FITNESS FOR A PARTICULAR PURPOSE. See the
# GNU General Public License for more details: <http://www.gnu.org/licenses/>.
# Reduction of letters
# From string to list & back
# A string: a list of characters, unchangeable, but treatable
# See: https://www.tutorialspoint.com/python3/python_strings.htm
# Write sentence as string
sentence = "Je vois La Vie en rose..."
# Print sentence
print("phrase originale:", sentence)
# define new word as list
new_word = []
# Convert sentence in list of words
words = sentence.split(" ")
print(words)
# For each word in word list
for word in words:
# remove capital letters (string operation)
word = word.lower().strip(" ;''?:,()!.\").”-")
# Clean punctuation (string operation)
# word = word.strip(" ;''?:,()!.\").”-")
# add word to new word list
new_word.append(word)
# Write words as one, without punctuation
print("phrase mise en mots:", ''.join(new_word))
@@ -0,0 +1,12 @@
#!/usr/bin/env python
# coding: utf8
# More options with Wordnet: http://www.nltk.org/howto/wordnet.html
from nltk.corpus import wordnet as wn
print([synset.lemma_names('fra') for synset in wn.synsets('société', lang='fra')])
'''
[['canis_familiaris', 'chien'], ['aboyeur', 'chien', 'chienchien', 'clébard', 'toutou'], ['chien', 'chien_de_chasse'], ['chien'], ['chien', 'clic', 'cliquer', 'cliquet'], ['chien', 'franc', 'hot-dog'], ['achille', 'chien', 'quignon', 'talon'], ['chien'], ['chien']
'''
@@ -0,0 +1 @@
sous le pont mirabeau titititi
@@ -0,0 +1,7 @@
import wikipedia
#wikipedia.set_lang("fr")
wikipedia.search("Barack")
#paris = wikipedia.page("Paris")
#print(paris.content)
@@ -0,0 +1,7 @@
import wikipedia
wikipedia.set_lang("fr")
wikipedia.search("Barack")
#paris = wikipedia.page("Paris")
#print(paris.content)
@@ -0,0 +1,7 @@
import wikipedia
wikipedia.set_lang("fr")
#wikipedia.search("Barack")
paris = wikipedia.page("Paris")
print(paris.content)
@@ -0,0 +1,17 @@
import wikipedia
#print (wikipedia.summary("Wikipedia"))
wikipedia.search("Macron")
wikipedia.set_lang("fr")
Paris = wikipedia.page("Paris")
Paris.title
# u'http://fr.wikipedia.org/wiki/Paris'
Paris.content
Paris.links[0]
@@ -0,0 +1,11 @@
import wikipedia
wikipedia.set_lang("fr")
paris = wikipedia..content("Paris")
print paris
@@ -0,0 +1,11 @@
import wikipedia
wikipedia.set_lang("fr")
paris = wikipedia.content("Paris")
print paris
@@ -0,0 +1,11 @@
import wikipedia
wikipedia.set_lang("fr")
paris = wikipedia.content("Paris")
print(paris)
@@ -0,0 +1,6 @@
import wikipedia
wikipedia.set_lang("fr")
paris = wikipedia.page("Paris")
print(paris.content)
@@ -0,0 +1,9 @@
import wikipedia
import time
time.sleep(5)
wikipedia.set_lang("fr")
paris = wikipedia.page("Paris")
print(paris.content)
@@ -0,0 +1,6 @@
import wikipedia
#wikipedia.set_lang("fr")
#paris = wikipedia.page("Paris")
#print(paris.content)
@@ -0,0 +1,7 @@
import wikipedia
w = wikipedia
w.set_lang("fr")
#paris = wikipedia.page("Paris")
#print(paris.content)
@@ -0,0 +1,7 @@
import wikipedia
#wikipedia.set_lang("fr")
wikipedia.search("Barack")
#paris = wikipedia.page("Paris")
#print(paris.content)
@@ -0,0 +1,6 @@
import wikipedia
#wikipedia.set_lang("fr")
paris = wikipedia.page("Paris")
print(paris.content)
@@ -0,0 +1,7 @@
import wikipedia
wikipedia.set_lang("fr")
#wikipedia.search("Barack")
paris = wikipedia.page("Paris")
print(paris.content)