ORSYS formation
CONTACT - +352 26 49 79 1204
CONTACT - 📞 +352 26 49 79 1204    drapeau francais   drapeau anglais

Consult our trainings :

Text Mining par la pratique Training

Stage pratique
New
Duration : 3 days
Ref : MMD
Price  2020 : Contact us
  • Program
  • Cycles certifiants
  • Participants / Prerequisite
  • Intra/Tailored
Program

Machine Learning et Deep Learning pour les données textuelles s'inscrivent dans le cadre du traitement statistique et de la valorisation des données dans tout projet Big Data. Ce cours pratique vous présentera toute la chaîne de conception appliquée au Machine Learning dans un contexte Big Data batch et streaming.

Objectifs pédagogiques

  • Comprendre les méthodes de la statistique textuelle
  • Mettre en œuvre l’extraction des caractéristiques de données textuelles
  • Créer des sélections et des classements dans de grands volumes de données textuelles
  • Choisir un algorithme de classification
  • Évaluer les performances prédictives d'un algorithme
PROGRAMME DE FORMATION

Les approches traditionnelles en Text Mining

  • Les API pour récupérer des données textuelles.
  • La préparation des données textuelles en fonction de la problématique.
  • La récupération et l'exploration du corpus de textes.
  • La suppression des caractères accentués et spéciaux.
  • Stemming, Lemmatization et suppression des mots de liaison.
  • Tout rassembler pour nettoyer et normaliser les données.

Travaux pratiques
La recherche des documents, la préparation, la transformation et la vectorisation des données en DataFrame.

Feature Engineering pour la représentation de texte

  • Comprendre la syntaxe et la structure du texte.
  • Le modèle Bag of Words et Bag of N-Grams.
  • Le modèle TF-IDF, Transformer et Vectorizer.
  • Le modèle Word2Vec et l’implémentation avec Gensim.
  • Le modèle GloVe.
  • Le modèle FastText.

Travaux pratiques
Mise en place des opérations d’extraction des caractéristiques de données textuelles afin d’effectuer des classifications.

La similarité des textes et classification non supervisée

  • Les concepts essentiels de similarité.
  • Analyse de la similarité des termes : distances Hamming, Manhattan, Euclidienne et Levenshtein.
  • Analyse de la similarité des documents.
  • Okapi BM25 et le palmarès de classement.
  • Les algorithmes de classification non supervisée.

Travaux pratiques
Construire un système de recommandation des produits similaires sur la base de la description et du contenu des produits que vous avez choisi.

La classification supervisée du texte

  • Prétraitement et normalisation des données.
  • Modèles de classification.
  • Multinomial Naïve Bayes.
  • Régression logistique. Support Vector Machines.
  • Random Forest. Gradient Boosting Machines.
  • Évaluation des modèles de classification.

Travaux pratiques
Mise en œuvre des classifications supervisées sur plusieurs jeux de données.

Natural Language Processing et Deep Learning

  • Les librairies NLP : NLTK, TextBlob, SpaCy, Gensim, Pattern, Stanford CoreNLP.
  • Les librairies Deep Learning : Theano, TensorFlow, Keras.
  • Natural Language Processing et Recurrent Neural Networks.
  • RNN et Long Short-Term Memory. Les modèles bidirectionnels RNN.
  • Les modèles Sequence-to-Sequence.
  • Questions et réponses avec les modèles RNN.

Travaux pratiques
Construire un RNN pour générer un nouveau texte.

Participants / Prerequisite

» Participants

Ingénieurs/chefs de projet IA, consultants IA et toute personne souhaitant découvrir le Text Mining pour le Machine Learning et le Deep Learning.

» Prerequisite

Bonnes connaissances en statistiques. Bonnes connaissances du Machine Learning et du Deep Learning. Expérience requise.
Intra/Tailored

Contact Informations

By checking this box, I certify that I have read and accepted the conditions for the use of my data regarding the General Data Protection Regulation (GDPR).
You can at any time modify the use of your data and exercise your rights by sending an email to rgpd@orsys.fr
By checking this box, I agree to receive commercial and promotional communications from ORSYS Training*. You can unsubscribe at any time by using the link included in our communications.

Book your place

Click on a session for reserving.

Time schedule

Generally, courses take place from 9:00 to 12:30 and from 14:00 to 17:30.
However, on the first day attendees are welcomed from 8:45, and there is a presentation of the session between 9:15 and 9:30.
The course itself begins at 9:30. For the 4- or 5-day hands-on courses, the sessions finish at 15:30 on the last day
linkedin orsys
twitter orsys
it! orsys
instagram orsys
pinterest orsys
facebook orsys
youtube orsys
LA LETTRE DE
LA TRANSFORMATION DIGITALE
Recevez la newsletter