Auteur du futur

Raphael Kassel

  • Staging Area : En quoi consiste cette étape du processus ETL ?

    La « Staging Area » est une étape importante dans le processus ETL (Extract, Transform, Load) qui consiste à extraire des données à partir de sources de données hétérogènes, à les transformer pour les préparer à l’analyse et à les charger dans un système de destination tel qu’un entrepôt de données (Data Warehouse) ou une base de données.​

    Lire la suite
  • Cypher : le langage pour manipuler des données dans les graphes

    Pour l’homme, la compréhension visuelle est souvent plus facile que la compréhension textuelle, car notre cerveau est capable de traiter les informations visuelles plus rapidement et plus efficacement. C’est pour cette raison que nous avons pu voir l’émergence des bases de données graphiques utilisant le langage Cypher au lieu du traditionnel SQL.

    Lire la suite
  • CRUD : définition, fonctionnement

    Étroitement lié à la gestion de données numériques, le CRUD est un acronyme informatique anglais lié au fonctionnement des données stockées. Il englobe quatre opérations de base qui concernent la gestion de la pertinence des données et des applications : Create, Read, Update et Delete.

    Lire la suite
  • TensorFlow : le framework de Machine Learning de Google

    TensorFlow est un framework de Machine Learning créé par Google et disponible en open source. Découvrez tout ce que vous devez savoir à son sujet : histoire, fonctionnement, avantages, formations…

    Lire la suite
  • Pipeline : Définition, fonctionnement et utilité en Data Science

    Un pipeline est un ensemble de processus et d’outils utilisés pour collecter des données brutes à partir de plusieurs sources, les analyser et présenter les résultats dans un format compréhensible. Les entreprises utilisent les pipelines de données pour répondre à des questions commerciales spécifiques et prendre des décisions stratégiques basées sur des données réelles. Tous les sets de données disponibles, (internes ou externes), sont analysés pour obtenir ces informations.

    Lire la suite
  • Le mouvement Brownien : principe et utilisations pratiques

    Prenons une particule de taille micrométrique qui baigne dans une fluide. Cette particule va posséder un mouvement aléatoire dû aux chocs d’autres petites particules sur cette « grosse » particule. C’est le principe du mouvement brownien également appelé processus de Wiener.

    Lire la suite
  • Neo4J : tout sur la meilleure base de données orientée graph

    Afin de tirer profit des larges volumes de données complexes dont elles disposent, les entreprises exploitent désormais les outils d’analyse graphique ou graph analytics. Cette technologie permet de convertir le Big Data en précieuses informations. Parmi les bases de données orientées graph les plus populaires, on compte Neo4j. Les développeurs et Data Scientists l’utilisent pour profiter de nombreux outils permettant de créer des applications ou d’analyser les données.

    Lire la suite
  • Clé primaire : Définition, avantages et particularités

    Les bases de données relationnelles contiennent des milliers et des milliers de lignes. Pour en simplifier le traitement, il est primordial d’identifier de manière claire et efficace les différents enregistrements d’une table. C’est à cet instant qu’interviennent les clés primaires.

    Lire la suite
  • API Rest : Qu’est-ce que c’est ? À quoi ça sert ?

    Aujourd’hui, les applications web et mobiles sont omniprésentes dans notre quotidien. Les entreprises sont constamment à la recherche de moyens pour améliorer l’expérience utilisateur et la performance de leurs applications. C’est là que les API REST (API pour Application Programming Interface et REST pour REpresentational State Transfer) entrent en jeu.

    Lire la suite
  • Réduction de dimension : Comment ça fonctionne ?

    L’analyse de données peut être considérée comme une science expérimentale, où les propriétés sont démontrées après avoir été observées, et où des codes sont établis de manière heuristique pour interpréter les résultats. Dans le domaine de l’apprentissage automatique (machine learning) et de l’analyse des données, la réduction de dimension joue un rôle essentiel pour simplifier les ensembles de données complexes.

    Lire la suite
  • Réaliser de la data-visualisation grâce à Plotly

    Il est bon de savoir que Plotly, avant d’être une librairie Python très connue, est une entreprise basée à Montréal qui a été fondée par quatre personnes. Son objectif est de développer des outils de visualisation ainsi que d’analyser des données. Dans cet article, nous nous intéresserons en particulier à la librairie Python plotly.

    Lire la suite
  • Boucle for : Une fonction essentielle de la programmation

    Qu’est ce qu’une « boucle for » ? En programmation, on parle d’itérables pour désigner des objets regroupant une collection d’objets qu’on peut parcourir. Parmi les itérables on compte entre autres : les listes, les tuples, les dictionnaires ou les strings… Les boucles for permettent de parcourir des itérables et de répéter une suite d’instructions pour chaque […]

    Lire la suite