Auteur du futur

Raphael Kassel

  • Prompt : Qu’est-ce que c’est ? Comment écrire un bon prompt ?

    Avec la démocratisation de l’utilisation de l’IA, de nouvelles compétences émergent. Notamment l’art de maîtriser les prompts. Ces instructions a priori toutes simples permettent d’exploiter le plein potentiel de l’intelligence artificielle. Mais alors comment les utiliser correctement et surtout, comment rédiger de bons prompts ? Dans cet article, découvrez ce qu’est un prompt, leur importance […]

    Lire la suite
  • Algorithme : Qu’est-ce que c’est ? A quoi ça sert ?

    Les algorithmes sont devenus omniprésents dans notre quotidien, des systèmes informatiques aux objets connectés, en passant par les réseaux sociaux et les applications de navigation. Mais que se cache-t-il réellement derrière ce terme souvent perçu comme technique ? Un algorithme, c’est bien plus qu’une simple notion abstraite : c’est un outil puissant qui permet de […]

    Lire la suite
  • Corrélations de Pearson et de Spearman : Tout comprendre

    La corrélation est un outil statistique utilisé pour le Machine Learning afin d’identifier des relations de dépendance entre plusieurs variables. Il existe plusieurs types de corrélations. Découvrez ci-dessous plus de détails sur les corrélations de Pearson et de Spearman. Pour l’analyse de données, un Data Scientist dispose de plusieurs outils statistiques. Parmi ces outils, il […]

    Lire la suite
  • Fine-Tuning : Qu’est-ce que c’est ? À quoi ça sert en IA ?

    Le fine-tuning est une technique permettant de spécialiser un modèle pré-entraîné de Machine Learning sur une tâche spécifique. Découvrez tout ce qu’il faut savoir sur cette technique au cœur de l’intelligence artificielle ! Le Machine Learning évolue vite, très vite. Au cours des dernières années, la conception de modèles pré-entraînés a été propulsée au centre […]

    Lire la suite
  • SQL DISTINCT : Comment utiliser cette requête ?

    Si la commande SELECT est l’une des plus couramment utilisées pour lire les données d’un tableau, elle présente quelques lacunes si elle est utilisée toute seule. C’est pourquoi, d’autres commandes lui sont associées. Ces combinaisons permettent ainsi d’affiner les résultats. Et notamment la commande SQL DISTINCT qui supprime les doublons au sein d’une Base de […]

    Lire la suite
  • Coup de Pouce Maths : qu’est-ce qu’une dérivée ?

    La notion de dérivée est notamment très utilsée en DataScience pour l’apprentissage des modèles de machine learning. En dehors de ce que vous avez pu sûrement voir au lycée, les applications de cet outil mathématiques sont bien plus vastes et nous y reviendrons à la fin de cet article. Dans cet article, vous apprendrez d’abord […]

    Lire la suite
  • Test de Fisher : définition, principe et cas pratiques pour mieux l’appliquer

    Le test exact de Fisher est une méthode statistique appropriée à l’analyse des relations entre deux variables binaires dans de petits échantillons. Il existe de nombreuses situations où nous pouvons souhaiter repérer s’il existe une relation entre deux variables binaires.Imaginons par exemple un tableau avec deux colonnes. Dans la première, nous aurions la mention Homme […]

    Lire la suite
  • Graph Neural Networks (GNN): qu’est-ce que c’est ?

    Les Graph Neural Networks (GNN) ou réseaux de neurones en graphes sont des réseaux de neurones particuliers utiles pour résoudre des problèmes difficiles à partir de graphes qui constituent une structure de données complexe. Découvrez ci-dessous plus de détails sur le fonctionnement, les architectures et les applications des GNN. En quoi consistent les réseaux de […]

    Lire la suite
  • Apache Airflow : qu’est-ce que c’est et comment l’utiliser ?

    Apache Airflow est une plateforme de planification de flux de travail open-source, très utilisée dans le domaine de l’ingénierie des données. Découvrez tout ce que vous devez savoir au sujet de cet outil du Data Engineer : fonctionnement, cas d’usage, composants principaux… L’histoire de Apache Airflow commence en 2015, dans les bureaux de AirBnB. A […]

    Lire la suite
  • Coefficient de détermination : qu’est ce que c’est et comment s’en servir ?

    Calculé par les logiciels de statistiques, le coefficient de détermination permet de comprendre combien de variables d’un facteur peuvent être expliquées par sa relation avec un autre facteur. Définition du coefficient de détermination Dans une régression linéaire, l’objectif est de déterminer une relation linéaire entre deux jeux de données. Lorsque l’on parle de coefficient de […]

    Lire la suite
  • Installer Anaconda pour Python : comment faire ?

    De nos jours, le potentiel du big data en entreprise n’est plus à prouver. Les recruteurs se disputent les profils les plus expérimentés et le besoin de formation se fait de plus en plus ressentir. Toutefois, lorsque l’on veut faire de la data science, le choix des outils est une étape très importante pour avoir […]

    Lire la suite
  • Les strings sur Python : Tout ce qu’il faut savoir

    Les chaînes de caractères appelées string en Python représentent un type fondamental de la programmation. Il s’agit d’une séquence de caractères alphabétiques, numériques ou de symboles. Lors du traitement de texte, de données structurées ou de données provenant de sources externes, les Python strings sont très fréquemment utilisés. Ainsi, si vous souhaitez vous lancer dans […]

    Lire la suite