{"id":135141,"date":"2023-04-25T14:15:58","date_gmt":"2023-04-25T13:15:58","guid":{"rendered":"https:\/\/multi.liora.io\/?p=135141"},"modified":"2026-08-07T13:14:00","modified_gmt":"2026-08-07T11:14:00","slug":"hello-daniel-was-ist-datennormalisierung","status":"publish","type":"post","link":"https:\/\/liora.io\/de\/hello-daniel-was-ist-datennormalisierung","title":{"rendered":"Hallo Daniel, was ist Datennormalisierung?"},"content":{"rendered":"\n<p><strong>Daniel ist unser technischer Support f\u00fcr die Weiterbildungen bei Liora. Er ist der Experte, der sich mit allen Themen der Data Science auskennt und die Lernenden durch ihre Weiterbildungen begleitet. Heute haben wir es geschafft, ein paar Minuten seiner kostbaren Zeit zu nehmen, damit er unsere Fragen rund um die Datenstandardisierung beantworten kann.\n\nIch: Hallo Daniel! Ich wei\u00df, dass wir Dir diese Frage schon oft gestellt haben, aber ich h\u00f6re st\u00e4ndig von der \u201eDatennormalisierung\u201d. Kannst Du mir helfen, das Konzept in wenigen Worten zu verstehen?<\/strong><\/p>\n\n\n\n<div class=\"wp-block-buttons is-layout-flex wp-block-buttons-is-layout-flex is-content-justification-center wp-container-core-buttons-is-layout-5ee10de4\" style=\"margin-top:32px;margin-bottom:32px\"><div class=\"wp-block-button\"><a class=\"wp-block-button__link wp-element-button\" href=\"https:\/\/liora.io\/de\/weiterbildung\/data-ki\/data-scientist\">Lerne, Daten zu normalisieren<\/a><\/div><\/div>\n\n\n\n<p><strong>Daniel:<\/strong> Tats\u00e4chlich ist die Datennormalisierung im Bereich Data Science ein <strong>zentrales Konzept der Datenvorverarbeitung<\/strong>, wenn man an einem <a href=\"https:\/\/liora.io\/de\/machine-learning-definition-funktionsweise-anwendungen\">Machine-Learning<\/a>-Projekt arbeiten muss.<\/p>\n\n\n\n<p>Mit dem Wort \u201eNormalisierung\u201d sind eigentlich zwei Hauptverfahren gemeint: <strong>Normalisierung und Standardisierung<\/strong>. Im Gro\u00dfen und Ganzen haben beide Verfahren denselben Zweck: numerische Variablen so zu skalieren, dass sie auf einer gemeinsamen Skala vergleichbar sind.<\/p>\n\n\n\n\n\n<h2 class=\"wp-block-heading\" id=\"wie-sieht-das-mathematisch-aus\">Wie sieht das mathematisch aus?<\/h2>\n\n\n\n<p>Betrachten wir eine <strong>numerische Variable<\/strong> mit <strong>n Beobachtungen<\/strong>, die so geschrieben werden kann:<\/p>\n\n\n\n<figure class=\"wp-block-image aligncenter size-full is-resized\" style=\"width:485px;max-width:100%;margin-top:32px;margin-right:auto;margin-bottom:32px;margin-left:auto\"><img alt=\"Normalisation des donn\u00e9es\" decoding=\"async\" height=\"85\" loading=\"lazy\" sizes=\"(max-width: 485px) 100vw, 485px\" src=\"https:\/\/liora.io\/app\/uploads\/sites\/8\/2020\/12\/cap3.png\" srcset=\"https:\/\/liora.io\/app\/uploads\/sites\/8\/2020\/12\/cap3.png 485w, https:\/\/liora.io\/app\/uploads\/sites\/8\/2020\/12\/cap3-300x53.png 300w\" style=\"width:485px;max-width:100%;height:auto\" width=\"485\"\/><\/figure>\n\n\n\n<p>Da wir eine <strong>endliche Anzahl von realen Werten<\/strong> haben, k\u00f6nnen wir verschiedene statistische Informationen extrahieren, darunter: <strong>Min<\/strong>, <strong>Max<\/strong>, <strong>Mittelwert<\/strong> und <strong>Standardabweichung<\/strong>.\u00a0F\u00fcr ein <strong>Normalisierungsverfahren<\/strong> brauchen wir nur Min und Max.<\/p>\n\n\n\n<p style=\"margin-top:32px;margin-bottom:32px\"><i>Die Idee dahinter ist, dass wir alle Werte der Variablen zwischen 0 und 1 reduzieren, w\u00e4hrend wir die Abst\u00e4nde zwischen den Werten beibehalten.<\/i><\/p>\n\n\n\n<p>Die Formel lautet einfach wie folgt:<\/p>\n\n\n\n<figure class=\"wp-block-image aligncenter size-full is-resized\" style=\"width:429px;max-width:100%;margin-top:32px;margin-right:auto;margin-bottom:32px;margin-left:auto\"><img alt=\"Normalisation des donn\u00e9es\" decoding=\"async\" height=\"109\" loading=\"lazy\" sizes=\"(max-width: 429px) 100vw, 429px\" src=\"https:\/\/liora.io\/app\/uploads\/sites\/8\/2020\/12\/cap1.png\" srcset=\"https:\/\/liora.io\/app\/uploads\/sites\/8\/2020\/12\/cap1.png 429w, https:\/\/liora.io\/app\/uploads\/sites\/8\/2020\/12\/cap1-300x76.png 300w\" style=\"width:429px;max-width:100%;height:auto\" width=\"429\"\/><\/figure>\n\n\n\n<p style=\"margin-top:32px;margin-bottom:32px\"><i>Bei der <\/i><strong><i>Standardisierung<\/i><\/strong><i> ist die Umwandlung feiner als einfach alle Werte zwischen 0 und 1 zu bringen: Der <\/i><strong><i>Mittelwert <\/i><i>\u03bc wird auf 0 <\/i><\/strong><i>gebracht, die <\/i><strong><i>Standardabweichung \u03c3 auf 1<\/i><\/strong><i>.<\/i><\/p>\n\n\n\n<p>Auch hier ist es einfach. Wenn man den Mittelwert \u03bc und die Standardabweichung \u03c3 einer gegebenen Variable X = x1 x2 xn zur Verf\u00fcgung hat, wird die standardisierte Variable so geschrieben:<\/p>\n\n\n\n<figure class=\"wp-block-image aligncenter size-full is-resized\" style=\"width:434px;max-width:100%;margin-top:32px;margin-right:auto;margin-bottom:32px;margin-left:auto\"><img alt=\"Ergebnis einer Datennormalisierung\" decoding=\"async\" height=\"122\" loading=\"lazy\" src=\"https:\/\/liora.io\/app\/uploads\/2020\/12\/Capture-de\u0301cran-2020-12-30-a\u0300-16.18.58.png\" style=\"width:434px;max-width:100%;height:auto\" width=\"434\"\/><\/figure>\n\n\n\n<h2 class=\"wp-block-heading\" id=\"das-ist-alles-toll-aber-wozu-braucht-man-datennormalisierung\">Das ist alles toll, aber wozu braucht man Datennormalisierung ?<\/h2>\n\n\n\n<p>In der Datenverarbeitung arbeiten wir sehr oft mit numerischen Daten, und <strong>diese Daten sind selten in ihrem Rohzustand vergleichbar.<\/strong><\/p>\n\n\n\n<p style=\"margin-top:32px;margin-bottom:32px\"><i>Die Arbeit mit unterschiedlich skalierten Daten kann bei der Analyse ein Problem sein, da eine numerische Variable mit einem Wertebereich von 0 bis 10.000 in der Analyse st\u00e4rker ins Gewicht f\u00e4llt als eine Variable mit Werten zwischen 0 und 1, was sp\u00e4ter zu <strong>Verzerrungen f\u00fchren w\u00fcrde<\/strong><strong>.<\/strong><\/i><\/p>\n\n\n\n<div class=\"wp-block-buttons is-layout-flex wp-block-buttons-is-layout-flex is-content-justification-center wp-container-core-buttons-is-layout-5ee10de4\" style=\"margin-top:32px;margin-bottom:32px\"><div class=\"wp-block-button\"><a class=\"wp-block-button__link wp-element-button\" href=\"https:\/\/liora.io\/de\/weiterbildung\/data-ki\/data-scientist\">Erfahre mehr \u00fcber unsere Weiterbildungen in Data Science<\/a><\/div><\/div>\n\n\n\n<p>Achtung! Bei der Verarbeitung unserer Daten ist die Normalisierung kein obligatorischer Schritt, da sie einen unmittelbaren Informationsverlust verursacht und in manchen F\u00e4llen von Nachteil sein kann!<\/p>\n\n\n\n\n\n<p>Jetzt ist es klarer, aber eine Frage bleibt offen: Wie normalisiert man konkret Daten?<\/p>\n\n\n\n<p>Mit <strong><a href=\"https:\/\/liora.io\/de\/python\">Python<\/a> ist das sehr einfach<\/strong>: Es gibt viele Bibliotheken, die dies erm\u00f6glichen. Ich werde nur <a href=\"https:\/\/scikit-learn.org\/stable\/\">Scikit-learn<\/a>\u00a0erw\u00e4hnen, da es die am h\u00e4ufigsten verwendete Bibliothek in Data Science ist. Diese Bibliothek bietet Funktionen, die die gew\u00fcnschten Normalisierungen in wenigen, sehr einfachen Codezeilen durchf\u00fchren.<\/p>\n\n\n\n<p>Dennoch ist es wichtig, die Anwendungsf\u00e4lle in einen<strong> Kontext zu stellen.<\/strong> Denn in der Praxis reicht es nicht aus, eine einfache Normalisierung auf alle unsere Daten anzuwenden, wenn wir unsere Trainingsdaten bereits normalisiert haben.<\/p>\n\n\n\n<p>Warum ist das so? Aus dem einfachen Grund, <strong>dass es nicht m\u00f6glich ist, dieselbe Transformation auf eine Stichprobe oder auf neue Daten anzuwenden<\/strong>.<\/p>\n\n\n\n<p>Es ist nat\u00fcrlich m\u00f6glich, jede beliebige Stichprobe auf die gleiche Weise zu zentrieren und zu reduzieren, aber mit einem Mittelwert und einer Standardabweichung, die sich von denen unterscheiden, die f\u00fcr den Trainingssatz verwendet werden.<\/p>\n\n\n\n<p>Die Ergebnisse w\u00e4ren dann <strong>keine angemessene Darstellung<\/strong> der Leistung des Modells als Ganzes, wenn es auf neue Daten angewendet wird.<\/p>\n\n\n\n<p>Anstatt also die Normalisierungsfunktion direkt anzuwenden, ist es besser, eine Funktion von Scikit-Learn namens <strong>API Transformer<\/strong> zu verwenden, die es Dir erm\u00f6glicht, einen Preprocessing-Schritt unter Verwendung der Trainingsdaten anzupassen (engl. <i>fit<\/i>).<\/p>\n\n\n\n<p>Wenn also beispielsweise die <strong>Normalisierung auf andere Stichproben angewendet<\/strong> wird, werden die gleichen gespeicherten Mittelwerte und Standardabweichungen verwendet.<\/p>\n\n\n\n<p>Um diesen <strong>\u201eangepassten\u201d Preprocessing-Schritt<\/strong> zu erstellen, verwende einfach die Funktion StandardScaler und passe sie dann mit den Trainingsdaten an. Um sie sp\u00e4ter auf eine Datentabelle anzuwenden, musst Du nur scaler.transform() anwenden.<\/p>\n\n\n\n<p>Genauso funktioniert es f\u00fcr eine <strong>Min-Max Normalisierung.<\/strong><\/p>\n\n\n\n<p>Super, danke Daniel!<\/p>\n\n\n\n<div class=\"wp-block-group has-background has-global-padding is-layout-constrained wp-container-core-group-is-layout-7441ce17 wp-block-group-is-layout-constrained\" style=\"border-left-color:#ff5c43;border-left-width:4px;border-radius:12px;background-color:#fff5f2;margin-top:32px;margin-bottom:32px;padding-top:24px;padding-right:28px;padding-bottom:24px;padding-left:28px\">\n\n<p style=\"margin-top:0;margin-bottom:16px;font-size:clamp(14.642px, 0.915rem + ((1vw - 3.2px) * 0.575), 22px);font-style:normal;font-weight:600\">Auch interessant<\/p>\n\n\n\n<ul style=\"margin-top:0;margin-bottom:0;padding-left:20px\" class=\"wp-block-list\">\n<li><a href=\"https:\/\/liora.io\/de\/data-leakage-was-ist-das-wie-kann-man-sich-davor-schuetzen\">Data Leakage<\/a><\/li>\n<li><a href=\"https:\/\/liora.io\/de\/treemap-definition-anwendung-und-grenzen\">Treemap ,  Definition und Anwendung<\/a><\/li>\n<li><a href=\"https:\/\/liora.io\/de\/datamart-tool-fuer-die-verwaltung-von-betriebsdaten\">Datamart: Betriebsdatenmanagement<\/a><\/li>\n<li><a href=\"https:\/\/liora.io\/de\/wie-wird-man-data-scientist\">Wie wird man Datascientist ?<\/a><\/li>\n<\/ul>\n\n<\/div>\n\n\n\n<h3 class=\"wp-block-heading\" id=\"wenn-wir-uns-in-data-science-weiterbilden-und-deine-tipps-anwenden-wollen-wie-machen-wir-das\">Wenn wir uns in Data Science weiterbilden und Deine Tipps anwenden wollen, wie machen wir das?<\/h3>\n\n\n\n<p>Ganz einfach: Du kannst in K\u00fcrze einen unserer <a href=\"https:\/\/liora.io\/de\/weiterbildung\/data-ki\/data-scientist\">Data Science-Kurse<\/a> belegen \ud83d\ude42.<\/p>\n\n\n\n<figure class=\"wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio\" style=\"margin-top:32px;margin-bottom:32px\"><div class=\"wp-block-embed__wrapper\" style=\"position:relative;width:100%;padding-top:56.25%;overflow:hidden\"><iframe loading=\"lazy\" title=\"YouTube video awMWNU5D2sE\" width=\"560\" height=\"315\" src=\"https:\/\/www.youtube.com\/embed\/awMWNU5D2sE?rel=0\" style=\"position:absolute;inset:0;width:100%;height:100%;border:0\" frameborder=\"0\" allow=\"accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share\" referrerpolicy=\"strict-origin-when-cross-origin\" allowfullscreen><\/iframe><\/div><\/figure>\n\n\n\n<div class=\"wp-block-buttons is-layout-flex wp-block-buttons-is-layout-flex is-content-justification-center wp-container-core-buttons-is-layout-5ee10de4\" style=\"margin-top:32px;margin-bottom:32px\"><div class=\"wp-block-button\"><a class=\"wp-block-button__link wp-element-button\" href=\"https:\/\/liora.io\/de\/weiterbildung\/data-ki\/data-scientist\">Entdecke unsere n\u00e4chsten Starttermine<\/a><\/div><\/div>\n\n","protected":false},"excerpt":{"rendered":"<p>Daniel ist unser technischer Support f\u00fcr die Weiterbildungen bei Liora. Er ist der Experte, der sich mit allen Themen der Data Science auskennt und die Lernenden durch ihre Weiterbildungen begleitet. Heute haben wir es geschafft, ein paar Minuten seiner kostbaren Zeit zu nehmen, damit er unsere Fragen rund um die Datenstandardisierung beantworten kann. Ich: Hallo [&hellip;]<\/p>\n","protected":false},"author":74,"featured_media":30548,"comment_status":"open","ping_status":"open","sticky":false,"template":"elementor_theme","format":"standard","meta":{"_acf_changed":false,"editor_notices":[],"footnotes":""},"categories":[2472],"class_list":["post-135141","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-data-ki"],"acf":[],"_links":{"self":[{"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/posts\/135141","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/users\/74"}],"replies":[{"embeddable":true,"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/comments?post=135141"}],"version-history":[{"count":5,"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/posts\/135141\/revisions"}],"predecessor-version":[{"id":224755,"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/posts\/135141\/revisions\/224755"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/media\/30548"}],"wp:attachment":[{"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/media?parent=135141"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/liora.io\/de\/wp-json\/wp\/v2\/categories?post=135141"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}