Datenpfad
banner
datenpfad.bsky.social
Datenpfad
@datenpfad.bsky.social
R-Tipp #20 💡

Mit der Funktion round_half_up() aus dem Paket janitor kannst du Werte auf ganze Zahlen runden, während die Funktion round_to_fraction() verwendet wird, um auf einen beliebigen Bruch zu runden. Im Beispiel wurden die Zahlen auf die nächsten Viertel gerundet (Nenner = 4).
April 3, 2026 at 7:30 AM
R-Tipp #19 💡

Die Kombination aus #Histogramm und Dichtekurve stellt die Rohdaten in Form von Häufigkeitsbalken dar und ergänzt sie durch eine geglättete Wahrscheinlichkeitsverteilungskurve. Damit lassen sich sowohl genaue Zahlen ermitteln als auch kontinuierliche Trends erkennen.
March 26, 2026 at 5:55 PM
R-Tipp #18 💡

Liegen numerische Daten auf unterschiedlichen Skalen, sind sie nicht so einfach vergleichbar. Eine gebräuchliche Technik ist das Normalisieren. Zu diesem Zweck wird die sogenannte Min/Max-Skalierung verwendet, bei der die Werte proportional auf einer Skala von 0 bis 1 verteilt werden.
March 19, 2026 at 6:01 PM
R-Tipp #17 💡

Das Kombinieren von Spalten ist eine gängige Operation bei der Arbeit mit Datensätzen in #R. Die Funktion unite() ist dabei eine komfortable Möglichkeit, um mehrere Spalten zu einer einzigen zusammenzufassen.
March 12, 2026 at 5:49 PM
R-Tipp #16 💡

Dank der Funktion tabyl() aus dem Paket janitor können Prozent- und Absolutwerte zusammen ausgegeben werden. Mit «adorn()» lässt sich die Ausgabe zudem leicht anpassen. Du kannst beispielsweise Summen hinzufügen oder die Anzahl der Nachkommastellen für Prozentwerte festlegen.
March 5, 2026 at 5:59 PM
Ersetze Google Fonts durch Bunny Fonts (bunny.net/fonts) und übernimm wieder die Kontrolle über die Privatsphäre deiner Nutzer. #BunnyFonts kann kostenlos für kommerzielle Zwecke genutzt werden, verkürzt die Ladezeiten und verfolgt keine Benutzerdaten. Das erleichtert die Umsetzung der DSGVO.
Bunny Fonts | Explore Faster & GDPR Friendly Fonts
Take complete control of your privacy and speed up your web applications with Bunny Fonts that help make the internet faster, safer, and GDPR compliant!
bunny.net
February 26, 2026 at 5:36 PM
R-Tipp #15 💡

Diagramme, in denen Symbole, Logos und emotionale Bilder im Titel oder in der Bildunterschrift direkt mit wichtigen Daten im #Diagramm verknüpft sind, wecken Interesse und Aufmerksamkeit. Sie lenken den Blick zu den wichtigsten Punkten.
February 19, 2026 at 7:11 PM
R-Tipp #14 💡

Mit tapply() kannst du eine Funktion auf Gruppen anwenden. Dabei kann es sich um vorhandene Funktionen wie mean() oder sd() oder um selbst geschriebene Funktionen handeln. Du kannst tapply() auch mit summary() verwenden, um einen Überblick über die Verteilung der Daten zu erhalten.
February 12, 2026 at 7:56 AM
R-Tipp #13 💡

Wenn kleine Abweichungen im #Säulendiagramm von Bedeutung sind, ist es empfehlenswert, beides darzustellen. Ein normales Säulendiagramm, das bei Null beginnt, aber auch eine vergrösserte Version, die es dem Leser ermöglicht, die einzelnen Säulenwerte besser zu erkennen.
February 5, 2026 at 5:41 PM
R-Tipp #12 💡

Um detaillierte deskriptive Statistiken für deine numerischen Variablen zu erhalten, kannst du die Funktion descr() aus dem Paket summarytools nutzen. Dabei kannst du auswählen, welche Statistiken generiert werden sollen, wie z.B. "common", "fivenum", usw.
January 29, 2026 at 5:28 PM
R-Tipp #11 💡

Mit keep() lassen sich alle Variablen auswählen, die anhand einer von dir ausgewählten Funktion den Wert TRUE zurückgeben. discard() verfolgt den umgekehrten Ansatz. Damit werden alle Variablen ausgewählt, die gemäss einer bestimmten Funktion den Wert FALSE zurückgeben.
January 22, 2026 at 5:52 PM
R-Tipp #10 💡

Mit der Funktion par() lassen sich mehrere Plots nebeneinander ausgegeben. Das ist hilfreich, wenn du beispielsweise die Verteilung mehrerer Variablen vergleichen möchtest.
January 15, 2026 at 5:36 PM
R-Tipp #9 💡

Mit dem Paket "forcats" lassen sich häufige Aufgaben mit Faktoren einfach erledigen. Es enthält beispielsweise Funktionen zum Hinzufügen oder Entfernen eines Levels sowie zum Ändern der Faktorwerte. Auch das Zusammenfassen bestimmter Werte eines Faktors ist möglich.
January 8, 2026 at 6:08 PM
R-Tipp #8 💡

Das forcats-Paket enthält Funktionen, die das Bearbeiten von Faktoren vereinfachen. forcats unterstützt dich bei vielen Aufgaben, z.B. beim Neuanordnen der Levels basierend auf einer anderen Variable, dem Sortieren der Levels nach ihrer Häufigkeit oder dem Neuordnen der Levels im Plot.
December 18, 2025 at 5:28 PM
R-Tipp #7 💡

Sowohl das Paket readr mit parse_factor() als auch Base R verfügen über eine Funktion zum Erstellen von Faktoren. Dabei gehen beide davon aus, dass die Levels die eindeutigen Werte des Vektors sind. Sie verfolgen jedoch unterschiedliche Ansätze, wie die Levels sortiert werden.
December 11, 2025 at 5:26 PM
Das animierte Streudiagramm visualisiert den Weg nach oben der drei Tennisspielerinnen Amanda Anisimova, Belinda Bencic und Eva Lys in der #WTA Tennisweltrangliste 🎾 Die Datenvisualisierung in Form einer Punktwolke wurde mithilfe der R-Pakete "ggplot2" und "gganimate" erstellt.
December 4, 2025 at 5:43 PM
R-Tipp #6 💡

Wann haben Kund:innen zuletzt gekauft und wie verändert sich das Kaufverhalten im Laufe der Zeit? In diesem #R-Tipp erfährst du, wie du das Verhalten deiner Kundschaft mit R analysieren kannst – für bessere Insights, gezieltes Marketing und passende Anreize für inaktive Kundschaft.
November 27, 2025 at 5:41 PM
R-Tipp #5 💡

Dank der Funktion geom_richtext() können Labels von ggplot2-Diagrammen aufgewertet und um informative Fakten erweitert werden. Im Diagramm der Top 10 der #ATP Weltrangliste lassen sich so die Spielernamen beispielsweise mit den Flaggen ihrer Nationalität kombinieren.
November 20, 2025 at 5:48 PM
Das animierte Balkendiagramm zeigt die Top 10 des WTA-Rankings vom 6. Januar bis 10. November 2025. Die Visualisierung der besten Tennisspielerinnen wurde mithilfe der R-Pakete ggplot2 und gganimate erstellt.
November 15, 2025 at 4:14 PM
Wenn du einen Inhalt in mehrere Spalten aufteilen möchtest, kannst du dafür die Funktion separate() verwenden. Das Trennzeichen ist dabei frei wählbar.
November 6, 2025 at 6:07 PM
R-Tipp #3 💡

Mit der Funktion slice() von dplyr können bestimmte Zeilen ausgewählt werden. Um die vorletzte Zeile zu erhalten, kannst du folgenden Code verwenden:
October 24, 2025 at 12:55 PM
R-Tipp #2 💡

Mithilfe der Funktion "corrplot" kannst du den Datensatz ganz einfach auf korrelierte Merkmale überprüfen. Dank verschiedener Argumente lässt sich der Plot zudem vielfältig anpassen.
October 16, 2025 at 5:17 PM
R-Tipp 💡

Das Hinzufügen eines Präfixes zum Spaltennamen kann nützlich sein, um Variablen zu organisieren, die Lesbarkeit zu verbessern oder Namenskonflikte beim Zusammenführen von Datensätzen zu vermeiden.
October 9, 2025 at 5:11 PM