R-Zertifizierung: Importing & Cleaning Data with R Track (DataCamp)

Nun ist auch der zweite „Skill Track“ komplett: Importing & Cleaning Data with R (Datenimport und Datenbereinigung in R). Die beiden Kurse zu „Cleaning Data in R“ (Methoden und Praxisbeispiele) hatte ich schon früher absolviert, dazu einen Kurs zu „Importing Data in R“. Dieser alte Kurs wurde durch zwei neue, ausführlichere ersetzt. Auch in den … „R-Zertifizierung: Importing & Cleaning Data with R Track (DataCamp)“ weiterlesen

R-Zertifizierung: R Programming Track (DataCamp)

Seit knapp 1,5 Jahren bin ich bei DataCamp registriert. In dieser Zeit wurde das Kursangebot erheblich erweitert. Zwischenzeitlich hatte ich mal einen großen Teil der Kurse absolviert – inzwischen sind sehr viele neue hinzugekommen. Aber nicht nur Kurse – auch der Aufbau des Kursangebots wurde besser strukturiert. Seit nicht allzu langer Zeit gibt es „Tracks“, … „R-Zertifizierung: R Programming Track (DataCamp)“ weiterlesen

R Zertifizierung: ggplot2 – 3. Kurs

Kürzlich konnte ich den dritten Kurs zu Hadley Wickhams ggplot2-Paket bei DataCamp abschließen. Diesen empfand ich als etwas Besonderes: bereits nach dem zweiten Kurs ist man in der Lage, eine Vielzahl professioneller Diagramme zu erstellen. Dennoch hat sich diese Vertiefung mehr als gelohnt.   Nach einer kurzen Auffrischung ging es u. a. um folgende Themen: Dichteplots … „R Zertifizierung: ggplot2 – 3. Kurs“ weiterlesen

Gastbeitrag: Siegchancen bei „Schlag den Star“ – eine stochastische Analyse

In dem Fernsehformat Schlag den Star treten zwei Prominente in 15 verschiedenen und zuvor unbekannten Spielen gegeneinander an. Das Punktesystem bei Schlag den Star sieht für jedes Spiel eine linear ansteigende Zahl an Wertungspunkten vor. Erhält der Sieger des ersten Spieles einen Punkt, kann der Gewinner des zweiten Spieles zwei Punkte auf sein Punktekonto verbuchen. … „Gastbeitrag: Siegchancen bei „Schlag den Star“ – eine stochastische Analyse“ weiterlesen

Diagramme für Präsentationen, Berichte, Abschlussarbeiten: Beispiele mit der freien R-Software (Boxplots, Histogramme, Streudiagramme)

Sind Sie gelangweilt von Standard-Excel-Diagrammen in Präsentationen, Berichten oder Abschlussarbeiten? Hier ein paar Beispiele, die mit der freien Statistik-Software R erstellt wurden, und zwar mit Hadley Wickhams ggplot2-Paket (sofern nicht anders angegeben). Beispiele für Boxplots mit Untergruppen Eine besondere Stärke von R besteht im sog. „faceting“: man kann Diagramme für Untergruppen elegant anordnen. Wer schon mal … „Diagramme für Präsentationen, Berichte, Abschlussarbeiten: Beispiele mit der freien R-Software (Boxplots, Histogramme, Streudiagramme)“ weiterlesen

R Zertifizierung: Funktionen programmieren – Writing functions in R (DataCamp, Hadley und Charlotte Wickham)

Learning from the best: Dieser DataCamp-Kurs wurde tatsächlich von Hadley Wickham selbst entwickelt, zusammen mit seiner Schwester Charlotte Wickham. Die allermeisten R-Anwender werden schon nach kurzer Zeit auf den Namen Hadley Wickham stoßen, hat er doch zahlreiche R-Erweiterungs-Pakete programmiert (er soll bereits an 55 Paketen mitgewirkt haben! Tendenz steigend), darunter einige der Bekanntesten: ggplot2, dplyr, … „R Zertifizierung: Funktionen programmieren – Writing functions in R (DataCamp, Hadley und Charlotte Wickham)“ weiterlesen

R Zertifizierung: Machine Learning Toolbox (DataCamp)

Nach einer Phase intensiverer Projektarbeit schaute ich nach längerer Zeit mal wieder bei DataCamp rein: Dort wurde inzwischen das Kursangebot erheblich erweitert. Einer der etwas neueren Kurse heißt Machine Learning Toolbox, rund um das caret-Paket, gelehrt vom Haupt-Entwickler Max Kuhn sowie dem Co-Autor Zachary (Zach) Mayer. Es geht um Supervised Learning, „überwachtes Lernen“: Modelle, die auf eine … „R Zertifizierung: Machine Learning Toolbox (DataCamp)“ weiterlesen

R Zertifizierung: Daten importieren und aufbereiten – Fallbeispiele (DataCamp)

R Zertifizierung abgeschlossen: Daten importieren und aufbereiten – Fallbeispiele. Hier gab es im Vergleich zu bisherigen DataCamp-Kursen nichts Wesentlich Neues – dieser Kurs ist sehr praxisorientiert. Datenbereinigung ist nicht so spektakulär wie das Entwickeln fortgeschrittener DataMining-Modelle, aber oft sehr zeitaufwändig. R-Pakete zur Datenbereinigung und Datenaufbereitung Neben etlichen Basisfunktionen kamen überwiegend Pakete von Hadley Wickham zum … „R Zertifizierung: Daten importieren und aufbereiten – Fallbeispiele (DataCamp)“ weiterlesen

R Zertifizierung: R für SAS / SPSS / Stata Anwender (DataCamp)

Weitere R-Zertifizierung abgeschlossen: R für SAS / SPSS / Stata Anwender. Im Vergleich zu anderen Kursen bei DataCamp war dieser wesentlich umfangreicher, mit insgesamt 21 statt der üblichen drei bis fünf Kapiteln. Für Neueinsteiger bei DataCamp empfehle ich, diesen Kurs früh zu absolvieren, wenn man bereits Erfahrung mit wenigstens einem der Statistik-Pakete SAS, SPSS oder … „R Zertifizierung: R für SAS / SPSS / Stata Anwender (DataCamp)“ weiterlesen

Gastbeitrag zum EM-Fieber: Elfmeterschießen-Tool – Modellierung der Sieg-Wahrscheinlichkeit

Das angefügte Excel-Tool für ein Fußball-Elfmeterschießen ermöglicht es, anhand der Binomialverteilung die Wahrscheinlichkeiten für den Sieg im Elfmeterschießen in Abhängigkeit des Spielstandes zu quantifizieren. Hierzu sind bestimmte Annahmen zu treffen. Es soll die Annahme getroffen werden, dass für beide am Elfmeterschießen beteiligte Mannschaften eine konstante Elfmeter-Trefferwahrscheinlichkeit in Höhe von 75% aufweisen. Somit haben beide Mannschaften … „Gastbeitrag zum EM-Fieber: Elfmeterschießen-Tool – Modellierung der Sieg-Wahrscheinlichkeit“ weiterlesen