Menu
Coddy logo textTech

בחירת תת־קבוצות של נתונים

שיעור 3 מתוך 14 בקורס מניפולציה של נתונים ב-R של Coddy.

בחירת תת־קבוצה של נתונים היא מיומנות חיונית ב־R, שמאפשרת לך לחלץ חלקים מסוימים מהנתונים שלך.

הפונקציה subset() מספקת דרך נוחה לבחור תת־קבוצות מתוך מסגרות נתונים.

df <- data.frame(
  name = c("Alice", "Bob", "Charlie"),
  age = c(25, 30, 35),
  city = c("New York", "London", "Paris")
)
# בחירת שורות משנה
result <- subset(df, age > 28)
print(result)

פלט:

  name     age  city
2 Bob      30   London
3 Charlie  35   Paris
# בחירת תת־קבוצה של עמודות
result <- subset(df, select = c("name", "city"))
print(result)

פלט:

     name     city
1    Alice    New York
2    Bob      London
3    Charlie  Paris
quiz iconבחנו את עצמכם

השיעור הזה כולל חידון קצר. התחילו את השיעור כדי לענות עליו ולעקוב אחרי ההתקדמות.

quiz iconבחנו את עצמכם

השיעור הזה כולל חידון קצר. התחילו את השיעור כדי לענות עליו ולעקוב אחרי ההתקדמות.

quiz iconבחנו את עצמכם

השיעור הזה כולל חידון קצר. התחילו את השיעור כדי לענות עליו ולעקוב אחרי ההתקדמות.

challenge icon

אתגר

קל

ניתנה לך מסגרת נתונים שמכילה מידע על תלמידים. המשימה שלך היא לבצע את הפעולות הבאות:

  1. סנן את מסגרת הנתונים כך שתכלול רק תלמידים שגילם מעל 20 שנים.
  2. מתוך תת-הקבוצה הזאת, בחר רק את העמודות "name" ו-"score".
  3. חשב והדפס את הציון הממוצע של התלמידים האלה.
  4. זהה והדפס את שמו של התלמיד שקיבל את הציון הגבוה ביותר.

נסו בעצמכם

# קראו את הקלט
con <- file("stdin", "r")
input_data <- suppressWarnings(readLines(con))

# צרו מסגרת נתונים מהקלט
df <- read.csv(text = input_data, header = TRUE, stringsAsFactors = FALSE)

# TODO: כתבו את הקוד שלכם למטה
# 1. סננו את מסגרת הנתונים לתלמידים שגילם מעל 20
# 2. בחרו רק את העמודות "name" ו-"score"
# 3. חשבו את הציון הממוצע
# 4. מצאו את התלמיד בעל הציון הגבוה ביותר

# הדפיסו את התוצאות (עדכנו אותן לפי החישובים שלכם)
cat("Average score:", 0, "\n")
cat("Student with highest score:", "", "\n")

כל השיעורים ביחידה מניפולציה של נתונים ב-R

תרגלו בעצמכם: קומפיילר R אונליין