تعديل السلاسل النصية
الدرس 12 من 19 في دورة تحليلات Pandas على Coddy.
التعامل مع السلاسل النصية (Strings) أكثر تعقيداً قليلاً لأنه لا يمكنك ببساطة إضافة 5 أو مقارنتها برقم. لذلك، تمتلك Pandas أداة خاصة .str تتيح لنا استخدام العديد من الطرق التي تدعمها سلاسل Python النصية مثل: .upper()، .lower()، .split() .len()، إلخ.
لتحويل عمود نصي إلى أحرف كبيرة:
df["existing_column"] = df["existing_column"].str.upper()لربط عدة طرق معاً، نحتاج إلى استخدام .str عدة مرات لأن كل طريقة تعيد كائن series:
.str.upper().str.split().str.lower()...لإنشاء عمود first_name وعمود last_name من عمود full_name:
df["first_name"] = df["full_name"].str.split(" ").str[0]
df["last_name"] = df["full_name"].str.split(" ").str[1] التحدي
سهليحتوي ملف CSV المسمى stats.csv على معلومات حول الإحصائيات.
إليك أول 5 أسطر من الملف:
ID,COUNTRY,COLOR,SKILL,SKILL_POINTS,UTILIZATION,IS_VALID,CATEGORY
1,France,Signal violet,marksmanship,14,0.1924,1,SHOW
2,Solomon Islands,Pearl violet,crocheting,4,0.6108,1,TREE
3,Germany,Bottle green,calligraphy,12,0.88646,0,SHOW
4,Mauritania,Fawn brown,paper cutting,9,0.058,1,JAPE- قم بتعديل عمود
COLORليحتوي فقط على الكلمة الأخيرة من عمودCOLOR. - أضف عموداً باسم
COUNTRY_LENGTHيحتوي على عدد الأحرف في عمودCOUNTRY. - قم بتصفية جميع الصفوف حيث يحتوي عمود
SKILLعلى كلمة واحدة فقط (على سبيل المثال، "wood chopper" تتكون من كلمتين).
قم بتخزين النتيجة في المتغير df.
جرّب بنفسك
# تم استيراد pandas كـ pd بالفعل
df = pd.read_csv("./stats.csv")
# اكتب كودك أدناه
جميع دروس تحليلات Pandas
4تحليل البيانات باستخدام Pandas
الإحصاء الوصفيتجميع البيانات وتلخيصهاأنواع التجميع المختلفةالدمج والضم3معالجة البيانات باستخدام Pandas
إرجاع النتيجة المطلوبةتصفية البياناتالإضافة والحذفتعديل البياناتتعديل السلاسل النصيةتعديلات مخصصةتدرّب بنفسك: مترجم Python عبر الإنترنت