الاستيراد

في هذا الجزء من الكتاب، ستتعلم كيفية استيراد مجموعة أوسع من البيانات إلى R، بالإضافة إلى كيفية تحويلها إلى شكل مفيد للتحليل. في بعض الأحيان يكون الأمر مجرد استدعاء دالة من حزمة استيراد البيانات المناسبة. ولكن في الحالات الأكثر تعقيداً، قد يتطلب الأمر كلاً من التنسيق النظيف (tidying) والتحويل (transformation) من أجل الوصول إلى المستطيل النظيف الذي تفضل العمل معه.

نموذج علم البيانات الخاص بنا مع إبراز خطوة الاستيراد باللون الأزرق.
الشكل 1: استيراد البيانات هو بداية عملية علم البيانات؛ فبدون البيانات لا يمكنك ممارسة علم البيانات!

في هذا الجزء من الكتاب ستتعلم كيفية الوصول إلى البيانات المخزنة بالطرق التالية:

هناك حزمتان مهمتان في tidyverse لن نناقشهما هنا: haven و xml2. إذا كنت تعمل مع بيانات من ملفات SPSS و Stata و SAS، فراجع حزمة haven عبر الرابط https://haven.tidyverse.org. وإذا كنت تعمل مع بيانات XML، فراجع حزمة xml2 عبر الرابط https://xml2.r-lib.org. خلاف ذلك، ستحتاج إلى إجراء بعض البحث لمعرفة الحزمة التي ستلزمك لاستخدامها؛ وجوجل هو صديقك هنا 😃.