وصف الوظيفة
الأدوار والمسؤوليات
وصف الوظيفة
كمهندس بيانات، ستنضم إلى فريق البيانات لديك للمشاركة في مشاريع تحليل البيانات الإستراتيجية وتنفيذ حلول معالجة البيانات واسعة النطاق. ستكون مسؤولاً عن تصميم وتحسين وتطوير خطوط بيانات على منصات سحابية، مع التركيز على استخدام PySpark و Azure Data Factory .
المسؤوليات الأساسية الخاصة بك ستكون:
- تصميم وتطوير وصيانة خطوط بيانات واسعة النطاق باستخدام PySpark .
- إعداد تدفقات البيانات مع Azure Data Factory، ودمج مصادر ووجهات بيانات مختلفة (SQL، Data Lakes، APIs، إلخ).
- ضمان دمج البيانات من أنظمة مختلفة في بيئة سحابية (Azure).
- تحسين أداء معالجة البيانات (SQL، PySpark، إلخ).
- التعاون مع فرق الأعمال، محللي البيانات وعلماء البيانات لفهم الاحتياجات واقتراح حلول فعالة وقابلة للتوسع.
- المشاركة في تعريف هندسة البيانات واستراتيجية الحوكمة.
- إعداد ومراقبة وظائف معالجة البيانات (معالجة الأخطاء، إدارة الأداء).
- توثيق الحلول المنفذة واتباع أفضل ممارسات التطوير.
- المشاركة في التحسين المستمر للعمليات والأدوات الحالية.
الملف الشخصي للمرشح المطلوب
المؤهلات
نحن نبحث عن مرشح يمتلك خبرة تقنية قوية في إدارة البيانات ومعالجتها على نطاق واسع، مع القدرات التالية:
الكفاءات التقنية :
- الإتقان في PySpark لمعالجة كميات ضخمة من البيانات في بيئة موزعة.
- خبرة كبيرة في إعداد وإدارة Azure Data Factory لإنشاء وتنظيم خطوط البيانات.
- خبرة صلبة في قواعد البيانات العلائقية وغير العلائقية (SQL، NoSQL).
- معرفة بأدوات إدارة البيانات في منظومة Azure (Azure Data Lake، Azure SQL Database، Azure Blob Storage، إلخ).
- معرفة عملية بخدمات سحابة Azure cloud services واستخدامها في حلول معالجة البيانات (Azure Databricks، Azure Synapse Analytics، إلخ).
- خبرة باستخدام أدوات التحكم بالإصدار (Git، Azure DevOps، إلخ) وممارسات تطوير برمجيات جيدة.
- معرفة بمفاهيم البيانات الكبيرة و优化 الأداء في البيئات الموزعة.
المهارات الشخصية:
- الاستقلالية والدقة والانتباه للتفاصيل.
- قدرة ممتازة على حل المشكلات التقنية المعقدة.
- مهارات اتصال جيدة والقدرة على العمل ضمن فريق.
- عقلية تحليلية وقدرة على فهم احتياجات الأعمال لاقتراح حلول مناسبة.
التكوين والخبرة :
- درجة الماجستير (BAC +5) في علوم الحاسوب، علم البيانات، أو مجال مكافئ.
- حد أدنى من 3 سنوات خبرة في دور مشابه، مع خبرة مثبتة في التطوير على PySpark و Azure Data Factory .
Job Description
Roles & Responsibilities
Job Description
As a Data Engineer, you will join our data team to participate in strategic data analysis projects and the implementation of large-scale data processing solutions. You will be responsible for the design, optimization, and development of data pipelines on cloud platforms, with a focus on the use of PySpark and Azure Data Factory .
Your main responsibilities will be:
- Design, develop and maintain large-scale data pipelines using PySpark .
- Set up data flows with Azure Data Factory , integrating various data sources and destinations (SQL, Data Lakes, APIs, etc.).
- Ensure the integration of data from various systems in a cloud environment (Azure).
- Optimize the performance of data processing (SQL, PySpark, etc.).
- Collaborating with business teams, data analysts and data scientists to understand needs and propose effective and scalable solutions.
- Participate in defining the data architecture and governance strategy.
- Set up and monitor data processing jobs (error handling, performance management).
- Document the solutions implemented and follow best development practices.
- Participate in the continuous improvement of existing processes and tools.
Desired Candidate Profile
Qualifications
We are looking for a candidate with strong technical expertise in large-scale data management and processing, with the following skills:
Comp tences techniques :
- Mastering PySpark for processing massive data in a distributed environment.
- Significant experience in setting up and managing Azure Data Factory for creating and orchestrating data pipelines.
- Solid experience in relational and non-relational databases (SQL, NoSQL).
- Knowledge of data management tools in the Azure ecosystem (Azure Data Lake, Azure SQL Database, Azure Blob Storage, etc.).
- Practical knowledge of Azure cloud services and their use in data processing solutions (Azure Databricks, Azure Synapse Analytics, etc.).
- Experience with version control tools (Git, Azure DevOps, etc.) and good software development practices.
- Knowledge of Big Data concepts and performance optimization in distributed environments.
Personal skills:
- Autonomy, rigor and attention to detail.
- Excellent ability to solve complex technical problems.
- Good communication skills and ability to work in a team.
- Analytical mindset and ability to understand business needs in order to propose appropriate solutions.
Formation et exp rience :
- Master's degree (Bac +5) in computer science, data science, or an equivalent field.
- Minimum of 3 years of experience in a similar role, with proven experience in development on PySpark and Azure Data Factory .