Thiết kế, xây dựng và duy trì các pipeline dữ liệu (data pipelines) hiệu quả, tin cậy và có khả năng mở rộng để thu thập, xử lý và lưu trữ dữ liệu.
Xây dựng và duy trì cơ sở hạ tầng dữ liệu, bao gồm các hệ thống lưu trữ dữ liệu (data warehouses, data lakes) và các công cụ xử lý dữ liệu (ETL).
Tối ưu hóa hiệu năng của các pipeline dữ liệu và cơ sở hạ tầng dữ liệu.
Triển khai các giải pháp để đảm bảo chất lượng dữ liệu, bao gồm việc kiểm tra tính chính xác, đầy đủ và nhất quán của dữ liệu.
Phối hợp với các nhóm khác (như
Data Scientists,
Data Analysts) để hiểu rõ yêu cầu về dữ liệu và cung cấp các giải pháp phù hợp.
Nghiên cứu và áp dụng các công nghệ mới để cải thiện hiệu quả và khả năng mở rộng của hệ thống dữ liệu.
Tạo tài liệu kỹ thuật chi tiết về hệ thống và quy trình dữ liệu.
Tốt nghiệp Đại học trở lên chuyên ngành Khoa học máy tính, Kỹ thuật phần mềm hoặc các ngành liên quan.
Có ít nhất 3 năm kinh nghiệm làm việc trong lĩnh vực Kỹ sư dữ liệu.
Kinh nghiệm làm việc với các hệ thống dữ liệu lớn (Big Data) và các công nghệ liên quan như Hadoop, Spark, Kafka, etc.
Có kiến thức vững chắc về các ngôn ngữ lập trình như Python, Scala hoặc Java.
Kinh nghiệm làm việc với các công cụ ETL (ví dụ: Apache Airflow, Apache NiFi).
Có kinh nghiệm về cơ sở dữ liệu (SQL, NoSQL).
Có kinh nghiệm về cloud platform như AWS, Google Cloud Platform hoặc Azure.
Có khả năng làm việc độc lập và làm việc nhóm tốt.
Kỹ năng giải quyết vấn đề và tư duy phân tích tốt.
Có khả năng đọc hiểu tài liệu
tiếng Anh.
Mức lương thỏa thuận theo năng lực và kinh nghiệm.
Cơ hội được làm việc trong môi trường năng động, chuyên nghiệp và thân thiện.
Cơ hội phát triển bản thân và thăng tiến trong công việc.
Được hưởng đầy đủ các chế độ bảo hiểm theo quy định của pháp luật.
Chế độ nghỉ phép, nghỉ lễ theo quy định của nhà nước.
Tham gia các hoạt động teambuilding, du lịch hàng năm.
Cơ hội được đào tạo và nâng cao kiến thức chuyên môn.