Nếu bạn mong muốn khai phá làm chủ công nghệ, tạo ra
sản phẩm phục vụ hàng triệu người dùng, cùng tổ chức định hình tương lai, từ đó phát triển bản thân
để chinh phục các cột mốc xa hơn.
Phân tích yêu cầu dữ liệu, thiết kế kiến trúc data lake / data warehouse phục vụ AI và phân tích.
Phát triển pipeline ETL/ELT (batch và streaming) cho dữ liệu huấn luyện và inference của hệ thống AI.
Tối ưu hiệu năng pipeline, đảm bảo độ trễ, throughput và tính nhất quán dữ liệu.
Quản trị chất lượng dữ liệu (Data Quality), data lineage, data catalog, data contract.
Tích hợp, triển khai và vận hành :
Tích hợp dữ liệu từ nhiều nguồn: RDBMS, NoSQL, API, message broker (Kafka), file/object storage.
Triển khai và vận hành nền tảng dữ liệu: Spark, Airflow, dbt, Trino/Presto trên môi trường on-prem/cloud.
Theo dõi, xử lý sự cố pipeline; đảm bảo SLA dữ liệu cho các bộ phận hạ nguồn.
Công việc khác :
Tài liệu hoá quy trình dữ liệu, data dictionary, hướng dẫn sử dụng dataset cho team AI/Analytics.
Nghiên cứu công nghệ mới, chuẩn hoá quy trình phát triển và CI/CD cho data pipeline.
Thực hiện các nhiệm vụ khác trong phạm vi chức năng theo phân công.
Yêu cầu
Yêu cầu bắt buộc: Ứng viên gửi kèm bằng tốt nghiệp và bảng điểm trong đơn ứng tuyển.
Tốt nghiệp Đại học trở lên các ngành: Công nghệ thông tin, Khoa học dữ liệu, Khoa học máy tính, Hệ thống thông tin, Kỹ thuật phần mềm, Toán-Tin, Trí tuệ nhân tạo hoặc các ngành tương đương phù hợp với vị trí công việc.
Tối thiểu 01 năm kinh nghiệm về Data Engineering / DataOps hoặc tương đương.
Thành thạo :
SQL tốt (MySQL/PostgreSQL/Oracle), biết tối ưu query/index