• Thành thạo Python và SQL, có khả năng viết code production, testable và dễ bảo trì.
• Có kinh nghiệm thực tế với Apache Airflow và một hệ thống xử lý phân tán như Spark.
• Hiểu sâu ETL/ELT, incremental loading, CDC, partitioning, data modeling và query optimization.
• Có kinh nghiệm làm việc với PostgreSQL hoặc hệ quản trị cơ sở dữ liệu quan hệ tương đương.
• Có khả năng thiết kế pipeline idempotent, hỗ trợ retry, backfill và schema evolution.
• Có kinh nghiệm vận hành workload bằng Docker và Kubernetes.
• Hiểu data quality, observability, security và quản lý secrets trong production.
• Có khả năng phân tích sự cố end-to-end và làm việc độc lập với mức độ ownership cao.
• Giao tiếp tốt với cả kỹ thuật và nghiệp vụ; có khả năng chuyển yêu cầu chưa rõ thành giải pháp dữ liệu cụ thể.
• Kinh nghiệm với Delta Lake/lakehouse, Kafka, Kafka Connect, Debezium hoặc PyFlink.
• Kinh nghiệm với S3-compatible object storage, BigQuery, MongoDB hoặc Oracle.
• Hiểu dimensional modeling, star schema và thiết kế data mart.
• Kinh nghiệm xây dựng dữ liệu cho logistics, fulfillment, OMS, WMS hoặc e-commerce.
• Kinh nghiệm với FastAPI, Pydantic, SQLAlchemy, Alembic hoặc dependency injection.
• Có kinh nghiệm xây dựng dashboard bằng Streamlit, Power BI, Metabase, Superset hoặc công cụ BI tương đương.
• Kinh nghiệm thiết lập CI/CD, GitOps, monitoring và alerting cho data platform.
• Từng giữ vai trò technicalowner hoặc xây dựng/nâng cấp nền tảng dữ liệu trong giai đoạn tăng trưởng.