รายละเอียดงานKey Responsibilities (หน้าที่ความรับผิดชอบ)
Fabric Platform Architecture: ออกแบบ จัดการ และเพิ่มประสิทธิภาพให้กับสถาปัตยกรรมข้อมูลบน Microsoft Fabric โดยใช้งาน OneLake เป็นศูนย์กลางในการจัดเก็บข้อมูล (Single Source of Truth)
Data Ingestion & Pipelines: สร้างและดูแลระบบ ETL/ELT Pipelines ผ่าน Data Factory (Dataflows Gen2 และ Pipelines) เพื่อดึงข้อมูลจากแหล่งต่างๆ เข้าสู่ระบบ
Data Lakehouse & Warehousing: ออกแบบและบริหารจัดการ Lakehouse และ Data Warehouse โดยใช้ประโยชน์จากตารางรูปแบบ Delta Lake (Parquet) เพื่อรองรับการสืบค้นข้อมูลที่มีประสิทธิภาพสูง
Data Transformation: เขียนโค้ดเพื่อจัดการ แปลงข้อมูล และทำความสะอาดข้อมูลขนาดใหญ่ (Big Data) โดยใช้ Apache Spark (Notebooks / Spark Job Definitions) ด้วยภาษา Python/PySpark หรือ Scala และ SQL
Direct Lake Optimization: ประสานงานกับทีม BI เพื่อออกแบบโมเดลข้อมูล (Semantic Model) ที่รองรับการเชื่อมต่อกับ Power BI ผ่านโหมด Direct Lake เพื่อการทำรายงานแบบ Real-time โดยไม่ต้องโหลดข้อมูลซ้ำ
Data Governance & Security: กำหนดสิทธิ์การเข้าถึงข้อมูล (Workspace Security, Row-level / Column-level security) และดูแลเรื่อง Data Quality ภายในระบบ Fabric
Monitoring & Maintenance: ตรวจสอบ ติดตาม (Monitor) และปรับแต่งประสิทธิภาพ (Performance Tuning) ของการใช้ Fabric Capacity ให้คุ้มค่าและมีประสิทธิภาพสูงสุด