Junior Data & AI Platform Engineer (SQL, Python)
Công ty Cổ phần ThinkLabs
Mô tả công việc
Mục tiêu vị trí (Role Objective) Tham gia triển khai và vận hành nền tảng Data & AI Platform dựa trên công nghệ của IBM Cloud Pak for Data tập trung vào: Tích hợp dữ liệu (Data Integration) Xây dựng pipeline phân tích (DataOps) Hỗ trợ triển khai các mô hình AI/ML ứng dụng Vận hành và xử lý sự cố hệ thống dữ liệu Đây là vị trí được kỳ vọng đào tạo bài bản để trở thành Data & AI Engineer chuyên sâu trong hệ sinh thái enterprise (của IBM) Mô tả công việc A. Data Platform & Integration Tham gia cài đặt, cấu hình và vận hành các thành phần trong CP4D: DataStage / Data Integration Watson Studio / Analytics Engine Xây dựng các pipeline xử lý dữ liệu: ETL / ELT Data ingestion từ nhiều nguồn (DB, API, file, streaming) Hỗ trợ tối ưu hiệu năng (performance tuning) B. DataOps & Pipeline Orchestration Thiết kế và triển khai pipeline dữ liệu: Batch / near real-time Sử dụng các công cụ orchestration: Workflow pipeline Monitoring (Databand hoặc tương đương) Tham gia xây dựng: Data lineage Data quality rules C. AI/ML ứng dụng trên dữ liệu Hỗ trợ triển khai các use case AI: Phân tích dữ liệu Machine Learning cơ bản GenAI (RAG, embedding, LLM integration) Làm việc với: Python (pandas, sklearn…) Notebook (Jupyter / Watson Studio) Tích hợp model vào pipeline dữ liệu D. Vận hành & xử lý sự cố (Support L1/L2) Giám sát hệ thống CP4D: Log, resource usage, job failure Xử lý các lỗi cơ bản: Pipeline lỗi Job fail Data inconsistency Phối hợp với senior / IBM support khi cần E. Tài liệu & chuyển giao Viết tài liệu kỹ thuật: Runbook Hướng dẫn vận hành Tham gia đào tạo nội bộ và khách hàng
Yêu cầu công việc
Trình độ Học vấn Tốt nghiệp đại học ngành: Công nghệ thông tin / Công nghệ phần mềm Khoa học dữ liệu Hệ thống thông tin Toán tin / AI Kiến thức & kỹ năng cơ bản Bắt buộc: Có kiến thức về: Cơ sở dữ liệu (SQL) Python cơ bản Hiểu: ETL / Data pipeline API / REST Có tư duy logic, giải quyết vấn đề tốt Ưu tiên: Có hiểu biết hoặc học qua: Data Engineering / Big Data Machine Learning cơ bản Docker / Kubernetes Có trải nghiệm với: Apache Spark Jupyter Notebook Kỹ năng mềm Ham học hỏi công nghệ mới (đặc biệt AI & Data) Có khả năng làm việc nhóm Có thể làm việc onsite tại dự án (khi cần) Tư duy “engineer mindset”: Trách nhiệm, Chủ động, không ngại làm việc ngoài giờ khi có yêu cầu công việc Lộ trình phát triển Sau 12-24 tháng, bạn sẽ được phát triển thành: Data Engineer / AI Engineer Platform Engineer (ví dụ: IBM CP4D) 24-36 tháng, bạn sẽ trưởng thành và có các kỹ năng của Solution Engineer trong các dự án về hạ tầng dữ liệu cho các dự án lớn của khối: Doanh nghiệp, Ngân hàng, Chính phủ Có cơ hội tham gia các dự án lớn về: Data Platform, AI Platform của doanh nghiệp lớn, cấp quốc gia
Quyền lợi
Thu nhập theo thoả thuận & năng lực. Các chế độ phúc lợi xã hội chung của công ty, theo quy định của Luật Lao động Việt Nam Được đào tạo trực tiếp bởi: Senior Architect / CTO level Tham gia dự án thực tế với: Công nghệ của IBM, khách hàng enterprise / chính phủ Môi trường startup công nghệ cao: làm thật – học nhanh – phát triển nhanh