-
Việc làm thực tập (14858)
-
En (0)
- Sales Staff / Business Development Executive (0)
- Manufacturing / Industrial Zone (0)
- Service Staff / Waiter / Waitress (0)
- Warehouse Staff / Logistics Staff (0)
- Sales (0)
- Customer Service (0)
- Technical Staff / Technician (0)
- Service Industry (F&B, Hotel, Restaurant) (0)
- General Labor / Unskilled Labor (0)
- Driver / Delivery (0)
- IT / Information Technology (0)
- Marketing / Communications (0)
- Accounting (0)
- Administration / Office Staff (0)
- Housekeeper / Cleaner / General Helper (0)
- Security Guard (0)
- Delivery Staff / Shipper (0)
- Factory Worker (0)
- Advertising - Public Relations (0)
- Arts - Entertainment - Publishing (0)
- Clerical - Administrative (0)
- Education - Training (0)
- Engineering - Architecture (0)
- Accounting - Finance (0)
- Technology (0)
- Retail (0)
- Restaurant - Food Service (0)
- Real Estate (0)
- Non-profit - Volunteer (0)
- Marketing (0)
- Manufacturing - Operations (0)
- Manual Labor (0)
- Healthcare (0)
- Human Resource (0)
- Internet (0)
- Legal (0)
- Other Jobs (0)
-
Tìm Việc Làm (0)
-
Việc làm it (0)
Check with seller TP.HCM => Tuyển gấp 3 Thực tập sinh Data Engineer đi làm ngay không cần kinh nghiệm
- Location: Tp Hồ Chí Minh, vietnam
MÔ TẢ CÔNG VIỆC: THỰC TẬP SINH KỸ SƯ DỮ LIỆU (DATA ENGINEER INTERN)
Tổng quan vai trò:
Chúng tôi đang tìm kiếm một "chuyên gia kết nối dữ liệu" – vị trí Thực tập sinh Kỹ sư Dữ liệu (Data Engineer Intern). Trong kỷ nguyên số hóa, dữ liệu được ví như "dầu mỏ", nhưng nếu không có hệ thống đường ống khai thác và xử lý, nguồn tài nguyên đó sẽ trở nên vô giá trị. Bạn chính là mắt xích quan trọng, người thiết kế, xây dựng và vận hành các "đường ống dẫn dầu" đó, đảm bảo dòng chảy thông tin trong doanh nghiệp luôn thông suốt, sạch sẽ, ổn định và bảo mật tuyệt đối.
Sự tỉ mỉ trong việc tối ưu hóa từng câu lệnh truy vấn SQL, tư duy logic nhạy bén khi thiết kế cấu trúc cơ sở dữ liệu và khả năng xử lý nhanh các sự cố nghẽn mạng dữ liệu (data pipeline) chính là giá trị cốt lõi bạn mang lại. Nếu bạn là một lập trình viên trẻ đam mê dữ liệu lớn (Big Data), yêu thích việc giải quyết các bài toán kỹ thuật phức tạp và mong muốn làm việc trong một môi trường công nghệ cao, đòi hỏi sự chính xác và hiệu năng tối đa, chúng tôi rất chào đón bạn gia nhập đội ngũ.
---
Nhiệm vụ công việc chính:
1. Vận hành & Giám sát Hệ thống Đường ống Dữ liệu (Data Pipeline)
* Theo dõi và kiểm tra hệ thống định kỳ: Thực hiện giám sát hàng ngày tình trạng hoạt động của các đường ống dữ liệu (ETL/ELT pipelines) tự động. Sử dụng các công cụ quản lý luồng công việc (workflow orchestration) như Apache Airflow, Prefect hoặc Cron Jobs để đảm bảo dữ liệu được đổ về kho dữ liệu đúng giờ và đầy đủ.
* Xử lý sự cố dữ liệu đầu ca: Phát hiện nhanh các lỗi xảy ra trong quá trình truyền tải dữ liệu (data ingestion), ví dụ: mất kết nối nguồn dữ liệu (API, Database nguồn), sai lệch định dạng file (CSV, JSON, Parquet), hoặc lỗi tràn bộ nhớ (Out of Memory). Co-work cùng các kỹ sư chính thức để debug và tái khởi động luồng chạy một cách nhanh nhất nhằm tránh gián đoạn báo cáo của doanh nghiệp.
* Kiểm tra tính toàn vẹn: Định kỳ thực hiện đối soát số lượng bản ghi (record count) và kiểm tra chất lượng dữ liệu (data quality checks) giữa nguồn cấp (Source) và đích đến (Data Warehouse/Data Lake).
2. Thiết lập, Cài đặt & Cấu hình Hệ thống Tích hợp Dữ liệu
* Phát triển luồng thu thập dữ liệu (Ingestion): Thiết lập và cấu hình các kết nối mới để lấy dữ liệu từ nhiều nguồn khác nhau bao gồm: Hệ quản trị cơ sở dữ liệu quan hệ (PostgreSQL, MySQL, SQL Server), cơ sở dữ liệu phi quan hệ (MongoDB), các hệ thống SaaS bên thứ ba thông qua RESTful API, Webhook, hoặc các tệp tin lưu trữ dạng phẳng.
* Cấu hình biến đổi dữ liệu (Transformation): Trực tiếp viết mã nguồn (Python, SQL) hoặc sử dụng các công cụ chuyển đổi dữ liệu (như dbt - Data Build Tool) để chuẩn hóa dữ liệu: ép kiểu dữ liệu, xử lý giá trị khuyết thiếu (Null/NaN), mã hóa thông tin nhạy cảm (PII masking), và bóc tách các trường thông tin phức tạp.
* Phân quyền và bảo mật dữ liệu: Hỗ trợ thiết lập các chính sách phân quyền truy cập dữ liệu (Row-level security, Column-level security) trên Kho dữ liệu (Data Warehouse) nhằm đáp ứng nhu cầu sử dụng an toàn của các phòng ban (Data Analyst, Business Analyst, Data Scientist).
3. Sửa chữa, Tối ưu hóa & Bảo trì Hệ thống Cơ sở Dữ liệu
* Tối ưu hóa câu lệnh truy vấn: Chẩn đoán, phân tích và khắc phục các câu lệnh SQL chạy chậm, gây nghẽn hệ thống. Thực hiện tối ưu hóa cấu trúc bảng, đánh chỉ mục (indexing), phân vùng dữ liệu (partitioning) và phân cụm dữ liệu (clustering) để tăng tốc độ truy xuất thông tin.
* Bảo trì hệ thống lưu trữ: Tham gia hỗ trợ dọn dẹp bộ nhớ đệm, tối ưu hóa dung lượng lưu trữ trên Cloud Storage (AWS S3, Google Cloud Storage) hoặc các hệ thống lưu trữ phân tán.
* Nâng cấp mã nguồn: Đọc hiểu mã nguồn hiện tại của hệ thống, phát hiện các đoạn mã dư thừa, tái cấu trúc (refactoring) mã nguồn Python/PySpark để tăng hiệu năng xử lý song song và giảm chi phí vận hành hạ tầng đám mây.
4. Triển khai Lắp đặt & Thiết kế Mô hình Dữ liệu (Data Modeling)
* Thiết kế mô hình dữ liệu vật lý và logic: Hỗ trợ thiết kế cấu trúc bảng dữ liệu theo các chuẩn phổ biến như Star Schema, Snowflake Schema hay Data Vault để phục vụ tối ưu cho việc truy vấn và làm báo cáo BI (Business Intelligence).
* Thiết lập môi trường làm việc: Thực hiện cài đặt, cấu hình các công cụ làm việc cục bộ (Local Environment) hoặc trên Cloud cho dự án mới bao gồm: Docker container, Git repository, ảo hóa môi trường Python (virtualenv/poetry), và kết nối bảo mật qua VPN/SSH Client.
* Kiểm thử tích hợp (Integration Testing): Viết các kịch bản kiểm thử tự động (Unit Test, Integration Test) cho mã nguồn ETL nhằm đảm bảo hệ thống không phát sinh lỗi khi tích hợp thêm các tính năng hoặc nguồn dữ liệu mới.
5. Lập Báo cáo, Tài liệu hóa & Hướng dẫn Sử dụng
* Tài liệu hóa kiến trúc hệ thống (Data Documentation): Soạn thảo và cập nhật liên tục tài liệu Từ điển dữ liệu (Data Dictionary), sơ đồ mối quan hệ thực thể (ERD), và sơ đồ luồng dữ liệu (Data Lineage) của doanh nghiệp.
* Lập báo cáo vận hành: Tổng hợp số liệu vận hành định kỳ của hệ thống dữ liệu (tỷ lệ chạy thành công của pipeline, thời gian xử lý trung bình, chi phí hạ tầng Cloud phát sinh) để báo cáo cho Quản lý trực tiếp (Lead/Manager).
* Hỗ trợ và hướng dẫn nội bộ: Giải đáp thắc mắc, hỗ trợ kỹ thuật và hướng dẫn các chuyên viên phân tích dữ liệu (DA, BA) cách thức kết nối, khai thác dữ liệu từ Data Warehouse một cách hiệu quả và an toàn, tránh gây quá tải hệ thống chung.
---
Lộ trình đào tạo và phát triển trong 3 tháng thực tập:
* Tháng thứ 1 (Onboarding & Cơ bản): Làm quen với văn hóa công ty, nắm bắt kiến trúc hệ thống dữ liệu hiện tại. Được đào tạo chuyên sâu về SQL nâng cao, quy chuẩn viết code Python sạch (Clean Code), và quy trình làm việc với Git/GitHub của đội ngũ.
* Tháng thứ 2 (Thực chiến có giám sát): Trực tiếp tham gia xây dựng các luồng ETL/ELT quy mô nhỏ. Tham gia trực ban xử lý lỗi pipeline cùng Mentor (Kỹ sư hướng dẫn). Học cách sử dụng Docker và làm quen với các dịch vụ đám mây (AWS/GCP).
* Tháng thứ 3 (Làm chủ dự án độc lập): Được giao quyền làm chủ (owner) một dự án nhỏ hoặc một module cụ thể trong hệ thống (ví dụ: tích hợp một nguồn dữ liệu mới, tối ưu hóa một cụm bảng lưu trữ). Đánh giá năng lực cuối kỳ thực tập để xem xét chuyển đổi lên nhân viên chính thức (Full-time).
---
Yêu cầu và điều kiện:
1. Học vấn/Kinh nghiệm:
* Trình độ: Sinh viên năm cuối hoặc mới tốt nghiệp Đại học/Cao đẳng chuyên ngành Khoa học máy tính, Kỹ thuật phần mềm, Hệ thống thông tin quản lý (MIS), Công nghệ thông tin, Toán - Tin, Khoa học dữ liệu hoặc các ngành kỹ thuật liên quan khác.
* Kinh nghiệm: Không yêu cầu kinh nghiệm làm việc thực tế tại doanh nghiệp (ưu tiên các ứng viên đã từng thực hiện các dự án cá nhân, đồ án tốt nghiệp hoặc bài tập lớn xuất sắc về chủ đề xử lý dữ liệu, ETL, hoặc phát triển phần mềm được lưu trữ trên GitHub/GitLab).
2. Kỹ năng chuyên môn:
* Khả năng lập trình: Sử dụng thành thạo ngôn ngữ lập trình Python (biết sử dụng các thư viện xử lý dữ liệu như Pandas, NumPy, hoặc PySpark là một lợi thế lớn). Có tư duy thuật toán và cấu trúc dữ liệu tốt.
* Kỹ năng Cơ sở dữ liệu (SQL): Nắm vững kiến thức về SQL (viết tốt các câu lệnh Join, Subquery, Common Table Expressions - CTE, Window Functions). Hiểu rõ nguyên lý hoạt động của Cơ sở dữ liệu quan hệ (RDBMS) và cách tối ưu Index.
* Kiến thức về Data Engineering: Hiểu cơ bản về khái niệm ETL/ELT, kiến trúc Data Warehouse (Kho dữ liệu) và Data Lake (Hồ dữ liệu).
* Công cụ kiểm soát phiên bản: Sử dụng thành thạo Git cho việc quản lý mã nguồn (phân nhánh branch, merge code, giải quyết conflict, tạo pull request).
* Điểm cộng ưu tiên (Không bắt buộc):
* Đã từng sử dụng qua các dịch vụ đám mây như AWS (S3, Redshift, Athena, Glue), GCP (BigQuery, Cloud Storage), hoặc Azure.
* Có kiến thức về Containerization (Docker, Kubernetes).
* Biết sử dụng các công cụ quản lý workflow như Apache Airflow hoặc công cụ biến đổi dữ liệu dbt.
* Có hiểu biết về NoSQL (MongoDB, Redis, Cassandra) hoặc các công cụ Big Data (Hadoop, Spark).
3. Phẩm chất cá nhân:
* Tư duy logic và giải quyết vấn đề (Problem-Solving): Có khả năng phân tích một bài toán phức tạp, bẻ nhỏ vấn đề để tìm ra nguyên nhân gốc rễ của lỗi kỹ thuật và đề xuất các phương án khắc phục khả thi.
* Sự tỉ mỉ và cẩn trọng: Dữ liệu quyết định đến các chiến lược kinh doanh của doanh nghiệp, do đó đòi hỏi ứng viên phải cực kỳ cẩn thận trong từng dòng code, tránh làm mất mát hoặc sai lệch thông tin.
* Khả năng tự học và thích nghi nhanh: Công nghệ dữ liệu thay đổi và cải tiến hàng ngày. Bạn cần có tinh thần chủ động tự học hỏi công nghệ mới thông qua tài liệu tiếng Anh (Technical Documentation).
* Kỹ năng giao tiếp và làm việc nhóm: Có khả năng truyền đạt rõ ràng các vấn đề kỹ thuật phức tạp cho những người không thuộc khối kỹ thuật dễ dàng thấu hiểu. Có tinh thần trách nhiệm, sẵn sàng hỗ trợ đồng đội khi hệ thống gặp sự cố khẩn cấp.
---
Quyền lợi:
* Mức lương hỗ trợ thực tập hấp dẫn: Hỗ trợ chi phí thực tập từ 4.000.000 VNĐ - 7.000.000 VNĐ/tháng (tùy thuộc vào năng lực chuyên môn đầu vào và số ngày công làm việc thực tế).
* Chính sách nâng cấp lên Full-time: Cơ hội cực kỳ rộng mở để trở thành Kỹ sư Dữ liệu chính thức (Junior Data Engineer) sau 3-6 tháng thực tập dựa trên kết quả đánh giá hiệu quả công việc.
* Được đào tạo bài bản (Mentorship): Làm việc trực tiếp dưới sự dẫn dắt, kèm cặp 1-1 từ các Senior Data Engineer và Data Architect giàu kinh nghiệm thực chiến. Được tham gia vào các dự án lớn xử lý dữ liệu quy mô hàng triệu bản ghi mỗi ngày (Big Data scale).
* Trang thiết bị hiện đại: Được công ty cung cấp laptop cấu hình cao (MacBook/ThinkPad) cùng màn hình phụ chuyên dụng để tối ưu hiệu suất lập trình.
* Môi trường làm việc lý tưởng:
* Môi trường công nghệ trẻ trung, năng động, cởi mở, khuyến khích sự sáng tạo và tôn trọng sự khác biệt của cá nhân theo phong cách Agile/Scrum.
* Văn phòng làm việc hiện đại, không gian mở, đầy đủ khu vực giải trí, relax, pantry phục vụ trà, cà phê, bánh kẹo miễn phí hàng ngày.
* Tham gia các hoạt động Teambuilding, dã ngoại, sinh nhật tháng, các câu lạc bộ thể thao (bóng đá, cầu lông, boardgame) do công ty tổ chức.
* Hỗ trợ thủ tục tốt nghiệp: Công ty hỗ trợ cung cấp dấu mộc đỏ, nhận xét báo cáo thực tập tốt nghiệp chuẩn chỉnh cho Nhà trường.
---
Tags:
Thực tập sinh Data Engineer, Tuyển dụng Data Engineer Intern, Kỹ sư dữ liệu thực tập, ETL Developer Intern, SQL Python Database, Việc làm Big Data, Cloud Data Engineer, Tuyển dụng IT thực tập, Thực tập sinh Khoa học dữ liệu, Thiết kế kho dữ liệu, Việc làm lập trình Python, dbt Airflow Docker Intern.
---
Từ khoá tìm kiếm:
Thực tập sinh Data Engineer, Tuyển dụng Data Engineer Intern, Kỹ sư dữ liệu thực tập, Thực tập sinh kỹ thuật dữ liệu, Intern Big Data, Thực tập sinh SQL Python, Tuyển dụng thực tập sinh IT Hà Nội, Thực tập sinh Kỹ sư dữ liệu TP.HCM, Học việc Data Engineer, Tuyển dụng dbt Airflow Spark, Thực tập sinh hệ thống dữ liệu, Data Engineer fresher.
Useful information
- Avoid scams by acting locally or paying with PayPal
- Never pay with Western Union, Moneygram or other anonymous payment services
- Don't buy or sell outside of your country. Don't accept cashier cheques from outside your country
- This site is never involved in any transaction, and does not handle payments, shipping, guarantee transactions, provide escrow services, or offer "buyer protection" or "seller certification"
Related listings
-
TP.HCM => Tuyển gấp 3 Thực tập sinh NLP (Xử lý Ngôn ngữ Tự nhiên) đi làm ngay không cần kinh nghiệmViệc làm thực tập - - 2026/07/02 Check with sellerMÔ TẢ CÔNG VIỆC: THỰC TẬP SINH XỬ LÝ NGÔN NGỮ TỰ NHIÊN (NLP INTERN) --- TỔNG QUAN VAI TRÒ: Trong kỷ nguyên số hóa và sự bùng nổ của Trí tuệ Nhân tạo (AI), ngôn ngữ không chỉ là phương tiện giao tiếp giữa con người mà đã trở thành cầu nối quan trọng n...
-
TP.HCM => Tuyển gấp 3 Thực tập sinh Computer Vision đi làm ngay không cần kinh nghiệmViệc làm thực tập - - 2026/07/02 Check with sellerMÔ TẢ CÔNG VIỆC: THỰC TẬP SINH COMPUTER VISION (COMPUTER VISION INTERN) Tổng quan vai trò: Chào mừng bạn đến với thế giới của những người định hình tương lai công nghệ – nơi những dòng mã (code) không chỉ là những ký tự khô khan mà là đôi mắt giúp má...
-
TP.HCM => Tuyển gấp 3 Thực tập sinh AR / VR đi làm ngay không cần kinh nghiệmViệc làm thực tập - - 2026/07/02 Check with sellerMÔ TẢ CÔNG VIỆC: THỰC TẬP SINH CÔNG NGHỆ THỰC TẾ ẢO / THỰC TẾ TĂNG CƯỜNG (AR / VR DEVELOPER INTERN) --- Mô tả công việc Tổng quan vai trò: Chúng tôi đang tìm kiếm những "kiến trúc sư của tương lai" – vị trí Thực tập sinh AR / VR (Augmented Reality / ...