Nhân viên Data Crawler/Web Scraping
Mô tả công việc: CHI TIẾT CÔNG VIỆC
Hỗ trợ xây dựng và bảo trì hệ thống ETL (Extract Transform Load) cơ bản.
YÊU CẦU
CHẾ ĐỘ VÀ QUYỀN LỢI
THỜI GIAN LÀM VIỆC
-Khối nhân viên full time:Từ thứ 2 đến thứ 6, đăng ký chọn thời gian làm việc theo 02 ca như sau:
Ca 1: Sáng từ 8h00 đến 11h30 - Chiều từ 13h00 - 16h30
Ca 2: Sáng từ 9h00 đến 11h30 - Chiều từ 13h00 - 17h30
Làm việc tại:19 Hồ Văn Huê, phường Đức Nhuận, TPHCM
Quyền lợi ứng viên: Thưởng Tháng 13, Thưởng Theo Dự Án, Tiệc liên hoan, Văn Hóa Công Ty Tốt, đào tạo nội bộ
Yêu cầu hồ sơ:
Từ khóa việc làm: Khoa Học Máy Tính, Network Engineer, Phân Tích Dữ Liệu, Chuyên Viên Thiết Kế Giải Pháp, Web Developer
Kỹ năng cần có: Database, Phân tích Dữ liệu, SQL, Thành Thạo Phần Mềm, Xử Lý Số Liệu
Kinh nghiệm làm việc: Từ 1 đến 3 năm
Giới tính: Không yêu cầu
Hỗ trợ xây dựng và bảo trì hệ thống ETL (Extract Transform Load) cơ bản.
- Viết các script đơn giản để tự động hóa việc thu thập và xử lý dữ liệu.
- Hỗ trợ các công việc liên quan đến quản lý cơ sở dữ liệu (Database)
- Theo dõi và xử lý các lỗi dữ liệu phát sinh.
- Phối hợp và xử lý các lỗi dữ liệu phát sinh.
YÊU CẦU
- Giới tính Độ tuổi
- Nam/Nữ, độ tuổi từ 2230, sức khỏe tốt.
- Phẩm chất / Thái độ
- Tư duy logic, cẩn thận, chú trọng trải nghiệm người dùng.
- Chủ động, cầu tiến, sẵn sàng học hỏi và thích ứng nhanh.
- Có tinh thần làm việc nhóm và trách nhiệm với công việc.
- Trình độ / Kiến thức
- Tốt nghiệpĐại học/Cao đẳngchuyên ngành Khoa học máy tính, kỹ thuật phần mềm, Toán tin hoặc lĩnh vực liên quan.
- Nắm vững kiến thức cơ bản về cơ sở dữ liệu (SQL, NoSQL): thiết kế bảng, viết query tối ưu, thao tác CRUD, kết nối và quản lý dữ liệu lớn.
- Có kiến thức về ít nhất một ngôn ngữ lập trình (Python, Java, Scala).
- Hiểu biết về các khái niệm ETL và quy trình xử lý dữ liệu..
- Kỹ năng
- Thành thạo async Playwright để crawl dữ liệu web động và phức tạp.
- Sử dụng aiohttp cho các tác vụ crawling song song quy mô lớn và requests cho các job API/data pipeline nhẹ.
- Có kinh nghiệm xây dựng data pipeline và xử lý dữ liệu bằng pandas, numpy.
- Có kiến thức môi trường Linux server: cronjob, tmux/screen, xử lý log, quản lý tiến trình.
- Hiểu biết về mạng và giao thức web: HTTP/HTTPS, proxy rotation, session/cookie management, chống rate-limiting.
- Kinh nghiệm
- Tối thiểu1 năm kinh nghiệm.
- Ưu tiên ứng viên đã tham gia dự án ừng triển khai dự án: Web scraping, xử lý dữ liệu tự động, crawling dữ liệu lớn,
CHẾ ĐỘ VÀ QUYỀN LỢI
- Môi trường làm việc trẻ, năng động.
- Được hưởng đầy đủ các chế độBHYT/BHXH/BHTNtheo quy định.
- Chính sách phúc lợi của Công ty (tặng quà lễ, tết, du lịch...) hằng năm.
- Làm việc trong môi trườngchuyên nghiệp, trẻ trung, năng động, có nhiều cơ hội phát triển bản thân và thăng tiến.
- Đượcđào tạo, bồi dưỡng kiến thức chuyên ngànhvà kỹ năng nghiệp vụ trong suốt quá trình làm việc tại Công ty.
THỜI GIAN LÀM VIỆC
-Khối nhân viên full time:Từ thứ 2 đến thứ 6, đăng ký chọn thời gian làm việc theo 02 ca như sau:
Ca 1: Sáng từ 8h00 đến 11h30 - Chiều từ 13h00 - 16h30
Ca 2: Sáng từ 9h00 đến 11h30 - Chiều từ 13h00 - 17h30
Làm việc tại:19 Hồ Văn Huê, phường Đức Nhuận, TPHCM
Quyền lợi ứng viên: Thưởng Tháng 13, Thưởng Theo Dự Án, Tiệc liên hoan, Văn Hóa Công Ty Tốt, đào tạo nội bộ
Yêu cầu hồ sơ:
Từ khóa việc làm: Khoa Học Máy Tính, Network Engineer, Phân Tích Dữ Liệu, Chuyên Viên Thiết Kế Giải Pháp, Web Developer
Kỹ năng cần có: Database, Phân tích Dữ liệu, SQL, Thành Thạo Phần Mềm, Xử Lý Số Liệu
Kinh nghiệm làm việc: Từ 1 đến 3 năm
Giới tính: Không yêu cầu