Data Engineer (2년 이상)

Summary

Builds and maintains data pipelines and warehouses to process, clean, and validate large-scale text, image, and audio datasets for AI training at a Korean language-data and AI services company.

About

플리토는 유수의 ​글로벌 ​IT ​기업들과 함께
‘언어 ​장벽 없는 세계’를 만들어 ​가고 ​있는 언어 ​데이터 및 인공지능 ​서비스 기업입니다.

자체 ​엔진을 ​적용한 플리토 ​AI번역과 ​전세계 ​1,400만 유저가 직접 ​참여하여
인공지능 ​학습용 언어 데이터를 ​구축하는 ​플리토 ​아케이드(Arcade)를 제공하고 있습니다.
또한, ​AI 디지털 ​다국어 ​이미지 번역 ​서비스와 (Image, ​Place ​Translation)
AI 다국어 통번역 ​솔루션(Chat, Live ​Translation) 등 글로벌 소통에
필요한 가치 있는 서비스들을 끊임없이 개발하고 있습니다.

이외에도 비즈니스 번역 및 현지화 등 다양한 서비스와 플랫폼을 통해
가장 정확하고 자연스러운 언어 데이터를 글로벌 유수 기업들에 제공하고 있으며,
향후 수 십조 규모로 성장할 언어 데이터 시장에서 대한민국 대표 기업으로서의
입지를 굳혀가고 있습니다.

Data Dev팀의 Data Engineer는 데이터 수집·가공·품질 관리 및 데이터 인프라 구축을 담당하고 있으며
텍스트, 이미지, 음성 등 다양한 데이터를 수집·정제·검증하여 대규모 학습 데이터셋을 구축하고,
효율적인 검수 과정을 통해 데이터 품질을 지속적으로 개선하고 있습니다.

'언어의 장벽을 뛰어넘는 독보적 언어 데이터 및 인공지능 서비스 기업' 플리토에서
함께 성장하기 위한 즐거운 도전에 합류하실 많은 분들의 지원을 기다립니다.

Responsibilities

• 다양한 형태의 대규모 데이터를 관리하기 위한 데이터 파이프라인 및 데이터 웨어하우스 설계·구축
• 텍스트, 이미지, 음성 등 멀티모달 데이터의 품질 검증 방법 연구 및 자동화 도구 개발
• 유관 부서와 협업하여 고객 맞춤형 데이터셋 구축을 지원하는 기술 개발
• 데이터 수집·정제·검수 과정을 효율화하기 위한 자동화 시스템 개발 및 운영

Requirements

• 2년 이상 혹은 그에 준하는 경력을 보유하신 분
• 텍스트, 이미지, 음성 등 대규모 데이터 처리 및 관리 경험이 있으신 분
• Python, SQL 등 데이터 처리에 필요한 프로그래밍 능력을 보유하신 분

Preferred

• 아래의 경험/경력사항을 보유하신 분
- 데이터 수집·가공·품질 관리에 필요한 프로세스 자동화 경험
- 데이터 구축 파이프라인 구축 경험
- 데이터에서 개인정보 비식별화 및 필터링 경험
- 웹 크롤링 및 데이터 수집 경험 (예: Selenium, Playwright 등 활용)
• 자체 데이터를 활용해 모델을 학습시키고 성능을 높이는 것에 관심과 역량 있으신 분

Benefits

• 상호 존중하는 문화
: 직급 없는 "님" 호칭 및 경어 사용, 자율 복장 등
: 자유로운 연차 사용과 사생활에 대한 배려와 존중

• 복리후생
: 연봉 外 중식대 별도 제공 (앱 활용, 11,000원/일)
: 경조휴가 및 경조지원금 (ex : 결혼 50만원, 출산 100만원 등)
: 기념일 휴가 (ex : 생일휴가, 결혼기념일 반차 등)
: 근속기간에 따른 추가 복리후생
(명절 상여, 건강검진, 자기개발비, 사내대출 지원 등)

• 개발장비
: 맥북 + 4K 모니터 + 개발장비 지원비(최초 입사시 15만원)