freehire launches on Product Hunt on 26 August.

Follow →

AI Research Scientist

About

"기업의 AI 도입을 막는 건 성능이 아닌, 사고에 대한 두려움입니다."
테스트에서 완벽했던 AI도, 운영 환경에서는 통제 불가능합니다. 티냅스는 운영 중인 AI의 모든 발화를 실시간 검사하고, 위험 감지 시 0.2초 내 개입하는 AI 런타임 신뢰 인프라를 만듭니다.

한국정보올림피아드 대상, 금융권 CTO/CISO 출신의 CEO, Google Research·삼성전자 출신 등 업계 최고의 팀으로,
세계 최고 성능의 경량 AI Trust Layer를 공급하여 AI 에이전트 경제의 글로벌 표준 프로토콜이 되는 것을 목표로 합니다.
한국을 넘어 글로벌 표준을 만들 여정에 함께할 최고의 동료를 기다립니다.

[왜 이 역할이 지금 중요한가?]
Runtime AI Trust는 아직 연구가 초기 단계인 분야이며, 답보다 해결해야 할 문제가 더 많은 분야입니다. 생성 모델보다 30배 작은 모델로 0.2초 이내에 hallucination을 탐지하려면 어떻게 해야 할까요? 고객의 데이터가 네트워크 밖으로 나가지 않는 온프레미스 환경에서는 어떻게 해야 할까요? 장기 실행 에이전트가 실패한 후가 아니라, 실패하기 전에 행동 패턴의 변화를 어떻게 포착할 수 있을까요? 여러 에이전트에 걸친 조직적인 prompt injection 공격을 어떻게 추적하고 원인을 특정할 수 있을까요?

이러한 질문에는 아직 교과서적인 정답이 없습니다. 티냅스에서는 이러한 답을 몇 년이 아니라 몇 주 안에 국내 최고 수준의 금융기관의 프로덕션 환경에서 검증합니다.

AI Research Scientist는 티냅스의 연구 방향을 직접 소유하는 멤버로 합류합니다. 어떤 문제를 풀 것인지 선택하고, 결과를 만들어내고, 연구를 발표하며, 실제 현장에서 연구 결과가 작동하는 것을 지켜보는 역할입니다.

[왜 티냅스인가?]
• 작은 모델로 달성하는 글로벌 SOTA: Detect-Jailbreak에서 84.4% F1, ToxicChat에서 81.7% F1을 달성했으며, 경쟁 시스템보다 3~33배 작은 모델을 사용합니다. 다음 벤치마크를 깨는 것은 여러분의 몫입니다.
• 연구가 직접 배포로 이어집니다: 한 사람이 아이디어를 논문에서 시작해 벤치마크, 프로덕션, 고객 검증까지 직접 이어갑니다. 여러분의 baseline은 단순한 리더보드가 아니라 규제 산업의 실제 트래픽입니다.
• 우리는 연구를 발표합니다: 멀티 에이전트 간 prompt injection attribution에 관한 최근 연구가 ICML 2026의 AIWILD Workshop에 발표되었으며, 추가적인 연구 결과를 최상위 학회에 제출하기 위한 준비를 진행하고 있습니다.
• 외부에서도 검증된 성장세: NVIDIA GTC 2026 AWS Startup Pitch 글로벌 Top 6(유일한 APAC 팀), Snowflake Startup Challenge 2026 글로벌 Top 10을 기록했으며, 국내 최고 수준의 금융기관에서 PoC를 진행하고 있습니다.

Responsibilities

[현재 우리가 풀고 있는 연구 문제]
• 인간의 합의 수준에 도달하는 Hallucination Detection: 전문 평가자들조차 약 90%의 경우에만 의견이 일치한다면, 검증에서의 진전이 무엇을 의미하는지, 그리고 어떻게 그 수준에 도달할 수 있는가?
• 에이전트 행동 변화의 조기 경보: 장기 실행 에이전트가 실패하기 전에 runtime signal을 통해 실패를 예측하는 방법
• 멀티 에이전트 시스템의 안전성과 보안: 단일 에이전트 분석만으로는 포착할 수 없는, 에이전트 간 상호작용에서 발생하는 실패와 공격을 이해하고 방어하는 방법
• 확장 가능한 Human Oversight: AI의 출력이 이를 검증할 수 있는 사람의 수를 훨씬 넘어서는 상황에서, 제한된 전문가 검토를 가장 효과적으로 활용하는 방법
• Detector와 Judge를 위한 Confidence Calibration: 신뢰도 점수가 실제 의미하는 바와 일치하도록 만들어, 개입과 escalation이 적절한 threshold에서 발생하도록 하는 방법
• 검증 가능한 Trust Task를 위한 Small Model Post-training: 단순한 reward 설계가 실패하는 상황에서 GRPO와 같은 RL 기반 방법을 활용하고, ensemble 전략을 통해 신호를 다시 확보하는 방법

[이 역할에서 하게 될 일]
• Research Agenda: Hallucination Detection, Guardrails, Jailbreak 및 Prompt Injection 방어, Agent Behavioral Drift를 아우르는 Runtime Trust Layer의 연구 방향을 정의하고 주도합니다.
• Novel Methods: 엄격한 제약 조건(0.2초 SLA, 온프레미스 배포, 규제 데이터) 하에서 작은 모델이 훨씬 큰 모델을 능가할 수 있도록 training, evaluation, inference 기술을 개발합니다.
• Benchmarks and Evaluation: 해당 분야의 reference point가 될 수 있을 만큼 엄격한 데이터셋, 벤치마크 및 평가 프로토콜을 설계합니다.
• Publication and Community Presence: 최상위 학회(NeurIPS, ICML, ICLR, ACL, EMNLP)에 논문을 발표하고, 글로벌 연구 커뮤니티에서 티냅스를 대표합니다.
• Research to Production and Back: Applied AI Engineers와 협업하여 연구 결과를 실제 배포 시스템으로 전환하고, 프로덕션에서 발생한 실패 사례를 새로운 연구 질문으로 발전시킵니다.

Requirements

[이런 분을 찾고 있어요.]
• 자신의 연구가 현실에서 검증되기를 원하는 사람: 실제 트래픽, 규제 산업, 엄격한 latency 및 deployment 제약 속에서 연구하기를 원하는 사람
• 제약을 연구의 장애물이 아니라 연구 문제의 출발점으로 바라보는 사람
• 성숙한 분야에서 기존 연구를 조금씩 개선하는 것이 아니라, Runtime Trust와 Agent Safety라는 새로운 분야를 정의하는 데 기여하고 싶은 사람
• 문제 정의, 실험, 분석, 논문 작성 및 커뮤니케이션까지 전체 연구 사이클을 독립적으로 수행할 수 있는 사람

[필요한 경험이에요.]
• ML, NLP 또는 관련 분야의 PhD 학위 또는 이에 준하는 연구 경험
• 최상위 학회(NeurIPS, ICML, ICLR, ACL, EMNLP 또는 이에 준하는 학회)의 First-author 논문 또는 널리 활용된 모델, 벤치마크, 오픈소스 프로젝트와 같이 이에 준하는 영향력을 가진 연구 결과물
• LLM에 대한 깊이 있는 실무 경험: Training 및 Fine-tuning, Post-training(SFT, RLHF/RLVR, Preference Optimization), 그리고 엄격한 Evaluation 경험
• 강한 구현 능력: 아이디어를 직접 작동하는 실험으로 구현할 수 있으며, 다른 사람이 이를 기반으로 개발하더라도 견고하게 유지되는 코드를 작성할 수 있는 사람

Preferred

[이런 경험이 도움이 돼요.]
• LLM Safety, Guardrails, Hallucination Detection, Factuality, Uncertainty 또는 Calibration 관련 연구 경험
• RL Post-training 경험(GRPO, PPO, DPO) 또는 Reward Modeling
• Agentic Systems 관련 연구: Multi-agent Security, Tool Use, Long-horizon Evaluation
• Small-model 전문성: Distillation, Quantization, Efficient Inference
• 커뮤니티에서 실제로 활용된 Benchmark 또는 Dataset 제작 경험
• 산업계 연구소 경험 또는 최상위 학회의 Reviewer / Area Chair 경험

Benefits

[업무에 온전히 집중할 수 있도록 지원해요]
• 업무 장비 지원 : 최고 사양의 노트북과 32인치 모니터를 제공해, 업무에 몰입할 수 있는 환경을 지원해요.
• AI 툴 지원 : Claude 등 업무에 필요한 AI 툴을 지원해, 더 빠르고 스마트하게 일할 수 있어요.
• 역량 개발 지원 : 도서 구매 및 외부 교육·컨퍼런스 참가를 지원해, 필요한 역량을 채워가며 계속 성장할 수 있어요.

[일상의 든든함도 챙겨요]
• 식사비 지원 : 든든한 점심 한 끼와, 야근 시 저녁까지 챙길 수 있도록 식대를 지원해요.
• 커피 및 간식 : 스파크플러스 라운지 커피와 사무실 내 간식을 제공해, 언제든 에너지를 챙길 수 있어요.
• 경조사 지원 : 인생의 중요한 순간을 함께 나눌 수 있도록 경조금과 휴가를 지원해요.
• 명절 선물 : 매 명절마다 마음을 담은 선물을 전달해요.

See also

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available