Tech jobs
Job listings
2 jobs
12 hours ago
Student Researcher (LLM Post Training – Agent & Reinforcement Learning) - 2026 Start (PhD)
RemoteNorth America
United States
Researcher optimizing large language models via post-training techniques like RLHF/DPO to improve reasoning, coding, and math while exploring future use cases.
curriculum learning decision making instruction tuning language models large language models +8 skills
12 hours ago
Research Scientist Graduate (Seed-LLM) - 2027 Start (PhD)
RemoteNorth America
United States
Research Scientist Graduate to align, tune, and optimize large-scale language models for improved reasoning, math, and code capabilities at a leading AI company.
c plus plus c# data construction deep learning inference +11 skills