Tech jobs
Job listings
2 jobs
yesterday
Research Engineer - LLM/VLM Inference Optimization (Seed Infra)
RemoteNorth America
United States
Research Engineer focused on optimizing inference for large-scale LLMs and VLMs. The role involves building model toolchains, conducting performance analysis, and designing high-performance inference engines and deployment pipelines to improve system efficiency.
c# c++ containerization conv2d cpu architecture +22 skills
yesterday
Research Engineer - LLM/VLM Inference Optimization (Seed Infra)
RemoteNorth America
United States
Design and build high-performance inference engines for large language and vision-language models, optimizing latency, throughput, and cost while collaborating with research teams.
c plus plus c# containerization conv2d cpu gpu +25 skills