Tech jobs
Job listings
1 job
yesterday
Research Engineer - LLM/VLM Inference Optimization (Seed Infra)
RemoteNorth America
United States
Research Engineer focused on optimizing inference for large-scale LLMs and VLMs. The role involves building model toolchains, conducting performance analysis, and designing high-performance inference engines and deployment pipelines to improve system efficiency.
c# c++ containerization conv2d cpu architecture +22 skills