About this role
Machine Learning Researcher at Inference.net. Location: San Francisco, California, United States. Role: research architectures, decrease latency, train models Requirements: 3+ years of PyTorch experience; transformer architectures; post-training LLMs (SFT/RLHF/DPO); experience with LLM training frameworks; strong experimental methodology; NVIDIA GPU-scale training; solid ML fundamentals. Category: Research and Development (R&D) Seniority: Mid Level Tools: PyTorch, Hugging Face Transformers, DeepSpeed, Megatron, TRL, NVIDIA GPUs Commitment: Full Time Workplace: Hybrid Languages: English