ml engineer для инференса LLM
ориентир по рынку
вакансия
зп не указана
в среднем
391 000 ₽
мэтч
Загрузи резюме, чтобы видеть мэтчи с вакансией
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Не рассматриваем: Саудовская Аравия, Россия, Беларусь
задачи
- Разрабатывать production-инференс больших LLM
- Разрабатывать распределённый инференс и оптимизировать serving
- Работать с SGLang в production
- Выполнять post-training LLM
- Разрабатывать agent harness
- Оптимизировать caching, batching, quantization и speculative decoding
- Работать с GPU-инфраструктурой на базе 32×H200 и AWS, участвовать в её расширении
- Осуществлять техническое лидерство NLP/CV-направления
требования
- Иметь сильный опыт production-инференса LLM
- Иметь опыт распределённого инференса больших моделей
- Знать vLLM, SGLang, TensorRT-LLM или сопоставимый стек
- Понимать tensor/pipeline/expert parallelism, KV cache и оптимизацию GPU
- Иметь опыт post-training: SFT, DPO, RLHF и других методов
- Иметь сильную базу в ML, компьютерных науках и математике
- Не подойдут кандидаты, которые преимущественно занимались RAG, LangChain, интеграциями API или только развёртывали готовые LLM
- Будет плюсом: CUDA/Triton, DeepSpeed, Megatron-LM, FSDP, MoE, собственные статьи, PhD, исследования или заметный вклад в open source
условия
- Remote, B2B (вне РФ,РБ)
- Часовой пояс, совместимый с CET
- В продукте присутствует контент 18+
- Отправить локацию, запрос зарплаты и резюме по требованиям
Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайтесь: это мошенничество.
Про зарплаты
Анонимные данные по зарплатам и грейдам.
Можно сверить вилку с рынком.
Посмотреть зарплаты