Strikt — IT-компания проектной разработки, которая превращает хаотичные бизнес-процессы заказчиков в понятные алгоритмы и решения на основе искусственного интеллекта. Компания работает с проектами в областях рекламы, медицины, машинного обучения, обработки естественного языка и автоматизации с помощью искусственного интеллекта.
data scientist
подготовьтесь к отклику
ai-инструментыЧтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
задачи
- Помогать разрабатывать модели машинного обучения для анализа текстовых и табличных данных;
- Очищать, предобрабатывать, анализировать и визуализировать данные;
- Использовать Python, pandas, numpy, matplotlib и scikit-learn;
- Работать с Jupyter Notebook;
- Участвовать в задачах обработки естественного языка: обрабатывать текст, создавать эмбеддинги, выполнять классификацию и кластеризацию;
- Изучать и применять современные подходы и модели обработки естественного языка: BERT, GPT и модели на основе смысловых представлений предложений;
- Извлекать и анализировать данные с помощью SQL;
- Помогать оценивать качество моделей и анализировать ошибки;
- Участвовать в командных обсуждениях решений и результатов.
требования
- Быть студентом последних курсов или выпускником технического, математического, IT- или смежного направления;
- Знать основы машинного обучения и анализа данных;
- Понимать основные алгоритмы машинного обучения: линейные модели, деревья решений и ансамбли;
- Понимать основы кластеризации, включая KMeans и DBSCAN или похожие методы;
- Уметь писать код на Python;
- Знать pandas, numpy, matplotlib и scikit-learn;
- Иметь опыт работы с Jupyter Notebook;
- Понимать основы SQL и реляционных баз данных;
- Интересоваться обработкой естественного языка, большими языковыми моделями, BERT, GPT и современными подходами искусственного интеллекта;
- Быть готовым учиться, задавать вопросы, разбираться в новых задачах и доводить работу до результата;
- Иметь хорошую техническую базу, интересоваться машинным обучением и обработкой естественного языка, аккуратно работать с данными, самостоятельно решать учебные и небольшие практические задачи и принимать обратную связь;
- Будет плюсом учебные, личные или дипломные проекты в Data Science, машинном обучении или обработке естественного языка, опыт работы с текстовыми данными, понимание принципов работы трансформеров BERT, RoBERTa и GPT, опыт с Hugging Face, PyTorch или TensorFlow, знание SQL на уровне простых запросов, английский для чтения технической документации, понимание Git, Docker или базовых принципов непрерывной интеграции и поставки.
условия
- Стажировка длится 3 месяца;
- Возможна частичная занятость;
- График обсуждается индивидуально;
- Реальные задачи по искусственному интеллекту и машинному обучению в проектах для бизнеса;
- Наставничество и поддержка команды;
- Возможность профессионального роста;
- По итогам успешной стажировки предоставят рекомендательное письмо и реальные кейсы по анализу данных для резюме.
навыки
Если просят войти через iCloud, отправить коды из SMS, запустить код, что-то установить, перевести деньги или сделать что угодно, связанное с деньгами, не соглашайтесь: это признаки мошенничества.