Junior data scientist, Департамент ИИ и разработки

ТОО QazCloud г.Астана
Требуемый опыт работы: Без опыта Полная занятость, Полный день
Вакансия открыта
Создана:

Подано заявок:
12

Количество просмотров:
191

   Детали конкурса

Обязанности:

Сбор, очистка, разметка и предобработка данных (табличные, текстовые источники).
Разведочный анализ данных (EDA), формирование и проверка гипотез, feature engineering.
Обучение, валидация и оценка качества классических ML-моделей (регрессия, классификация, кластеризация).
Разработка и интеграция LLM/GenAI-решений: RAG-пайплайны, работа с эмбеддингами и векторными БД, промпт-инжиниринг.
Прототипирование AI-сервисов и их упаковка в API-эндпоинты.
Написание чистого воспроизводимого кода, ведение экспериментов и документации.

Требования:

Уверенное владение Python и профильными библиотеками: pandas, NumPy, scikit-learn. Знание основ машинного обучения: типы задач, метрики качества, переобучение/недообучение, кросс-валидация.
Понимание математической базы: линейная алгебра, теория вероятностей, статистика. Знание SQL и умение работать с реляционными базами данных.
Базовое понимание работы LLM: токенизация, эмбеддинги, принцип RAG, основы промпт-инжиниринга.
Опыт работы с API LLM-провайдеров (OpenAI, Anthropic и аналоги) или фреймворками (LangChain, LlamaIndex) — хотя бы на уровне пет-проектов.
Навыки работы с Git и понимание принципов совместной разработки.
Аналитическое мышление, внимательность к деталям, умение доводить задачу до результата.
Знание языков:
Казахский, Русский — свободный (рабочий язык команды).
Английский — на уровне чтения технической документации, статей и работы с англоязычными библиотеками (Intermediate / B1–B2 и выше).
Казахский — будет преимуществом.
Желательно Знакомство с DL-фреймворками (PyTorch, TensorFlow) и нейросетевыми архитектурами (трансформеры).
Опыт визуализации данных и построения дашбордов (matplotlib/plotly, BI-инструменты).
Профильные сертификаты: специализации по ML/DL (Coursera, DeepLearning.AI), облачные сертификаты (AWS ML, Google Cloud ML) и аналогичные.
Публичное портфолио: GitHub, Kaggle, пет-проекты, участие в соревнованиях/хакатонах.
Опыт работы: От 0 до 1–2 лет коммерческого опыта в Data Science / ML.
Уверенное владение ПК
Рассматриваются недавние выпускники профильных направлений (Computer Science, Data Science, прикладная математика, статистика) с сильными учебными или пет-проектами.
Приветствуется опыт стажировок, участие в ML-соревнованиях (Kaggle) или собственные реализованные проекты с использованием ML/LLM.
Ищем начинающего специалиста, который будет участвовать в разработке ML-моделей и AI-сервисов: от подготовки данных и обучения классических моделей до интеграции больших языковых моделей (LLM) в продуктовые решения. Кандидат работает в команде под наставничеством senior-специалиста, доводит гипотезы до рабочих прототипов и помогает выводить модели в эксплуатацию. Подойдёт человек с крепкой базой в Python и математике, горящий темой AI и готовый быстро учиться.

Условия:

- График работы: с 09:00 - 18:30 ч.
- Мед.страхование
- Развозка
Заработная плата 240 000 тенге с учетом налогов.

Необходимые степени образования

  • Бакалавр