Назад
5 дней назад

Data Scientist (LLM)

180 - 210
Тип работы
project
Страна
Russia
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
Data Scientist (ML/LLM): Разработка классических ML-моделей и LLM-решений для проверки AI-гипотез в рамках AI-инкубатора, с акцентом на автоматизированные товарные связки, оценку качества и production-интеграцию. Focus on построение evals для LLM-систем, контроле галлюцинаций и рисков безопасности, оптимизации стоимости и latency, а также проектировании agentic workflows.
🧠😘😀😘😘🥰😀🫢
Data Scientist
Гражданство: РФ
Вилка: 180-210
Длительность: Долгосрочный проект

Основные требования
• Понимание принципов проектирования моделей, управление состоянием и контекстом, выбор инструментов, контроль уровня автономности и human-in-the-loop.
• Глубокое понимание основных принципов машинного обучения: подготовка данных и признаков, выбор моделей, регуляризация, переобучение, data leakage, интерпретация результатов.
• Знание математической статистики: проверка гипотез, доверительные интервалы, дизайн и анализ A/B-тестов.
• Понимание принципов оценки качества ML-систем: offline- и online-метрики, построение валидации, оценка бизнес-эффекта, мониторинг качества моделей и данных.
• Опыт работы хотя бы в одном из направлений:
o классическое машинное обучение;
o временные ряды и прогнозирование;
o рекомендательные системы, поиск и ранжирование;
o NLP, LLM и генеративный AI.
• Уверенное владение Python и основными библиотеками для анализа данных и машинного обучения: pandas или polars, NumPy, scikit-learn, CatBoost / LightGBM / XGBoost, PyTorch или аналогичные инструменты.
• Умение писать поддерживаемый production-код: модульная архитектура, тестирование, логирование, документация, работа с Git и участие в code review.
• Уверенное владение SQL
Опыт построения evals для LLM-систем, оценки качества ответов, контроля галлюцинаций и мониторинга поведения системы.
• Понимание рисков prompt injection, некорректного tool calling, утечки данных и чрезмерных прав доступа агента.
• Опыт работы с API языковых моделей, Hugging Face и одним из orchestration-фреймворков.
• Умение оценивать стоимость, latency и масштабируемость LLM-решений.
• Опыт работы в e-commerce, retail или других продуктовых highload-системах.
• Опыт работы с Airflow, MLflow, Kafka, Redis, Kubernetes, Prometheus и Grafana.
• Опыт эксплуатации GPU-инфраструктуры и оптимизации inference.
• Опыт fine-tuning или адаптации LLM, включая LoRA / PEFT.
• Опыт проектирования agentic workflows или multi-agent-систем.
• Понимание принципов информационной безопасности, privacy и работы с персональными данными.
Задачи на проекте
Разработка моделей c класическим ML для работы в рамках проверки PoC для ИИ идей. входящих в ИИ инкубатор. Развитие идей, предполагающих автоматизированные товарные связки (аналоги, комплементарные товары и т.д.).

Направить CV

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -