Навыки Data Scientist: что требуют работодатели
На основе 157 вакансий — частотность навыков, разбивка по грейдам, связки технологий.
Коротко: какие навыки нужны Data Scientist в 2026 году
По данным 157 вакансий московского рынка, чаще всего требуют: Python (91.7%), SQL (64.3%), pandas (45.9%), PyTorch (36.3%), Apache Spark (33.8%).
Для Junior: базовый стек — Python, SQL.
На уровне Middle/Senior добавляются: pandas, PyTorch, Apache Spark, NumPy.
Таблица ниже — реальные требования работодателей по вакансиям, а не учебная программа.
Какие навыки чаще всего требуют от Data Scientist
Частота упоминания в 157 активных вакансиях. Клик по заголовку колонки — сортировка.
Главный вывод: Python, SQL встречаются в ≥60% вакансий — это базовый стек. Остальное зависит от специализации: pandas, PyTorch, Apache Spark.
| # | Навык | Частота | Доля | Вакансий |
|---|---|---|---|---|
| 1 | Python | | 91.7% | 144 |
| 2 | SQL | | 64.3% | 101 |
| 3 | pandas | | 45.9% | 72 |
| 4 | PyTorch | | 36.3% | 57 |
| 5 | Apache Spark | | 33.8% | 53 |
| 6 | NumPy | | 33.1% | 52 |
| 7 | LLM | | 31.8% | 50 |
| 8 | scikit-learn | | 28% | 44 |
| 9 | Docker | | 26.1% | 41 |
| 10 | Apache Airflow | | 25.5% | 40 |
| 11 | Git | | 24.8% | 39 |
| 12 | RAG | | 22.3% | 35 |
| 13 | Apache Hadoop | | 19.1% | 30 |
| 14 | LangChain | | 14.6% | 23 |
| 15 | TensorFlow | | 13.4% | 21 |
| 16 | MLflow | | 13.4% | 21 |
| 17 | FastAPI | | 12.7% | 20 |
| 18 | Kubernetes | | 12.1% | 19 |
| 19 | Apache Kafka | | 11.5% | 18 |
| 20 | XGBoost | | 11.5% | 18 |
Доля = процент вакансий Data Scientist, в которых упоминается навык. Одна вакансия может содержать несколько навыков. На основе 157 вакансий, 11 октября 2026.
Навыки по грейдам: Junior, Middle, Senior
Доля вакансий каждого грейда, в которых встречается навык. Фильтр — кнопки ниже. Ячейки с «≈» — оценка по выборке менее 20 вакансий.
Стек по категориям
Навыки сгруппированы по типу технологий. Цифры — частота в вакансиях.
ML Engineer, AI Engineer и Data Scientist: чем отличаются навыки
Роли пересекаются — вакансии часто смешивают термины. LLM встречается в 31.8% вакансий этой профессии , RAG — в 22.3%. Вот как отличаются фокусы:
| Роль | Фокус | Ключевые навыки |
|---|---|---|
| ML Engineer | Модели в production, ML-пайплайны | PyTorch (36.3%), PyTorch, MLflow (13.4%), Docker, Airflow |
| AI Engineer | LLM, RAG, агенты, API-интеграции | LLM (31.8%), RAG (22.3%), LangChain (14.6%), FastAPI |
| Data Scientist | Исследование данных, гипотезы, метрики | Python, pandas, SQL, статистика, Jupyter |
Что учить Data Scientist первым
Порядок опирается на частотность навыков по данным вакансий и логику освоения специализации. Список — ориентир, не жёсткое правило.
- 1Python и базовые библиотеки (91.7%)NumPy, Pandas — обработка данных; Jupyter/VS Code, виртуальные окружения.
- 2Классический ML (28%)Scikit-learn: линейные модели, деревья, градиентный бустинг, оценка качества моделей.
- 3Нейросетевые фреймворки (36.3%)PyTorch или TensorFlow/Keras — архитектуры, обучение, инференс.
- 4LLM и языковые модели (31.8%)Трансформеры, API OpenAI/YandexGPT/GigaChat, prompt engineering, few-shot learning.
- 5RAG и векторные базы данных (22.3%)Retrieval-Augmented Generation: эмбеддинги, Qdrant/Chroma/Weaviate, similarity search.
- 6Агентные фреймворки и оркестрация (14.6%)LangChain, LlamaIndex — AI-пайплайны, tool calling, многоагентные системы.
- 7Деплой и сервинг моделей (12.7%)FastAPI/gRPC для инференса, Docker, ONNX — оптимизация latency в production.
- 8MLOps и мониторинг (13.4%)MLflow, DVC, Airflow — версионирование экспериментов, воспроизводимость, мониторинг дрейфа.
Как мы считаем навыки — методология
Источник данных: 157 вакансий в московском сегменте. Навыки извлечены автоматически из текста каждой вакансии. Все значения рассчитываются на основе реальных данных — без ручной редакции.
Доля (share %): доля вакансий профессии, в которых упомянут навык. Одна вакансия может упоминать несколько навыков — суммарная доля может превышать 100%.
Данные по грейдам: грейд определяется по требованиям каждой вакансии (уровень опыта). Ячейки с «≈» — оценка: выборка менее 20 вакансий. Ячейки «—» — данных нет.
Связки навыков: пары, встречающиеся вместе в ≥10 вакансиях (порог надёжности данных).
Зарплатная премия: разница медианы вакансий с навыком к медиане профессии. Показывается при наличии ≥20 вакансий с зарплатой. «Оценка» — 20–29 вакансий.
Обновлено: 11 октября 2026 · 157 вакансий
Курсы для Data Scientist
Сопоставили программы с реальным стеком из 157 вакансий — оценка соответствия рассчитана автоматически, это не реклама.