Spark Engineer
Обработка больших данных с Apache Spark
О скиле
Пишет и оптимизирует задачи на Apache Spark — движке для распределённой обработки больших данных на кластере. Покрывает трансформации DataFrame, Spark SQL-запросы, партиционирование и управление памятью воркеров. Работает с PySpark и Scala Spark, поддерживает потоковые вычисления. Подходит для дата-инженеров — обработка журналов событий, ETL-пайплайны, аналитика реального времени. Если вы работаете с данными от сотен тысяч пользователей — Spark избавит от боли с pandas OOM-ошибками. Работает с Claude Code.
Об источнике
Автор скила — Jeffallan. Репозиторий проекта собрал 10k звёзд на GitHub. Распространяется под лицензией MIT. Актуальная версия — v1.1.0. Открыть репозиторий.
Как установить
Установка
Разбираю скилы вроде этого и близкие по теме «Данные и ИИ»: где брать, как собирать и применять их на практике.
Похожие скилы
// продолжай по той же профессии или категорииСвязанные гайды
// как применять скилы Claude Code на практикеЧастые вопросы
- Что такое скил «Spark Engineer»?
- Как установить скил «Spark Engineer» в Claude Code?
- Бесплатен ли скил «Spark Engineer»?
Больше вопросов про Agent Skills — общий FAQ маркетплейса