Dask — параллельные вычисления над большими данными

★ 7.0 · data

dask — это скилл для Claude Code, который масштабирует pandas и NumPy на датасеты, превышающие объём оперативной памяти, с помощью параллельных и распределённых вычислений. Требует Python 3.10+ и dask 2025.1+; для полного стека с планировщиком и дашбордом устанавливается через `dask[complete]`, облачные пути (s3://, gs://) подключаются через s3fs или gcsfs. Скилл охватывает три ключевых компонента: DataFrame для параллельной обработки табличных данных, Array для блочных операций над NumPy-массивами и Bag для потоковой обработки неструктурированных данных — логов, JSON, текстов. Инструменты Read, Write, Edit и Bash позволяют Claude Code читать референсные файлы, генерировать и запускать код. Подходит тем, кто переходит от pandas-прототипа к production-пайплайну на кластере или обрабатывает десятки CSV и Parquet-файлов на одной машине без загрузки всего датасета в память.