다음을 통해 공유


Machine Learning용 Databricks Runtime 14.2(EoS)

참고

이 Databricks Runtime 버전에 대한 지원이 종료되었습니다. 지원 종료 날짜는 지원 종료 기록을 참조하세요. 지원되는 모든 Databricks Runtime 버전은 Databricks Runtime 릴리스 정보 버전 및 호환성을 참조하세요.

Machine Learning용 Databricks Runtime 14.2는 Databricks Runtime 14.2(EoS)를 기반으로 기계 학습 및 데이터 과학을 위한 즉시 사용할 수 있는 환경을 제공합니다. Databricks Runtime ML에는 TensorFlow, PyTorch 및 XGBoost를 포함하여 널리 사용되는 많은 기계 학습 라이브러리가 포함되어 있습니다. Databricks Runtime ML에는 기계 학습 파이프라인을 자동으로 학습시키는 도구인 AutoML이 포함되어 있습니다. Databricks Runtime ML은 Horovod를 사용한 분산 딥 러닝 학습도 지원합니다.

지원 종료(EoS)에 도달한 Databricks Runtime 버전에 대한 릴리스 정보를 확인하려면 지원 종료 Databricks Runtime 릴리스 정보를 참조하세요. EoS Databricks Runtime 버전은 폐기되었으며 업데이트되지 않을 수 있습니다.

새로운 기능 및 향상 기능

Databricks Runtime 14.2 ML은 Databricks Runtime 14.2를 기반으로 빌드됩니다. Apache Spark MLlib 및 SparkR을 포함하여 Databricks Runtime 14.2의 새로운 기능과 관련된 자세한 내용은 Databricks Runtime 14.2(EoS) 릴리스 정보를 참조하세요.

시스템 환경

Databricks Runtime 14.2 ML의 시스템 환경은 다음과 같이 Databricks Runtime 14.2와 다릅니다.

Databricks Runtime 14.2 ML에는 컴퓨팅 기능이 5.2 이하인 GPU 클러스터를 지원하지 않는 XGBoost 1.7.6이 포함되어 있습니다.

라이브러리

다음 섹션에서는 Databricks Runtime 14.2에 포함된 라이브러리와 다른 Databricks Runtime 14.2 ML에 포함된 라이브러리를 나열합니다.

이 구역의 내용:

최상위 계층 라이브러리

Databricks Runtime 14.2 ML에는 다음과 같은 최상위 계층 라이브러리가 포함되어 있습니다.

Python 라이브러리

Databricks Runtime 14.2 ML은 Python 패키지 관리를 위해 virtualenv를 사용하며, 많은 인기 있는 ML 패키지를 포함합니다.

다음 섹션에 지정된 패키지 외에도 Databricks Runtime 14.2 ML에는 다음 패키지도 포함됩니다.

  • hyperopt 0.2.7+db4
  • sparkdl 3.0.0_db1
  • automl 1.23.0

로컬 Python 가상 환경에서 Databricks Runtime ML Python 환경을 재현하려면 requirements-14.2.txt 파일을 다운로드하고 실행pip install -r requirements-14.2.txt합니다. 이 명령은 Databricks Runtime ML이 사용하는 모든 오픈 소스 라이브러리를 설치하지만 databricks-automl, databricks-feature-store 또는 hyperopt의 Databricks 포크와 같은 Databricks에서 개발한 라이브러리는 설치하지 않습니다.

CPU 클러스터의 Python 라이브러리

라이브러리 버전 라이브러리 버전 라이브러리 버전
absl-py 1.0.0 가속하다 0.23.0 aiohttp 3.8.6
aiosignal 1.3.1 anyio 3.5.0 앱 디렉토리 1.4.4
argon2-cffi 21.3.0 argon2-cffi-bindings 21.2.0 아스토르 0.8.1
asttokens 2.0.5 astunparse 1.6.3 async-timeout 4.0.3
속성 22.1.0 audioread 3.0.1 azure-core 1.29.1
azure-cosmos 4.3.1 azure-storage-blob 12.18.3 Azure 스토리지 파일 데이터 레이크 12.13.2
백콜 0.2.0 bcrypt 3.2.0 beautifulsoup4 4.11.1
검정색 22.6.0 표백제 4.1.0 깜빡이 1.4
블리스 0.7.11 boto3 1.24.28 botocore 1.27.96
cachetools 5.3.2 카탈로그 2.0.10 범주 인코더 2.6.2
certifi 2022.12.7 cffi 1.15.1 chardet 4.0.0
charset-normalizer 2.0.4 클릭하다 8.0.4 cloudpathlib 0.16.0
cloudpickle 2.0.0 cmdstanpy 1.2.0 comm 0.1.2
과자 0.1.3 configparser 5.2.0 contourpy 1.0.5
암호화 39.0.1 사이클러 0.11.0 cymem 2.0.8
Cython 0.29.32 데사이트 1.8.1 databricks-automl-runtime 0.2.20
databricks-cli 0.18.0 Databricks 특성 공학 0.1.2 databricks-feature-store (데이터브릭스 기능 저장소) 0.16.1
databricks-sdk 0.1.6 dataclasses-json 0.6.1 데이터 세트 2.14.5
dbl-tempo 0.1.26 dbus-python 1.2.18 debugpy 1.6.7
데코레이터 5.1.1 deepspeed 0.11.1 defusedxml 0.7.1
0.3.6 디스크 캐시 5.6.3 distlib 0.3.7
도크스트링을 마크다운으로 변환 0.11 진입점 0.4 평가하다 0.4.1
실행 중 0.8.3 기능 개요 1.1.1 fastjsonschema 2.18.1
fasttext 0.9.2 파일 잠금 3.9.0 Flask 2.2.5
플랫버퍼스 23.5.26 fonttools 4.25.0 frozenlist 1.4.0
fsspec 2023.6.0 미래 0.18.3 gast 0.4.0
gitdb 4.0.11 GitPython 3.1.27 google-api-core 2.12.0
google-auth 2.21.0 google-auth-oauthlib 1.0.0 google-cloud-core (구글 클라우드 코어) 2.3.3
구글 클라우드 스토리지 2.11.0 google-crc32c 1.5.0 google-파스타 0.2.0
google-resumable-media 2.6.0 googleapis-common-protos 1.61.0 그린렛 (greenlet) 2.0.1
grpcio 1.48.2 grpcio-status 1.48.1 gunicorn 20.1.0
gviz-api 1.10.0 h5py 3.7.0 hjson 3.1.0
휴일 0.35 horovod 0.28.1 htmlmin 0.1.12
httplib2 0.20.2 허깅페이스-허브 0.16.4 아이디엔에이 3.4
ImageHash 4.3.1 imbalanced-learn (불균형 데이터 학습 패키지) 0.11.0 importlib-metadata 4.11.3
importlib-resources 6.1.0 ipykernel 6.25.0 ipython 8.14.0
ipython-genutils 0.2.0 ipywidgets 7.7.2 isodate 0.6.1
위험한 것 2.0.1 jedi 0.18.1 지프니(필리핀 대중교통 수단) 0.7.1
Jinja2 3.1.2 jmespath 0.10.0 joblib 1.2.0
joblibspark 0.5.1 jsonpatch 1.33 jsonpointer 2.4
jsonschema 4.17.3 jupyter-client 7.3.4 jupyter-server 1.23.4
jupyter_core (주피터 코어) 5.2.0 jupyterlab-pygments 0.1.2 jupyterlab-widgets 1.0.0
Keras 2.14.0 열쇠고리 23.5.0 kiwisolver 1.4.4
langchain 0.0.314 언어 코드 3.3.0 langsmith 0.0.56
launchpadlib 1.10.16 lazr.restfulclient 0.14.4 lazr.uri 1.0.6
lazy_loader 0.3 libclang 15.0.6.1 librosa 0.10.1
lightgbm 4.1.0 llvmlite 0.39.1 lxml 4.9.1
Mako 1.2.0 Markdown 3.4.1 MarkupSafe 2.1.1
마시멜로 3.20.1 matplotlib 3.7.0 matplotlib-inline 0.1.6
mccabe 0.7.0 미튠 0.8.4 ml-dtypes 0.2.0
mlflow-skinny 2.8.0 more-itertools 8.10.0 mpmath 1.2.1
msgpack 1.0.7 멀티딕트 6.0.4 다중 방법 1.10
다중 처리 0.70.14 murmurhash 1.0.10 mypy-extensions 0.4.3
nbclassic 0.5.2 nbclient 0.5.13 nbconvert 6.5.4
nbformat 5.7.0 nest-asyncio 1.5.6 networkx 2.8.4
닌자 1.11.1.1 nltk 3.7 nodeenv 1.8.0
공책 6.5.2 notebook_shim 0.2.2 numba 0.56.4
numpy (넘파이) 1.23.5 oauthlib 3.2.0 오픈AI 0.28.1
opt-einsum 3.3.0 패키징 22.0 pandas 1.5.3
pandocfilters 1.5.0 paramiko 2.9.2 parso 0.8.3
패스스펙 (pathspec) 0.10.3 0.10.3 희생양 0.5.3
petastorm 0.12.1 pexpect 4.8.0 phik 0.12.3
피클쉐어 0.7.5 베개 9.4.0 pip 22.3.1
platformdirs 2.5.2 plotly 5.9.0 플러기 1.0.0
pmdarima 2.0.3 강아지 1.4.0 preshed 3.0.9
prometheus-client 0.14.1 prompt-toolkit 3.0.36 예언자 1.1.5
protobuf 4.24.0 psutil 5.9.0 psycopg2 2.9.3
ptyprocess 0.7.0 pure-eval 0.2.2 py-cpuinfo 9.0.0
pyarrow 8.0.0 pyasn1 0.4.8 pyasn1-modules 0.2.8
pybind11 2.11.1 pycparser 2.21 pydantic 1.10.6
pyflakes 3.1.0 Pygments 2.11.2 PyGObject 3.42.1
PyJWT 2.3.0 PyNaCl 1.5.0 pyodbc 4.0.32
pyparsing 3.0.9 pyright 1.1.294 pyrsistent 0.18.0
pytesseract 0.3.10 python-dateutil 2.8.2 파이썬 편집기 1.0.4
python-lsp-jsonrpc 1.1.1 python-lsp-server 1.8.0 pytoolconfig 1.2.5
pytz 2022년 7월 PyWavelets 1.4.1 PyYAML 6.0
pyzmq 23.2.0 regex 2022.7.9 요청 2.28.1
requests-oauthlib 1.3.1 응답 0.18.0 밧줄 1.7.0
RSA (암호화 방식) 4.9 s3transfer 0.6.2 safetensors 0.4.0
scikit-learn 1.1.1 scipy 1.10.0 시본 0.12.2
SecretStorage 3.3.1 Send2Trash 1.8.0 sentence-transformers 2.2.2
sentencepiece 0.1.99 setuptools 65.6.3 shap 0.43.0
simplejson 3.17.6 6 1.16.0 슬라이서 0.0.7
스마트-오픈 5.2.1 smmap 5.0.0 sniffio 1.2.0
사운드파일 0.12.1 수프 거르기 도구 2.3.2.post1 soxr 0.3.7
spacy 3.7.1 spacy-legacy 3.0.12 spacy-loggers 1.0.5
spark-tensorflow-distributor 1.0.0 SQLAlchemy 1.4.39 sqlparse 0.4.2
진심으로 2.4.8 ssh-import-id 5.11 스택 데이터 0.2.0
stanio 0.3.0 statsmodels 0.13.5 sympy 1.11.1
표로 만들다 0.8.10 유니코드에 엉킨 0.2.0 끈기 8.1.0
tensorboard 2.14.0 tensorboard-data-server 0.7.2 tensorboard-plugin-profile 2.14.0
tensorflow-CPU(중앙처리장치) 2.14.0 tensorflow-estimator 2.14.0 tensorflow-io-gcs-filesystem 0.34.0
termcolor 2.3.0 완료 0.17.1 thinc 8.2.1
threadpoolctl 2.2.0 tiktoken 0.5.1 tinycss2 1.2.1
tokenize-rt 4.2.1 토크나이저 0.14.0 tomli 2.0.1
손전등 (if referring to a flashlight) / 횃불 (if referring to a flaming torch) 2.0.1+cpu torchvision 0.15.2+cpu tornado 6.1
tqdm 4.64.1 traitlets 5.7.1 변환기 4.34.0
타입 가드 (typeguard) 2.13.3 타이핑하는 사람 0.9.0 타이핑 검사 0.9.0
typing_extensions 4.4.0 ujson 5.4.0 자동 업그레이드 0.1
urllib3 1.26.14 virtualenv 20.16.7 비전 0.7.5
wadllib 1.3.6 와사비 1.1.2 wcwidth (문자 너비 계산 함수) 0.2.5
족제비 0.3.3 웹 인코딩 0.5.1 websocket-client (웹소켓 클라이언트) 0.58.0
도구 2.2.2 whatthepatch 1.0.2 바퀴 0.38.4
위젯엔비익스텐션 3.6.1 wordcloud 1.9.2 wrapt 1.14.1
xgboost 1.76 xxhash 3.4.1 yapf 0.33.0
yarl 1.9.2 ydata-profiling 4.2.0 zipp 3.11.0

GPU 클러스터의 Python 라이브러리

라이브러리 버전 라이브러리 버전 라이브러리 버전
absl-py 1.0.0 가속하다 0.23.0 aiohttp 3.8.6
aiosignal 1.3.1 anyio 3.5.0 appdirs 1.4.4
argon2-cffi 21.3.0 argon2-cffi-bindings 21.2.0 astor 0.8.1
asttokens 2.0.5 astunparse 1.6.3 async-timeout (비동기-타임아웃) 4.0.3
속성 22.1.0 오디오리드 3.0.1 azure-core 1.29.1
azure-cosmos 4.3.1 azure-storage-blob (Azure 저장 블롭) 12.18.3 Azure 스토리지 파일 데이터 레이크 (azure-storage-file-datalake) 12.13.2
백콜 0.2.0 bcrypt 3.2.0 beautifulsoup4 4.11.1
검정색 22.6.0 표백제 4.1.0 깜빡이 1.4
블리스 0.7.11 boto3 1.24.28 botocore 1.27.96
캐시 도구 (cachetools) 5.3.2 카탈로그 2.0.10 카테고리 인코더 2.6.2
certifi 2022.12.7 cffi 1.15.1 chardet 4.0.0
charset-normalizer 2.0.4 클릭 8.0.4 cloudpathlib 0.16.0
클라우드피클 2.0.0 cmake 3.27.7 cmdstanpy 1.2.0
comm 0.1.2 과자 0.1.3 configparser 5.2.0
컨투어파이 1.0.5 암호화 39.0.1 사이클러 0.11.0
cymem 2.0.8 Cython 0.29.32 다사이트 1.8.1
databricks-automl-runtime 0.2.20 databricks-cli 0.18.0 databricks-특성 공학 0.1.2
databricks-feature-store 0.16.1 databricks-sdk 0.1.6 dataclasses-json 0.6.1
데이터 세트 2.14.5 dbl-tempo 0.1.26 dbus-python 1.2.18
debugpy 1.6.7 decorator 5.1.1 딥스피드 0.11.1
defusedxml 0.7.1 0.3.6 디스크 캐시 5.6.3
distlib 0.3.7 문서 문자열을 마크다운으로 변환 0.11 einops 0.7.0
진입점 0.4 평가하다 0.4.1 실행 중 0.8.3
측면 개요 1.1.1 fastjsonschema 2.18.1 fasttext 0.9.2
파일 잠금 3.9.0 flash-attn 2.3.2 플라스크 2.2.5
flatbuffers 23년 5월 26일 fonttools 4.25.0 동결 목록 1.4.0
fsspec 2023.6.0 미래 0.18.3 gast 0.4.0
gitdb 4.0.11 GitPython 3.1.27 google-api-core 2.12.0
google-auth 2.21.0 google-auth-oauthlib 1.0.0 google-cloud-core 2.3.3
Google Cloud Storage (구글 클라우드 스토리지) 2.11.0 google-crc32c 1.5.0 google-pasta 0.2.0
google-resumable-media (구글의 재개 가능한 미디어 API) 2.6.0 googleapis-common-protos 1.61.0 greenlet (그린렛) 2.0.1
grpcio 1.48.2 grpcio-status 1.48.1 gunicorn(구니콘) 20.1.0
gviz-api 1.10.0 h5py 3.7.0 hjson 3.1.0
휴일 0.35 horovod 0.28.1 htmlmin 0.1.12
httplib2 0.20.2 huggingface-hub 0.16.4 idna 3.4
ImageHash 4.3.1 imbalanced-learn 0.11.0 importlib-metadata 4.11.3
importlib-resources 6.1.0 ipykernel 6.25.0 ipython 8.14.0
ipython-genutils 0.2.0 ipywidgets 7.7.2 isodate 0.6.1
위험하다 2.0.1 jedi 0.18.1 지프니 0.7.1
Jinja2 3.1.2 jmespath 0.10.0 joblib 1.2.0
joblibspark 0.5.1 jsonpatch 1.33 jsonpointer 2.4
jsonschema 4.17.3 jupyter-client 7.3.4 jupyter-server 1.23.4
jupyter_core 5.2.0 jupyterlab-pygments 0.1.2 jupyterlab-widgets 1.0.0
Keras 2.14.0 열쇠고리 23.5.0 kiwisolver 1.4.4
langchain 0.0.314 언어 코드 3.3.0 langsmith 0.0.56
launchpadlib (런치패드 라이브러리) 1.10.16 lazr.restfulclient 0.14.4 lazr.uri 1.0.6
lazy_loader 0.3 libclang 15.0.6.1 librosa 0.10.1
lightgbm 4.1.0 멋진 17.0.4 llvmlite 0.39.1
lxml 4.9.1 Mako 1.2.0 Markdown 3.4.1
MarkupSafe 2.1.1 마시멜로 3.20.1 matplotlib 3.7.0
matplotlib-inline 0.1.6 맥케이브 0.7.0 잘못 조율하다 0.8.4
ml-dtypes 0.2.0 mlflow-skinny 2.8.0 more-itertools 8.10.0
mpmath 1.2.1 msgpack 1.0.7 멀티딕트 6.0.4
다중 방법 1.10 멀티프로세스 0.70.14 murmurhash 1.0.10
mypy-extensions 0.4.3 nbclassic 0.5.2 nbclient 0.5.13
nbconvert 6.5.4 nbformat 5.7.0 nest-asyncio 1.5.6
networkx 2.8.4 ninja 1.11.1.1 nltk 3.7
nodeenv 1.8.0 공책 6.5.2 notebook_shim 0.2.2
numba (소프트웨어 라이브러리) 0.56.4 numpy 1.23.5 oauthlib 3.2.0
openai 0.28.1 opt-einsum 3.3.0 패키징 22.0
pandas 1.5.3 pandocfilters 1.5.0 paramiko 2.9.2
파르소 0.8.3 패스스펙 (pathspec) 0.10.3 병증 0.10.3
희생양 0.5.3 petastorm 0.12.1 pexpect 4.8.0
phik 0.12.3 pickleshare 0.7.5 베개 9.4.0
pip 22.3.1 platformdirs 2.5.2 plotly 5.9.0
플러기 1.0.0 pmdarima 2.0.3 강아지 1.4.0
프레쉬드 3.0.9 prompt-toolkit 3.0.36 예언자 1.1.5
protobuf 4.24.0 psutil 5.9.0 psycopg2 2.9.3
ptyprocess 0.7.0 pure-eval 0.2.2 py-cpuinfo 9.0.0
pyarrow 8.0.0 pyasn1 0.4.8 pyasn1-modules 0.2.8
pybind11 2.11.1 pycparser 2.21 pydantic 1.10.6
pyflakes 3.1.0 Pygments 2.11.2 PyGObject 3.42.1
PyJWT 2.3.0 PyNaCl 1.5.0 pyodbc 4.0.32
pyparsing 3.0.9 pyright 1.1.294 pyrsistent 0.18.0
pytesseract 0.3.10 python-dateutil 2.8.2 파이썬 편집기 1.0.4
python-lsp-jsonrpc 1.1.1 python-lsp-server 1.8.0 pytoolconfig 1.2.5
pytz 2022.7 PyWavelets 1.4.1 PyYAML 6.0
pyzmq 23.2.0 regex 2022.7.9 요청사항 2.28.1
requests-oauthlib 1.3.1 응답 0.18.0 밧줄 1.7.0
rsa 4.9 s3transfer 0.6.2 safetensors (세이프텐서) 0.4.0
scikit-learn 1.1.1 scipy 1.10.0 seaborn 0.12.2
SecretStorage 3.3.1 Send2Trash 1.8.0 센텐스 트랜스포머 (문장 변환기) 2.2.2
sentencepiece (문장 단위 토큰화) 0.1.99 setuptools 65.6.3 0.43.0
simplejson 3.17.6 6 1.16.0 슬라이서 0.0.7
smart-open 5.2.1 smmap 5.0.0 sniffio 1.2.0
사운드파일 0.12.1 soupsieve 2.3.2.post1 soxr 0.3.7
스페이시 3.7.1 spacy-legacy (스페이시-레거시) 3.0.12 spacy-loggers 1.0.5
spark-tensorflow-distributor 1.0.0 SQLAlchemy 1.4.39 sqlparse 0.4.2
진짜 2.4.8 ssh-import-id 5.11 스택 데이터 0.2.0
stanio 0.3.0 statsmodels 0.13.5 sympy 1.11.1
표로 정리하다 0.8.10 유니코드에 얽혀서 0.2.0 끈기 8.1.0
tensorboard 2.14.0 텐서보드 데이터 서버 (tensorboard-data-server) 0.7.2 Tensorboard 플러그인 프로파일 2.14.0
tensorflow 2.14.0 tensorflow-estimator 2.14.0 tensorflow-io-gcs-filesystem 0.34.0
termcolor 2.3.0 완료된 0.17.1 thinc 8.2.1
threadpoolctl 2.2.0 tiktoken 0.5.1 tinycss2 1.2.1
tokenize-rt 4.2.1 토크나이저 0.14.0 tomli 2.0.1
torch 2.0.1+cu118 torchvision 0.15.2+cu118 tornado 6.1
tqdm 4.64.1 traitlets 5.7.1 변환기 4.34.0
트리톤 2.0.0 타입가드 2.13.3 typer 0.9.0
입력 검사 0.9.0 typing_extensions 4.4.0 ujson 5.4.0
자동 업그레이드 0.1 urllib3 1.26.14 virtualenv 20.16.7
비전 0.7.5 wadllib 1.3.6 와사비 1.1.2
wcwidth 0.2.5 족제비 0.3.3 webencodings 0.5.1
websocket-client 0.58.0 도구 2.2.2 whatthepatch 1.0.2
바퀴 0.38.4 widgetsnbextension 3.6.1 wordcloud 1.9.2
감싸인 1.14.1 xgboost 1.76 xxhash 3.4.1
yapf 0.33.0 yarl 1.9.2 ydata-profiling 4.2.0
zipp 3.11.0

R 라이브러리

R 라이브러리는 Databricks Runtime 14.2의 R 라이브러리와 동일합니다.

Java 및 Scala 라이브러리(Scala 2.12 클러스터)

Databricks Runtime 14.2의 Java 및 Scala 라이브러리 외에도 Databricks Runtime 14.2 ML에는 다음 JAR이 포함됩니다.

CPU 클러스터

그룹 ID 아티팩트 ID 버전
com.typesafe.akka akka-actor_2.12 2.5.23
ml.dmlc xgboost4j-spark_2.12 1.7.3
ml.dmlc xgboost4j_2.12 1.7.3
org.graphframes graphframes_2.12 0.8.2-db2-spark3.4
org.mlflow mlflow-client 2.8.0
org.scala-lang.modules scala-java8-compat_2.12 0.8.0
org.tensorflow spark-tensorflow-connector_2.12 1.15.0

GPU 클러스터

그룹 ID 아티팩트 ID 버전
com.typesafe.akka akka-actor_2.12 2.5.23
ml.dmlc xgboost4j-gpu_2.12 1.7.3
ml.dmlc xgboost4j-spark-gpu_2.12 1.7.3
org.graphframes graphframes_2.12 0.8.2-db2-spark3.4
org.mlflow mlflow-client 2.8.0
org.scala-lang.modules scala-java8-compat_2.12 0.8.0
org.tensorflow spark-tensorflow-connector_2.12 1.15.0