SAP HANA용 Python 기계 학습 클라이언트(hana-ml)는 데이터 과학자가 SAP HANA 데이터에 액세스할 수 있도록 지원하는 Python 패키지입니다. 실무자는 SAP HANA [2]에서 직접 데이터를 사용하여 기계 학습 모델을 작성할 수 있습니다.
SAP HANA의 Python 기계 학습 클라이언트는 다음 두 가지 주요 컴포넌트로 구성됩니다.
- SAP HANA DataFrame: 클라이언트에 데이터를 가져오지 않고도 SAP HANA에서 데이터에 액세스하고 쿼리할 수 있는 일련의 메소드를 제공합니다.
- 기계 학습 모델을 개발하기 위한 기계 학습 API 세트입니다.
기계 학습 API는 다음 두 패키지로 구성됩니다.
PAL 패키지
PAL 패키지는 SAP HANA Predictive Analysis Library(PAL)에서 기계 학습 기능에 액세스할 수 있는 Python 알고리즘 및 함수 세트로 구성됩니다. SAP HANA PAL 함수는 모델 훈련을 위한 다양한 기계 학습 알고리즘을 다루므로 훈련된 모델이 채점에 사용됩니다.
APL 패키지
Automated Predictive Library(APL) 패키지는 일련의 함수를 통해 SAP HANA 내 자동화된 분석 엔진의 데이터 마이닝 기능을 제공합니다. 이 함수는 분석가가 SAP HANA에 저장된 고객 데이터세트에 대한 간단한 질문에 답하는 데 사용할 수 있는 예측 모델링 프로세스를 개발합니다.
HANA-ML은 SAP HANA Python 드라이버(hdbcli)를 사용하여 SAP HANA에 연결하고 액세스합니다. 자세한 내용은 [2]을(를) 참조하십시오.