
5
장
-
인공지능 프레임워크
81
비즈니스 환경에서는 랜덤 포레스트 내 각 트리의 랜덤 부분집합
random
subset
5
에 주
목해 가장 가능성 높은 결과를 도출한다. 랜덤 포레스트의 다양한 평가 방식은 비
즈니스의 성공 여부를 예측하는 데 의미 있는 지표로 활용될 수 있다.
NOTE_
랜덤 포레스트 알고리즘으로 학습을 시작하기 전에 먼저 예측 데이터를 분리하는 것이 중요하
다. 따라서 특정 양의 훈련 데이터로 학습을 진행한 후 예측 데이터를 적용할 것을 권장한다.
데이터의 중요성
데이터는 알고리즘의 동력이며 인공지능을 작동시키는 연료다. 결함이 있는 데이
터로 기계를 훈련하면 가치 없는 데이터 결과가 나온다. 실제로 데이터 과학자와
인공지능 개발자들은 데이터를 실제로 사용할 수 있도록 정제하는 데 많은 시간
을 쏟는다.
데이터는 알고리즘의 동력이며 인공지능을 작동시키는 연료다.
정제된 데이터를 얻는 가장 좋은 방법은 주요 데이터 소스에 적합한
API
를 연결
하고, 인공지능과 통신할 수 있도록 만드는 것이다.
IMVU
는 ‘아테나 프라임
Athena
Prime
’이라는 자체적인 인공지능과 각 데이터 소스를
API
로 연결했다. 상세한 데이
터 소스는 다음과 같다.
●
앱스플라이어
AppsFlyer
는 모바일 광고 및 마케팅 분석을 위한 플랫폼이다. 모바일 환경에서 진
행하는 사용자 ...