NobleBlocks
Public

A Sparse Data Preprocessing Using Support Vector Regression

Published in Journal of Korean institute of intelligent systems • Oct 1, 2004
Authors:
Sunghae Jun
,
Jung-Eun Park
,
Kyung-Whan Oh

Abstract

웹 마이닝, 바이오정보학, 통계적 자료 분석 등 여러 분야에서 매우 다양한 형태의 결측치가 발생하여 학습 데이터를 희소하게 만든다. 결측치는 주로 전처리 과정에서 가장 기본적인 평균과 최빈수뿐만 아니라 조건부 평균, 나무 모형, 그리고 마코프체인 몬테칼로 기법과 같은 결측치 대체 기법들을 적용하여 추정된 값에 의해 대체된다. 그런데 주어진 데이터의 결측치 비율이 크게 되면 기존의 결측치 대체 방법들의 예측의 정확도는 낮아지는 특성을 보인다. 또한 데이터의 결측치 비율이 증가할수록 사용 가능한 결측치 대체 방법들의 수는 제한된다. 이...

Finding related papers...

Discussions

(0)

No comments yet

Be the first to share your thoughts!