알라딘서재

읽고보고듣고쓰고
이 책의 마지막 부분에는 AI 빅데이터 분야와 관련된 용어들에 대한 설명이 간략하게나마 나와있다. 이 책을 처음부터 끝까지 쭉 읽어왔던 독자라면 적어도 본문에서 한 번쯤은 만나봤던 용어겠지만, 이 분야의 전공자가 아닌 이상 해당 용어들이 비교적 생소할 것이기에 아마도 저자가 독자들을 배려해서 용어가 의미하는 바를 정리해준 듯하다.

개인적으로는 우리가 영어를 처음 공부할 때 새로 배우는 단어의 뜻을 알아야 하는 것처럼 AI 빅데이터 분야를 공부할 때도 이 분야에서 자주 쓰는 용어들을 숙지하고 있어야 하는 게 맞겠다는 생각이 들었다.

토픽모델링: 문서 집합의 추상적인 ‘주제‘를 발견하기 위한 통계적 모델 중 하나로, 텍스트 본문의 숨겨진 의미 구조를 발견하기 위해 사용되는 텍스트 마이닝 기법 중 하나다.- P270
감성 분석: 어떤 주제에 대한 주관적인 인상, 감정, 태도, 개인의 의견들을 텍스트로부터 뽑아내는 분석을 말한다.- P270
단어 네트워크: 각 단어들을 노드로 단어 간의 관계를 엣지로 표현해 단어 간의 관계를 네트워크로 도시화하는 분석 방법이다.- P270
서포트 벡터 머신(Support Vector Machine): 기계 학습의 분야 중 하나로 패턴 인식, 자료 분석을 위한 지도 학습 모델이며, 주로 분류와 회귀 분석을 위해 사용한다. (기준을 정해 분류 문제를 해결)- P270
랜덤포레스트(Random Forest): 분류, 회귀 분석 등에 사용되는 앙상블 학습 방법의 일종으로, 훈련 과정에서 구성한 다수의 결정 나무로부터 부류(분류) 또는 평균 예측치(회귀 분석)를 출력함으로써 동작한다.- P270
배깅(bagging, bootstrap aggregating): 통계적 분류와 회귀 분석에서 사용되는 기계 학습 알고리즘의 안정성과 정확도를 향상시키기 위해 고안된 일종의 앙상블 학습법의 메타 알고리즘이다.- P270
부스팅(Boosting): 전체 데이터에서 여러 샘플링 데이터를 추출해 순차적으로 이전 학습 분류기의 결과를 토대로 다음 학습 데이터의 샘플 가중치를 조정하면서 학습을 진행하는 기법이다.- P270
KNN(k-nearest neighbor): 분류나 회귀에 사용되는 비모수 방식이다. 입력이 특징 공간 내 k개의 가장 가까운 훈련 데이터로 구성되어 있다. 출력은 k개의 최근접 이웃이 가진 투표값 또는 평균값이다.- P270
SI 업체: 정보시스템의 개발에 관하여 상담하고 그에 따라 설계, 개발, 운용, 보수, 관리 등 일체 업무를 담당하는 정보 통신 기업을 말한다.- P270
IBM 모델러(IBM Modeler): IBM의 데이터 마이닝 및 텍스트 분석 소프트웨어 애플리케이션이다. 예측 모델을 작성하고 다른 분석 작업을 수행하는 데 사용된다. 사용자가 프로그래밍 없이 통계 및 데이터 마이닝 알고리즘을 활용할 수 있는 시각적 인터페이스가 있다.- P271
래피드마이너(rapid miner): 데이터 과학에서 사용하는 컴퓨터 소프트웨어 프로그램이다. ‘래피드마이너‘라는 회사에서 개발했다. 프로그램을 통해 데이터 전처리, 기계학습, 딥러닝, 텍스트 마이닝, 예측 분석 등을 활용할 수 있는 프로그램을 제공한다.- P271
나임(knime): 무료 오픈 소스 데이터 분석, 보고 및 통합 플랫폼이다. 모듈식 데이터 파이프라인 개념을 통해 기계 학습 및 데이터 마이닝을 위한 다양한 구성 요소를 통합 제공한다.- P271
주성분 분석: 고차원의 데이터를 저차원의 데이터로 환원시키는 기법이다. 서로 연관 가능성이 있는 고차원 공간의 표본들을 선형 연관성이 없는 저차원 공간의 표본으로 변환하기 위해 직교 변환을 사용한다. 주성분의 차원 수는 원래 표본의 차원 수보다 작거나 같다.- P271
장고(Django): 파이썬으로 작성된 오픈소스 웹 애플리케이션 프레임워크로, 모델-뷰-컨트롤러 패턴을 따르고 있다.- P271
PyQT: C++의 크로스 플랫폼 GUI 프레임워크 중 하나인 QT를 파이썬 모듈로 변환해 사용 가능하게 만든 라이브러리다.- P271
Tkinter: 파이썬 설치 시 기본적으로 내장되어 있는 파이썬 표준 라이브러리이며 쉽고 간단한 GUI 프로그램을 만들 때 활용될 수 있다.- P271
스파크(Spark): 메모리 내 처리를 지원하여 빅데이터를 분석하는 애플리케이션의 성능을 향상시키는 오픈소스 병렬 처리 프레임워크다.- P271
SCI-HUB: 온라인 논문 검색 엔진 사이트로, 5,800만 개의 유료 논문을 무료로 제공하고 있다.- P271
슬랙(slack): 클라우드 기반 팀 협업 도구다.- P271
플로(flow): 프로젝트 관리 중심의 그룹웨어 협업 툴이다. 프로젝트 일정 관리, 일정 공유, 업무 관리를 제공한다.- P271
API(Application programming interface): 응용 프로그램에서 사용할 수 있도록, 운영 체제나 프로그래밍 언어가 제공하는 기능을 제어할 수 있게 만든 인터페이스를 뜻한다.- P271
프로세스 마이닝(Process Mining): 이벤트 로그 데이터 분석을 통해서 어떤 일이 어떻게 흘러가는지, 어떤 상품이 어떤 과정으로 제작되는지, 한 고객이 서비스 내에서 어떤 여정을 거치는지 등의 프로세스를 도출해내는 것을 의미한다.- P271

  • 댓글쓰기
  • 좋아요
  • 공유하기
  • 찜하기
로그인 l PC버전 l 전체 메뉴 l 나의 서재