반응형

스터디 3

[Spark] 스파크에 대한 간단 스터디 1

1. 스파크란 스파크는 통합 컴퓨팅 엔진이며, 클러스터 환경에서 데이터를 병렬로 처리하는 라이브러리 집합. 널리 쓰이는 언어(파이썬, 자바,스칼라,R) 을 지원하며 SQL 뿐만 아니라 스트리밍, 머신러닝에 이르기까지 넓은 범위의 라이브러리를 제공한다. 2. 스파크의 특징 HDFS 사용 – 하둡의 파일시스템 기반 동작 직관적 이해 – 스칼라 기반 최소화 코드로 작성 RDD – RDD 단위로 데이터 연산을 수행 3. 스파크 철학 1) 통합 간단한 데이터 읽기부터 SQL 처리, 머신러닝 그리고 스트림 처리에 이르기까지 다양한 데이터 분석작업을 같은 연산 엔진과 일관성있는 API 로 수행할 수 있도록 설계. 2) 컴퓨팅 엔진 통합관점의 중시하면서 기능의 범위를 컴퓨팅 엔진으로 제한, 그 결과 저장소 시스템의 데..

[Careerly] 카카오톡 선물하기의 분석가라면? - 데이터리안

1. 기록의 이유 평소에 관심이 있었던 카카오톡 선물하기에 대한 분석이 있었다. 분석가의 관점에서 선물하기의 타겟 유저군과 사업모델을 보았다는 점, 4가지 지표 크게 이 두가지를 주제로하여 스터디 내용을 정리한 점이 매우 흥미로웠다. 지금은 개발을 하고 있지만, 개발자도 분석가와 마케터의 관점에서 생각해보는 자세가 필요하기에 기록을 해둔다. 또, 다른 많은 분석글에 비해서 심플하고, 잘 읽힌다는 것도 한 몫 했다. 2. 요약 선물하기 서비스의 비즈니스 모델은 B2C, B2B 모델을 혼용한 모델이다. 왜냐하면, 선물하기 서비스는 선물을 직접 판매하는 것이 아닌 기업들이 입점하여 직접 선물을 팔고, 홍보를 위해 여러 플랫폼에 노출할 수 있는 서비스를 제공을 하므로 기업고객, 일반 소비자 누구나 접근하여 서비..

2021 클라우드 컴퓨팅 전망 - careerly 김호중님

커리어리에서 2021년 도 클라우드 컴퓨팅 전망으로 해서 올라온 김호중님의 컬럼 있어 읽고 공유. 추후 다시 읽어야 겠다. careerly.co.kr/comments/15118?utm_campaign=user-share 1. 코로 | 김호중 | 커리어리 김호중 지구별 여행자 & 라이프 해커 | 1. 코로나19: 팬데믹 극복의 중심에 선 클라우드 2. 엣지 컴퓨팅: 엣지는 새로운 클라우드 3. 인공지능 엔지니어 careerly.co.kr 2021 클라우드 컴퓨팅 전망: 7개의 키워드 1. 코로나19: 팬데믹 극복의 중심에 선 클라우드 글로벌 퍼블릭 클라우드 인프라 시장은 21년에 35% 증가하여 12..

반응형