|
이 책은 하둡이 어떤 목적으로 만들어 졌으며, 어떤 용도로 사용하면 좋을지 사례를 들어 설명하고 있다. 처음 설치부터 설정에 이르기까지 세세하게 설명되어 있어 일단 훝어보고 나중에 다시 찾아보기에도 유용할 것 같다. 또한 버전별 특징과 변화된 과정을 설명하고 있고 활용에 관련된 다양한 예시가 있어 하둡을 설치하고 운영하며 활용하는데 도움이 될 것 같다. |
|
업계의 가장 큰 화두가 빅데이터임은 틀림이 없다. 모든 세미나들도 빅데이터이며, 쏟아져나오는 책들도 빅데이터 관련 책들이다.
이 책은 저자들의 경험이 녹아있는 책인지라 다른 책들에 비해 나같은 입문자들이 쉽게 이해할 수 있었던 것 같다. 또한, 번역책에는 없는 국내 사례들도 포함하고 있어서 좀 더 빅데이터가 피부에 와 닿는다.
특히, 개인적으로 (DB 관련 업무를 해서인지는 모르지만) 8장. NoSql 개요 부분은 감동이었다. 정말 정리가 잘되어 있고, 타 책에서는 거의 보기 힘든 NoSQL 데이터 모델링에 대해서도 다루고 있어..
Hadoop, MapReduce, NoSql(HBase) 입문서로는 괜챦은 책임에 틀림이 없다. |
|
이책의 머릿말은 다음과 같은 문장으로 시작하고 있다 "앞으로 양질의 콘텐츠는 빅데이터를 어떻게 가공하느냐에 달려 있다" 그리고 2013년 01월 15일자 디지털타임즈 기사 중에 [삼성사장단 '빅테이터' 배운다]라는 기사가 실렸었다. 아마도 요즘 IT 기술들 중에 빅데이터 만큼 관심을 받고 있는 이슈도 없을것이다. 요즘 소셜 네트워크나 플랫폼, 클라우드 등에 대해서 관심을 갖고 여러 책들을 구해서 읽고 있는데 결국 그런 시스템을 구축하기 위해서는 빅데이터가 처리가 가장 큰 걸림돌이 되는데 마침 이 책을 접하게 되었다. 이 책에서는 이 빅 데이터를 효과적으로 분석 및 처리하기 위한 도구인 Hadoop과 NoSQL(특히 HBase)에 대해서 설명하고 있다. 이 책에서는 단순히 Hadoop/NoSQL를 어떻게 사용하는냐에 대한 설명이 아니라 그 배경에 대한 설명도 함께 있기 때문에 처음 시작하는 입문자에게는 아주 적당한 책이 될 것이다. 물론 배경 지식과 사용법을 한권의 책에서 설명하기 때문에 좀 부족하다고 생각할 수도 있겠지만 ….. |
|
이책은 하둡시스템 구조 뿐만 아니라 비즈니스 활용 사례까지 다루고 다양한 주제를 다루고 있습니다. 개인적으로는 빅데이터 분석 업무에 관심이 많아 하둡 구축보다는 Ch.7 빅데이터 분석 편이 도움이 많이 되었습니다. 다만, 빅데이터 분석 부분은 챕터 한장으로 마무리되고 Mahout과 RHive에 한정된 설명이어서 아쉬움이 남네요. 하둡을 처음 접하고 전체적인 이해도를 높이는 용도라면 선택하셔도 좋을 것 같습니다. |
|
하둡과 그의 주변 친구들인 하이브,머하웃,지라프, NoSQL 등을 잘 버무려놓았다. 다른책에 없는 이 책의 특징으로는 R-HIVE 가 있다. R 은 데이타를 분석하기위한 툴이고 HIVE 는 데이타를 조작하기위한 도구이다. HIVE 를 통해서 좀더 큰 규모의 데이타를 분석하기위한 R-Hive 기술에 대해서 재밌게 읽었다. 다만 조금더 깊이있는 기술적 내용을 원했지만 이 책의 범위를 벗어나는것이다.. 하둡관련된 책중에서 그나마 가장 깊이있는 기술적 분석을 한 책은 하둡 difinition guide 가 유일한거 같다. 그리고 이책의 지라프와 머하웃관련된 섹션도 재밌게 읽었다. 지라프의 BSP 에 대해서 깊이있는 설명은 역시 없다. 역시 이 책의 범위를 벗어난다. 국산(?)인 하마와의 비교분석도 있었으면 더 좋을뻔 했다. |