2012년 1월 22일 일요일

Facebook에 NHibernate Group을 만들었습니다.

안녕하세요^^ 블로그로도 NHibernate 정보를 제공하기도 했는데, Facebook에 Group 기능이 있더군요. 이를 이용해서 Facebook에 NHibernate 그룹을 만들었습니다.

http://www.facebook.com/#!/groups/nhibernate.korea/

제가 관리하고 있고요, 신청하시는 분들은 모두 가입되도록 하겠습니다. 관심 있으신 분은 참여해주기 바랍니다.

한가지 더 – Google+ 에도 NHibernate Korea 서클을 만들었습니다.
둘 중 어떤 서비스가 더 좋을 지 몰라 우선 둘 다 만들어서 써보면서, 좋은 쪽으로 단일화해야 할 것 같습니다.

2012년 1월 14일 토요일

Visual Studio 11 Dev Preview를 위한 Resharper

Visual Studio 2010의 느려터진 속도에 절망의 세월을 보내고 있습니다만, 갑자기 Windows 8 Preview 와 더불어 Visual Studio 11 Dev Preview가 나와서 당장 설치해 봤습니다.
내부적으로는 .NET 4.5 기반이지만 .NET 4.0 에 설치되는 것을 보니, 버전 숫자에 의아하기도 하기도 하지만, 버전 구분을 자꾸 바꾸는 것이 좋지 않음을 경험으로 알고 있어서… “다행이다~” 를 외쳤습니다.

다음으로는 Visual Studio 11 을 실행하는 데 “우와” 엄청 빠르다… VS.NET 2010을 그냥 버리고 싶습니다…

그런데 한가지 제약이 있군요… 전 다른 건 몰라도 Resharper 가 없으면 코딩을 못합니다.
Resharper 의 조언이 없으면 불안하고, 색상이 달라지면 괜히 속성과 클래스가 헷갈리고 그렇습니다. ㅎㅎ

다행히 Resharper EAP 에서 Resharper 6.1.1 부터는 Visual Studio 11 Preview 도 지원하는군요.
다만 설치본이 아니라, 아래 화면처럼 Resharper for VS11 (.vsix) 를 다운 받으셔야 합니다.

Resharper_VS11_Download

설치 후 Visual Studio 11을 실행 시켰습니다… 결론적으로 Preview 임에도 Visual Studio 2010 보다 실행속도도 빠르고, 반응 속도도 빠르네요. 물론 영어와 한글버전의 차이도 있으려나 싶지만, 그래도 그렇지 Preview 가 더 빠르다는 게… 좀 그렇네요…

이제 저는 Visual Studio 11 Preview를 이용해 코딩합니다^^
Visual Studio 11 Dev Preview를 설치하신 분들은 한번 시도해보시길…

2012년 1월 13일 금요일

요즘 Issue 가 되는 빅데이터 분석에 대한 생각

지인이 빅데이터 분석 회사의 사장이고, 요즘 여러 매체에서도 “빅데이터” 라는 용어가 상당히 자주 등장하네요. 예전 Data Warehouse 나 ETL, OLAP 등의 용어가 이제는 너무 오래된 구식 용어가 된 느낌이네요^^

어쨌거나 “빅데이터” 라는게 직적적으로는 단순히 아주 많은 데이터를 의미하기도 하지만,

  • 얼마나 많은 데이터를 빠르고, 안정적으로 수집하고 관리하느냐
  • 원하는 분석 결과를 얼마나 효과적으로 추출할 수 있느냐?
  • 원하는 분석을 정의하기, 데이터 필터링 기능 등의 데이터 정제 기능
  • 분석 결과 리포팅 등의 보고서 기능

등을 필요로 하겠지요.

저야 이 분야에 대해, 아직까지는 DW 와 OLAP 수준을 벗어나지 못했습니다. 다만, 데이터 양이 기하급수적으로 늘었으니, 새로운 방법으로 데이터를 처리해야 하는 것에 이견이 있는 것이 아닙니다.

예전이나 지금이나 아주 많은 Data가 있더라도, 거기에서 의미있는 가설을 이용하여 의미있는 결과를 만들어 낼 수 있는 능력이 더 중요하다고 볼 수 있습니다.

그런 의미에서 제가 한 일 중에 기업의 모든 단위업무를 어떤 “고리” 를 이용하여, 업무들의 연속 흐름 즉 프로세스로 도출해 내는 Process Mining 도 여기에 해당합니다.

많은 데이타가 있을 수록 더 좋은 결과를 낼 수 있다고 생각할 수 있지만, 원하는 결과에 실제로 필요 없는 대량의 쓰레기 데이터는 그냥 쓰레기일 뿐이죠.

프로세스 시뮬레이터도 수 많은 Raw Data 를 생성하고, 이를 이용하여, 프로세스의 성능이나 적정 투입 리소스를 예측할 수 있습니다. 다만, 이 것도 목적에 따라, 기법에 따라 상당히 다른 결과를 산출합니다. 그걸 해석하고, 분석할 수 있는 능력이 중요하지요.

요즘 이슈가 되는 빅데이터는 이러한 기존 분석 방법을 뛰어넘는 것은 아니라 봅니다. Data를 다루기 위한 기법이 달라지고, 연산을 더 빠르고 하기 위한 알고리즘 등의 개선은 있어야 겠지만…

그리고, 요즘 빅데이터가 크기만을 뜻하는 게 아니라, 다양한 데이터 소스와 다양한 데이터 형식 (글, 이미지, 음성, 음악, 동영상 등) 를 뜻하기도 하니, 확실히 예전 DW 나 OLAP 하고는 다르지요.

전통적으로 데이터 분석에 유명한 SAS의 본부장이 쓴 글을 보면, 경계와 함께 데이터 분석의 중요한 점이 무엇인지 생각해 보게 합니다.

원문 : 빅데이터 분석, 자신감만으로 되나