25257번: Monty's Hall d개의 문이 있고 정확히 1개의 문에 상품이 존재한다. 참가자는 s개의 문을 선택한다. 그러면 사회자는, 참가자가 선택하지 않은 문 중에서 상품이 없는 문 e개를 랜덤하게 열어준다. 이제 참가자에게 다시 한번 s개의 문을 선택할 기회를 준다. 기존의 선택을 바꾸지 않아도 좋다. 최적의 전략으로 게임에 임할때, 참가자가 상품을 획득할 확률은? 여기서 s+e ---------------------------------------------------------------------------------------------------------------------------------------- 전체 문 개수가 d개이고, 선택한 s개의 문 중에서 x개는 유지하고,..
1. 몬티 홀 문제(monty hall problem) 극한탈출 시간의 딜레마(zero escape time dilemma) 플레이 중 흥미로운 문제가 등장했다. 갇혀진 밀실에 이산화탄소가 쏟아져 나오고 있다. 이 이산화탄소는 20분동안 나오는데, 산소마스크를 쓰지 않는다면 죽게될 위기에 처했다. 이제 10개의 로커함이 주어진다 이 로커함중 단 한 곳에만 산소마스크가 있다. 정확히 한 곳만 골라 열어볼 수 있다고 할때, 산소마스크가 당첨될 확률은? 당연히 $\frac{1}{10}$이다. 어느 한 곳을 선택했는데, 이제 사회자가 다음과 같은 제안을 한다. "나는 산소마스크가 어디에 있는지 알고 있다. 당신이 선택한 곳에 산소마스크가 존재한다면, 나는 나머지 9개의 문 중 8개의 문을 랜덤하게 열어줄 ..
1. 가중 절댓값 합(weighted absolute sum) $$f(x) = \sum_{i = 1}^{n} w_{i} | x - a_{i} | $$을 최소로 만드는 x는 무엇일까 잘 알지만 $f(x) = |x|$는 미분 불가능한 함수이다. 최적화를 위해서는 subgradient에 대해 알아야한다. https://hgmin1159.github.io/convex/firstorder2/ [First-Order Method] Part2. Subgradient MethodSubgradient Methodhgmin1159.github.io 여기가 설명이 잘 나와있긴 한데 어렵다 대충 일단 $f(x) = |x|$는 x > 0, x x = 0에서는 미분 불가능이다. 그래서 subgradient를 f'(x) = 1..
1. skewness(왜도) 실수 값을 가지는 확률 변수의 분포가 평균을 기준으로 얼마나 비대칭적인지를 나타내는 척도 양수, 0, 음수 혹은 정의되지 않음이 될 수 있다 수학적으로 확률변수 X의 3차 표준화 적률이다. $$E((\frac{X-\mu}{\sigma})^{3}) = \frac{1}{\sigma^{3}} E((X-\mu)^{3})$$ 여기서 $\sigma^{2} = E((X-\mu)^{2})$이므로, $$E((\frac{X-\mu}{\sigma})^{3}) = \frac{E(((X-\mu)^{3})}{E((X-\mu)^{2})^{3/2}}$$ 표본 왜도는 다음과 같이 정의된다. 2. 왼쪽으로 치우친 분포와 오른쪽으로 치우친 분포 아래 그림의 확률 분포를 보면 첫번째 그림은 왼쪽 값들이 가..
1. 왜 해야하는가? 원본 데이터의 값 범위가 크게 다를 경우, 일부 머신러닝 알고리즘에서는 정규화를 하지 않으면 목적 함수가 제대로 작동하지 않을 수 있습니다. 예를 들어, 많은 분류기(classifier)들은 두 지점 간의 유클리드 거리(Euclidean distance)를 계산합니다. 만약 어떤 특성(feature)이 매우 넓은 값의 범위를 가진다면, 이 거리 계산은 해당 특성에 의해 지배될 수 있습니다. 따라서 모든 특성의 값 범위를 정규화하여, 각 특성이 최종 거리 계산에 거의 비슷한 비중으로 기여하도록 하는 것이 중요합니다. 또한, 정규화를 적용하는 또 다른 이유는 경사 하강법(gradient descent)이 정규화를 통해 훨씬 더 빠르게 수렴하기 때문입니다. 정규화는 손실 함수에 정규..
0. 개요 조건부확률은 두 변수간의 상관정도를 측정해주는 통계적 해석을 제공하지만 데이터가 충분히 많아지더라도 이것이 인과관계를 가진다고 추론할 수는 없다. 조건부확률에 기반한 모형은 보통 확률분포 변화에 민감하다 무슨말이냐면 훈련된 모형에서 정확도가 매우 높더라도 테스트 모형에서 분포(데이터)가 조금이라도 변하면 성능이 떨어질 수 있다. 인과관계에 기반한 예측모형은 테스트할 때 데이터의 변화에 강건하여 성능변화가 거의 없다 조건부확률은 교란변수(중첩요인,confounding factor)의 영향에 의해 높게 측정될 수 있다 예를 들어 키가 클 수록 지능지수가 큰 경향이 있는데 일반적으로는 무관하다는 것을 안다 데이터 분석하면 저런 경향이 나오는데 나이라는 변수의 영향이 있어서 그렇다. 두 변수에 동시에..