통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

1
기울기 정규 분포에 대한 모수 추정치
스큐 노멀에 대한 공식 모수 추정치는 무엇입니까? 가능하다면 MLE 또는 Mom을 통한 파생도 훌륭 할 것입니다. 감사 편집 . 플롯으로 시각적으로 알 수있는 데이터 세트가 왼쪽으로 약간 기울어 져 있습니다. 평균과 분산을 추정 한 다음 적합도 검정을 수행하려고합니다 (모수 추정값이 필요한 이유). 나는 단지 비대칭을 추측해야한다고 생각하는 것이 맞습니까? 본인의 …

1
역변환 된 신뢰 구간
건너면서 이 토론 나는 다시 변환 된 신뢰 구간 규칙에 의문을 제기하고있다. 이 기사 에 따르면 로그 정규 확률 변수의 평균에 대한 공칭 적용 범위 역변환 CI는 다음과 같습니다. LCL(X)=exp(Y+var(Y) 유씨L ( X) = exp( Y+ var ( Y)2+ zvar ( Y)엔+ var ( Y)22 ( n - 1 )−−−−−−−−−−−−√) …

2
평균 상관 계수의 의의
면책 조항 :이 질문이 다른 질문과 너무 유사하다고 생각되면 병합하여 기쁩니다. 그러나, 나는 다른 곳에서 만족스러운 답변을 찾지 못했으며 (아직 의견을 제시하거나 찬성하는 "평판"을 얻지 못 했으므로) 새로운 질문을 직접하는 것이 최선이라고 생각했습니다. 내 질문은 이것입니다. 12 명의 인간 피험자 각각에 대해, 나는 독립 변수 X의 6 개 수준과 종속 …

3
최소 제곱이 나쁜 생각은 언제입니까?
I는 회귀 경우 : Y=Xβ+ε와이=엑스β+ε Y = X\beta + \varepsilon V[ε]=Id∈Rn×nV[ε]=나는디∈아르 자형엔×엔\mathbb{V}[\varepsilon] = Id \in \mathcal{R} ^{n \times n} 과 E[ε]=(0,…,0)이자형[ε]=(0,…,0)\mathbb{E}[\varepsilon]=(0, \ldots , 0) , 사용 할 때 βOLSβOLS\beta_{\text{OLS}} ,의 정규 방정식 추정 ββ\beta , 추정량에 대한 빈약 한 선택? 최소 제곱이 제대로 작동하지 않는 예를 찾으려고합니다. 따라서 이전 가설을 …

1
SurveyMonkey는 무작위가 아닌 샘플을 받는다는 사실을 무시합니까?
SurveyMonkey에는 모집단 규모에 따라 주어진 오차 한계 또는 신뢰 구간에 필요한 표본 크기를 파악하기위한 단계와 차트가 있습니다. SurveyMonkey 샘플 크기 이 차트는 단순히 무작위 표본을 얻지 못한다는 사실을 무시합니까? 설문 조사에 귀를 기울이는 사람들 만 얻을 수 있기 때문입니까? 이 질문을 입력하면 질문이 주관적인 것처럼 보이므로 제대로 묻지 않을 수 …

3
첫 번째 주요 컴포넌트는 클래스를 분리하지 않지만 다른 PC는 클래스를 분리합니다. 어떻게 가능합니까?
인스턴스를 두 개의 클래스로 분류하기 위해 감독 기계 학습에 사용되는 더 작은 변수 세트 (주요 구성 요소)를 얻기 위해 17 개의 정량 변수에 대해 PCA를 실행했습니다. PCA 후 PC1은 데이터 분산의 31 %를 차지하고 PC2는 17 %, PC3은 10 %, PC4는 8 %, PC5는 7 %, PC6은 6 %를 차지합니다. …

1
우도 비 검정과 Wald 검정은 R에서 glm에 대해 다른 결론을 제공합니다.
일반화, 선형 및 혼합 모델 에서 예제를 재현하고 있습니다. 내 MWE는 다음과 같습니다. Dilution <- c(1/128, 1/64, 1/32, 1/16, 1/8, 1/4, 1/2, 1, 2, 4) NoofPlates <- rep(x=5, times=10) NoPositive <- c(0, 0, 2, 2, 3, 4, 5, 5, 5, 5) Data <- data.frame(Dilution, NoofPlates, NoPositive) fm1 <- glm(formula=NoPositive/NoofPlates~log(Dilution), family=binomial("logit"), …

4
파이썬의 주성분 분석 및 회귀
SAS에서 수행 한 일부 작업을 Python으로 재현하는 방법을 찾으려고합니다. 다중 공선 성이 문제가되는 이 데이터 세트를 사용하여 Python에서 주요 구성 요소 분석을 수행하고 싶습니다. scikit-learn 및 statsmodels를 살펴 보았지만 출력을 가져 와서 SAS와 동일한 결과 구조로 변환하는 방법을 모르겠습니다. 우선, SAS를 사용할 때 SAS가 상관 관계 매트릭스에서 PCA를 수행하는 것처럼 …

3
어느 거리를 사용해야합니까? 예 : 맨해튼, 유클리드, 브레이 커티스 등
저는 지역 사회 생태학자가 아니지만 요즘에는 지역 사회 생태 데이터를 연구하고 있습니다. 이 거리의 수학을 제외하고 내가 이해할 수 없었던 것은 사용할 각 거리의 기준과 적용 가능한 상황입니다. 예를 들어, 카운트 데이터와 함께 무엇을 사용해야합니까? 두 위치 사이의 경사각을 거리로 변환하는 방법은 무엇입니까? 아니면 두 곳의 기온이나 강우? 각 거리에 …


1
컨볼 루션 신경망 교육
현재 컨볼 루션 신경망을 사용하여 얼굴을 인식하는 얼굴 인식 소프트웨어를 개발 중입니다. 나의 독서에 기초하여, 나는 컨볼 루션 신경망이 가중치를 공유하여 훈련하는 동안 시간을 ​​절약 할 수 있다는 것을 모았다. 그러나 어떻게 역 전파 (backpropagation)를 조정하여 컨볼 루션 신경망에서 사용될 수 있습니까? 역 전파에서, 이와 유사한 공식을 사용하여 가중치를 훈련시킵니다. …

3
통제 된 실험에서 숨어있는 변수의 어떤 예가 출판물에 있습니까?
이 논문에서 : 숨어있는 변수 : 몇 가지 예 Brian L. Joiner American Statistician Vol. 1981 년 11 월 35 일 35 호 227-233 Brian Joiner는 "무작위 화는 만병 통치약이 아니다"고 주장합니다. 이것은 다음과 같은 일반적인 진술과 상반됩니다. 잘 설계된 실험에는 독립 변수와 종속 변수 사이의 관찰 된 관계에 대한 …

4
불확실한 클래스 레이블 분류기
클래스 레이블이 연결된 인스턴스 집합이 있다고 가정 해 봅시다. 이러한 인스턴스가 어떻게 표시 되었는지 는 중요하지 않지만 클래스 멤버쉽은 얼마나 확실 합니다. 각 인스턴스는 정확히 하나의 클래스에 속합니다 . 각 클래스 멤버쉽의 확실성을 1에서 3까지의 명목 속성으로 정량화 할 수 있다고 가정합니다 (각각 불확실 함). 그러한 확실성 측정을 고려하는 분류 …

3
군집 솔루션을 평가하기위한 두 가우스 혼합 간의 거리
다른 클러스터링 방법을 비교하기 위해 빠른 시뮬레이션을 실행 중이며 현재 클러스터 솔루션을 평가하려고 시도 중입니다. 다양한 유효성 검사 메트릭 ( R의 cluster.stats () 에서 발견 됨)에 대해 알고 있지만 예상 클러스터 수가 실제 클러스터 수와 같으면 가장 잘 사용된다고 가정합니다. 원래 시뮬레이션에서 올바른 수의 클러스터를 지정하지 않은 경우 클러스터링 솔루션의 …

2
퍼셉트론에 대한 결정 경계 플롯
퍼셉트론 알고리즘의 결정 경계를 플롯하려고하는데 실제로 몇 가지 사항에 대해 혼란스러워합니다. 내 입력 인스턴스는 이며 기본적으로 2D 입력 인스턴스 ( x 1 및 x 2 ) 및 이진 클래스 대상 값 ( y ) [1 또는 0]입니다.[(x1,x2),y][(x1,x2),y][(x_{1},x_{2}), y]x1x1x_{1}x2x2x_{2}yyy 내 가중치 벡터는 입니다.[w1,w2][w1,w2][w_{1}, w_{2}] 이제 추가 바이어스 매개 변수 을 통합해야 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.