통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A


2
윌크스 정리와 유한 한 혼합으로 가우스 수를 찾는가?
독립적이고 동일하게 분포 된 일 변량 관측 값 와 x 가 어떻게 생성 되었는지에 대한 두 가지 가설 이 있다고 가정합니다 .엑스엑스x엑스엑스x : x 는 평균과 분산을 알 수없는 단일 가우스 분포에서 도출됩니다.H0H0H_0엑스엑스x : x 는 평균, 분산 및 혼합 계수가 알려지지 않은 두 가우스 혼합에서 도출됩니다.HㅏHㅏH_A엑스엑스x 만약 내가 제대로 …

2
모든 커뮤니티에 대해 개별 회귀 분석을 실행해야합니까? 아니면 커뮤니티가 집계 된 모델에서 제어 변수가 될 수 있습니까?
DV로 지속적인 자산 인덱스 변수를 사용하여 OLS 모델을 실행하고 있습니다. 내 데이터는 서로 가까운 지리적으로 근접한 3 개의 유사한 커뮤니티에서 집계됩니다. 그럼에도 불구하고 커뮤니티를 제어 변수로 사용하는 것이 중요하다고 생각했습니다. 결과적으로 커뮤니티는 1 % 수준에서 중요합니다 (t 점수 -4.52). 커뮤니티는 3 개의 다른 커뮤니티 중 1 개에 대해 1,2,3으로 코딩 …

8
죄수 역설
나는 운동을 받았고, 그것을 알아낼 수 없다. 죄수 역설독방에 갇힌 죄수 A, B, C 3 명이 같은 날 사형을 선고 받았지만, 국경일이 있기 때문에 총재는 사면을 인정하기로 결정했다. 수감자들은이 사실을 알고 있지만 처형 예정일까지 어느 쪽을 살려 줄지 알지 못할 것이라고 말했다. 죄수 A는 간수에게“나는 이미 다른 두 명의 죄수들이 …

3
on- 선과 on- 선의 이변 량 회귀 계수의 곱이 상관의 제곱과 동일한 이유는 무엇 입니까?
이고 이고 인 회귀 모델이 있는데 , 의 상관 계수가 있습니다.와이= a + b XY=a+bXY = a + bXa = 1.6a=1.6a = 1.6b = 0.4b=0.4b=0.4r = 0.60302아르 자형=0.60302r = 0.60302 경우 및 다음 주위 전환 방정식이된다 및 , 그것은 또한 갖는다 값 .엑스엑스X와이와이Y엑스= c + d와이엑스=씨+디와이X = c + dYc …


2
동일하지 않은 분산을 갖는 2- 표본 t- 검정에 대한 베이지안 대응은 무엇입니까?
불균형 분산 (웰치 검정)을 사용하는 2- 표본 t- 검정의 베이지안 대응 부분을 찾고 있습니다. 또한 Hotelling의 T 통계와 같은 다변량 검정을 찾고 있습니다. 참조 감사합니다. 다변량 사례의 경우 및 이 있다고 가정합니다 . 여기서 (resp z i )는 표본 평균, 표본 표준 편차 및 점 수에 대한 바로 가기입니다 . …

1
R에서 대규모 데이터 세트 처리-자습서, 모범 사례 등
저는 R의 대규모 데이터 세트에 대해 다양한 종류의 분석을 수행해야하는 R noob입니다. 언제 어떤 패키지를 사용할 것인지, 어떤 변환을 데이터에 적용 할 것인지 등 나는이 모든 것을 비판하고 체계적인 방법으로 정보를 제시하는 책 / 튜토리얼 / 안내서가 있는지 궁금합니다. 주변을 둘러 보거나 다른 출처의 정보를 온라인에서 수집하는 대신이 작업을 선호합니다. …
11 r  large-data 

1
R을 사용하여 개체 간 및 개체 내 대비를 사용하여 4 x 4 혼합 분산 분석을 수행하는 방법은 무엇입니까?
R의 초보자는 반복 측정 ANOVA로 어려움을 겪고 있습니다. 4 단계 ( '그룹'이라는 단일 변수로 코딩 됨)와 4 단계 (4 개의 개별 변수 'DV1', 'DV2', 'DV3으로 코딩 된 주제 요소)로 구성된 데이터 세트가 있습니다. ','DV4 '). 다음과 같은 목표가 있습니다. 전체 반복 측정 ANOVA를 실행하십시오. SPSS의 LMATRIX 명령에서와 같이 사용자 정의 …

2
의사 결정 트리 공간과 임의 포리스트의 MCMC 샘플링
임의 숲 의 모음입니다 의사 결정 트리 무작위로 (때로는 훈련 데이터를 포기할)와 각 트리를 구축하는 특정 기능을 선택하여 형성했다. 분명히 그들은 잘 배우고 일반화합니다. 의사 결정 트리 공간에 대한 MCMC 샘플링을 수행하거나 임의 포리스트와 비교 한 사람이 있습니까? MCMC를 실행하고 샘플링 된 모든 트리를 저장하는 데 계산 비용이 더 많이들 …

1
0으로 팽창 된 감마 회귀를위한 SAS NLMIXED 코드를 R로 변환
R에서 연속 응답 변수에 대해 0으로 부풀린 회귀를 실행하려고합니다. gamlss 구현을 알고 있지만 Dale McLerran이 개념적으로 조금 더 직관적 인이 알고리즘을 시도하고 싶습니다. 불행히도 코드는 SAS에 있으며 nlme와 같은 코드를 다시 작성하는 방법을 모르겠습니다. 코드는 다음과 같습니다. proc nlmixed data=mydata; parms b0_f=0 b1_f=0 b0_h=0 b1_h=0 log_theta=0; eta_f = b0_f + …
11 r  sas  gamlss 

2
주사위 굴림에 영향을 줄 수 있다고 말하는 심령을위한 테스트 디자인
자신의 마음을 사용하여 주사위 굴림을 제어 할 수 있다고 말하는 친구가 있다고 가정 해 봅시다 (예를 들어, 주사위가 생각하고있는 특정 수에 떨어질 가능성이 더 높습니다). 그가 실제로 이것을 할 수 있는지 확인하기 위해 과학적으로 엄격한 테스트를 어떻게 디자인 할 수 있습니까? (물론 그가 실제로 할 수는 없다고 생각하지만 테스트가 시작되기 …

2
Wilcoxon 서명 등급 테스트의 적절성
Cross Validated 아카이브에서 약간 찌르고 내 질문에 대한 답변을 찾지 못하는 것 같습니다. 내 질문은 다음과 같습니다. Wikipedia는 Wilcoxon 부호있는 순위 테스트 (내 질문에 약간 수정 됨)에 대해 세 가지 가정을 제공합니다. i = 1, ..., n에 대해 Zi = Xi-Yi라고하자. 차이 Zi는 독립적 인 것으로 가정된다. (a.) 각 Zi는 …

1
상관 관계가 거의없는 상관 관계가 높은 변수의 합과 차이에 대한 참조
종이에서 나는 내가 확률 변수 모델을 작성했습니다 와 보다는 와 효과적으로 할 때 발생하는 문제를 제거하는 와 높은 상관 관계하고 (그들은 내 응용 프로그램에있는 것처럼) 동일한 분산을 가지고 있습니다. 심판은 내가 참조를하기를 원한다. 쉽게 증명할 수는 있지만 응용 프로그램 저널은 간단한 수학 파생에 대한 참조를 선호합니다.X − Y X Y …

5
샘플에서 "왼쪽 눈"과 "오른쪽 눈"을 두 개의 다른 피사체로 사용할 수 있습니까?
내 데이터는 다음과 같습니다. 두 그룹의 환자가 있습니다. 각 그룹의 환자는 다른 유형의 안과 수술을 받았습니다. 각 그룹의 환자에 대해 5 개의 변수를 측정 하였다. 순열 테스트 또는 MANOVA를 사용하여 두 그룹 간의 변수를 비교하고 싶습니다. 수술을 한 눈은 실제로 분석에 중요하지 않습니다. 그러나, 예를 들어, 그룹 A의 환자 2는 …
11 sampling 

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.