통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

3
균일하게 분포되고 상관 된 난수 쌍 생성
특정 상관 관계로 임의의 숫자 쌍을 생성하고 싶습니다. 그러나 균일 변수의 선형 조합이 더 이상 균일하게 분포 된 변수가 아니기 때문에 두 정규 변수의 선형 조합을 사용하는 일반적인 방법은 여기서 유효하지 않습니다. 두 변수가 균일해야합니다. 주어진 상관 관계로 균일 한 변수 쌍을 생성하는 방법에 대한 아이디어가 있습니까?

2
최적화 : 통계에서 모든 악의 근원?
나는 전에 다음과 같은 표현을 들었다. "최적화는 통계에서 모든 악의 근원"입니다. 예를 들어이 스레드 의 최상위 답변은 모델을 선택하는 동안 너무 적극적으로 최적화 할 위험에 대한 설명입니다. 내 첫 번째 질문은 다음과 같습니다.이 인용문은 특히 누구에게 귀속됩니까? (예 : 통계 문헌에서) 내가 이해 한 바에 따르면,이 진술은 과적 합의 위험을 …

4
회의적이지만 수학을 싫어하는 독자를위한 추론
방금 통계 온라인 코스 소개의 일부인 통계적 추론 ( "비율과 평균 비교")에 대한 강의를 보았습니다. 자료는 항상 그렇듯이 나에게 의미가 없었습니다. (지금까지 나는이 물건들을 수십 번 보았을 것입니다. 나는 회의 론적 독자를 설득하는 문제를 심각하게 다루는 "기본 통계 -101"(점 추정, 추정 평가, 통계적 추론, 가설 검정, 연구 설계)에 관한 책을 …

3
GARCH 매개 변수를 해석하는 방법?
표준 GARCH 모델을 사용합니다 : rtσ2t=σtϵt=γ0+γ1r2t−1+δ1σ2t−1rt=σtϵtσt2=γ0+γ1rt−12+δ1σt−12\begin{align} r_t&=\sigma_t\epsilon_t\\ \sigma^2_t&=\gamma_0 + \gamma_1 r_{t-1}^2 + \delta_1 \sigma^2_{t-1} \end{align} 계수의 추정치가 다르므로 해석해야합니다. 따라서 좋은 해석이 궁금합니다. , γ 1 및 δ 1 은 무엇을 나타 냅니까?γ0γ0\gamma_0γ1γ1\gamma_1δ1δ1\delta_1 나는 것을 볼 일정 부분 같은 것입니다. 이것은 일종의 "주변 변동성"을 나타냅니다. γ 1은 과거의 충격에 조정을 …

5
상관 된 비정규 데이터 생성 방법
상관 된 비정규 데이터를 생성하는 방법을 찾는 데 관심이 있습니다. 따라서 공분산 (또는 상관) 행렬을 모수로 사용하고 근사치에 가까운 데이터를 생성하는 분포가 이상적입니다. 그러나 여기에 캐치가 있습니다. 제가 찾고자하는 방법은 다변량 왜도 및 / 또는 첨도를 제어 할 수있는 유연성을 가져야합니다. 나는 익숙한 Fleishman의 방법과 정규 변량의 거듭 제곱 방법의 …

1
이것이 R에서 lme4로 혼합 효과 모델을 분석 할 수있는 적절한 방법입니까?
불균형 반복 측정 데이터를 분석하도록 설정했으며, 대부분의 통계 패키지가 ANOVA (즉, 유형 III 제곱합)로이를 처리하는 방식이 잘못되었음을 읽었습니다. 따라서 혼합 효과 모델을 사용하여 이러한 데이터를 분석하고 싶습니다. 에서 혼합 모델에 대해 많이 읽었 R지만 여전히 R혼합 효과 모델에 익숙하지 않고 제대로 작동하고 있다고 확신하지 못합니다. 아직 "전통적인"방법으로 이혼 할 수는 …

2
McNemar의 검정과 조건부 로지스틱 회귀 분석의 관계
쌍으로 된 관측치에서 이진 반응 데이터의 모델링에 관심이 있습니다. 우리는 그룹에서 사전 사후 중재의 효과에 대해 추론하여 잠재적으로 여러 공변량을 조정하고 중재의 일부로 특별히 다른 훈련을받은 그룹에 의한 효과 수정이 있는지를 결정합니다. 다음과 같은 형식의 데이터가 제공됩니다. id phase resp 1 pre 1 1 post 0 2 pre 0 2 …

2
단계적 회귀는 모집단 r- 제곱의 편향 추정치를 제공합니까?
심리학 및 기타 분야에서 다음과 같은 단계적 회귀 형태가 종종 사용됩니다. 나머지 예측 변수를보고 (처음에는 모형에 없음) 가장 큰 r- 제곱 변화를 초래하는 예측 변수를 식별하십시오. r- 제곱 변화의 p- 값이 알파보다 작 으면 (일반적으로 .05) 해당 예측 변수를 포함시키고 1 단계로 돌아가십시오. 그렇지 않으면 중지하십시오. 예를 들어, SPSS 에서이 …

6
10 배 교차 검증을 위해 데이터 세트를 분할하는 방법
잠김 . 이 질문과 주제는 주제가 다르지만 역사적으로 중요하기 때문에이 질문과 답변은 잠겨 있습니다. 현재 새로운 답변이나 상호 작용을받지 않습니다. 이제 R데이터 프레임 (트레이닝)이 있습니다. 누구 든지이 데이터 세트를 무작위로 분할하여 10 배 교차 검증을 수행하는 방법을 말해 줄 수 있습니까?


5
KNN 대치 R 패키지
KNN 대치 패키지를 찾고 있습니다. 나는 대치 패키지 ( http://cran.r-project.org/web/packages/imputation/imputation.pdf )를보고 있었지만 어떤 이유로 든 KNN 대치 기능 (설명에서 예제를 따르더라도) 0 값을 대치하기 위해 (아래와 같이). 나는 둘러 보았지만 아직 무언가를 찾을 수 없으므로 좋은 KNN 대치 패키지에 대한 다른 제안이 있는지 궁금해하고 있습니까? 여 아래 코드에서-NA 값은 Knn …

3
중앙값의 표준 오차
정규 분포가 아닌 작은 표본의 경우 중간 값의 표준 오차를 측정하려면 다음 공식이 올바른가요? (파이썬을 사용하고 있습니다)? sigma=np.std(data) n=len(data) sigma_median=1.253*sigma/np.sqrt(n)


1
공감 자-정의
그의 책 M. 카츠에 따르면, 다 변수 분석 (섹션 1.2, 6 페이지), " 교란 요인이 위험 인자와 연관되어 인과 결과. 관련 "왜 교란 요인이해야 인과 결과와 관련? 혼란자가 결과와 관련 되는 것으로 충분 합니까?

4
R에서의 브랜트 테스트 [닫기]
닫은. 이 질문은 주제에 맞지 않습니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 교차 검증에 대한 주제가 되도록 질문을 업데이트하십시오 . 휴일 7 개월 전 . 순서 형 로지스틱 회귀 분석에서 병렬 회귀 가정을 테스트 할 때 몇 가지 방법이 있습니다. 나는 그래픽 방식 (Harrell의 책에 자세히 나와 있음)과 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.