통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A


2
설문지의 신뢰성 평가 : 차원, 문제가있는 항목 및 알파, 람다 6 또는 기타 색인 사용 여부?
실험에 참석 한 참가자의 점수를 분석하고 있습니다. 제품에 대한 참가자의 태도를 추정하기위한 6 가지 항목으로 구성된 설문지의 신뢰성을 추정하고 싶습니다. 모든 항목을 단일 스케일 (알파는 약 0.6)로 처리하고 한 번에 한 항목을 삭제하는 경우 (최대 알파는 약 0.72) Cronbach의 알파를 계산했습니다. 항목의 수와 기본 구성의 차원에 따라 알파가 과소 평가되거나 …

6
R 데이터 프레임에서 하나의 특정 중복 레코드를 제외한 모든 레코드를 제거하려면 어떻게합니까? [닫은]
닫은. 이 질문은 주제에 맞지 않습니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 주제를 다루 도록 질문을 업데이트하십시오.교차 검증에 대한 . 휴일 3 년 전 . 중복 ID가 포함 된 데이터 프레임이 있습니다. 중복 값이있는 레코드를 제거하고 최대 값을 가진 행만 유지하려고합니다. 따라서 다음과 같이 구조화됩니다 (다른 변수는 표시되지 …
16 r 

2
패널 / 세로 데이터를 사용하여 회귀 데이터를 표준화하는 것이 좋은 방법입니까?
일반적으로 계수를 올바르게 비교하기 위해 회귀 분석에서 독립 변수를 표준화합니다 (이렇게하면 동일한 단위 (표준 편차)를 갖습니다). 그러나 패널 / 세로 데이터를 사용하면 특히 계층 적 모델을 추정 할 때 데이터를 어떻게 표준화해야하는지 잘 모르겠습니다. 그것이 잠재적 인 문제가 될 수있는 이유를 보려면, 개인이 t = 1 , … , T …




2
Cohen의 d에 대한 신뢰 구간을 어떻게 계산합니까?
나는 메타 분석에 결과를 모으고 어떻게 작동하는지 확인하기 위해 회귀 계수 (t 통계량), 승산 비 및 평균 차이에 대한 Cohen의 d를 계산했습니다. 그러나 Stata에서는 Cohen d에 대한 신뢰 구간없이 이러한 결과를 풀링 할 수없는 것처럼 보이므로 제 질문은 어떻게 해결할 수 있습니까? 그것을 계산하는 방법이 있습니까, 아니면이 정보없이 Stata에 결과를 …
16 cohens-d 

4
군집 분석 가정
초보적인 질문에 대한 사과, 나는이 형태의 분석에 익숙하지 않으며 지금까지 원리에 대한 이해가 매우 제한적입니다. 다변량 / 단 변량 검정에 대한 많은 파라 메트릭 가정이 군집 분석에 적용되는지 궁금합니다. 클러스터 분석과 관련하여 읽은 많은 정보 소스는 가정을 지정하지 않습니다. 특히 관측의 독립성에 관심이 있습니다. 내 이해는이 가정 (예 : ANOVA …

4
카운트 데이터에 적합한 모델을 결정하기위한 전략
카운트 데이터와 함께 사용할 모델을 결정하기위한 적절한 전략은 무엇입니까? 나는 다중 레벨 모델로 모델링 해야하는 데이터를 계산 했으며이 사이트에서 버그 또는 MCMCglmm을 통해 가장 좋은 방법이라고 제안했습니다. 그러나 나는 여전히 베이지안 통계에 대해 배우려고 노력하고 있으며, 먼저 데이터를 일반 선형 모델로 맞추고 데이터의 중첩 구조를 무시해야한다고 생각했습니다 (그러므로 기대할 내용에 …

2
선형 모형에서 결과 집계 R
회귀 모델링은 종종 과학보다 "예술"이기 때문에 회귀 구조의 여러 반복을 테스트하는 경우가 종종 있습니다. "최상의"모델을 찾기 위해 이러한 여러 모델 실행의 정보를 요약하는 효율적인 방법은 무엇입니까? 내가 사용한 한 가지 접근 방식은 모든 모델을 목록에 넣고 해당 목록을 실행 summary()하는 것입니다.하지만 비교하는 더 효율적인 방법이 있다고 생각합니까? 샘플 코드 및 …
16 r  regression 

1
로그 정규 확률 변수의 상관
상관 계수가 ρ 인 및 X 2 정규 랜덤 변수가 주어지면 다음 로그 정규 랜덤 변수 Y 1 과 Y 2 사이의 상관 관계를 어떻게 찾을 수 있습니까?X1X1X_1X2X2X_2ρρ\rhoY1Y1Y_1Y2Y2Y_2 Y1=a1exp(μ1T+T−−√X1)Y1=a1exp⁡(μ1T+TX1)Y_1 = a_1 \exp(\mu_1 T + \sqrt{T}X_1) Y2=a2exp(μ2T+T−−√X2)Y2=a2exp⁡(μ2T+TX2)Y_2 = a_2 \exp(\mu_2 T + \sqrt{T}X_2) 이제 이고 X 2 = σ 1 Z …


4
ezANOVA에서 III 형 제곱합을 요청하는 인수를 포함시켜야합니까?
SPSS와 같은 통계 패키지에서 R로 통계 패키지를 전환하는 데 도움이되는 수단으로 R 용 ez 패키지를 개발했습니다. 다양한 분산 분석의 스펙을 단순화하고 SPSS와 유사한 출력 (효과 크기 및 가정 포함)을 제공함으로써 (희망적으로) 달성됩니다. 다른 기능들 중에서도). 이 ezANOVA()함수는 주로 래퍼 역할을 car::Anova()하지만 현재 버전의 ezANOVA()구현에서는 II 형 제곱합 만 구현하는 반면 …

4
통계 정보에 근거하여 잘못된 결정이 내려진 전쟁 이야기?
통계가 응용 과학이라고 말하는 것이 공평하다고 생각합니다. 평균과 표준 편차를 계산할 때 누군가가 그 숫자에 따라 몇 가지 결정을 내리려고하기 때문입니다. 좋은 통계학자가 되려면 샘플 데이터를 신뢰할 수 있고 관심있는 실제 데이터를 완전히 잘못 표시하는 통계 테스트가있을 때 "감지"할 수 있기를 바랍니다. 분석에 관심이있는 프로그래머가 되려면 빅 데이터 세트 통계와 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.