통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

1
오프셋이있는 포아송 랜덤 효과 모델의 과대 산포 및 모델링 대안
개체 내 실험을 사용하여 실험 연구의 카운트 데이터를 모델링 할 때 여러 가지 실용적인 질문에 부딪 쳤습니다. 실험, 데이터 및 지금까지 수행 한 작업에 대해 간단히 설명하고 질문을합니다. 응답자의 샘플에 4 개의 다른 영화가 순서대로 표시되었습니다. 각 영화가 끝난 후 인터뷰를 진행하여 RQ에 관심이있는 특정 진술 (예측 카운트 변수)의 발생 …

1
기본 lme4 옵티마이 저는 고차원 데이터에 대해 많은 반복이 필요합니다
TL은, DR은 : lme4최적화 기본적 모델 파라미터의 수에 선형으로 나타날 것이다 방법 등가보다 느리게 glm그룹 더미 변수 모델. 속도를 높이기 위해 할 수있는 일이 있습니까? 상당히 큰 계층 적 로짓 모델 (~ 50k 행, 100 열, 50 그룹)을 맞추려고합니다. 일반 로짓 모델을 데이터에 그룹화하면 (그룹에 더미 변수가 있음) 제대로 작동하지만 …

2
가 확률 밀도 함수일 때 를 찾는 방법 은 무엇입니까?
이 문제를 어떻게 해결할 수 있습니까? 중간 방정식이 필요합니다. 아마도 대답은 입니다.−tf(x)−tf(x)-tf(x) ddt[∫∞txf(x)dx]ddt[∫t∞xf(x)dx] \frac{d}{dt} \left [\int_t^\infty xf(x)\,dx \right ] f(x)f(x)f(x) 는 확률 밀도 함수입니다. 즉, 및 \ lim \ limits_ {x \ to \ infty} F (x) = 1limx→∞f(x)=0limx→∞f(x)=0\lim\limits_{x \to \infty} f(x) = 0limx→∞F(x)=1limx→∞F(x)=1\lim\limits_{x \to \infty} F(x) = 1 출처 …

3
신뢰 수준을 선택하는 방법?
나는 종종 90 % 신뢰 수준을 사용하는데, 이것이 95 % 또는 99 %보다 더 큰 불확실성을 가지고 있다는 것을 인정합니다. 그러나 올바른 신뢰 수준을 선택하는 방법에 대한 지침이 있습니까? 또는 다른 분야에서 사용되는 신뢰 수준에 대한 지침? 또한 신뢰 수준을 해석하고 제시 할 때 숫자를 언어로 바꾸는 가이드가 있습니까? 예를 …

1
'가설 테스트'와 '모델 선택'의 차이점은 무엇입니까?
문헌에서 두 용어는 종종 동의어 또는 짜여져 사용됩니다. 나는 지금 두 용어 사이에 분명한 차이점을 찾으려고 노력하고 있습니다. 내 관점에서 가설은 일반적으로 모델을 통해 표현됩니다. 따라서 우리는 귀무 가설 대 대안 가설을 검정하더라도 내 관점에서 모델 선택을 수행합니다. 누군가이 차이점에 대해 직관적으로 설명 할 수 있습니까?

3
실험 설계의 잠재적 혼란
질문 개요 경고 :이 질문에는 많은 설정이 필요합니다. 저를 참아주세요. 저의 동료와 저는 실험 설계를하고 있습니다. 디자인은 많은 제약 조건을 해결해야하며, 아래에 나열합니다. 나는 제약 조건을 만족시키고 관심의 영향에 대한 편견없는 추정치를 제공하는 디자인을 개발했습니다. 그러나 저의 동료는 디자인에 혼란이 있다고 생각합니다. 우리는이 요점을 메스꺼움으로 해결하지 않고 논란을 일으켰으므로이 시점에서 …

1
무작위 로지스틱 회귀 분석과 일반 바닐라 로지스틱 회귀 분석의 차이점
나는 사이의 차이점을 알고 싶습니다 무작위 로지스틱 회귀 (RLR) 및 일반 로지스틱 회귀 나는 종이 읽고있다, 따라서 (LR)를 "안정성 선택" 으로 등, Meinshausen. ; 그러나 나는 RLR이 무엇이며 RLR과 LR의 차이점이 무엇인지 이해하지 못합니다. 누군가 RLR을 이해하기 위해 읽어야 할 것을 지적 할 수 있습니까? 아니면 간단한 예가 있습니까?

2
분산 분석의 정규성 가정에서 출발 : 첨도 또는 왜도가 더 중요합니까?
Kutner 등의 응용 선형 통계 모델. ANOVA 모델의 정규성 가정에서 벗어난 것과 관련하여 다음과 같이 설명 합니다. 오차 분포의 첨도 (정규 분포보다 많거나 적은 피크)는 추론에 미치는 영향 측면에서 분포의 왜도보다 중요합니다 . 나는이 진술에 약간 당황하고 책이나 온라인에서 관련 정보를 찾지 못했습니다. 또한 꼬리가 두꺼운 QQ- 플로트는 선형 회귀 …


1
던의 시험 결과를 읽는 방법?
Dunn의 테스트 결과를 어떻게 읽 습니까? 구체적으로, 아래 표의 값은 무엇을 알려줍니까? 나는 4 개의 그룹으로 비모수 적 데이터를 가지고 있으며, 그룹의 분포가 서로 다르고 집계 데이터 세트와 다른지 확인하기 위해 먼저 Kruskal-Wallis 테스트를 수행했습니다. 그런 다음 Dunn의 테스트를 사용하여 서로 다른 그룹과 그렇지 않은 그룹을 확인했습니다. library(dunn.test) dunn.test(data, g=area, …




1
R에서 회귀 스플라인이있는 로지스틱 회귀
영국의 두부 외상 데이터베이스에 대한 소급 데이터를 기반으로 로지스틱 회귀 모델을 개발하고 있습니다. 주요 결과는 30 일 사망률입니다 ( "생존"척도로 표시). 이전 연구 결과에 중대한 영향을 미친다는 증거가 발표 된 다른 조치는 다음과 같습니다. Year - Year of procedure = 1994-2013 Age - Age of patient = 16.0-101.5 ISS - …

1
MCMC에서 자기 상관 플롯을 해석하는 방법
나는 "강아지 책"이라고도 알려진 John K. Kruschke의 Doing Bayesian Data Analysis 책을 읽음으로써 베이지안 통계에 익숙해 졌다. 9 장에서는 계층 모델이 간단한 예 도입 및 베르누이 관측치는 3 개의 동전이며, 각각 10 회 뒤집습니다. 하나는 9 헤드, 다른 하나는 5 헤드 및 다른 하나는 1 헤드를 보여줍니다.와이j 나는θ제이μκ~ B e …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.