통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

1
베이 즈 정리의 오용 예
이 수학 오버플로 커뮤니티 질문은 "비 수학적 상황에서 수학 이론의 적용을 포함하는 잘못된 주장의 예"를 요청하고 병리학 적으로 적용되는 수학의 매력적인 목록을 만들었습니다. 베이지안 추론의 병리학 적 사용에 대한 비슷한 예가 궁금합니다. 누구나 베이지안 방법을 사용하는 학문적 기사, 괴상한 블로그 게시물을 만난 적이 있습니다.
11 bayesian 

2
실제 머신 러닝에 관한 모든 것이 무엇입니까?
나는 기계 학습 (일부 통계)의 새로운 이민자이며, 학습 지식 (감독 / 감독되지 않은 학습 알고리즘, 관련 최적화 방법, 정규화, 일부 철학 (예 : 편향 분산 절충)?)입니다. 나는 실제 연습이 없으면 기계 학습에 대한 깊은 이해를 얻지 못할 것이라는 것을 알고 있습니다. 따라서 실제 데이터에 대한 분류 문제부터 시작합니다 (예 : …

1
ARMA 모델의 적합치
ARMA (p, q) 모델에 적합한 값이 계산되는 방식을 이해하려고합니다. ARMA 프로세스의 적합한 값과 관련하여 이미 여기에서 질문을 찾았지만 이해할 수 없었습니다. ARMA (1,1) 모델이있는 경우 Xt=α1Xt−1+ϵt−β1ϵt−1Xt=α1Xt−1+ϵt−β1ϵt−1X_t = \alpha_1X_{t-1}+\epsilon_t - \beta_1 \epsilon_{t-1} 매개 변수를 추정 할 수있는 (고정) 시계열이 제공됩니다. 이 추정치를 사용하여 적합치를 어떻게 계산합니까? AR (1) 모형의 경우 적합치가 …
11 arma 

2
무작위 절편 모델 대 GEE
랜덤 절편 선형 모형을 고려하십시오. 이것은 교환 가능한 작업 상관 행렬을 사용하는 GEE 선형 회귀와 같습니다. 예측 변수가 및 이고 이러한 예측 변수의 계수가 , 및 합니다. 랜덤 절편 모델의 계수에 대한 해석은 무엇입니까? 개별 수준에 있다는 점을 제외하고 GEE 선형 회귀와 동일합니까?x 3 β 1 β 2 β 3엑스1, …

3
ARIMA 개입 전달 기능-효과를 시각화하는 방법
저는 매월 시계열이 개입되어 있고이 개입이 결과에 미치는 영향을 수량화하고 싶습니다. 나는 시리즈가 다소 짧고 효과가 아직 끝나지 않았다는 것을 알고 있습니다. 자료 cds <- structure(c(2580L, 2263L, 3679L, 3461L, 3645L, 3716L, 3955L, 3362L, 2637L, 2524L, 2084L, 2031L, 2256L, 2401L, 3253L, 2881L, 2555L, 2585L, 3015L, 2608L, 3676L, 5763L, 4626L, 3848L, 4523L, …

3
통계의 미래
이 질문은 수학에서 해결되지 않은 질문에 대한 공개 강의에 앉아있을 때 나에게 일어났습니다. 아직 해결되지 않은 수학적 질문이 많다는 것은 잘 알려져 있습니다. 통계의 미해결 문제가 무엇인지 생각하게 만들었습니다. 이 주제를 구글 화하는 데 시간을 보낸 후에, 나는이 질문에 대해 상대적으로 자세한 논의가 없다고 생각합니다. 그래서 저는 사람들이 그것에 대해 …

1
Ising 모델의 깁스 샘플링
숙제 질문 : 1-d Ising 모델을 고려하십시오. 이라고하자 . 는 -1 또는 +1입니다.X 난x = ( x1, . . . 엑스디)엑스=(엑스1,...엑스디)x = (x_1,...x_d)엑스나는엑스나는x_i π( x ) ∝ e∑39나는 = 1엑스나는엑스나는 + 1π(엑스)∝이자형∑나는=139엑스나는엑스나는+1\pi(x) \propto e^{\sum_{i=1}^{39}x_ix_{i+1}} 대략 목표 분포 에서 샘플을 생성하도록 깁스 샘플링 알고리즘을 설계하십시오 .π( x )π(엑스)\pi(x) 내 시도 : …

1
“.632 규칙”에서 확률이 같지 않으면 어떻게됩니까?
이 질문은 ".632 규칙" 에 관한 질문에서 비롯된 것 입니다. 문제를 단순화하는 범위에서 user603의 답변 / 표기법을 특별히 언급하고 있습니다. 이 답변은 크기가 표본으로 시작하고, 수집 된 별개의 항목 에서 을 교체합니다 (콜). 샘플 가 N 의 특정 요소 과 다를 은N I t의 H S I m ( 1 …


1
도구 변수는 선택 바이어스를 어떻게 처리합니까?
도구 변수가 회귀에서 선택 바이어스를 어떻게 처리하는지 궁금합니다. 내가 씹고있는 예는 다음과 같습니다. 대부분 무해한 계량 경제학 에서 저자들은 병역과 후기 소득에 관한 IV 회귀에 대해 논의합니다. 문제는 "군 복무는 미래의 수입을 늘리거나 줄입니까?"입니다. 그들은 베트남 전쟁의 맥락에서이 질문을 조사합니다. 나는 군복 무를 무작위로 배정 할 수 없으며 이것이 인과 …

3
랜덤 효과 모델에서 정규화 기법을 사용할 수 있습니까?
정규화 기술에서는 올가미, 능선 회귀, 탄성 그물 등을 말합니다. 입원 환자 체류 기간이 예측되는 인구 통계 학적 및 진단 데이터를 포함하는 건강 관리 데이터에 대한 예측 모델을 고려하십시오. 일부 개인의 경우, 기준 기간 동안 상관 된 다수의 LOS 관찰 (즉, 하나 이상의 IP 에피소드)이 존재한다. 예를 들어 각 개인에 대한 …

2
실험을 다시 실행하여 웹 a / b 테스트의 유효성을 검사하십시오. 이것이 유효합니까?
며칠 전에 a / b 테스트 회사의 웹 세미나에서 상주 "데이터 과학자"가 실험을 다시 실행하여 결과를 확인해야한다고 설명했습니다. 전제 조건은 95 % 신뢰를 선택하면 오 탐지 확률이 5 % (1/20)라는 것입니다. 동일한 제약 조건으로 실험을 다시 실행하면 1/400이 있습니다 (이것이 0.05 ^ 2 = 1/400으로 결정되었다고 가정합니다) 이것이 유효한 진술입니까? …

1
지수 가족 분포에 대해 평균과 분산이 항상 존재합니까?
스칼라 랜덤 변수 가 pdf를 가진 벡터 매개 변수 지수 군에 속 한다고 가정합니다XXX fX(x|θ)=h(x)exp(∑i=1sηi(θ)Ti(x)−A(θ))fX(x|θ)=h(x)exp⁡(∑i=1sηi(θ)Ti(x)−A(θ)) f_X(x|\boldsymbol \theta) = h(x) \exp\left(\sum_{i=1}^s \eta_i({\boldsymbol \theta}) T_i(x) - A({\boldsymbol \theta}) \right) 여기서 θ=(θ1,θ2,⋯,θs)Tθ=(θ1,θ2,⋯,θs)T{\boldsymbol \theta} = \left(\theta_1, \theta_2, \cdots, \theta_s \right )^T 는 매개 변수 벡터이고 T(x)=(T1(x),T2(x),⋯,Ts(x))TT(x)=(T1(x),T2(x),⋯,Ts(x))T\mathbf{T}(x)= \left(T_1(x), T_2(x), \cdots,T_s(x) \right)^T 는 충분한 통계량입니다. 각 …


2
로지스틱 회귀 분석에서 범주의 영향과 해당 빈도를 시각화하는 가장 좋은 방법은 무엇입니까?
여론 조사 데이터를 사용하여 후보자 투표의 주요 예측 자에 대한 정보를 제시해야합니다. 관심있는 모든 변수를 사용하여 로지스틱 회귀 분석을 실행했지만이 정보를 제시하는 좋은 방법을 찾을 수 없습니다. 내 의뢰인은 효과의 크기 만 신경 쓰지 않고 효과의 크기와 그러한 속성을 가진 모집단의 크기 사이의 상호 작용에 대해서는 신경 쓰지 않습니다. 그래프에서 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.