통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

1
예측에서 휴일의 영향을 설명하는 방법
주간 계절성을 가진 상당히 예측 가능한 일일 시계열이 있습니다. 휴일이 없을 때 꽤 정확한 예측 (교차 유효성 확인으로 확인)을 제시 할 수 있습니다. 그러나 휴일이있을 때 다음과 같은 문제가 있습니다. 모든 역사적 공휴일이 0이지만 내 예측에 공휴일의 숫자가 0이 아닙니다. 이것은 실제로 주요한 문제는 아닙니다. 문제는 ... 공휴일에 발생하지 않는 …

3
조정 된 회귀 : 예측 변수 간의 * 제품 * 항을 계산하는 이유는 무엇입니까?
중재 된 회귀 분석은 종종 사회 과학에서 두 개 이상의 예측 변수 / 공변량 간의 상호 작용을 평가하는 데 사용됩니다. 일반적으로 예측 변수가 두 개인 경우 다음 모델이 적용됩니다. Y=β0+β1∗X+β2∗M+β3∗XM+eY=β0+β1∗X+β2∗M+β3∗XM+eY = β_0 + β_1*X + β_2*M + β_3*XM + e 중재 테스트는 (독립 변수 와 중재자 변수 의 곱) 이라는 …

2
2- 표본 비율 테스트에 lm 사용
선형 모델을 사용하여 잠시 동안 2- 표본 비율 테스트를 수행했지만 완전히 정확하지 않을 수도 있음을 깨달았습니다. 이항 군 + 항등 링크와 함께 일반화 선형 모형을 사용하면 풀링되지 않은 2- 표본 비율 테스트 결과가 정확하게 나타납니다. 그러나 선형 모델 (가우스 패밀리가있는 glm)을 사용하면 결과가 약간 다릅니다. 나는 이것이 R이 이항 대 …

2
랜덤 변수의 값 범위가 제한된 경우 어떻게 정규 분포를 로 얻을 수 있습니까?
와 묶인 값 범위를 갖는 임의의 변수가 있다고 가정 해 봅시다 . 여기서 는 최소값이고 는 최대 값입니다.b a baaabbbaaabbb I 같이 들었다 , 여기서 우리의 샘플 크기는, 우리의 샘플의 샘플링 수단 분포 인 정규 분포. 우리가 증가함에 따라 즉, 우리가 점점 더 가까이 정규 분포를 얻을 수 있지만, 같은 …

1
LASSO의 자유도에 대한 직감
Zou et al. "올가미의"자유도 " (2007)에 따르면, 0이 아닌 계수의 수는 올가미의 자유도에 대한 편견이없고 일관된 추정치 인 것으로 나타났습니다. 나에게는 약간의 직관이 아닌 것 같습니다. 회귀 모형이 있다고 가정합니다 (변수가 0 평균 인 경우). y=βx+ε.y=βx+ε.y=\beta x + \varepsilon. 의 무제한 OLS 추정값 이 라고 가정합니다 . 패널티 강도가 매우 …

4
블랙웰의 내기
Futility closet 에서 Blackwell의 내기 역설에 대해 읽었습니다 . 다음은 요약입니다. 두 개의 봉투 ( 및 E y)가 제공 됩니다. 봉투에는 임의의 금액의 돈이 포함되어 있지만 돈에 대한 분포에 대해서는 아무것도 모릅니다. 하나를 열고 돈이 얼마나 있는지 확인하고 ( x ) 선택해야합니다 : 봉투 E x 또는 E y ?이자형엑스ExE_x이자형와이EyE_y엑스xx이자형엑스ExE_x이자형와이EyE_y …


6
Brexit : 통계적으로 유의 한“탈출”이 있었습니까? [닫은]
폐쇄되었습니다 . 이 질문은 의견 기반 입니다. 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 이 게시물 을 편집 하여 사실과 인용으로 답변 할 수 있도록 질문을 업데이트하십시오 . 휴일 삼년 전에 . 이 포스트에서 우리는 인간 이라고 불리는 자연 현상에 대한 질문 을하여 투표를 세어 결정을 찾으려고 시도합니다 . 이 …


2
자신감 타원의 진정한 의미
95 % 신뢰 타원의 진정한 의미에 대해 읽으면서 나는 두 가지 설명을 접하는 경향이 있습니다. 데이터의 95 %를 포함하는 타원 위가 아니라 데이터의 분산을 설명하는 타원. 나는 정확하게 이해하고 있지는 않지만 새로운 데이터 포인트가 들어 오면 새로운 분산이 타원에 머무를 확률이 95 %라는 것을 의미하는 것 같습니다. 약간의 빛을 비출 …

2
첫 번째 실험의 95 % 신뢰 구간 내에서 반복 실험의 효과 크기는 어느 정도입니까?
랜덤 샘플링, 가우시안 모집단, 등분 산, P- 해킹 없음 등으로 이상적인 상황을 고수합시다. 1 단계. 두 표본 평균을 비교하는 실험을 실행하고 두 모집단 평균의 차이에 대한 95 % 신뢰 구간을 계산합니다. 2 단계. 더 많은 실험 (수천)을 실행합니다. 평균 간의 차이는 무작위 샘플링으로 인해 실험마다 다릅니다. 질문 : 2 단계에서 …


1
ACF 함수에 대한 신뢰 구간은 어떻게 계산됩니까?
예를 들어, R에서 acf()함수 를 호출하면 기본적으로 상관 관계를 표시하고 95 % 신뢰 구간을 그립니다. 코드를 보면을 호출 plot(acf_object, ci.type="white")하면 다음을 볼 수 있습니다. qnorm((1 + ci)/2)/sqrt(x$n.used) 화이트 노이즈 유형의 상한으로. 이 방법의 배후에있는 이론을 설명 할 수있는 사람이 있습니까? 왜 우리는 1 + 0.95의 qnorm을 얻은 다음 2로 나누고 …

4
Gradient Descent를 옵티 마이저로 사용하여 학습률을 체계적으로 조정하는 방법은 무엇입니까?
외부 / ML / DL 필드 Tensorflow를 기반으로 Udacity Deep Learning 과정을 시작했습니다. 과제 3 문제 4 수행; 다음 구성으로 학습 속도를 조정하려고합니다. 배치 크기 128 걸음 수 : 2 개의 에포크를 채우기에 충분 숨겨진 레이어의 크기 : 1024, 305, 75 가중치 초기화 : 표준에서 잘림 sqrt (2 / n)의 …

1
변수 선택과 모델 선택
따라서 변수 선택은 모델 선택의 일부라는 것을 알고 있습니다. 그러나 모델 선택은 정확히 무엇으로 구성됩니까? 다음 이상입니다 : 1) 모형의 분포를 선택하십시오 2) 설명 변수를 선택하십시오. 나는 Burnham & Anderson : AIC vs BIC 기사를 읽고 모델 선택에서 AIC와 BIC에 대해 이야기 하기 때문에 이것을 묻습니다 . 내가 '변수 선택'과 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.