통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A


2
곡선을 피팅 할 때 피팅 된 매개 변수에 대한 95 % 신뢰 구간을 어떻게 계산합니까?
하나의 매개 변수를 추출하기 위해 데이터에 곡선을 맞추고 있습니다. 그러나 그 매개 변수의 확실성이 무엇인지, % 신뢰 구간을 계산 / 표현하는 방법을 잘 모르겠습니다 .959595 지수 적으로 부패하는 데이터를 포함하는 데이터 세트에 대해 말하면, 각 데이터 세트에 곡선을 맞 춥니 다. 그런 다음 추출하려는 정보는 지수 입니다. 나는 t 의 …

4
최대 우도 추정 (MLE)과 베이 즈 정리 비교
베이지안 정리에서 이고 내가 읽고있는 책에서 는 가능성 ,하지만 난 그냥있어 가정 조건부 확률 의 주어진 , 그렇지? P(X|Y)의 X, Yp(y|x)=p(x|y)p(y)p(x)p(y|x)=p(x|y)p(y)p(x)p(y|x) = \frac{p(x|y)p(y)}{p(x)}p(x|y)p(x|y)p(x|y)xxxyyy 최대 우도 추정 시도는 극대화 오른쪽? 그렇다면 가 모두 임의의 변수 이기 때문에 혼란 스럽 습니다. 극대화하기 위해 그냥 찾을 수 있습니다 ? 또 하나의 문제는,이 2 …

3
데이터 불확실성을 기반으로 선형 회귀 기울기의 불확실성을 계산
데이터 불확실성 (아마도 Excel / Mathematica)을 기반으로 선형 회귀 기울기의 불확실성을 계산하는 방법은 무엇입니까? 예 : 데이터 포인트 (0,0), (1,2), (2,4), (3,6), (4,8), ... (8, 16)을 가지지 만 각 y 값은 불확실성 4. 내가 찾은 대부분의 함수는 점이 함수 y = 2x와 완벽하게 일치하기 때문에 불확실성을 0으로 계산합니다. 그러나 그림에 …


4
빅 데이터를 이용한 가설 테스트
빅 데이터로 가설 검정을 어떻게 수행합니까? 혼란을 강조하기 위해 다음 MATLAB 스크립트를 작성했습니다. 그것은 두 개의 임의의 계열을 생성하고 한 변수의 다른 선형 회귀 분석을 실행하는 것입니다. 서로 다른 임의의 값을 사용하여이 회귀 분석을 여러 번 수행하고 평균을보고합니다. 샘플 크기를 늘리면 평균 p- 값이 매우 작아지는 경향이 있습니다. 충분히 큰 …

2
완벽하게 분산 된 점 패턴에서 Moran의 I이 "-1"이 아닌 이유는 무엇입니까?
위키 백과가 잘못되었거나 이해가되지 않습니까? Wikipedia : 흰색과 검은 색 정사각형 ( "체스 패턴")이 완벽하게 분산되므로 Moran 's는 -1이됩니다. 흰색 사각형이 보드의 절반에 쌓이고 검은 사각형이 다른 사각형에 쌓이면 Moran 's는 +1에 가깝습니다. 정사각형 색상의 임의 배열은 Moran 's I에 0에 가까운 값을 제공합니다. # Example data: x_coor<-rep(c(1:8), each=8) y_coor<-rep(c(1:8), …

1
지수 랜덤 변수에 대한 달성 가능한 상관 관계
지수 분포 확률 변수 및 쌍에 대해 달성 가능한 상관 범위는 무엇이며 , 여기서 은 비율 매개 변수?X 2 ~ E x p ( λ 2 ) λ 1 , λ 2 > 0X1∼Exp(λ1)X1∼Exp(λ1)X_1 \sim {\rm Exp}(\lambda_1)X2∼Exp(λ2)X2∼Exp(λ2)X_2 \sim {\rm Exp}(\lambda_2)λ1,λ2>0λ1,λ2>0\lambda_1, \lambda_2 > 0

2
일별, 주별 및 연간 주기로 시간별 시계열 예측
주요 편집 : 지금까지 그들의 답변에 대해 Dave & Nick에게 큰 감사를 표하고 싶습니다. 좋은 소식은 내가 일할 루프가 있다는 것입니다 (배치 예측에 대한 Hydnman 교수의 게시물에서 빌린 원칙). 미해결 쿼리를 통합하려면 다음을 수행하십시오. a) auto.arima의 최대 반복 횟수를 늘리는 방법-많은 외인성 변수를 사용하면 auto.arima가 최종 모델에 수렴하기 전에 최대 …

2
이분산성 및 잔차 정규성
나는 아주 좋은 선형 회귀를 가지고 있다고 생각합니다 (대학 프로젝트를위한 것이므로 정말로 정확할 필요는 없습니다). 요점은 잔차 대 예측 값을 플롯하면 (내 교사에 따르면)이 분산의 힌트가 있습니다. 그러나 잔차의 QQ-Plot을 플롯하면 정규 분포가 분명합니다. 또한 잔차에 대한 Shapiro 검정의 값은 이므로 잔차가 실제로 정규 분포인지 의심 할 여지가 없습니다.피피p0.80.80.8 질문 …

1
테스트 대 테스트?
나는 테스트와 테스트 의 차이점이 무엇인지 정확히 파악하려고합니다 .z티티t지지z 내가 알 수있는 한 두 가지 테스트 클래스 모두 동일한 테스트 통계를 사용합니다. 비^− Cseˆ( b^)비^−씨se^(비^)\frac{\hat{b} - C}{\widehat{\operatorname{se}}(\hat{b})} 여기서 은 일부 샘플 통계이고 는 참조 (위치) 상수 (테스트의 특성에 따라 다름)이며 이 표준입니다. 오류 . C ^ SE ( B ) …

1
동적 요인 분석과 상태 공간 모델
R의 MARSS 패키지는 동적 요인 분석을위한 기능을 제공합니다. 이 패키지에서 동적 요인 모델은 특수한 형태의 상태 공간 모델로 작성되며 공통 추세가 AR (1) 프로세스를 따른다고 가정합니다. 이 두 가지 방법에 익숙하지 않기 때문에 두 가지 질문이 있습니다. 동적 계수 분석은 특수한 형태의 상태 공간 모델입니까? 이 두 방법의 차이점은 무엇입니까? …

1
로지스틱 회귀 모델 조작
다음 코드가 수행하는 작업을 이해하고 싶습니다. 코드를 작성한 사람은 더 이상 여기서 작동하지 않으며 거의 ​​완전히 문서화되지 않았습니다. " 그것은 베이지안 로지스틱 회귀 모델입니다 " bglm <- function(Y,X) { # Y is a vector of binary responses # X is a design matrix fit <- glm.fit(X,Y, family = binomial(link = …

3
신경망을 그래픽 모델로 수학적으로 모델링
신경망과 그래픽 모델을 수학적으로 연결하는 데 어려움을 겪고 있습니다. 그래픽 모델에서 아이디어는 간단합니다. 확률 분포는 그래프의 기울기에 따라 인수 분해되며, 일반적으로 전위는 지수 계열입니다. 신경망에 대한 동등한 추론이 있습니까? Restricted Boltzmann 기계 또는 CNN의 단위 (변수)에 대한 확률 분포를 에너지 또는 단위 간 에너지의 곱으로 나타낼 수 있습니까? 또한 확률 …

2
QQ 플롯 해석
다음 코드 및 출력을 고려하십시오. par(mfrow=c(3,2)) # generate random data from weibull distribution x = rweibull(20, 8, 2) # Quantile-Quantile Plot for different distributions qqPlot(x, "log-normal") qqPlot(x, "normal") qqPlot(x, "exponential", DB = TRUE) qqPlot(x, "cauchy") qqPlot(x, "weibull") qqPlot(x, "logistic") 로그 노멀에 대한 QQ 플롯은 weibull에 대한 QQ 플롯과 거의 같은 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.