통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

2
선형 회귀 분석에서 t- 검정과 분산 분석의 차이점
선형 회귀 분석에서 t- 검정과 분산 분석의 차이점이 무엇인지 궁금합니다. t-test는 기울기와 절편 중 하나가 평균 0을 갖는지 테스트하는 반면 ANOVA는 모든 기울기가 평균 0을 갖는지 테스트합니까? 이것이 그들 사이의 유일한 차이점입니까? 단순한 선형 회귀 분석에서, 즉 예측 변수가 하나만있는 경우 추정 할 기울기는 하나뿐입니다. 그렇다면 t- 검정과 분산 분석은 …

4
이진 시계열 예측
자동차가 움직이지 않을 때 1과 자동차가 움직일 때 0으로 이진 시계열이 있습니다. 최대 36 시간 전과 매 시간마다 수평선을 예측하고 싶습니다. 첫 번째 접근 방식은 t-24 (일별 계절), t-48 (주간 계절), 하루 중 시간을 사용하여 Naive Bayes를 사용하는 것입니다. 그러나 결과는 그리 좋지 않습니다. 이 문제에 대해 어떤 기사 나 …


1
종속 관측치에서 부트 스트랩을 통해 신뢰 구간 계산
표준 형태의 부트 스트랩은 관측치가 iid 인 경우 추정 된 통계의 신뢰 구간을 계산하는 데 사용할 수 있습니다. I. Visser et al. " 숨겨진 Markov 모델 매개 변수의 신뢰 구간 "에서 매개 변수 부트 스트랩을 사용하여 HMM 매개 변수의 CI를 계산했습니다. 그러나 관측 시퀀스에 HMM을 적용 할 때는 이미 혼합 …

2
자동차를 사용하여 반복 측정 ANOVA에 대한 특정 대비를 지정하는 방법은 무엇입니까?
R에서 Anova를 반복적으로 측정하고 그 데이터 세트에 대한 특정 대비를 수행하려고합니다. 올바른 방법은 Anova()자동차 패키지에서 사용하는 것이라고 생각합니다 . 데이터 를 ?Anova사용하여 얻은 예제로 내 질문을 설명 해 보겠습니다 OBrienKaiser(참고 : 예에서 성별 요인을 생략했습니다) : 우리는 주제 요인, 치료 (3 수준 : 통제, A, B) 및 2 반복 중 …

2
R에서 그래프에 여러 개의 바 플로트 그리기 [닫기]
닫은. 이 질문은 주제에 맞지 않습니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 교차 검증에 대한 주제가 되도록 질문을 업데이트하십시오 . 휴일 3 년 전 . R의 단일 그래프에 네 개의 막대 그래프를 플로팅하고 싶습니다. 다음 코드를 사용했습니다. 여기서 범례를 그래프 위에 유지하는 방법, 특히 범례는 2 ~ 3 …

1
가중 샘플에 대한 Quantile 정의
Quantile을 계산하려는 가중치 샘플이 있습니다. 1 가중치가 동일한 경우 (= 1이든 아니든) 결과는 scipy.stats.scoreatpercentile()R 과 동일 quantile(...,type=7)합니다. 간단한 방법 중 하나는 주어진 가중치를 사용하여 샘플을 "곱셈"하는 것입니다. 이는 중량이 1보다 큰 영역에서 국부적으로 "평평한"ecdf를 효과적으로 제공하는데, 이는 샘플이 실제로 서브 샘플링 일 때 직관적으로 잘못된 접근법처럼 보입니다. 특히, 가중치가 모두 …

2
요인 분석 의 첫 번째 요인은 무엇을 최대화합니까?
주성분 분석에서 첫 번째 kkk 주성분 은 최대 분산을 갖는 kkk 직교 방향입니다. 즉, 제 1 주성분은 최대 분산의 방향으로 선택되고, 제 2 주성분은 최대 분산을 갖는 제 1 방향과 직교하는 방향으로 선택된다. 요인 분석에 대한 유사한 해석이 있습니까? 예를 들어, 첫 번째 요인은 원래 상관 행렬 의 비대 각 …

9
통계적 방법에 대한 광범위하고 개념적 개요
시뮬레이션 / 예측 / 함수 추정 등에 대한 통계 분석의 가능성에 매우 관심이 있습니다. 그러나 나는 그것에 대해 많이 알지 못하며 수학 지식은 여전히 ​​상당히 제한적입니다. 저는 소프트웨어 공학의 중학교 학부생입니다. 나는 선형 회귀 및 다른 종류의 회귀, 베이지안 방법, 몬테 카를로 방법, 기계 학습 등 계속해서 읽는 특정 것들에 …



3
결과를 범주가 아닌 서수로 간주하면 무엇을 얻을 수 있습니까?
순서 변수와 범주 변수를 예측하는 방법에는 여러 가지가 있습니다. 내가 이해하지 못하는 것은이 구별이 어떻게 중요한지입니다. 주문을 취소하면 무엇이 잘못되었는지 분명히 알 수있는 간단한 예가 있습니까? 어떤 상황에서 중요하지 않습니까? 예를 들어, 독립 변수가 모두 범주 형 / 소수 형인 경우 차이가 있습니까? 이 관련 질문 은 독립 변수의 유형에 …

1
F- 검정의 표본 크기 공식?
F- 검정에 적용되는 Lehr의 공식과 같은 표본 크기 공식이 있는지 궁금합니다. t- 검정에 대한 Lehr의 공식은 이며, 여기서 는 효과 크기입니다 ( 예 : ). 이것은 로 일반화 될 수 있습니다. 여기서 는 유형 I 비율, 원하는 전력 및 단면 테스트를 수행하는지 또는 양면 테스트를 수행하는지에 따라 상수입니다.n=16/Δ2n=16/Δ2n = 16 …

2
R에서 공간 데이터 클러스터링
해수면 온도 (SST) 월간 데이터 집합이 있으며 비슷한 SST 패턴을 가진 지역을 탐지하기 위해 몇 가지 클러스터 방법을 적용하고 싶습니다. 1985에서 2009까지 실행되는 월간 데이터 파일 세트가 있으며 첫 번째 단계로 매월 클러스터링을 적용하고 싶습니다. 각 파일에는 약 50 %가 랜드이고 99.99 값이 NA 인 358416 포인트에 대한 그리드 데이터가 …
12 r  clustering  spatial 


당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.