통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

5
비모수 적 테스트 (예 : 순열 테스트)로 상호 작용 효과를 테스트하는 방법은 무엇입니까?
두 가지 범주 형 / 명목 형 변수가 있습니다. 각각은 두 개의 고유 한 값만 가질 수 있습니다 (따라서 총 4 개의 조합이 있습니다). 각 값 조합에는 일련의 숫자 값이 제공됩니다. 그래서 저는 4 개의 숫자를 가지고 있습니다. 그것을보다 구체적인하려면하자 우리는 내가 가진 말 male / female과 young / old와 …


2
회귀 : 왜 조건부 잔차 대신에 전체 잔차의 정규성을 테스트 합니까?
선형 회귀 분석에서 오류는 y의 예측 값에 따라 정규 분포로 가정된다는 것을 이해합니다. 그런 다음 잔차를 오류에 대한 일종의 프록시로 봅니다. 다음과 같이 출력을 생성하는 것이 좋습니다 . 그러나 각 포인트의 잔차를 가져 와서 단일 플롯으로 묶는 점이 무엇인지 이해하지 못합니다. 예측 된 각 y 값에서 정규 잔차가 있는지 여부를 …

2
치우침은 추정기 또는 특정 추정치의 속성입니까?
예를 들어, Observed 가 인구의 편향 ​​추정기 라는 것을 알고있는 학생들이 종종 있습니다 . 그런 다음 보고서를 작성할 때 다음과 같이 말합니다.R 2아르 자형2R2R^2아르 자형2R2R^2 "Observed 와 Adjusted 계산 했는데, 그것들이 매우 비슷해서 우리가 얻은 Observed 값 에서 약간의 편향만을 나타냅니다 ."R 2 R 2아르 자형2R2R^2아르 자형2R2R^2아르 자형2R2R^2 나는 일반적으로 …

1
신경망은 일반적으로 훈련 중에“킥 인”하는 데 시간이 걸립니까?
역 전파를 사용하여 분류를 위해 심층 신경망을 훈련하려고합니다. 특히, Tensor Flow 라이브러리를 사용하여 이미지 분류에 회선 신경망을 사용하고 있습니다. 훈련하는 동안 이상한 행동을 겪고 있으며 이것이 전형적인 것인지 또는 내가 잘못하고 있는지 궁금합니다. 그래서 내 컨볼 루션 신경망에는 8 개의 레이어 (5 컨볼 루션, 3 개의 완전히 연결된)가 있습니다. 모든 …

2
팻 핑거 분포
간단한 질문 : 지방 손가락 분포가 있습니까? 존재한다면 다른 이름을 가지고 있다고 확신합니다. 분석 함수로 공식화하는 방법을 모르겠습니다. 기존 버전을 찾거나 거대한 시뮬레이션보다 더 깨끗한 것으로 공식화하는 데 도움을 줄 수 있습니까? 주어진 숫자가 의도 한 목표 일 때 실제로 적중되는 숫자의 분포이지만, 단추가 손가락보다 훨씬 작기 때문에 근처의 단추가 …


3
카운트 데이터와 함께 사용하기에 가장 적합한 회귀 모델은 무엇입니까?
통계에 약간의 노력을 기울이고 있지만 뭔가 붙어 있습니다. 내 데이터는 다음과 같습니다. Year Number_of_genes 1990 1 1991 1 1993 3 1995 4 이제 데이터를 기반으로 특정 연도의 유전자 수를 예측할 수있는 회귀 모델을 만들고 싶습니다. 나는 지금까지 선형 회귀로 그것을했지만, 약간의 독서를 했으며이 종류의 데이터에 가장 적합한 선택은 아닌 것 …

3
종속 표본 t- 검정에 대한 코헨의 d
빠른 질문 : Cohen의 d는 의존적 샘플 t- 검정 (예를 들어, 샘플 전 / 후 시점에서 약물의 효능을 테스트하는 샘플 내 설계)에 대해 두 가지 다른 방법을 계산 한 것을 보았습니다. Cohen d에 대한 방정식의 분모에서 변화 점수의 표준 편차를 사용하여 d. Cohen d에 대한 방정식의 분모에서 사전 테스트 점수의 …

1
자동 상관 이진 시계열 모델링
이진 시계열 모델링에 대한 일반적인 접근 방법은 무엇입니까? 이것이 취급되는 종이나 교과서가 있습니까? 강력한 자기 상관 관계가있는 이진 프로세스를 생각합니다. AR (1) 프로세스의 부호와 같은 것은 0에서 시작합니다. 말 및 백색 잡음 . 그런 다음 의해 정의 된 이진 시계열 은 자기 상관을 보여 주며 다음 코드로 설명하고 싶습니다.엑스0= 0X0=0X_0 …

3
CLT에서 왜
하자 은 n → ∞ 일 때 평균 μ 및 분산 σ 2 &lt; ∞ 인 분포에서 독립적으로 관측됩니다.엑스1, . . . , X엔엑스1,...,엑스엔X_1,...,X_nμμ\muσ2&lt; ∞σ2&lt;∞\sigma^2 < \inftyn → ∞엔→∞n \rightarrow \infty 엔−−√엑스¯엔− μσ→ N( 0 , 1 ) .엔엑스¯엔−μσ→엔(0,1).\sqrt{n}\frac{\bar{X}_n-\mu}{\sigma} \rightarrow N(0,1). 이것이 왜 엑스¯엔~ N( μ , σ2엔) ?엑스¯엔∼엔(μ,σ2엔)?\bar{X}_n \sim …

1
Pareto 스무딩 중요도 샘플링 (PSIS-LOO) 실패 방지
최근에이 논문에서 설명하는 파레토 스무딩 중요도 샘플링 휴가 교차 검증 (PSIS-LOO)을 사용하기 시작했습니다. Vehtari, A., &amp; Gelman, A. (2015). 파레토는 중요도 샘플링을 완화했습니다. arXiv 프리 프린트 ( link ). Vehtari, A., Gelman, A., &amp; Gabry, J. (2016). leave-one-out 교차 검증 및 WAIC를 사용한 실제 베이지안 모델 평가. arXiv 프리 프린트 …

3
방향성 독립 변수에 의한 정규 분포 DV의 연관성 테스트?
정규 분포 종속 변수가 방향 분포 변수 와 연관되어 있는지에 대한 가설 검정이 있습니까? 예를 들어, 하루 중 시간 이 설명 변수 인 경우 (예 : 요일, 월 등의 항목이 관련이 없다고 가정) 11 시가 오전 1시 22 시간 보다 앞서고 2 시라 는 사실을 설명하는 방법 협회 시험에서 1am …

3
RBF SVM 사용 사례 (로지스틱 회귀 및 임의 포리스트)
지원 벡터 기계 와 방사형 기본 기능 커널은 범용이 분류를 감독이다. 이러한 SVM에 대한 이론적 기초와 장점을 알고 있지만 이들이 선호되는 방법에 대해서는 알지 못합니다. 그렇다면 RBF SVM이 다른 ML 기술보다 우월한 문제가 있습니까? (점수 또는 기타 견고성, 시작하기 쉬움, 해석 가능성 등) 기본 접근 방식은 로지스틱 회귀 (아마도 일부 …

2
통계 문헌에서 II 형 오류가 강조되지 않는 이유는 무엇입니까?
다양한 연구 기사에서 유형 I 오류가 (알파 값으로 표시) 설명되는 많은 경우를 보았습니다. 나는 연구원이 힘 또는 타입 II 오류를 고려하는 경우는 드물다. 유형 II 오류가 큰 문제 일 수 있습니까? 우리는 대체 가설이 실제로 거짓 일 때 우연히 거부했다. 베타 값 대신 알파 값이 강조되는 이유는 무엇입니까? 첫해 통계를봤을 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.