통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

1
R의 NLS에 대한 적합 함을 읽는 방법은 무엇입니까?
nls ()의 출력을 해석하려고합니다. 이 게시물 을 읽었 지만 여전히 가장 적합한 방법을 이해하지 못합니다. 내 몸매에는 두 가지 출력이 있습니다. > summary(m) Formula: y ~ I(a * x^b) Parameters: Estimate Std. Error t value Pr(>|t|) a 479.92903 62.96371 7.622 0.000618 *** b 0.27553 0.04534 6.077 0.001744 ** --- Signif. …


8
p- 값이 정확히 1 (1.0000000) 인 경우 귀무 가설이 참이되도록 신뢰 구간 한계는 무엇이어야합니까? [닫은]
폐쇄되었습니다 . 이 질문에는 세부 사항이나 명확성 이 필요 합니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 이 게시물 을 편집 하여 세부 사항을 추가하고 문제점을 명확하게하십시오 . 휴일 6 개월 전 . 이것은 순전히 가상의 질문입니다. 매우 일반적인 설명은 이 사실이 아니며 샘플 크기의 문제 일뿐입니다.H0H0H_0 실제로는 정규 …

1
동일한 모형에서 두 모수 추정치가 크게 다른지 어떻게 테스트 할 수 있습니까?
나는 모델이있다 와이= xㅏ× z비+ 전자y=xa×zb+e y=x^a \times z^b + e 여기서 는 종속 변수이고, 와 는 설명 변수이고, 와 는 매개 변수이며 는 오류 항입니다. 와 의 모수 추정치 와 이러한 추정치의 공분산 행렬이 있습니다. 와 가 크게 다른지 어떻게 테스트 합니까?와이yy엑스xx지zzㅏaa비bb이자형eeㅏaa비bbaaabbb

11
정규 분포이지만 치우친 분포가 가우시안으로 간주됩니까?
이 질문이 있습니다. YouTube에서 하루에 소비 한 시간의 분포는 어떻게 생각하십니까? 내 대답은 아마도 정상적으로 분포되어 있고 매우 왼쪽으로 기울어 져 있다는 것입니다. 나는 대부분의 사용자가 평균 시간을 소비하고 일부 사용자가 압도적 인 고급 사용자이기 때문에 긴 꼬리를 보내는 하나의 모드가 있다고 생각합니다. 그게 정답입니까? 그 분포에 대해 더 나은 …


2
인과의 사다리에서 렁 2와 3의 차이점
유대 진주의 "이유서"에서 그는 원인의 사다리라고 부르는 것에 대해 이야기합니다. 이것은 본질적으로 다른 수준의 인과 추론으로 구성된 계층입니다. 가장 낮은 것은 관찰 된 데이터 (예 : 상관 관계, 조건부 확률 등)의 연관 패턴과 관련이 있으며, 다음은 개입에 중점을 둡니다 (데이터 생성 프로세스를 미리 지정된 방식으로 의도적으로 변경하면 어떻게됩니까?). 상반된 현상 …
12 causality 

1
승산 비의 메타 분석은 본질적으로 절망적인가?
최근 논문에서 Norton et al. (2018) [ 1 ] 상태[ 1 ][1]^{[1]} 각 모델마다 다른 임의의 스케일링 계수가 있기 때문에 승산 비 추정을 초래하는 통계 모델이 다른 설명 변수를 갖는 경우 동일한 연구에서 다른 승산 비를 비교할 수 없습니다. 서로 다른 샘플과 모델 사양이 다른 임의의 스케일링 계수를 가지기 때문에 …

1
하이퍼-엘 립소 이드 표면에서 균일하게 샘플링하는 방법 (일정한 Mahalanobis 거리)?
실제 다변량의 경우 평균에서 Mahalanobis 거리가 일정한 표면에서 점을 균일하게 샘플링하는 방법이 있습니까? 편집 : 이것은 방정식을 충족시키는 하이퍼 엘리스 포 이드 표면에서 균일하게 샘플링 지점으로 요약됩니다. (x−μ)TΣ−1(x−μ)=d2.(x−μ)TΣ−1(x−μ)=d2.(x-\mu)^T \Sigma^{-1}(x-\mu) = d^2. 더 정확하게 말하면, "균일하게" 는 하이퍼-표면의 각 영역 요소 가 동일한 확률 질량을 포함하도록 샘플을 의미 합니다.dAdAdA

1
GLM을 모델 평균화하기 위해 링크 또는 응답 척도로 예측을 평균화합니까?
"올바른"GLM의 응답 스케일에 대한 모델 평균 예측을 계산하려면? 링크 스케일에서 모델 평균 예측을 계산 한 다음 응답 스케일로 역변환하거나 예측을 반응 척도로 다시 변환 한 다음 모형 평균을 계산합니다. 모델이 GLM 인 경우 예측은 비슷하지만 같지 않습니다. 다른 R 패키지는 둘 다에 대한 옵션을 제공합니다 (기본값이 다름). 몇몇 동료들은 "모든 …

1
t-SNE에서 축의 의미는 무엇입니까?
나는 현재 t-SNE 수학 주위로 머리를 감싸려고합니다 . 불행히도, 여전히 만족스럽게 대답 할 수없는 질문이 하나 있습니다 : t-SNE 그래프에서 축의 실제 의미는 무엇입니까? 이 주제에 대한 프레젠테이션을하거나 출판물에 포함시킬 경우 : 축에 적절한 레이블을 어떻게 지정합니까? 추신 : 나는 이 Reddit 질문을 읽었 지만 거기에 주어진 대답 (예 : …

2
AIC와 BIC가 완전히 다른 모델을 선택할 수 있습니까?
1 개의 반응 변수와 6 개의 공변량으로 포아송 회귀 모델을 수행하고 있습니다. AIC를 사용하여 모형을 선택하면 모든 공변량 및 6 개의 교호 작용 항이있는 모형이 생성됩니다. 그러나 BIC는 공변량이 2 개이고 교호 작용 항이없는 모형이됩니다. 매우 유사한 두 가지 기준이 완전히 다른 모델 선택을 산출 할 수 있습니까?

3
여러 가지 (모두는 아님) 모수 적 가설 검정에서 랜덤 샘플링을 가정하는 이유는 무엇입니까?
Z, t 및 기타 여러 테스트는 데이터가 랜덤 샘플링을 기반으로하는 것으로 가정합니다. 왜? 실험적 연구를하고 있는데, 외부 연구보다 내부 타당성을 훨씬 더 중요하게 생각합니다. 따라서 전체 모집단에 대한 가설을 추론하지 않기로 동의했기 때문에 샘플이 약간 편향되어있을 수 있습니다. 그룹화는 여전히 임의적입니다. 즉, 편의를 위해 샘플 참가자를 선택하지만 무작위로 다른 그룹에 …

5
실험을 시작하기 전에 샘플 크기를 결정하거나 실험을 무기한 실행 하시겠습니까?
나는 몇 년 전에 통계를 연구하고 모든 것을 잊어 버렸으므로 이것들은 구체적인 것보다 일반적인 개념적 질문처럼 보일 수 있지만 여기에 내 문제가 있습니다. 전자 상거래 웹 사이트에서 UX 디자이너로 일하고 있습니다. 우리는 그것을 의심하기 시작한 몇 년 전에 만들어진 A / B 테스트 프레임 워크를 가지고 있습니다. 우리가 모든 결정을 …

3
선형성은 선형성이 유지됩니까?
고정 된 두 개의 시계열 프로세스가 있다고 상상해보십시오 .xt,ytxt,ytx_t,y_t 가요 , 또한 고정? ∀ α , β ∈ Rzt=αxt+βytzt=αxt+βytz_t=\alpha x_t +\beta y_t∀α,β∈R∀α,β∈R\forall \alpha, \beta \in \mathbb{R} 도움을 주시면 감사하겠습니다. MA 표현이 있으므로 예라고 대답합니다.

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.