통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

1
exp (계수)에서 Odds Ratio까지 및 Logistic Regression에서 요인에 대한 해석
나는 SAT 점수와 가족 / 민족적 배경에 대해 대학에 합격을 선형으로 회귀시켰다. 데이터는 허구입니다. 이것은 이미 답변 된 이전 질문에 대한 후속 조치입니다. 이 질문은 SAT 점수를 단순성으로 남겨 두는 경우 확률 비의 수집 및 해석에 중점을 둡니다. 변수는 Accepted(0 또는 1) 및 Background( "빨간색"또는 "파란색")입니다. 나는 "빨간색"배경의 사람들이 더 …
14 r  regression  logistic 

1
동일한 평균, 다른 분산
8 명의 러너가 레이스를한다고 가정 해 봅시다. 개별 실행 시간의 분포는 보통이며 각각 평균 111111 초입니다. 러너 1의 표준 편차는 가장 작고, 두 번째는 가장 작고, 세 번째는 가장 작으며, 8은 가장 큽니다. 두 가지 질문이 혼란 스럽습니다. (1) 첫 번째가 마지막을 이길 확률은 얼마입니까? (2) 누가 레이스에서 이길 가능성이 …

2
클러스터링을위한 Dirichlet 프로세스 : 레이블을 처리하는 방법?
Q : Dirichlet Process를 사용하여 데이터를 클러스터링하는 표준 방법은 무엇입니까? Gibbs 샘플링을 사용하면 샘플링 중에 클러스터가 나타나고 사라집니다. 게다가 사후 분포가 군집 재 표식에 변동이 없기 때문에 식별 가능성 문제가 있습니다. 따라서 우리는 어느 사용자의 클러스터인지를 말할 수 없지만 두 명의 사용자가 동일한 클러스터에 있다고 말할 수 있습니다 (즉, ).p(ci=cj)p(ci=cj)p(c_i=c_j) …

2
부트 스트랩 리샘플링에 가장 권장되는 교과서?
나는 단지 당신의 견해로는 부트 스트랩에 대한 최고의 책을 묻고 싶었습니다. 이것으로 반드시 개발자가 작성한 것을 의미하지는 않습니다. 다음 기준을 충족하는 부트 스트랩에 가장 적합한 교과서를 표시 할 수 있습니까? 적용 가능성, 강점 및 약점, 모델 선택의 중요성을 기술하는 기술에 대한 철학적 / 인식 론적 근거? 구현, 철학적 토대, 바람직하게는 …


2
신경망을 이용한 Q- 러닝에 관한 질문
에 설명 된대로 Q-Learning을 구현했습니다. http://web.cs.swarthmore.edu/~meeden/cs81/s12/papers/MarkStevePaper.pdf 약. Q (S, A) 다음과 같은 신경망 구조를 사용합니다. 활성화 시그 모이 드 동작 뉴런에 대한 입력, 입력 수 + 1 (모든 입력의 크기가 0-1 임) 출력, 단일 출력. Q- 값 M 개의 숨겨진 레이어 N 개 탐색 방법 임의 0 <rand () <propExplore …

1
“인자 분석의 기본 정리”는 PCA에 어떻게 적용됩니까? 또는 PCA 로딩은 어떻게 정의됩니까?
저는 현재 "인자 분석"(PCA)에 대한 슬라이드 세트를 사용하고 있습니다. 여기에서 분석에 들어가는 데이터의 상관 행렬 ( )을 인자 로딩 행렬 ( A )을 사용하여 복구 할 수 있다고 주장하는 "인자 분석의 기본 정리"가 도출됩니다 .RR\bf RAA\bf A R=AA⊤R=AA⊤\bf R = AA^\top 그러나 이것은 나를 혼란스럽게합니다. PCA에서 "인자 로딩"의 행렬은 데이터의 …

2
Welch t-test의 자유도보고
동일하지 않은 분산에 대한 Welch t- 검정 (Welch-Satterthwaite 또는 Welch-Aspin이라고도 함)은 일반적으로 정수 가 아닌 자유도를 갖습니다 . 테스트 결과를보고 할 때 이러한 자유도를 어떻게 인용해야합니까? 다양한 소스 *에 따르면 "표준 t 테이블을 컨설팅하기 전에 가장 가까운 정수로 내림하기 위해 기존의 것입니다."- 보수적 라운딩이 방향으로 의미가 ** 일부 오래된 통계 …



5
시계열 계량 경제학과 패널 데이터 계량 경제학의 차이점은 무엇입니까?
이 질문은 매우 순진하지만, 계량 경제학을 가르치는 방식이 시계열 데이터와 패널 데이터 방법간에 차이가있을 경우 매우 혼란스러워합니다. 시계열과 관련하여 공분산 고정, AR, MA 등과 같은 주제를 다루었습니다. 패널 데이터와 관련하여 고정 효과 대 임의 효과 (보다 일반적으로 계층 적 모델), 차이 형식의 토론 만 보았습니다. 차이 등 이러한 주제는 어떤 …

1
일관성있는 추정기의 정의가 왜 그런가? 일관성에 대한 대체 정의는 어떻습니까?
Wikipedia에서 인용 : 통계에서, 일관된 추정기 또는 무의식적으로 일관된 추정기는 추정기 (모수 의 계산을 계산하는 규칙)- 사용 된 데이터 포인트 수가 무한정 증가함에 따라 결과 추정치가 확률로 수렴되는 특성을 가짐 .θ ∗θ∗θ∗θ^*θ∗θ∗θ^* 이 문장을 정확하게 만들려면 θ∗θ∗\theta^* 를 추정하려는 실제 매개 변수의 값으로, θ^( S엔)θ^(에스엔)\hat\theta(S_n) 데이터의 함수로이 매개 변수를 추정하는 …

1
1 차 도함수가 0 인 동안 델타 방법을 사용하는 방법은 무엇입니까?
http://en.wikipedia.org/wiki/Delta_method Wikipedia 기사에서 g′(θ)g′(θ)g'(\theta) 가 존재하고 g′(θ)g′(θ)g'(\theta) 는 0이 아닌 것으로 가정했습니다 . √에 대한 점근 분포를 찾을 수 있습니까?n−−√(g(Xn)−g(θ))n(g(Xn)−g(θ))\sqrt{n}(g(X_n)-g(\theta)) 이 주어진g′(θ)g′(θ)g'(\theta)제로 일 수 있습니다?n−−√(Xn−θ)→dN(0,σ2)n(Xn−θ)→dN(0,σ2)\sqrt{n}(X_n-\theta) \stackrel{d}{\rightarrow} N(0,\sigma^2)

5
확산의 '균일 성'이 있습니까?
웹에서 검색했지만 도움이되는 항목을 찾을 수 없습니다. 나는 기본적으로 가치가 얼마나 '균등하게'분배되는지 측정하는 방법을 찾고 있습니다. AN, 마찬가지로 '균등' 과 같은 분산 분포 X : 및 "불균일" 분산 분포 Y 거의 동일한 평균 및 표준 편차 : 그러나 m (X)> m (Y)와 같은 균일도 m이 있습니까? 그렇지 않은 경우 이와 …

3
품목 반응 이론 대 확인 요인 분석
품목 반응 이론과 확인 요인 분석의 핵심, 의미있는 차이점이 무엇인지 궁금했습니다. 계산에 차이가 있음을 이해합니다 (항목 대 공분산, 로그 선형 대 선형에 중점을 둡니다). 그러나 이것이 상위 수준의 관점에서 이것이 무엇을 의미하는지 잘 모르겠습니다. 이는 일부 상황에서 IRT가 CFA보다 낫다는 것을 의미합니까? 아니면 약간 다른 최종 목적을 위해? 연구 문헌을 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.