통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

3
베이지안 변수 선택-실제로 작동합니까?
나는 좋은 블로그 게시물 과 그 안에 연결된 논문에 따라 일부 베이지안 변수 선택을 가지고 장난감을 가지고 있다고 생각했습니다 . rjags (내가 꽤 신인 임) 에서 프로그램 을 작성하고 Exxon Mobil에 대한 가격 데이터 를 가져 왔으며 , 수익률 (예 : 팔라듐 가격)을 설명 할 수없는 것 및 SP500과 같이 …

2
금융 / 경제 연구에서 일정 간격의 시계열
금융 계량 경제학 연구에서는 매일의 데이터 형식을 취하는 재무 시계열 간의 관계를 조사하는 것이 매우 일반적 입니다. 변수는 종종 로그 차이를 취하여 으로 만들어집니다 . .LN ( P t ) - LN ( P t - 1 )나는( 0 )나는(0)I(0)ln( P티) − ln( Pt - 1)ln⁡(피티)−ln⁡(피티−1)\ln(P_t)-\ln(P_{t-1}) 그러나 일별 데이터는 매주 …

3
R에서 베이지안 분산 분석 및 회귀 분석을 어떻게 수행 하시겠습니까? [닫은]
닫은. 이 질문은 주제에 맞지 않습니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 교차 검증에 대한 주제가 되도록 질문을 업데이트하십시오 . 휴일 2 년 전 . 하나의 독립 변수, 하나의 종속 변수 및 범주 변수로 구성된 상당히 간단한 데이터 세트가 있습니다. 나는 aov()and 같은 잦은 테스트를 수행 한 경험이 …

3
파라 메트릭 및 비 파라 메트릭 부트 스트랩에 대한 질문
Kevin Murphy의 저서 " Machine Learning-A Probabilistic Perspective " 에서 상용 통계에 관한 장을 읽고 있습니다. 부트 스트랩 섹션은 다음과 같습니다. 부트 스트랩은 샘플링 분포를 근사화하는 간단한 Monte Carlo 기술입니다. 추정기가 실제 모수의 복잡한 함수 인 경우에 특히 유용합니다. 아이디어는 간단하다. 우리가 진정한 매개 변수를 안다면 , 우리는 많은 (말을 …

3
R의 부트 패키지에서 cv.glm의 비용 함수는 무엇입니까?
leave-one-out 방법을 사용하여 교차 유효성 검사를 수행하고 있습니다. 이진 응답이 있고 R의 부트 패키지와 cv.glm 함수를 사용하고 있습니다. 내 문제는이 기능의 "비용"부분을 완전히 이해하지 못한다는 것입니다. 내가 이해할 수있는 것은 추정 값을 1 또는 0으로 분류 해야하는지 여부, 즉 분류의 임계 값을 결정하는 함수입니다. 이 올바른지? 그리고 R의 도움으로이 함수를 …


2
방법 : 부트 스트랩을 통한 선형 회귀 예측 간격
부트 스트랩 을 사용 하여 선형 회귀 모델의 예측 간격 을 계산 하는 방법을 이해하는 데 어려움이 있습니다. 누군가 단계별 절차를 설명 할 수 있습니까? Google을 통해 검색했지만 실제로 의미가 없습니다. 모델 매개 변수의 신뢰 구간을 계산하기 위해 부트 스트랩을 사용하는 방법을 이해합니다.

1
웹 사이트를 순 방문자로 방문하는 사람은 권력 법을 준수합니까?
첫 번째 요소가 방문 횟수가 가장 많은 고유 IP에 의해 주어진 기간 동안 웹 사이트를 방문한 횟수가 있고 두 번째 요소가 두 번째가있는 고유 한 IP에 의한 방문 수인 순서 벡터가 있다고 가정하십시오. 최고 방문수 등. 사이트 당 변형이있을 수 있지만 일반적으로이 벡터의 모양에 가정 된 패턴이 있습니까? 예를 들어 …
14 web  power-law 

3
메타 분석의 장단점
나는 진화의 특정 연구 분야에 대한 메타 분석을 고려하고 있었지만, 더 나아 가기 전에 더 알고 싶습니다. 프로세스의 긍정과 부정은 무엇입니까? 예를 들어, 실용적인 실험이 필요하지는 않지만 (시간과 돈), 단점은 출판 편향 (더 흥미로운 결과가 출판 됨)이있을 것입니다. 통계 저널의 어떤 논문이 메타 분석의 장단점에 대해 논의하고 있습니까?

1
RandomForest-MDS 플롯 해석
나는 randomForest를 사용하여 8 가지 변수 (다른 신체 자세와 움직임)를 기반으로 6 가지 동물 행동 (예 : 서기, 걷기, 수영 등)을 분류했습니다. randomForest 패키지의 MDSplot 은이 출력을 제공하며 결과를 해석하는 데 문제가 있습니다. 나는 동일한 데이터에 대해 PCA를 수행했으며 PC1과 PC2의 모든 클래스 사이에서 이미 좋은 분리를 얻었지만 Dim1과 Dim2는 …

2
LME () 오류-반복 한계에 도달
교차 혼합 효과 모델을 지정할 때 상호 작용을 포함하려고합니다. 그러나 다음과 같은 오류 메시지가 나타납니다. Error in lme.formula(rate ~ nozzle, random = ~nozzle | operator, data = Flow) : nlminb problem, convergence error code = 1 message = iteration limit reached without convergence (10) 모델은 다음과 같습니다. 1. 3 가지 …

4
클러스터의 모양을 측정하는 방법?
이 질문은 잘 정의되지 않았지만 일부 클러스터는 타원형이거나 낮은 차원 공간에있는 반면 다른 클러스터는 비선형 모양 (2D 또는 3D 예)이 있습니다. 클러스터의 비선형 성 (또는 "모양") 측정 값이 있습니까? 2D 및 3D 공간에서는 클러스터의 모양을 보는 것이 문제가되지 않지만 더 높은 차원 공간에서는 모양에 대해 말하는 것이 문제가됩니다. 특히 볼록한 …

2
카운트 데이터를 독립 변수로 사용하면 GLM 가정을 위반합니까?
로지스틱 회귀 모델에 적합하면서 카운트 데이터를 공변량으로 사용하고 싶습니다. 내 질문은 : 음수가 아닌 계수를 세는 독립 변수로 사용하여 로지스틱 (및 일반적으로 일반화 된 선형) 모델에 대한 가정을 위반합니까? 나는 문헌에서 많은 양의 데이터를 결과로 사용하지만 공변량으로는 사용하지 않는 것에 관한 많은 참고 문헌을 발견했다. "NE Breslow (1996) 일반화 선형 …

2
가우스 RBF 커널에 대한 유한 차원 피쳐 공간이 없음을 증명하는 방법은 무엇입니까?
방사형 기저 함수 에는 유한 차원 피쳐 공간이없는H는일부되도록Φ:RN→H우리가K(X를,Y)=⟨Φ(X),Φ(Y)⟩?k(x,y)=exp(−||x−y||2)2σ2)k(x,y)=exp⁡(−||x−y||2)2σ2)k(x, y) = \exp(-\frac{||x-y||^2)}{2\sigma^2})HHHΦ:Rn→HΦ:Rn→H\Phi: \text{R}^n \to Hk(x,y)=⟨Φ(x),Φ(y)⟩k(x,y)=⟨Φ(x),Φ(y)⟩k(x, y) = \langle \Phi(x), \Phi(y)\rangle

1
이 시계열 리샘플링 방법이 문헌에 알려져 있습니까? 이름이 있습니까?
최근에 시계열을 다시 샘플링하는 방법을 찾고있었습니다. 긴 메모리 프로세스의 자동 상관을 거의 유지합니다. 관측 영역을 유지합니다 (예 : 다시 샘플링 된 일련의 정수는 여전히 일련의 정수입니다). 필요한 경우 일부 스케일에만 영향을 줄 수 있습니다. 길이 시계열에 대해 다음 순열 체계를 생각해 냈습니다 .2N2N2^N 빈 연속 관측의 쌍에 의해 시계열 (가 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.