통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

2
MCMC 조회 및 실행
적중을 구현하고 MCMC 알고리즘을 실행하려고하는데 그 방법을 이해하는 데 약간의 어려움이 있습니다. 일반적인 아이디어는 다음과 같습니다. MH에서 제안 점프를 생성하기 위해 : 단위 구의 표면에 대한 분포에서 방향 를 생성합니다.dddOO\mathcal{O} 제한된 공간을 따라 부호있는 거리 를 생성합니다 .λλ\lambda 그러나 R (또는 다른 언어)로 이것을 구현하는 방법을 모릅니다. 누구든지 올바른 방향으로 …
16 r  bayesian  mcmc 

1
로지스틱 회귀-다중 공선 성 문제 / 함정
로지스틱 회귀 분석에서 OLS 회귀 분석과 마찬가지로 다중 공선성에 대해 우려 할 필요가 있습니까? 예를 들어, 다중 공선 성이 존재하는 로지스틱 회귀 분석을 사용하면 베타 계수에서 추론 할 때주의해야합니다 (OLS 회귀 분석에서와 같이)? OLS 회귀 분석의 경우 높은 다중 공선성에 대한 하나의 "수정"은 능선 회귀입니다. 로지스틱 회귀 분석과 같은 것이 …

4
리소스 집약적 컴퓨팅을 위해 누가 R을 멀티 코어, SNOW 또는 CUDA 패키지와 함께 사용합니까?
이 포럼에서 여러분은 멀티 코어 , 스노우 패키지 또는 CUDA 와 함께 "> R을 사용 하므로 워크 스테이션 CPU보다 더 많은 전력을 필요로하는 고급 계산을 위해서는 어떤 하드웨어에서 이러한 스크립트를 계산합니까? 어딘가에 데이터 센터 액세스? 이러한 질문의 배경은 다음과 같습니다. 저는 현재 M.Sc를 작성하고 있습니다. R과 고성능 컴퓨팅에 관한 논문이며 …

3
PCA 점수 해석
누구든지 PCA 점수를 해석하는 데 도움을 줄 수 있습니까? 내 데이터는 곰에 대한 태도에 관한 설문에서 나온 것입니다. 로딩에 따르면, 나는 주요 구성 요소 중 하나를 "곰 공포"로 해석했습니다. 해당 주요 구성 요소의 점수가 각 응답자가 해당 주요 구성 요소까지 측정하는 방식과 관련이 있습니까 (긍정적이든 부정적이든).
16 pca 

3
R에서 barplot의 막대에 값을 넣는 방법 [닫기]
닫은. 이 질문은 주제에 맞지 않습니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 교차 검증에 대한 주제가 되도록 질문을 업데이트하십시오 . 휴일 육년 전 . 이 질문은 이전 질문 과 관련이 있습니다. 막대 그래프에서 막대 위에 값을 넣고 싶습니다. 나는 R에서 음모를 꾸미는 초보자입니다.

3
시계열에 가장 적합한 통계 검정은 무엇입니까?
정기적으로 데이터 세트당 5-10 개의 데이터 포인트가있는 간단한 시계열이 있습니다. 두 데이터 세트가 다른지 여부를 결정하는 가장 좋은 방법이 무엇인지 궁금합니다. 각 데이터 포인트에서 t- 검정을 시도하거나 곡선 아래의 영역을보아야합니까, 아니면 더 잘 작동하는 다변량 모델이 있습니까?

5
평균 절대 편차 및 큰 데이터 세트를위한 온라인 알고리즘
나는 나를 놀리 게 만드는 약간의 문제가 있습니다. 다변량 시계열의 온라인 획득 프로세스에 대한 절차를 작성해야합니다. 매 시간 간격 (예 : 1 초)마다 기본적으로 N 크기의 부동 소수점 벡터 인 새 샘플을 얻습니다. 수행해야하는 작업은 약간 까다 롭습니다. 각각의 새 샘플에 대해 요소를 1로 합치도록 벡터를 정규화하여 해당 샘플의 백분율을 …

7
"가장 적합"및 교차 검증이라는 용어에 사용 된 "최고"의 정의는 무엇입니까?
비선형 함수를 점 집합에 맞추는 경우 (각 가로 좌표마다 세로 좌표가 하나만 있다고 가정) 결과는 다음 중 하나 일 수 있습니다. 잔차가 적은 매우 복잡한 함수 잔차가 큰 매우 간단한 함수 교차 검증은 일반적으로이 두 극단 사이의 "최상의"타협점을 찾는 데 사용됩니다. 그러나 "최고"는 무엇을 의미합니까? "가장 가능성이 높습니까?" 가장 가능성있는 …

5
분산 분석 가정 확인
몇 달 전에 나는 R on SO의 homoscedasticity 테스트에 관한 질문을 게시했으며 Ian Fellows는 다음과 같이 대답했습니다. Homocedasticity 테스트는 모델의 적합도를 테스트 할 때 좋은 도구가 아닙니다. 작은 표본의 경우 동종이 변성에서 이탈을 감지하기에 충분한 검정력이없고 큰 표본의 경우 "충분한 검정력"이 있으므로 평등에서 사소한 이탈까지도 선별 할 가능성이 높습니다. 그의 …

3
비모수 반복 측정 R에서 다 방향 Anova?
다음 질문은 한동안 저를위한 성배 중 하나입니다. 누군가 좋은 조언을 해 줄 수 있기를 바랍니다. R을 사용하여 비모수 반복 측정 multiway anova를 수행하고 싶습니다. 나는 한동안 온라인 검색과 독서를 해왔으며 지금까지 일부 경우에 대한 해결책을 찾을 수있었습니다. anova 등. 부분 솔루션은이 질문 스레드에서 찾고있는 것이 아닙니다. 내가 몇 시간 전에 …

1
EM, 직관적 인 설명이 있습니까?
EM 절차는 초기에 거의 흑 마법으로 나타납니다. 감독 된 데이터를 사용하여 HMM의 매개 변수를 추정하십시오 (예 :). 그런 다음 태그가없는 것처럼 'count'이벤트를 앞뒤로 사용하여 태그가 지정되지 않은 데이터를 디코딩합니다. 이것이 왜 모델을 더 좋게 만드는가? 나는 수학에 대해 뭔가를 알고 있지만, 어떤 종류의 수학 그림을 계속 희망하고 있습니다.

4
손실 기능에 대한 포괄적 인 개요?
기계 학습의 필수 아이디어 중 일부에 대한 세계적 관점을 얻으려고 노력하고 있으며 손실의 다른 개념 (제곱, 로그, 힌지, 프록시 등)에 대한 포괄적 인 처리가 있는지 궁금합니다. 나는 Loss Function Semantics 에 관한 John Langford의 훌륭한 포스트에 대한보다 포괄적이고 공식적인 발표를 통해 무언가를 생각하고있었습니다 .

2
GLM에 적합 할 때 Fisher 점수 사용에 대해 왜 큰 소란을 듭니까?
GLMS가 특별한 최적화 문제인 것처럼 피팅하는 이유를 궁금합니다. 그들이 있습니까? 그것들은 단지 최대 가능성 일 뿐이며, 우리는 가능성을 기록한 다음 ... 그것을 최대화하는 것 같습니다! 왜 우리는 응용 수학 문헌에서 개발 된 수많은 최적화 체계 대신 Fisher 점수를 사용합니까?


2
현재 채식주의 자에 대한 설문 조사 데이터 만있을 때 채식주의에 대한 평균 준수 기간을 계산하는 방법은 무엇입니까?
무작위 모집단 샘플을 조사했다. 그들은 채식을 먹는지 물었습니다. 그들이 예라고 대답하면, 그들은 중단없이 채식을 얼마나 오랫동안 먹었는지 명시하도록 요청 받았다. 이 데이터를 사용하여 채식주의에 대한 평균 준수 기간을 계산하고 싶습니다. 다시 말해, 누군가 채식을하면 평균적으로 채식을한다는 것을 알고 싶습니다. 다음과 같이 가정 해 봅시다 : 모든 응답자가 정확하고 정확한 답변을하였습니다 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.