통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

4
R을 사용하여 바람 데이터 분석
안녕하세요, 풍력 터빈에서 에너지를 추정하기 위해 풍력 데이터를 분석하고 있습니다. 10 년 동안의 바람 데이터를 가져 와서 히스토그램을 그래프로 표시했습니다. 두 번째 단계는 Weibull 분포를 데이터에 맞추는 것이 었습니다. 패키지와 함께 R lmom을 사용하여 Weibul 모양을 계산하고 크기를 조정했습니다. 이것은 내가 사용한 코드입니다. >library(lmom) wind.moments<-samlmu(as.numeric(pp$WS)) moments<-pelwei(wind.moments) x.wei<-rweibull(n=length(pp$WS), shape=moments["delta"], scale=moments["beta"]) hist(as.numeric(pp$WS), …
12 r  distributions 

4
Sweave, R, Latex, Eclipse StatET 설정 [닫기]
닫은. 이 질문은 주제에 맞지 않습니다 . 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 교차 검증에 대한 주제가 되도록 질문을 업데이트하십시오 . 휴일 삼년 전에 . 며칠 전에 SweaveR을 설정하는 방법에 대한 게시물을 보았습니다.이를 통해 사용자는 테이블, 그래프 등과 같은 것을 라텍스로 직접 내보낼 수 있습니다. 지시 사항을 제대로 따르지 …
12 r 

2
분할 도표 분산 분석 : R의 모형 비교 테스트
R에서 X및 M인수 와 함께 사용하기에 적합한 모델 비교를 사용하여 Split-Plot ANOVA에서 효과를 테스트하려면 anova.mlm()어떻게해야합니까? 저는 ?anova.mlmDalgaard (2007)에 익숙합니다 [1]. 불행히도 Split-Plot Design 만 브러시합니다. 이를 위해 두 가지 개체-내 요인이있는 완전 무작위 설계에서이를 수행합니다. N <- 20 # 20 subjects total P <- 3 # levels within-factor 1 Q …

2
어떤 파라미터 추정 방법을 선택해야하는지 어떻게 알 수 있습니까?
거기에는 파라미터 추정을위한 방법이 꽤 있습니다. MLE, UMVUE, MoM, 의사 결정 이론 및 기타 사항은 모두 매개 변수 추정에 유용한 이유에 대해 상당히 논리적 인 것처럼 보입니다. 어떤 방법이 다른 방법보다 낫습니까, 아니면 "최적의 적합"추정기가 무엇인지 정의하는 방법의 문제입니까 (직교 오차를 최소화하는 것이 일반적인 최소 제곱 접근법과 다른 추정치를 생성하는 …

2
단일 변수에서 결측 데이터의 80 %
내 데이터에 하나의 변수에 누락 된 데이터의 80 %가 있습니다. 존재하지 않기 때문에 데이터가 누락되었습니다 (즉, 회사가 빚진 은행 대출 금액). 더미 변수 조정 방법 이이 문제의 해결책이라고 말하는 기사를 보았습니다. 이 연속 변수를 범주 형으로 변환해야한다는 것을 의미합니까? 이것이 유일한 해결책입니까? 이론적으로 생각할 때이 변수를 삭제하고 싶지 않습니다. 연구 …


2
포지티브 및 네거티브 예측 값에 대한 통계 테스트
나는 논문을 읽었으며 PPV (Positive Predictive Value)와 NPV (Negative Predictive Value)를 비교 한 표를 보았습니다. 그들은 그들을 위해 일종의 통계 테스트를했습니다. 이것은 표의 스케치입니다. PPV NPV p-value 65.9 100 < 0.00001 ... 모든 행은 특정 우발 사태 테이블을 나타냅니다. 그들은 어떤 종류의 가설 검정을 했습니까? 감사!

1
데이터 프레임 필터링
아직도 R의 기본 기능을 배우고 있습니다. 하위 집합 함수는 여러 조건이 있거나없는 단일 열을 기반으로 조건을 필터링하는 것 같습니다. 데이터 프레임에서 데이터를 쉽게 필터링하려면 어떻게해야합니까? 여러 조건이 제공 될 때 사용 가능한 열에 조건을 적용해야하는 경우 예 : 주어진 데이터 프레임 name D1 D2 D3 D4 julius "A" "A" "B" …
12 r 

3
SVM 회귀 이해 : 목적 함수 및 "평탄도"
분류를위한 SVM은 직관적입니다. 최소화 하면 최대 마진 이 어떻게 산출 되는지 이해합니다 . 그러나 회귀의 맥락에서 그 목표를 이해하지 못합니다. 다양한 텍스트 ( 여기 및 여기 )는 이것을 "평평함"을 최대화하는 것으로 설명합니다. 왜 그렇게하고 싶습니까? 회귀에서 "여백"의 개념과 동등한 것은 무엇입니까?||θ||2||θ||2||\theta||^2 여기 몇 가지 시도 된 답변이 있지만 실제로 내 …
12 regression  svm 

2
Akinator.com 및 Naive Bayes 분류기
맥락 : 저는 유니 코스 통계에서 (반반 잊혀진) 경험이있는 프로그래머입니다. 최근에 나는 http://akinator.com을 우연히 발견 하고 실패하기 위해 시간을 보냈습니다. 누가 아니 었어? :) 나는 그것이 작동하는 방법을 찾기로 결정했습니다. 인터넷 검색 및 관련 블로그 게시물을 읽은 후 결과 혼합에 내 제한된 지식을 추가 한 후 다음 모델을 생각해 냈습니다 …

3
그룹 간의 평균 생존을 비교하는 방법?
나는 다른 유형의 Kaplan-Meier를 사용하여 암의 유형에 대한 평균 생존을 조사하고 있습니다. 주들 사이에는 상당히 큰 차이가 있습니다. 어떻게 모든 주들 사이의 평균 생존을 비교하고 전국의 평균 평균 생존과 유의하게 다른 것을 결정할 수 있습니까?

3
이산 형, 서수형 반응의 요인 점수
순서가 다른 이산 변수가있을 때 요인 점수를 추정하는 원칙적인 방법이 있습니까? 내가 가진 , 변수를 순서, 이산. 각 반응의 기본이 연속적이고 정규 분포 된 변수라고 가정하면 polychoric correlation matrix를 계산할 수 있습니다 . 그런 다음이 행렬에 대한 요인 분석을 실행하고 각 변수에 대한 요인 로딩을 얻을 수 있습니다.n × nnnnn×nn×nn\times …

2
임의의 기울기를 갖는 혼합 효과 회귀 모델에 대해 MCMC 가설을 어떻게 테스트 할 수 있습니까?
라이브러리 languageR은 lmer를 사용하여 혼합 효과 회귀 모형 적합에서 고정 효과의 MCMC 유의성 검정을 수행하는 방법 (pvals.fnc)을 제공합니다. 그러나 lmer 모델에 임의의 기울기가 포함되어 있으면 pvals.fnc에서 오류가 발생합니다. 이러한 모델에 대한 MCMC 가설 검정을 수행 할 수있는 방법이 있습니까? 그렇다면 어떻게? (응답을 받으려면 R에 실례가 있어야합니다.) 그렇지 않은 경우 개념적 …

8
통계학자가하는 일은 무엇입니까?
비 통계 친구들에게 말할 때 통계학 박사 과정을 밟고있는 대학원생은 자연스럽게 "아, 교수가되고 싶어?" 나는 실제로 업계에서 일할 계획이 없다고 말한다. 그런 다음 그들은 "무엇을합니까?" 이 질문에 대한 좋은 답변을 찾지 못했습니다. 나는 통계 학자들이 다루고있는 흥미로운 문제들을 다양하게 제시하고 싶지만, 나의 반응은 일반적으로 혼란 스럽거나 너무 기술적이다. 나는 대부분의 …
12 careers 


당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.