통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

3
의 기대치를 어떻게 계산 합니까?
경우 지수 분포 파라미터와 및 의 서로 무관의 기대 무엇 ( I는 = 1 , . . . , N ) λ X 난XiXiX_i(i=1,...,n)(i=1,...,n)(i=1,...,n)λλ\lambdaXiXiX_i (∑i=1nXi)2(∑i=1nXi)2 \left(\sum_{i=1}^n {X_i} \right)^2 측면에서 과 및 가능한 다른 상수?λnnnλλ\lambda 참고 : 이 질문은 /math//q/12068/4051 에서 수학 답변을 얻었습니다 . 독자들도 그것을 볼 것입니다.

3
분석을 위해 CDF 및 PDF 통계를 사용하는 방법
이것은 일반적인 질문이 너무 많을 수 있지만 여기서 도움을 얻을 수 있기를 바랍니다. 나는 대학에서 RA 직업을 시작하고 있으며 내 주제는 인터넷 트래픽 분석과 관련이 있습니다. 나는 분석의 세계에 상당히 새로운 것이지만 연구의 세계에서 이것이 내가해야 할 일이라고 생각합니다. 나는 몇 가지 논문을 겪었고 많은 논문에서 그들이 얻은 결과를 설명하기 …


5
로지스틱 회귀 분석에서 더 나은 불이행 분류
전체 공개 : 이것은 숙제입니다. 데이터 세트에 대한 링크를 포함 시켰습니다 ( http://www.bertelsen.ca/R/logistic-regression.sav ) 저의 목표는이 데이터 세트에서 대출 불이행자 예측을 최대화하는 것입니다. 지금까지 생각해 낸 모든 모델은 기본값이 아닌 사용자의> 90 %를 예측하지만 분류기의 전체 효율을 ~ 80 %로 만드는 기본값의 <40 %를 예측합니다. 변수 사이에 상호 작용 효과가 …
12 r  logistic  spss  self-study 

1
새로운 관측치로 올가미 업데이트
L1 정규 선형 회귀 분석을 매우 큰 데이터 세트에 맞추고 있습니다 (n >> p 사용) 변수는 미리 알려져 있지만 관측치는 작은 덩어리로 도착합니다. 각 덩어리 후에 올가미 맞춤을 유지하고 싶습니다. 각각의 새로운 관측 값 세트를 본 후 전체 모델을 다시 맞출 수 있습니다. 그러나 이것은 많은 데이터가 있다는 점에서 상당히 …
12 regression  lasso 

3
설문지 검증
논문에 대한 설문지를 디자인하고 있습니다. Cronbach의 알파 테스트를 초기 샘플 그룹에 적용한 설문지를 검증하는 중입니다. 설문지에 대한 답변은 리 커트 규모입니다. 누구든지 그 유효성을 테스트하는 데 도움이되는 추가 테스트를 제안 할 수 있습니다. 통계 전문가가 아니므로 도움을 주시면 감사하겠습니다. 몇 가지 조사를 해왔으며 Rasch 분석을 수행 할 수있는 것으로 보입니다.이 …

2
R 초보자를위한 아이템 분석
20 개 항목의 다중 선택 시험을 평가하려고합니다. 이 예 에서 찾을 수있는 것과 같은 항목 분석을 수행하고 싶습니다 . 따라서 각 질문에 대해 P- 값과 총계와의 상관 관계 및 선택한 옵션의 분포를 원합니다. 다양한 통계 소프트웨어 패키지에 대해서는 아무것도 모르지만 프로그래밍에 익숙하고 R은 오픈 소스이므로 R을 사용하고 싶습니다. 내가 상상하는 …

2
두 정규 분포 변수의 비율 또는 하나의 역을 매개 변수화하는 방법은 무엇입니까?
문제점 : 베이지안 메타 분석에서 사전 및 데이터로 사용할 분포를 매개 변수화하고 있습니다. 이 자료는 문헌에 요약 통계로 제공되며, 거의 독점적으로 정규 분포로 가정됩니다 (변수는 0보다 작을 수없고 일부는 비율, 일부는 질량 등임). 나는 해결책이없는 두 가지 사례를 보았습니다. 때로는 관심있는 매개 변수가 데이터의 역수 또는 두 변수의 비율입니다. 예 …

3
적응 형 커널 밀도 추정기?
누구나 적응 형 커널 밀도 추정기 사용 경험을보고 할 수 있습니까? (적응 형 | 가변 | 가변 폭, KDE | 히스토그램 | 보간 기 등의 동의어가 많이 있습니다.) 가변 커널 밀도 추정에 따르면 "샘플 공간의 다른 영역에서 커널의 너비를 변경합니다. 실제로는 두 가지 방법이 있습니다." multigrid ... 물론 단일 방법으로 …

4
LASSO 모델에 ILS (Iteratively Reweighted Least Squares) 방법을 적용하는 방법은 무엇입니까?
IRLS 알고리즘을 사용하여 로지스틱 회귀를 프로그래밍했습니다 . 올바른 기능을 자동으로 선택하기 위해 LASSO 처벌 을 적용하고 싶습니다 . 각 반복에서 다음이 해결됩니다. (XTWX)δβ^=XT(y−p)(XTWX)δβ^=XT(y−p)\mathbf{\left(X^TWX\right) \delta\hat\beta=X^T\left(y-p\right)} 하자 음수가 아닌 실수합니다. 나는 The Elements of 에서 제안한 것처럼 요격을 처벌하지 않습니다 . 통계 학습 . 이미 0의 계수에 대한 차이. 그렇지 않으면 오른쪽에서 …

2
모수 표본 크기 계산 및 비모수 분석
파라 메트릭 방식 (즉, 정규 분포와 특정 측정 편차 가정)을 사용하여 표본 크기 계산을 수행하는 의학 문헌의 일반적인 관행을 지원하기 위해 특정 참조 (텍스트 또는 저널 기사)를 보유하고 있는지 궁금합니다. 1 차 시험 결과의 분석이 비모수 적 방법을 사용하여 수행 될 때. 예 : 1 차 결과는 특정 약물을 투여 …



3
때 통계적 연계가 순진하게 거부되지 않는 이유를 설명 할 수 있습니까 ?
통계 통계를 순진하게 선언하기 위해 폴링에서보고 된 오류 한계 (MOE) 통계를 사용하는 것이 일반적으로 잘못된 이유를 설명하고 기본 통계 텍스트, 논문 또는 기타 참조를 인용하는 데 도움이 필요합니다. 예 : 설문 조사에서 후보 리드 후보 B, %로 마진의 오류에 대한 조사 유권자.39−3139−3139 - 314.5%4.5%4.5 \%500500500 내 친구의 이유는 다음과 같습니다. …
12 polling 

3
불완전하거나 누락 된 데이터를 처리하는 기술
내 질문은 분류 자 / 모델 교육 / 피팅 중 불완전한 데이터 를 처리하는 기술에 관한 것입니다 . 예를 들어, 수백 개의 행이있는 데이터 세트에서 각 행에 5 개의 차원과 클래스 레이블이 마지막 항목이라고 가정하면 대부분의 데이터 포인트는 다음과 같습니다. [0.74, 0.39, 0.14, 0.33, 0.34, 0] 몇 가지가 다음과 같이 …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.