통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

2
BSTS 모델의 예측 (R)은 완전히 실패합니다
베이지안 구조 시계열 모델에 대한 이 블로그 게시물을 읽은 후 이전에 ARIMA를 사용했던 문제와 관련하여이를 구현하고 싶었습니다. 나는 알려진 (그러나 시끄러운) 계절 성분에 대한 데이터를 가지고 있습니다. 연간, 매월 및 매주 성분이 있으며 특별한 날 (연방 또는 종교 휴일과 같은)로 인한 영향도 있습니다. 나는 bsts이것을 구현 하기 위해 패키지를 사용했으며 …
15 r  time-series  bayesian  mcmc  bsts 

3
10 회 실패까지 샘플링하여 Bernoulli 프로세스의 확률 추정 : 편향되어 있습니까?
10 개의 실패 가 발생할 때까지 샘플링 할 수있는 실패 확률 q (작은 수, 예 : q ≤ 0.01 )를 갖는 Bernoulli 프로세스 가 있다고 가정하십시오 . 우리는 따라서로 실패의 확률을 추정 Q : = 10 / N 여기서, 샘플들의 개수이다.qqqq≤0.01q≤0.01q \leq 0.01101010q^:=10/Nq^:=10/N\hat{q}:=10/NNNN 질문 : IS 바이어스 추정 의 ? …

5
두 개의 Formula 1 적격 형식의 통계 변동
방금 Formula 1의 적격 형식에 대한 BBC 기사를 읽었습니다 . 주최자는 자격을 덜 예측하기 쉽게, 즉 결과의 통계적 변동을 증가시키기를 원합니다. 몇 가지 부적합한 세부 사항에 대해 광택을내는 순간, 운전자는 두 번의 시도 (구체적으로)에서 최고의 단일 랩으로 순위가 매겨집니다. Jean Todt의 F1 최고 책임자는 운전자가 실수를 할 가능성이 두 배일 …
15 variance 

1
하나의 변수가 다른 변수의 선형 조합이지만 완벽한 다중 공선 성으로 인해이 회귀가 실패하지 않는 이유는 무엇입니까?
오늘은 작은 데이터 세트로 놀고 있었고 완벽한 다중 공선 성으로 인해 실패 할 것으로 예상 되는 간단한 OLS 회귀를 수행했습니다 . 그러나 그렇지 않았습니다. 이것은 다중 공선성에 대한 나의 이해가 잘못되었음을 의미합니다. 내 질문은 : 내가 어디 잘못입니까? 내 변수 중 하나가 다른 변수의 선형 조합임을 보여줄 수 있다고 생각합니다. …

2
"표준 오류"및 "신뢰 구간"이 측정 정밀도를 측정하는 경우 정확도 측정은 무엇입니까?
40 페이지의 "인체에 대한 생물 통계학"책에서 나는 다음을 읽었습니다. 표준 오차 (약칭 SE)는 물체의 추정 또는 측정이 얼마나 정확한지를 나타내는 한 가지 방법입니다. 과 신뢰 구간은 추정의 정확성 또는 무언가의 측정을 나타내는 다른 방법을 제공합니다. 그러나 측정의 정확성을 나타내는 방법은 없습니다. 질문 : 물체의 측정이 얼마나 정확한지를 나타내는 방법은 무엇입니까? …

2
모델 정제를 언제 중단해야합니까?
지난 3 년간 많은 책에서 통계를 연구 해 왔으며이 사이트 덕분에 많은 것을 배웠습니다. 그럼에도 불구하고 하나의 근본적인 질문은 여전히 ​​답이 남아 있습니다. 매우 간단하거나 어려운 답변이있을 수 있지만 통계에 대한 깊은 이해가 필요하다는 것을 알고 있습니다. 모델을 데이터에 맞출 때 (빈번주의 또는 베이지안 접근법), 우리는 가능성, 이전 또는 커널 …

2
의 PDF
가정하십시오 . . . , X n 은 알려지지 않은 μ ∈ R 및 σ 2 > 0으로 N ( μ , σ 2 )X1,X2,...,XnX1,X2,...,XnX_1, X_2,...,X_n 에서 iidN(μ,σ2)N(μ,σ2)N(\mu,\sigma^2)μ∈Rμ∈R\mu \in \mathcal Rσ2>0σ2>0\sigma^2>0 Z = X 1 − ˉ X라고 하자Z=X1−X¯S,Z=X1−X¯S,Z=\frac{X_1-\bar{X}}{S},S는 표준 편차입니다. ZZZ 에 Lebesgue 가 있음을 알 수 있습니다 pdf …
15 self-study  umvue 

1
QR 분해 이해
나는 더 많은 것을 이해하려고 노력한 예제 (R)를 가지고 있습니다. 선형 모델을 만들기 위해 Limma를 사용하고 있으며 폴드 변경 계산에서 단계별로 어떤 일이 일어나고 있는지 이해하려고합니다. 나는 주로 계수 계산에 어떤 일이 발생하는지 알아 내려고 노력하고 있습니다. 내가 알아낼 수있는 것에서 QR 분해는 계수를 얻는 데 사용되므로 본질적으로 계산중인 방정식 …

1
어떤 수준에서입니다
배경 : 안전하게 건너 뛰십시오-참조를 위해 여기 있으며 질문을 정당화합니다. 이 문서 의 시작 부분은 다음 과 같습니다. "Karl Pearson의 유명한 카이-제곱 비상 테스트는 정규 분포를 기반으로하는 z 통계라고하는 다른 통계량에서 파생됩니다. 가장 간단한 버전의 χ2χ2\chi^2 는 수학적으로 동일한 z 테스트와 동일한 것으로 표시 될 수 있습니다.이 테스트는 동일한 결과를 …

1
RNN이 모델링 할 수있는 가능한 시퀀스 길이는 얼마입니까?
시계열 데이터 모델링을 위해 LSTM ( long short-term memory ) 버전의 RNN (Recurrent Neural Network) 을 사용하려고 합니다. 데이터의 시퀀스 길이가 길수록 네트워크의 복잡성이 증가합니다. 따라서 어느 정도의 시퀀스가 ​​좋은 정확도로 모델링 할 수 있을지 궁금합니다. 최신 방식을 구현하기가 어려운 비교적 간단한 LSTM 버전을 사용하고 싶습니다. 내 시계열의 각 관측치에는 …

5
다양한 다면체 주사위의 분포는 한 번에 무엇입니까?
던전 앤 드래곤 주사위 세트에서 5 개의 플라톤 고체를 가져 가십시오. 이들은 4면, 6면 (기존), 8면, 12면 및 20면 주사위로 구성됩니다. 모두 1에서 시작하여 총계에서 1까지 증가합니다. 한 번에 모두 굴려서 합계를 가져옵니다 (최소 합계는 5, 최대는 50입니다). 여러 번 그렇게하십시오. 분포는 무엇입니까? 분명히 그것들은 더 높은 숫자보다 더 낮은 …

7
베이 즈의 규칙을 기억하기 위해 무엇을 했습니까?
수식을 기억하는 좋은 방법은 다음과 같이 수식을 생각하는 것입니다. 독립적 인 이벤트 B의 결과를 고려할 때 일부 이벤트 A가 특정 결과를 가질 확률 = 두 결과가 동시에 발생할 확률 / 이벤트 A의 원하는 결과 확률은 이벤트 B의 결과를 모르는 경우입니다. 예를 들어, 질병 검사를 고려하십시오. 질병에 대해 양성 검사를받는 환자가 …
15 bayesian  bayes 

4
텍스트 마이닝 : 인공 지능으로 텍스트 (예 : 뉴스 기사)를 클러스터링하는 방법?
나는 탁구 연주, 필기 숫자 및 물건 분류와 같은 다양한 작업을 위해 일부 신경망 (MLP (완전히 연결되어 있음), Elman (반복))을 만들었습니다. 또한 여러 자필 필기 노트를 분류하기 위해 첫 번째 회선 신경망을 구축하려고 시도했지만 25x25 크기의 이미지와 같은 표준화 된 입력에 의존 할 수있는 이미지 인식 / 클러스터링 작업에서 텍스트를 …

2
편차-분산 트레이드 오프에 관한 질문
편향-분산 트레이드 오프, 추정 자의 편향과 모델의 편향 사이의 관계, 그리고 추정 자의 분산과 모형의 분산 사이의 관계를 이해하려고합니다. 나는 이러한 결론에 도달했다. 추정 자의 편향을 무시할 때, 즉 모형의 분산을 무시하는 모형의 편향 만 최소화하려는 경우 (즉, 고려하지 않고 추정 자의 분산을 최소화하는 것을 목표로하는 경우) 데이터를 과적 합하는 …

1
ARIMA 모델의 정규화
선형 회귀 모델에서 LASSO, 릿지 및 탄성 그물 유형의 정규화를 알고 있습니다. 질문: 이 (또는 유사한) 불이익 추정을 ARIMA 모델링에 적용 할 수 있습니까 (빈 부분이 아닌 MA 부분이 있는가)? pmaxpmaxp_{max}qmaxqmaxq_{max}피⩽p해요 X를p⩽pma엑스p \leqslant p_{max}q⩽ q해요 X를q⩽큐미디엄ㅏ엑스q \leqslant q_{max} 추가 질문 은 다음과 같습니다. 모든 항을 ( , q_ {max} ) …

당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.