통계 및 빅 데이터

통계, 기계 학습, 데이터 분석, 데이터 마이닝 및 데이터 시각화에 관심있는 사람들을위한 Q & A

6
더 중요한 통계 : '모든 여성의 90 %가 살아 남았다'또는 '생존 한 모든 사람들의 90 %가 여자였다'?
타이타닉의 다음 진술을 고려하십시오. 가정 1 : 배에는 남자와 여자 만 있었다 가정 2 : 많은 남성과 여성이 있었다 성명서 1 : 모든 여성의 90 %가 생존 성명서 2 : 생존 한 모든 사람들의 90 %가 여성이었습니다. 첫 번째는 여자를 구하는 것이 우선 순위가 높았 음을 나타냅니다 (남자를 구했는지 여부에 …

1
의사 결정 트리의 깊이
의사 결정 트리 알고리즘은 모든 단계에서 속성으로 분할되므로 의사 결정 트리의 최대 깊이는 데이터의 속성 수와 같습니다. 이 올바른지?

1
랜덤 포레스트의 합법적 인 후속 알고리즘은 무엇입니까?
알고리즘을 증폭시키기 위해, 나는 그것들이 꽤 잘 진화했다고 말할 것입니다. 1995 년 초 AdaBoost가 소개 된 후 얼마 지나지 않아 그라디언트 부스팅 머신 (GBM)이었습니다. 최근, 2015 년경 XGBoost가 도입되었으며, 이는 정확하고 과적 합을 처리하며 여러 개의 Kaggle 경쟁의 승자가되었습니다. 2017 년에 Microsoft에서 LightGBM을 도입했으며 XGBoost에 비해 교육 시간이 크게 단축되었습니다. …

3
응용 과학자와의 협력에 대한 조언
나는 통계학 대학원생이며 응용 과학자들 (경제학자, 산림업자 등)과의 협력에 관여하고 있습니다. 이러한 협업은 (대부분) 재미 있고 많은 것을 배우지 만, 예를 들어 다음과 같은 몇 가지 복잡한 문제가 있습니다. 때로는 좋은 통계 모델이 무엇인지에 대한 나의 견해는 동료의 배경과 해당 분야의 일반적인 관행과 다릅니다. 그런 다음 모델을 이해하려고 애 쓰거나 …
14 references 

4
예측 모델 : 통계는 머신 러닝을 능가 할 수 있습니까? [닫은]
폐쇄되었습니다 . 이 질문은 더 집중되어야 합니다. 현재 답변을받지 않습니다. 이 질문을 개선하고 싶습니까? 이 게시물 을 편집 하여 한 가지 문제에만 집중할 수 있도록 질문을 업데이트하십시오 . 휴일 2 년 전 . 현재 통계 / 경제학에 중점을 둔 마스터 프로그램을 따르고 있습니다. 제 주인은 모든 학생들이 3 개월 동안 …

6
"상관 된"의 능동 / 수동 사용에 대한 힌트
나는 이것을 StackExchange 통계 또는 언어 / 영어로 여기에서 물어볼 것을 주저하지만, 다른 포럼에서 통계에 정통한 사용자보다 더 많은 언어 니팅 사용자가있을 수 있다고 생각합니다.) 나는 종종 "우리는 A와 B를 연관시키고 발견했다 ..."에서와 같이 능동적 음성에서 동사로 상관 관계를 언급하는 보고서를 읽는다. 나에게이 동사는 수동적 목소리에서만 의미가 있습니다. 예를 들어 …

1
인형 용 해밀턴 몬테 카를로
Hamiltonian Monte Carlo의 작동 방식에 대한 인형 설명을 단계별로 제공 할 수 있습니까? 추신 : 나는 이미 여기에 해밀턴 몬테 카를로 , 그리고 여기에 해밀턴 몬테 카를로 대 순차적 몬테 카를로 , 그리고 여기에 해밀턴 몬테 카를로 : 해밀턴 제안 제안을 이해하는 방법을 읽었습니다. 그리고 단계별로 다루지 않습니다.
14 bayesian  hmc 

1
왜 우리는 신경망 이외의 것들에 알맞은 기울기가 아닌 일정한 학습 속도를 사용하지 않습니까?
딥 러닝 문학은 기울기 강하에서 일정하지 않은 학습 속도를 사용하는 영리한 속임수로 가득합니다. 지수 붕괴, RMSprop, Adagrad 등은 구현하기 쉽고 모든 딥 러닝 패키지에서 사용할 수 있지만 신경망 외부에는 존재하지 않는 것 같습니다. 이것에 대한 이유가 있습니까? 사람들이 단순히 신경 쓰지 않는다면 신경망 외부에서 신경 쓰지 않아도되는 이유가 있습니까?


3
양자 컴퓨팅으로 어떤 종류의 통계 문제가 도움이 될까요?
우리는 현재 양자 컴퓨터 가 시뮬레이션 된 양자 컴퓨터를 위해 높은 수준 과 낮은 수준으로 이용 가능한 하드웨어 양자 컴퓨터를 예상하는 양자 언어와 함께 양자 컴퓨팅 의 도래에 있습니다. 양자 컴퓨팅은 큐빗의 얽힘 및 순간 이동 , 큐 비트 측정 , 큐 비트에 중첩 부과 와 같은 새로운 기본 기능을 …

2
강력한 통계 테스트 란 무엇입니까? 강력한 통계 테스트 란 무엇입니까?
일부 통계 테스트는 강력하고 일부는 그렇지 않습니다. 견고성은 정확히 무엇을 의미합니까? 놀랍게도이 사이트에서 그런 질문을 찾을 수 없었습니다. 또한 때로는 테스트의 견고성과 강력 함이 함께 논의됩니다. 직관적으로 두 개념을 구분할 수 없었습니다. 강력한 테스트 란 무엇입니까? 강력한 통계 테스트와 다른 점은 무엇입니까?

5
선형 회귀 분석에서 가설과 입력 데이터 포인트 간의 수직 거리를 기반으로 비용 함수를 사용하는 이유는 무엇입니까?
입력 (예측 자) 및 출력 (응답) 데이터 포인트 A, B, C, D, E가 있고 포인트를 통해 선을 맞추고 싶다고 가정 해 봅시다. 이것은 문제를 설명하기위한 간단한 문제이지만 더 높은 차원으로 확장 될 수도 있습니다. 문제 설명 현재 최상의 적합 또는 가설은 위 의 검은 선으로 표시됩니다 . 파란색 화살표 ( …

3
분포 패밀리의 정의?
분포 패밀리가 다른 분야와 통계에 대해 다른 정의를 가지고 있습니까? 일반적으로, 곡선 군 은 일련의 곡선이며, 각각의 곡선은 하나 이상의 파라미터가 변하는 함수 또는 매개 변수화에 의해 주어진다. 이러한 제품군은 예를 들어 전자 부품 을 특성화 하는 데 사용됩니다 . 통계의 경우 한 소스 에 따른 패밀리 는 모양 매개 …

4
귀무 가설이 참일 확률
따라서 이것은 일반적인 질문 일 수 있지만 만족스러운 답변을 찾지 못했습니다. 귀무 가설이 참 (또는 거짓) 일 확률을 어떻게 결정합니까? 학생들에게 두 가지 다른 버전의 테스트를 제공하고 해당 버전이 동일한 지 확인하고 싶다고 가정 해 봅시다. t- 검정을 수행하면 p- 값이 .02가됩니다. 좋은 p- 값! 즉, 테스트가 동등하지 않을 것입니다. …


당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.