İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Wilcoxon Rank Sum Test ile Wilcoxon Signed Rank Test arasındaki fark
Wilcoxon Rank-Sum Testi ile Wilcoxon İşaretli Rank Testi arasındaki teorik farkın eşleştirilmiş gözlemler kullanarak ne olduğunu merak ediyordum. Wilcoxon Rank-Sum Test'in iki farklı numunede farklı miktarlarda gözlemlere izin verdiğini biliyorum, oysa ki eşleştirilmiş numuneler için İşaretli Sıra testi buna izin vermiyor, ancak ikisinin de aynı şeyi yaptığını düşünüyorum. Birisi Wilcoxon …



3
Yoğunluk tahmininde bir Bayesian yaklaşımı var mı
Sürekli rastgele bir değişkeninin yoğunluğunu tahmin etmekle ilgileniyorum . Bunu öğrenmenin bir yolu Çekirdek Yoğunluğu Tahmini kullanımıdır.XXX Ama şimdi, aşağıdaki satırlardaki Bayes yaklaşımıyla ilgileniyorum. Başlangıçta F dağılımını takip ettiğine inanıyorum . Attığım n okumalar X . Yeni okumalarıma dayanarak F güncelleme konusunda bazı yaklaşımlar var mı ?F n X FXXXFFFnnnXXXFFF …


5
Casella ve Berger'den sonra neler öğrenmeli?
Ben, uygulamalı matematiğin çok az bir geçmişine sahip bir matematik mezunuyum. Geçen sonbahardan beri Casella & Berger'in kitabında ders alıyorum ve kitapta yüzlerce (230+) sayfa egzersiz problemi bitirdim. Şu anda Bölüm 10’dayım. Ancak, istatistiklere girmediğim veya istatistikçi olmayı planlamadığım için, veri analizini öğrenmeye devam etmek için düzenli olarak zaman harcayabileceğimi …

3
Çoklu regresyonda “herkes eşit” ne demektir?
Birden fazla regresyon yaptığımızda ve bir değişkenindeki bir değişiklik için değişkenindeki ortalama değişime baktığımızı, diğer tüm değişkenleri sabit tuttuğumuzu söylediğinde, diğer değişkenleri sabit olarak hangi değerleri tutuyoruz? Onların ortalaması mı? Sıfır? Herhangi bir değer?yyyxxx Herhangi bir değerde olduğunu düşünmeye meyilliyim; sadece açıklama arıyorum. Birisi bir kanıtı olsaydı, bu da harika …


4
Stouffer'ın Z-skor yöntemi: biz Özetle ne olur yerine ?
Ben yapıyorum aynı boş hipotezi ile bağımsız istatistiksel testler ve bir içine sonuçlarını birleştirmek istiyoruz -değeri. İki "kabul edilmiş" yöntem varmış gibi görünüyor: Fisher yöntemi ve Stouffer yöntemi .pN-NNppp Benim sorum Stouffer'ın yöntemi hakkında. Her ayrı test için, bir z-puanı elde . Boş bir hipotez altında, her biri standart bir …

3
Q-grafiklerini histogramlar üzerinde kullanmanın faydaları
In Bu yoruma Nick Cox yazdı: Sınıflara girmek eski bir yöntemdir. Histogramlar kullanışlı olsa da, modern istatistiksel yazılım, ham verilere dağılımları sığdırmanın yanı sıra tavsiye edilmesini de kolaylaştırır. Binning sadece hangi dağılımın uygun olduğunu belirlemede çok önemli olan detaylardan vazgeçer. Bu yorumun içeriği, QQ alanlarının uygunluğu değerlendirmek için alternatif bir …

2
R'deki önyükleme gerçekte nasıl çalışır?
R'deki boot paketine bakıyordum ve nasıl kullanılacağına dair bazı iyi primerler bulurken, henüz "sahne arkasında" ne olduğunu tam olarak anlatan bir şey bulamadım. Örneğin, bu örnekte , kılavuz standart regresyon katsayılarının bir önyükleme regresyonu için başlangıç ​​noktası olarak nasıl kullanılacağını gösterir, ancak önyükleme regresyon katsayılarını türetmek için önyükleme prosedürünün gerçekte …

2
Neden verilerin PCA'sı SVD aracılığıyla?
Bu soru ana bileşenleri hesaplamanın etkili bir yoludur. Doğrusal PCA ile ilgili birçok metin, casewise verilerinin tekil değer ayrışımını kullanarak savunur . Veri varsa kendisine, ve değişkenler (kendi değiştirmek istiyor sütun temel bileşenler), yaptığımız SVD: X = U S V ' (. Kare özdeğerler kökleri), tekil değerler ana çapını işgal …

5
Parametrik olmayan bir test tam olarak ne yapar ve sonuçlar ile ne yaparsınız?
Bunun başka bir yerde sorulmuş olabileceği hissine kapıldım, ancak gerçekten ihtiyacım olan temel tanım türüyle değil. Parametrik olmayanların bir şeyleri kıyaslamak yerine medyanı kullandığını biliyorum. Ayrıca standart sapma yerine "serbestlik derecelerine" (?) Dayandığını düşünüyorum. Yine de yanılıyorsam düzelt. Oldukça iyi bir araştırma yaptım, ya da öyle düşündüm, kavramı anlamaya çalışarak, …

2
“Bayesian Akıl Yürütme ve Makine Öğrenimi” sonrası sonraki adımlar
Şu anda David Barber tarafından "Bayesian Reasoning and Machine Learning" den geçiyorum ve temelleri öğrenmek için oldukça iyi yazılmış ve ilgi çekici bir kitap. Bu yüzden bunu zaten yapmış olan birine bir soru. Barber'daki kavramların çoğunda makul bir yeterliliğe sahip olduktan sonra okumam gereken bir sonraki kitap seti hangileridir?

1
Spesifik bir çoklu-doğrusallık ölçüsünü tercih etmek için bir sebep var mı?
Birçok giriş değişkeni ile çalışırken, çoğu zaman çoklu bağlanma konusunda endişeliyiz . Çok kutupluluk algılamak, düşünmek ve / veya iletmek için kullanılan çok sayıda çoklu doğrusallık önlemi vardır. Bazı yaygın öneriler: Belirli bir değişken için çokluR,2jR,j2R^2_j Belirli bir değişken için tolerans,1 - R2j1-R,j21-R^2_j Varyans enflasyon faktörü, , belirli bir değişken …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.