İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

1
Parametrik olmayan istatistiklerde bağlar neden bu kadar zor?
Benim parametrik olmayan metin, Pratik Parametredışı İstatistikler , sık sık olduğu gibi, varyansları testi istatistik ve beklentilerin temiz formüller verir ama biz bağları göz ardı edersek bu sadece çalışır bu ihtar içerir. Mann-Whitney U İstatistiği hesaplanırken, hangisinin daha büyük olduğunu karşılaştırırken bağlı çiftleri atmanız önerilir. Bu bağların bize hangi popülasyonun …

2
Birisi doğrusal ve doğrusal olmayan karışık etkilere ışık tutabilir mi?
R öğrenmeye dalmak üzereyim ve öğrenme projem, tahmini bir denklem geliştirmek için bir veri kümesine karışık veya rastgele etkiler regresyonunun uygulanmasını gerektirecektir. Bu yazıda yazarın endişesini paylaşıyorum Karışık efekt modelleri için nlme veya lme4 R kütüphanesi nasıl seçilir? NLME veya LME4'ün kendimi tanımak için daha iyi bir paket olup olmadığını …


1
Toplam (sınıf içinde + sınıf arasında) dağılım matrisinin türetilmesi
PCA ve LDA yöntemleri ile uğraşıyordum ve bir noktada takılı kaldım, göremediğim kadar basit bir his var. İçinde sınıfının ( ) arasında sınıfının ( S B ) dağılım matrisleri gibi tanımlanır:SWSWS_WSBSBS_B SW= ∑i = 1CΣt = 1N-( xbent- μben) ( xbent- μben)TSW=∑i=1C∑t=1N(xti−μi)(xti−μi)T S_W = \sum_{i=1}^C\sum_{t=1}^N(x_t^i - \mu_i)(x_t^i - \mu_i)^T SB= …


3
Uzunlamasına bir veri kümesinin analizinde aov () ve lme () kullanımı arasındaki fark nedir?
Birisi bana boyuna verileri kullanma aov()ve lme()analiz etme arasındaki farkı söyleyebilir ve bu iki yöntemden elde edilen sonuçları nasıl yorumlayabilir? Aşağıda, aynı kullanarak veri kümesi analiz aov()ve lme()ve 2 farklı sonuçlar aldık. İle aov()ben Tedavi etkileşimi süresinde önemli bir sonuç var, ama doğrusal karma modelin yerleştirilmesi, Tedavi etkileşimi zaman önemsizdir. …

2
Nüfus yoğunluğu tahmini modeli
Her bir şekle (bir Sayım bloğu, yol, ilçe, eyalet, ne olursa olsun) çokgen / alan sabit bir değer atayarak nüfus yoğunluğunu eşlemek için (nüfus, alan, şekil) bir veritabanı kullanılabilir. Bununla birlikte, popülasyonlar genellikle çokgenlerinde eşit olarak dağılmaz. Dasimetrik haritalama , bu yoğunluk tahminlerini yardımcı verilerle hassaslaştırma işlemidir. Bu son derlemede …

2
Model ayarlamasını düz İngilizce olarak açıklayın
İstatistiksel analiz yöntemlerini ve sonuçlarını, özellikle epidemiyolojide okurken , modellerin ayarlanması veya kontrol edilmesi hakkında çok sık duyuyorum . İstatistikçi olmayan birine bunun amacını nasıl açıklarsınız? Belirli bir değişkeni kontrol ettikten sonra sonuçlarınızı nasıl yorumluyorsunuz? Stata veya R'de küçük bir gezinti veya çevrimiçi bir gösterici, gerçek bir mücevher olurdu.

1
Tekrarlanan ölçüm ANOVA için gerekli örneklem büyüklüğü nasıl belirlenir?
Tekrarlanan ölçüm ANOVA hakkında yardıma ihtiyacım var. Bazı müdahalelerin bazı servislerde kan akımı enfeksiyonunu (BSI) azaltma üzerindeki etkisini araştırıyoruz. BSI oranı bilgilerini aylık olarak, önce müdahale olmadan 12 ay, sonra müdahale ile 12 ay boyunca yakalamayı planlıyoruz. Zaman serisi veya tekrarlı ölçüm ANOVA yapmayı düşünüyoruz, ilkinde yapmak için çok fazla …


1
Entropi yere ve ölçeğe nasıl bağlıdır?
Entropi yoğunluk fonksiyonu sürekli bir dağılım beklentisine negatif olarak tanımlanır ve bu yüzden eşitffflog(f),log⁡(f),\log(f), Hf=−∫∞−∞log(f(x))f(x)dx.Hf=−∫−∞∞log⁡(f(x))f(x)dx.H_f = -\int_{-\infty}^{\infty} \log(f(x)) f(x)\mathrm{d}x. Ayrıca dağılımı yoğunluğuna sahip herhangi bir rastgele değişken entropi (Bu integral, sıfırları olduğunda bile iyi tanımlanmıştır , çünkü bu değerlerde sıfıra alınabilir.)XXXfffHf.Hf.H_f.ffflog(f(x))f(x)log⁡(f(x))f(x)\log(f(x))f(x) Zaman ve bu rastgele değişkenlerin ( bir sabittir), bir …

3
Bomba nerede: Satır ve sütun toplamları verildiğinde olasılık nasıl tahmin edilir?
Bu sorudan Pokemon Soulsilver'in mini oyunundan esinlenilmiştir: Bu 5x6 alanda gizli 15 bomba olduğunu düşünün (EDIT: maksimum 1 bomba / hücre): Şimdi, satır / sütun toplamları göz önüne alındığında, belirli bir alanda bomba bulma olasılığını nasıl tahmin edersiniz? Sütun 5'e bakarsanız (toplam bomba = 5), o zaman düşünebilirsiniz: Bu sütun …

5
Rasgele Orman ve Karar Ağacı Algoritması
Rastgele bir orman, torbalama kavramını takip eden karar ağaçlarının bir koleksiyonudur. Bir karar ağacından bir sonraki karar ağacına geçtiğimizde, son karar ağacı tarafından öğrenilen bilgiler bir sonrakine nasıl ilerler? Çünkü, anlayışım gereği, her karar ağacı için oluşturulan ve bir sonraki karar ağacı yanlış sınıflandırılmış hatadan öğrenmeye başlamadan önce yüklenen eğitimli …

1
REML için bir Bayes yorumu var mı?
REML'nin Bayes yorumu mevcut mudur? Sezgime göre REML, ampirik Bayes tahmin prosedürlerine güçlü bir benzerlik taşıyor ve merak ediyorum ki bir tür asimptotik eşdeğerlik (bazı uygun öncelik sınıfları altında) gösterilip gösterilmediğini merak ediyorum. Hem ampirik Bayes hem de REML , örneğin rahatsızlık parametreleri karşısında gerçekleştirilen 'uzlaşılmış' tahmin yaklaşımları gibi görünmektedir …

3
Değerleri ve 1. / 2. türevleri içeren verilere bir eğri çizgiyi nasıl sığdırabilirim?
Diyelim ki, konum, hız ve ivme için bazı ölçümler içeren bir veri kümem var. Hepsi aynı "koşu" dan geliyor. Doğrusal bir sistem kurabilirim ve tüm bu ölçümlere bir polinom sığdırabilirim. Ama aynısını spline ile yapabilir miyim? Bunu yapmanın 'R' yolu nedir? İşte sığdırmak istediğim bazı simüle veriler: f <- function(x) …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.