İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
2 örnekli oran testi için lm kullanma
Bir süredir 2 örnek oranlı testler yapmak için doğrusal modeller kullanıyorum, ancak bunun tamamen doğru olmayabileceğini fark ettim. Binom ailesi + kimlik bağlantısı ile genelleştirilmiş doğrusal bir modelin kullanılmasının tam olarak ayrılmamış 2 örnek oranlı test sonuçları verdiği görülmektedir. Bununla birlikte, doğrusal bir model (veya gaussian ailesiyle glm) kullanmak biraz …

1
LASSO'nun serbestlik dereceleri için sezgi
Zou ve diğ. "Kementin" serbestlik dereceleri " (2007), sıfır olmayan katsayıların sayısının, kementin serbestlik dereceleri için tarafsız ve tutarlı bir tahmin olduğunu göstermektedir. Bana biraz mantıksız geliyor. Bir regresyon modelimiz olduğunu varsayalım (değişkenlerin sıfır ortalaması olduğu yerlerde) y=βx+ε.y=βx+ε.y=\beta x + \varepsilon. değerinin sınırsız OLS tahmini olduğunu varsayalım . Çok düşük …

3
Ilımlı regresyon: Neden öngörücüler arasında bir * ürün * terimi hesaplıyoruz?
Ilımlı regresyon analizleri genellikle sosyal bilimlerde iki veya daha fazla öngörücü / ortak değişken arasındaki etkileşimi değerlendirmek için kullanılır. Tipik olarak, iki öngörücü değişkeni ile aşağıdaki model uygulanır: Y=β0+β1∗X+β2∗M+β3∗XM+eY=β0+β1∗X+β2∗M+β3∗XM+eY = β_0 + β_1*X + β_2*M + β_3*XM + e Ilımlılık testinin XM ürün terimi XMXMXM(bağımsız değişken XXX ile moderatör değişkeni …

2
Rastgele değişkenimizin değer aralığı sınırlandırılmışsa olarak nasıl normal bir dağılım elde edebiliriz ?
Diyelim ki ve sınırlanmış bir dizi değer içeren rastgele bir değişkenimiz var , burada minimum değer ve maksimum değerdir.aaabbbaaabbb Ben söylendi , nerede örneklem büyüklüğü, bizim örnek araçlarının örnekleme dağılımı olan bir normal dağılım. Biz arttıkça Yani, daha yakın ve daha yakın bir normal dağılım almak, ancak gerçek sınır olan …


4
Blackwell'in bahsi
Blackwell'in Futility dolaplarındaki bahis paradoksunu okudum . Özet: ve üzere iki zarf . Zarflar rastgele miktarda para içerir, ancak para hakkındaki dağılım hakkında hiçbir şey bilmezsiniz. Birini , orada ne kadar para olduğunu kontrol edersiniz ( ) ve seçmeniz gerekir: veya ?E y x E x E yExExE_xEyEyE_yxxxExExE_xEyEyE_y Boşluk Dolabı, …

2
Güven Elipsinin Gerçek Anlamı
% 95 güven elipsinin gerçek anlamını okurken, 2 açıklamaya rastlıyorum: Verilerin% 95'ini içeren elips Yukarıdakiler değil, verilerin varyansını açıklayan elips. Doğru anladığımdan emin değilim, ancak yeni bir veri noktası geliyorsa, yeni varyansın elips içinde kalma olasılığı% 95'tir. Biraz ışık tutabilir misin?

1
ACF işlevi için güven aralığı nasıl hesaplanır?
Örneğin, R acf()işlevini çağırırsanız, varsayılan olarak bir korelogram çizer ve% 95 güven aralığı çizer. Koda bakarak, eğer ararsanız plot(acf_object, ci.type="white"), şunu görürsünüz: qnorm((1 + ci)/2)/sqrt(x$n.used) beyaz gürültü için üst sınır olarak. Bazıları bu yöntemin arkasındaki teoriyi açıklayabilir mi? Neden 1 + 0.95 qnorm'u alıyoruz ve sonra 2'ye bölüyoruz ve bundan …


2
Tekrar deneylerin hangi kısmının, ilk deneyin% 95 güven aralığında bir etki büyüklüğü olacaktır?
Rastgele örnekleme, Gauss popülasyonları, eşit varyanslar, P-hackleme vb.İle ideal bir duruma geçelim. Adım 1. İki numune aracının karşılaştırıldığı bir deneme çalıştırın ve iki popülasyon aracı arasındaki fark için% 95 güven aralığı hesaplayın. 2. Adım. Çok daha fazla deneme (binlerce) gerçekleştirirsiniz. Ortalamalar arasındaki fark, rastgele örnekleme nedeniyle deneyden deneye değişecektir. Soru: …


1
Değişken seçimi ve Model seçimi
Değişken seçiminin model seçiminin bir parçası olduğunu anlıyorum. Peki, model seçimi tam olarak nelerden oluşur? Aşağıdakilerden daha fazla mı? 1) modeliniz için bir dağıtım seçin 2) açıklayıcı değişkenleri seçer,? Bunu soruyorum çünkü Burnham & Anderson: AIC vs BIC, model seçiminde AIC ve BIC hakkında konuştukları bir makale okuyorum . Bu …

1
Oz'da hiç mutsuz bir Tribble olacak mı?
İşte bir öğrencinin getirdiği eğlenceli bir problem. Başlangıçta bir silah tarafından düzenli aralıklarla ateşlenen karşılıklı imha mermileri açısından ifade edilmiş olsa da, daha barışçıl bir sunumun tadını çıkarabileceğinizi düşündüm. Sonsuz düz Oz dünyasında, Sarı Tuğla Yolu Emerald City'nin merkezinde başlar, kırsal alanda gevşer ve kendini geçmeden sonsuza dek ilerler. Her …

4
Degrade İnişe sahip öğrenme oranını Optimize Edici olarak nasıl (sistematik olarak) ayarlayabilirsiniz?
ML / DL alanından bir yabancı; Tensorflow'a dayanan Udacity Derin Öğrenme kursuna başladı; ödev 3 problemini yapmak 4; öğrenme hızını aşağıdaki yapılandırma ile ayarlamaya çalışmak: Parti büyüklüğü 128 Adım sayısı: 2 dönemi doldurmak için yeterli Gizli katmanların boyutları: 1024, 305, 75 Ağırlık başlatma: std ile normal kesildi. sqrt (2 / …


Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.