İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap



3
Sırt regresyonunu kullanırken katsayı standart hatalarını nasıl tahmin edebilirim?
Oldukça çok doğrusal verilerde sırt regresyonunu kullanıyorum. OLS kullanarak çoklu doğrusallık nedeniyle katsayılarda büyük standart hatalar alıyorum. Sırt regresyonunun bu sorunla başa çıkmanın bir yolu olduğunu biliyorum, ancak baktığım sırt regresyonunun tüm uygulamalarında, katsayılar için rapor edilen standart hatalar yok. Belirli katsayıların standart hatalarını ne kadar düşürdüğünü görerek sırt regresyonunun …

1
Bu olabilirlik oranlarını doğru hesapladım mı?
R için ez paketinin yazarıyım ve ANOVA'ların çıkışına otomatik olasılık oranlarını (LR'ler) otomatik olarak hesaplamak için bir güncelleme üzerinde çalışıyorum. Fikir, ANOVA'nın başardığı etkinin testine benzer her etki için bir LR sağlamaktır. Örneğin, ana etki için LR temel etkisi içeren bir modeli için bir boş modeli karşılaştırmasını temsil eder, bir …

6
Farklı entropi türlerine iyi giriş
Sample Entropy ve Shannon Entropy gibi farklı entropi türlerini ve bunların avantajlarını ve dezavantajlarını açıklayan bir kitap veya çevrimiçi kaynak arıyorum. Birisi beni doğru yönde gösterebilir mi?


5
Neden bir oran için bir güven aralığı oluşturmak için t-dağılımını kullanmıyoruz?
Bilinmeyen popülasyon standart sapması (sd) ile ortalama güven aralığını (CI) hesaplamak için, t dağılımını kullanarak popülasyon standart sapmasını tahmin ediyoruz. Özellikle, CI=X¯±Z95%σX¯CI=X¯±Z95%σX¯CI=\bar{X} \pm Z_{95\% }\sigma_{\bar X} burada σX¯=σn√σX¯=σn\sigma_{\bar X} = \frac{\sigma}{\sqrt n} . Ancak, popülasyonun standart sapması hakkında nokta tahminimiz olmadığından, tahminimizCI=X¯±t95%(se)CI=X¯±t95%(se)CI=\bar{X} \pm t_{95\% }(se)olup, buradase=sn√se=snse = \frac{s}{\sqrt n} Buna …

4
Adil d6 kullanarak 1'den bağımsız olarak ve tekdüze tamsayılar çizmek ?
Bir miktar adil altı taraflı zar (d6) yuvarlayarak 1'den belirli bir tam sayılar çizmek istiyorum . İyi bir cevap, yönteminin neden düzgün ve bağımsız tamsayılar ürettiğini açıklayacaktır .NNN Açıklayıcı bir örnek olarak, bir çözümün durumunda nasıl çalıştığını açıklamak faydalı olacaktır .N=150N=150N=150 Ayrıca, prosedürün olabildiğince verimli olmasını dilerim: üretilen her sayı …


3
Parti büyüklüğü SGD'nin yakınsamasını nasıl etkiler ve neden?
Minibatch boyutu büyüdükçe SGD'nin yakınsamasının aslında zorlaştığı / kötüleştiği gibi birçok tartışmadan benzer bir sonuç gördüm, örneğin bu makale ve bu cevap . Ayrıca, erken aşamada küçük öğrenme oranları veya parti boyutları gibi hileler kullanan insanların büyük parti boyutları ile bu zorluğu gidermek için duydum. Ancak bir minibatch ortalama kaybı …

2
Üstel aile neden tüm dağıtımları içermiyor?
Kitap okuyorum: Piskopos, Örüntü Tanıma ve Makine Öğrenmesi (2006) üstel aileyi formun dağılımları olarak tanımlar (Denk. 2.194): p(x|η)=h(x)g(η)exp{ηTu(x)}p(x|η)=h(x)g(η)exp⁡{ηTu(x)}p(\mathbf x|\boldsymbol \eta) = h(\mathbf x) g(\boldsymbol \eta) \exp \{\boldsymbol \eta^\mathrm T \mathbf u(\mathbf x)\} Ancak veya üzerinde herhangi bir kısıtlama görmüyorum . Bu , h (\ mathbf x) ve \ mathbf u …

1
Eşzamanlı L1 ve L2 regülasyonu (elastik ağ olarak da bilinir) ile doğrusal regresyonun Bayesian yorumu var mı?
Bir cezası olan lineer regresyonun , katsayılardan önce bir Gaussian verilen MAP tahminini bulmaya eşdeğer olduğu iyi bilinmektedir . Benzer şekilde, bir cezası kullanmak, daha önce olduğu gibi bir Laplace dağılımı kullanmaya eşdeğerdir.l2l2l^2l1l1l^1 ve normalleştirmesinin bazı ağırlıklı kombinasyonlarını kullanmak nadir değildir . Bunun katsayılar üzerindeki önceki dağılımlara eşdeğer olduğunu söyleyebilir …

3
İzometrik log-oran dönüşümü nasıl yapılır
Hareket davranışları (uyku, hareketsiz ve fiziksel aktivite yapmak için harcanan zaman) hakkında yaklaşık 24 (günde saat cinsinden) olan verilerim var. Bu davranışların her birinde harcanan göreceli zamanı yakalayan bir değişken oluşturmak istiyorum - Bana bunu izometrik bir log-oran dönüşümünün başaracağı söylendi. R ilr işlevini kullanmalıyım gibi görünüyor, ancak kod ile …

2
Mini-toplu eğitim sinir ağları için rastgele seçilen eğitim örnekleri değiştirilmeden mi çekilmelidir?
Bir çağı, mevcut tüm eğitim örneklerinin tamamından geçmiş olarak ve mini-parti boyutunu, degradeyi azaltmak için gereken ağırlık / sapma güncellemelerini bulmak için ortalama örnek sayısı olarak tanımlarız. Benim sorum, bir çığır içindeki her bir mini partiyi üretmek için bir dizi eğitim örneği yerine getirilmememiz gerekip gerekmediğidir. Dönem sonu gereksinimini karşılamak …


Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.