İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap


3
Kovaryans sıfıra eşit mi ikili rassal değişkenler için bağımsızlık anlamına gelir?
Eğer ve vardır bunu nasıl gösterebileceklerini sadece iki olası durumları alabilir iki rasgele değişkenler, bağımsızlığını ima? Bu tür bağımsızlık anlamına gelmediği gün öğrendiklerime ters düşüyor ...XXXYYYCov(X,Y)=0Cov(X,Y)=0Cov(X,Y) = 0Cov(X,Y)=0Cov(X,Y)=0Cov(X,Y) = 0 İpucu , olası durumlar olarak ve ile başlayıp oradan genelleme söylüyor. Ve bunu yapabilirim ve gösterebilirim , ama bu bağımsızlık …

3
Değişkenlerden biri kategorik olduğunda korelasyon neden çok yararlı değildir?
Bu biraz bağırsak kontrolü, lütfen bu kavramı yanlış anlayıp anlamadığımı görmem için bana yardım et. İşlevsel bir korelasyon anlayışım var ama bu fonksiyonel anlayışın arkasındaki ilkeleri gerçekten güvenle açıklamak için pipetleri biraz kavramış hissediyorum. Anladığım kadarıyla, istatistiksel korelasyon (terimin daha genel kullanımının aksine), iki sürekli değişkeni ve bunların nasıl yükselme …

1
Sadece 1 gözlemle rastgele etkiler genelleştirilmiş doğrusal karışık modeli nasıl etkiler?
Rasgele bir efekt olarak kullanmak istediğim değişkenin sadece bazı seviyeler için tek bir gözlemi olduğu bir veri setim var. Önceki soruların cevaplarına dayanarak, prensip olarak, bunun iyi olabileceğini topladım. Sadece 1 gözlemi olan deneklerle karışık bir model takabilir miyim? Rastgele engelleme modeli - konu başına bir ölçüm Ancak, ikinci linkte …

3
Beta rasgele değişkenin ters normal CDF'si hangi dağılımı takip eder?
Varsayalım: X∼ Beta ( α , β)X∼Beta(α,β)X\sim\mbox{Beta}(\alpha,\beta) Y∼ Φ- 1( X)Y∼Φ−1(X)Y\sim \Phi^{-1}(X) burada , standart normal dağılımın CDF'sinin tersidir .Φ- 1Φ−1\Phi^{-1} Sorum şu: takip ettiği ya da yakın olabileceği basit bir dağılım var mı? YYYYYYY -Y a p a = 1 ; β = 1 X YSimülasyon sonuçlarına (aşağıda gösterilmiştir) …

1
Aşırı değerlere bağımlı (kabaca) bağımsız değişkenlerin herhangi bir örneği var mı?
Ben 2 rastgele değişken XXX , bir örnek arıyorum YYYki |cor(X,Y)|≈0|cor(X,Y)|≈0\newcommand{\cor}{{\rm cor}}|\cor(X,Y)| \approx 0 fakat dağılımların kuyruk kısmı düşünüldüğünde, yüksek derecede ilişkilidirler. (Kuyruk için 'korelasyonlu' / 'korelasyon'dan kaçınmaya çalışıyorum çünkü doğrusal olmayabilir). Muhtemelen bunu kullanın: |cor(X′,Y′)|≫0|cor(X′,Y′)|≫0|\cor(X', Y')| \gg 0 burada X′X′X' koşullu üzerinde X>90%X>90%X > 90\% arasında XXX nüfusunun ve …

1
İki dünya çarpışıyor: Karmaşık anket verileri için ML'yi kullanma
Görünüşte kolay bir sorunla karşılaştım, ancak birkaç hafta boyunca uygun bir çözüm bulamadım. Çok sayıda anket / anket verilerim var (on binlerce katılımcı, veri seti başına 50 bin), umarım ağırlıklar, tabakalaşma, spesifik yönlendirme vb. Her katılımcı için demografi (yaş, bölge ...) ve daha sonra çoğunlukla ikili (en fazla kategorik) değişkenler …

3
Neden bir RNN'de zaman içinde geri yayılır?
Tekrarlayan bir sinir ağında, genellikle birkaç zaman adımında ilerler, ağı "açar" ve daha sonra girdi dizisi boyunca geri yayılırsınız. Neden sadece sekanstaki her bir adımdan sonra ağırlıkları güncellemiyorsunuz? (1 kısaltma uzunluğunun kullanılmasına eşdeğerdir, bu yüzden açılacak bir şey yoktur) Bu, yok olan degrade sorununu tamamen ortadan kaldırır, algoritmayı büyük ölçüde …

2
Palantir'in Asya'daki ayrımcılık davası: olasılıklar nasıl hesaplandı?
Palantir'in Çalışma Departmanının onları Asyalılara karşı ayrımcılıkla suçladığı dava hakkındaki bu makaleyi okudum . Herkes bu olasılık tahminlerini nereden aldıklarını biliyor mu? (A) maddesinde 1/741 elde edemiyorum. (a) KG Mühendisi pozisyonu için, yaklaşık% 77'si Asyalı olan 730'dan fazla nitelikli başvuru havuzundan Palantir altı Asya dışı başvuru sahibi ve sadece bir …

2
İki lineer regresyon modeli göz önüne alındığında, hangi model daha iyi performans gösterir?
Üniversitemde bir makine öğrenimi kursu aldım. Sınavlardan birinde bu soru soruldu. Model 1: y=θx+ϵy=θx+ϵ y = \theta x + \epsilon Model 2: y=θx+θ2x+ϵy=θx+θ2x+ϵ y = \theta x + \theta^2 x + \epsilon Yukarıdaki modellerden hangisi verilere daha uygun? (verilerin doğrusal regresyon kullanılarak modellenebileceğini varsayın) Doğru cevap (profesöre göre) her iki …


3
Örüntü tanıma görevlerinde son teknoloji topluluk öğrenme algoritması?
Bu sorunun yapısı şöyledir: ilk olarak, topluluk öğrenme kavramını sağlarım , ayrıca örüntü tanıma görevlerinin bir listesini veririm, daha sonra topluluk öğrenme algoritmalarına örnekler veririm ve son olarak sorumu tanıtırım. Tüm ek bilgilere ihtiyaç duymayanlar sadece başlıklara bakabilir ve doğrudan soruma gidebilirler. Topluluk öğrenimi nedir? Wikipedia makalesine göre : İstatistik …


1
Örnek korelasyon katsayısı popülasyon korelasyon katsayısının tarafsız bir tahmincisi midir?
un için tarafsız bir tahmin edici olduğu doğru mu? Yani, ρ X , Y, E [ R, X , Y, ] = ρ X , Y, ?RX,YRX,YR_{X,Y}ρX,YρX,Y\rho_{X,Y}E[RX,Y]=ρX,Y?E[RX,Y]=ρX,Y?\mathbf{E}\left[R_{X,Y}\right]=\rho_{X,Y}? Değilse, için tarafsız bir tahminci nedir? (Belki de kullanılan standart bir tarafsız tahminci var mı? Ayrıca, taraflı örnek varyansının basitçe ile çarpılmasını basit …

2
Hamiltonian Monte Carlo
Birisi Hamiltonian Monte Carlo yöntemlerinin arkasındaki ana fikri açıklayabilir ve hangi durumlarda Markov Zinciri Monte Carlo yöntemlerinden daha iyi sonuçlar verecektir?
14 bayesian  mcmc  hmc 

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.