İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap


1
vcovHC, vcovHAC, NeweyWest - hangi işlevi kullanmalı?
Doğru standart hataları ve testleri almak için lm () tabanlı modelimi güncellemeye çalışıyorum. Hangi VC matrisini kullanacağım gerçekten kafam karıştı. sandwichPaket teklifler vcovHC, vcovHACve NeweyWest. İlki sadece heteroskedastisiteyi açıklarken, son ikisi seri korelasyon ve heteroskedastisiteyi açıklar. Ancak, belgeler son ikisi arasındaki fark hakkında çok fazla bilgi vermiyor (en azından anlamıyorum). …

1
Kalman filtresi ve yivleri düzleştirme
S: Yivleri yumuşatmak yerine durum uzayı modellemesi ve Kalman filtrelemesi kullanmak hangi veriler için uygundur? İkisi arasında bir denklik ilişkisi var mı? Bu yöntemlerin birbirine nasıl uyduğuna dair üst düzey bir anlayış edinmeye çalışıyorum. Johnstone'un yeni Gauss Tahmini: Dizi ve Çoklu Çözünürlük Modelleri'ne göz attım . Durum-uzay modelleri ve Kalman …

3
R'de faktörlerle doğrusal regresyon
R faktörleri tam olarak nasıl çalıştığını anlamaya çalışıyorum Diyelim ki bazı örnek verileri R kullanarak bir regresyon çalıştırmak istiyorum: > data(CO2) > colnames(CO2) [1] "Plant" "Type" "Treatment" "conc" "uptake" > levels(CO2$Type) [1] "Quebec" "Mississippi" > levels(CO2$Treatment) [1] "nonchilled" "chilled" > lm(uptake ~ Type + Treatment, data = CO2) Call: lm(formula …


1
Regresyon eğimlerini karşılaştırarak gruplar arasındaki korelasyonları karşılaştırabilir miyiz?
Gelen bu soruya onlar (örneğin kadın vs erkek olarak) iki bağımsız gruplar için Pearson r karşılaştırmak nasıl sorun. Yanıt ve yorumlar iki yol önerdi: R "z-dönüşümü" kullanarak Fisher iyi bilinen formülü kullanın; Eğimlerin karşılaştırmasını kullanın (regresyon katsayıları). İkincisi, sadece doymuş bir doğrusal model ile kolayca gerçekleştirilebilir: Y= a + b …




4
İstatistiğe teorik yaklaşım hakkında iyi bir kitap
10 yıl önce bir teorik istatistik dersi aldığımda, Dudewicz ve Mishra'nın Modern Matematik İstatistiklerini kullandık . Kendimi şimdi kitaba atıfta bulunarak buluyorum ve bazı kod örnekleri bir IBM 370 için montajda olduğunu hatırlattı. Antika olsa da, ben yardım edemem ama bu biraz tarihli hissediyorum. Daha eski vintagelardan hangi yüksek kaliteli …
10 references 

2
Hokey oyuncuları tarafından atılan toplam kariyer hedeflerini tahmin ederken Poisson regresyonunda bir ofset kullanıp kullanmayacağı
Bir ofset kullanıp kullanmama konusunda bir sorum var. Hokeydeki (toplam) gol sayısını tanımlamak istediğiniz çok kolay bir model olduğunu varsayalım. Yani hedefleriniz, oynanan oyunların sayısı ve oyuncu bir forvet ise 1'e eşit olan bir kukla değişken "forvet" var, aksi takdirde 0. Peki, aşağıdaki modellerden hangileri doğru bir şekilde belirtildi? goals …

2
Sol eğimli ve simetrik dağılım gözlendi
Bunu tanımlamak benim için oldukça zor, ama problemimi anlaşılır yapmaya çalışacağım. Bu yüzden önce şunu bilmelisiniz ki şu ana kadar çok basit bir doğrusal regresyon yaptım. Katsayıyı tahmin etmeden önce, dağılımını izledim . Ağır eğri kaldı. Modeli tahmin ettikten sonra, QQ-Parselinde sol eğimli bir kalıntıyı wel olarak gözlemlediğimden emindim, ama …


1
Gaussian verimliliği ne anlama geliyor?
Güçlü tahmin ediciler söz konusu olduğunda, Gauss verimliliği ne demektir? ÖrneğinSnSnQ_{_n} % 82 Gauss verimliliği ve% 50 arıza noktasına sahiptir. Referans: Rousseeuw PJ ve Croux, C. (1993). “Ortanca mutlak sapmaya alternatifler.” J. American Statistical Assoc., 88, 1273-1283

1
Oran Oranlarının Standart Hatası nasıl hesaplanır?
Genom çapında ilişki çalışmalarından iki veri setim var. Mevcut tek bilgi ilk veri seti için olasılık oranı ve p değeridir. İkinci veri seti için, Oran Oranı, p değeri ve alel frekansları (AFD = hastalık, AFC = kontroller) var (örn: 0.321). Bu verilerin bir meta-analiz yapmaya çalışıyorum ama bunu gerçekleştirmek için …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.