İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

5
Neden AIC kullanarak model seçimi uygulamak, değişkenler için bana anlamlı olmayan p değerleri veriyor?
AIC ile ilgili bazı sorularım var ve umarım bana yardımcı olabilirsiniz. Verilerimdeki AIC'ye dayalı olarak model seçimi (geri veya ileri) uyguladım. Seçilen değişkenlerin bazıları p değeri> 0,05 ile sonuçlandı. İnsanların p-değeri yerine AIC'ye dayalı modeller seçmemiz gerektiğini söylediklerini biliyorum, bu yüzden AIC ve p-değeri iki fark kavramıdır. Birisi bana farkın …

2
MCMC Geweke teşhisi
Bir Metropolis örnekleyici (C ++) çalıştırıyorum ve yakınsama oranını tahmin etmek için önceki örnekleri kullanmak istiyorum. Bulduğum uygulaması kolay bir tanı , iki örnek aracı arasındaki farkı tahmin edilen standart hataya bölünen Geweke tanılamasıdır . Standart hata, spektral yoğunluktan sıfır olarak tahmin edilir. Zn= θ¯bir- θ¯B1nbirSbirθ^( 0 ) + 1nBSBθ^( …
14 mcmc  diagnostic 

5
QQ grafiğinin merkezine yakın yabancı noktaların kaldırılması
Ben (qqplot kullanarak ve ggplot2 içine veri besleme), R yaklaşık 1.2 milyon puanlık iki veri seti ile bir QQ-komplo çizmek çalışıyorum. Hesaplama yeterince kolaydır, ancak sonuçta ortaya çıkan grafiğin yüklenmesi oldukça yavaştır, çünkü çok fazla nokta vardır. 10000 sayısını azaltmak için doğrusal yaklaşım denedim (veri kümeleriniz diğerinden daha büyükse, qqplot …

1
Türevlerin çekirdek yoğunluk tahmincisi için en uygun bant genişliği var mı?
Çekirdek yoğunluk tahmincisini kullanarak bir dizi gözlem temelinde yoğunluk fonksiyonunu tahmin etmem gerekiyor. Aynı gözlem kümesine dayanarak, çekirdek yoğunluk tahmin edicisinin türevlerini kullanarak yoğunluğun birinci ve ikinci türevlerini de tahmin etmem gerekiyor. Bant genişliği kesinlikle nihai sonuç üzerinde büyük bir etkiye sahip olacaktır. İlk olarak, KDE bant genişliğini veren birkaç …

3
Sabit / rastgele efekt modellerinin arkasındaki kavramlar
Birisi sabit / rastgele efekt modellerini anlamama yardımcı olabilir mi? Bu kavramları sindirdiyseniz ya da beni herhangi bir karışıklık olmadan öğrenebilmem için belirli bir adresle (sayfa numarası, bölüm vb.) Kaynağa (kitap, notlar, web sitesi) yönlendirirseniz kendi yolunuzla açıklayabilirsiniz. Bu doğru mu? "Genel olarak sabit etkilerimiz var ve rastgele etkiler özel …

1
Kategorik değişkenler arasındaki etkileşimler dahil edildiğinde karma bir modelden regresyon çıktısının yorumlanması
Karışık bir model / lmer kullanmamla ilgili bir sorum var. Temel model şudur: lmer(DV ~ group * condition + (1|pptid), data= df) Grup ve koşul her iki faktördür: grup iki seviyeye (grup A, grup B) ve koşul üç seviyeye (koşul1, koşul2, koşul3) sahiptir. Bu, insan deneklerden elde edilen verilerdir, bu …


3
GAM modeli için güven aralığı
Reading mgcv::gamyardım sayfası: güven / güvenilir aralıklar, takılı bir model kullanılarak tahmin edilen herhangi bir miktar için kolayca kullanılabilir Ancak bir tane elde etmenin bir yolunu bulamıyorum. Ben predict.gambir type=confidenceve bir levelparametre olacağını düşündüm ama değil. Nasıl yaratılacağı konusunda bana yardım edebilir misin?

2
Bayes analizi için en uygun yazılım paketi
Bayesci Çıkarım yapmak için hangi yazılım istatistik paketini önereceğinizi merak ediyordum. Örneğin, openBUGS veya winBUGS'yi bağımsız olarak çalıştırabileceğinizi veya bunları R'den de çağırabileceğinizi biliyorum. Ancak R'nin bayes analizi yapabilen kendi paketleri (MCMCPack, BACCO) da var. Herkesin R'deki hangi bayes istatistik paketinin en iyi olduğu veya diğer alternatifler (Matlab veya Mathematica) …

3
Bu alıntı neden standart sapmanın tarafsız bir şekilde tahmin edilmesinin genellikle uygun olmadığını söylüyor?
Standart sapmanın tarafsız tahmininin hesaplandığını ve okuduğum kaynağın (...) bazı önemli durumlar dışında, görev, istatistik uygulamalarıyla çok az ilişkilidir, çünkü önem testlerinin ve güven aralıklarının kullanılması gibi standart prosedürlerle veya Bayes analizi kullanılarak ihtiyaçtan kaçınılır. Herkes bu ifadenin ardındaki mantığı aydınlatabilir mi diye merak ediyordum, örneğin güven aralığı standart sapmayı …

1
Sinir ağlarında ikili ve sürekli girdilerin bir karışımıyla nasıl başa çıkılır?
Kınamak için emlak fiyatları (kişisel proje) tahmin etmek için bir YSA oluşturmak için R nnet paketini kullanıyorum. Ben bu konuda yeniyim ve matematik geçmişim yok, bu yüzden lütfen bana çıplak. Hem ikili hem de sürekli girdi değişkenleri var. Örneğin, başlangıçta evet / hayır olan bazı ikili değişkenler, sinir ağı için …

2
En küçük kareler katsayısını atarak azlık
Diyelim ki normalize edilmiş bir karşı gerilemek istiyorum , ancak seyrek bir çözüm istiyorum. Regresyondan sonra, neden en küçük büyüklükteki katsayıların atılmasına izin verilmiyor?XYYYXXX Kayıt için, LARS ve LASSO yöntemlerini duydum ve sıklıkla kullanıyorum. Yukarıdaki yaklaşımın neden geçerli olmadığını merak ediyorum.

1
Sıfır şişirilmiş Poisson regresyonu
Diyelim ki bağımsız veY =( Y1, … , Yn)'Y=(Y1,…,Yn)′ \textbf{Y} = (Y_1, \dots, Y_n)' Yben= 0Yben= kolasılıkla p ben+ ( 1 - pben) e- λbenolasılıkla ( 1 - p ben) e- λbenλkben/ k!Yi=0with probability pi+(1−pi)e−λiYi=kwith probability (1−pi)e−λiλik/k!\eqalign{ Y_i = 0 & \text{with probability} \ p_i+(1-p_i)e^{-\lambda_i}\\ Y_i = k & \text{with …


2
Farklı örnek boyutlarına sahip grup ortalamalarına dayanan tahmin değişkenleriniz varsa ne yapabilirsiniz?
sonucunuz olan ve bunun bir dizi belirleyicisiyle nasıl ilişkili olduğu klasik bir veri analizi problemini düşünün . Burada akla gelen temel uygulama türü X, i 1 , . . . , X i pYiYiY_{i}Xi1,...,XipXi1,...,XipX_{i1}, ..., X_{ip} YiYiY_{i} , kentindeki suç oranı gibi grup düzeyinde bir sonuçtur .iii Tahmini, şehir demografik …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.