İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
M-tahmin edicisinin gerçek ortama yaklaşması için koşullar
Bir gauss dağıtımından ve M tahmincisinden , üzerinde özellikleri neler garanti etmek için yeterli olasılık? Mı kesinlikle dışbükey olmak ve kesinlikle yeterli artan?X1,...,Xn∼N(μ,σ)X1,...,Xn∼N(μ,σ)X_1,...,X_n \sim N(\mu,\sigma) μm=argmina∑ρ(|Xi−a|)μm=argmina∑ρ(|Xi−a|)\mu_m = \underset{a}{\operatorname{argmin}} \sum\rho(|X_i-a|)ρρ\rhoμm→μμm→μ\mu_m \rightarrow \muρρ\rho
10 estimation 

1
Karışık modellerde zamanın bir yordayıcı olarak yer almasına izin veriliyor mu?
Her zaman zamanın regresyonlarda (gamlar dahil) bir yordayıcı olarak kullanılmaması gerektiğine inanıyordum, çünkü o zaman, kişi sadece trendin kendisini "tanımlayacaktır". Bir çalışmanın amacı, bir hayvanın aktivitesindeki varyansı açıklayan sıcaklık vb. Çevresel parametreleri bulmaksa, o zaman merak ediyorum, zaman nasıl faydalı olabilir? ölçülemeyen parametreler için bir proxy olarak? Liman porpoises aktivite …

2
Zaman serisi kümelerinin karşılaştırılması
Karşılaştırmak istediğim üç dizi zaman serisi veri var. Yaklaşık 12 günlük 3 ayrı periyotta alınmıştır. Final haftalarında bir üniversite kütüphanesinde alınan ortalama, maksimum ve minimum kafa sayımlarıdır. Saat başı sayımları sürekli olmadığından ortalama, maksimum ve min yapmak zorunda kaldım (bkz . Zaman serisindeki düzenli veri boşlukları ). Şimdi veri seti …

4
Demograflar neden 100.000 kişi başına ücret veriyor?
Demografik istatistiklerin yılda 100.000 nüfus olarak verildiği evrensel görünmektedir. Mesela intihar oranları, cinayet oranları, özürlülük ayarlı yaşam yılı, liste uzayıp gidiyor. Neden? Kimyadan bahsediyorsak, milyonda parça (ppm) yaygındır. İnsanları sayma eylemi neden temelde farklı görünüyordu? 100.000 sayısının SI sisteminde bir temeli yoktur ve söyleyebildiğim kadarıyla, yüzde ile zayıf bir ilişki …
10 demography  units 




1
Düşük seviyeli lineer sistemin hızlı hesaplanması / tahmini
Doğrusal denklem sistemleri, hesaplama istatistiklerinde yaygındır. Karşılaştığım özel bir sistem (örneğin, faktör analizinde) sistemdir A x = bbirx=bAx=b burada Burada D , kesinlikle pozitif bir diyagonal olan bir n × n diyagonal matristir, Ω bir m × m ( m ≪ n ile ) simetrik pozitif yarı tanımlanmış matristir ve …

2
Daha önce verilen verilerin geçerliliğini test edebilir miyim?
Sorun Bilgilendirilmiş bir ön ve veri verilen bir posterior yoğunluğu tahmin etmek için Bayes analizi yapan bir R fonksiyonu yazıyorum. Kullanıcının öncekini yeniden düşünmesi gerekiyorsa işlevin bir uyarı göndermesini istiyorum. Bu soruda, bir önceliğin nasıl değerlendirileceğini öğrenmekle ilgileniyorum. Önceki sorular bilgilendirilmiş öncelikleri ( burada ve burada ) belirtme mekaniğini kapsamıştır …

2
Kalman filtresi için parametreler nasıl tahmin edilir?
Önceki bir soruda, Gauss olmayan bazı ampirik verilere dağıtımların yerleştirilmesi hakkında bilgi aldım. Bana çevrimdışı olarak, verilerin Gauss olduğu varsayımını deneyebileceğim ve önce bir Kalman filtresine sığabileceğim önerildi. Ardından, hatalara bağlı olarak, daha meraklı bir şey geliştirmeye değip değmeyeceğine karar verin. Mantıklı. Bu nedenle, güzel bir dizi zaman verisiyle, Kalman …

3
Rasgele iz tekniği
Berkeley, Tech. California'daki M. Seeger'de “Cholesky ayrışması için düşük seviyeli güncellemeler” adlı şu rasgele izleme tekniğiyle tanıştım . Rep, 2007. tr(A)=E[xTAx]tr⁡(A)=E[xTAx]\operatorname{tr}(\mathbf{A}) = {E[\mathbf{x}^T \mathbf{A} \mathbf{x}]} burada .x∼N(0,I)x∼N(0,I)\mathbf{x} \sim N(\mathbf{0},\mathbf{I}) Derin matematik bilgisi olmayan bir kişi olarak, bu eşitliğin nasıl sağlanabileceğini merak ediyorum. Ayrıca, , örneğin geometrik olarak nasıl yorumlanabilir? Bir …

3
ITT ve ATE arasındaki fark nedir?
Bir etki değerlendirmesinde kullanılabilecek farklı tahmin edicileri anlamakta güçlük çekiyorum. Tedavi etme niyeti (ITT) tahmin edicisinin, programa sahip olmayan uygun kişiler ile programa uygun bireyler arasındaki uyumsuzluğa bakılmaksızın farklılıkları karşılaştırdığını biliyorum. Ancak, ortalama tedavi etkisinin (ATE) de aynı şeyi ölçtüğünü düşündüm. Ancak, ATE'nin uygunluğu dikkate aldığı görülmektedir. Bu nedenle, uygun …

2
AUC kullanmanın gerekçesi?
Özellikle makine öğrenimi literatürünün bilgisayar bilimi odaklı tarafında, AUC (alıcı operatör karakteristik eğrisinin altındaki alan) sınıflandırıcıları değerlendirmek için popüler bir kriterdir. AUC kullanımının gerekçeleri nelerdir? En iyi kararın en iyi AUC'ye sahip sınıflandırıcı olduğu belirli bir kayıp fonksiyonu var mı?

6
Bulutta çalışan bir R oturumu ile etkileşim kurmanın en iyi yolu
Kilitli . Bu soru ve cevapları kilitlidir çünkü soru konu dışıdır, ancak tarihsel önemi vardır. Şu anda yeni yanıtları veya etkileşimleri kabul etmiyor. R, amazon EC2'de , biyoiletken AMI'nin değiştirilmiş bir versiyonunu kullanarak çalışıyor . Şu anda, sunucuya ssh için macun kullanıyorum, komut satırından R'yi başlatarak ve komut dosyasını kopyalayıp …
10 r 

2
R ile ikilik veriler üzerinde faktör analizi için önerilen prosedür
İki değişkenli (0 = evet, 1 = hayır) veri kümesinde bir faktör analizi yapmak zorundayım ve doğru yolda olup olmadığımı bilmiyorum. Kullanarak tetrachoric()üzerinde çalıştığım bir korelasyon matrisi yaratırım fa(data,factors=1). Sonuç MixFactor kullanırken aldığım sonuçlara oldukça yakın , ama aynı değil. Bu uygun mu yoksa başka bir prosedür önerir misiniz? Neden …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.