İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Dirichlet Kümeleme işlemleri: etiketlerle nasıl başa çıkılır?
S: Dirichlet İşlemi kullanarak verileri kümelemenin standart yolu nedir? Gibbs örnekleme kullanılırken örnekleme sırasında kümeler belirir ve yok olur. Ayrıca posterior dağılımın küme yeniden etiketlemelerine değişmediği için bir tanımlanabilirlik problemimiz var. Böylece, bir kullanıcının küme hangisi olduğunu söyleyemeyiz, bunun yerine iki kullanıcının aynı kümede olduğunu (yani ).p ( cben= cj)p(ci=cj)p(c_i=c_j) …

1
Yığılmış otomatik kodlayıcı ile 2 katmanlı sinir ağı eğitimi arasında fark var mıdır?
Diyelim ki 2 katmanlı yığın otomatik kodlayıcı ve 2 katmanlı sinir ağı oluşturmak için bir algoritma yazıyorum. Aynı şeyler mi yoksa fark mı? Anladığım kadarıyla, bir yığın otomatik kodlayıcı oluşturduğumda, katman katman oluşturacağım. Sinir ağı için, ağdaki tüm parametreleri başlatırım ve daha sonra her veri noktası için, ağdan geçiririm ve …

2
Bootstrap yeniden örnekleme konusunda en iyi önerilen ders kitapları?
Ben sadece orada hangi bootstrap üzerinde mevcut en iyi kitaplar hangisi olduğunu sormak istedim. Bununla sadece geliştiricileri tarafından yazılmış olanı kastetmiyorum. Aşağıdaki kriterleri kapsayan önyükleme için hangi ders kitabının size en uygun olduğunu belirtebilir misiniz? Uygulanabilirlik alanı, güçlü ve zayıf yönleri, model seçimi için önemi listeleyen tekniğin felsefi / epistemolojik …


2
Yapay Sinir Ağları kullanarak Q-Learning hakkında sorular
Q-Learning'i aşağıda açıklandığı gibi uyguladım, http://web.cs.swarthmore.edu/~meeden/cs81/s12/papers/MarkStevePaper.pdf Yakl. S (S, A) Aşağıdaki gibi bir sinir ağı yapısı kullanıyorum, Aktivasyon sigmoid Girişler, giriş sayısı + Eylem nöronları için 1 (Tüm Girişler Ölçeklendirilmiş 0-1) Çıkışlar, tek çıkış. Q-Değer N M Gizli Katman sayısı. Keşif yöntemi rastgele 0 <rand () <propExplore Aşağıdaki formülü kullanarak …

1
“Faktör Analizinin Temel Teoremi” PCA için nasıl uygulanır veya PCA yüklemeleri nasıl tanımlanır?
Şu anda "faktör analizi" (anlayabildiğim kadarıyla PCA) için bir slayt seti geçiyorum. İçinde, analize giren verilerin korelasyon matrisinin ( ) faktör yükleri matrisi ( ) kullanılarak geri kazanılabileceğini iddia eden "faktör analizi temel teoremi" elde edilir :R,R\bf RbirA\bf A R = A A⊤R=AA⊤\bf R = AA^\top Ancak bu beni karıştırıyor. …


1
Tutarlı bir tahmincinin tanımı neden olduğu gibi? Alternatif tutarlılık tanımları ne olacak?
Vikipedi'den alıntı: İstatistik olarak, tutarlı bir tahmin edici veya asimptotik tutarlı tahmin bir parametrenin işlem tahminleri için bir tahmin-kuraldır özelliği -Ona sahip veri noktalarının sayısı süresiz artar kullanıldığı haliyle, olasılık tahmini yakınsak elde edilen sekans İçeride ISTV melerin RWMAIWi'nin ^ * .θ∗θ∗θ^*θ∗θ∗θ^* Bu ifadeyi kesinleştirmek için, θ∗θ∗\theta^* tahmin etmek istediğiniz …

2
Welch t-testi için serbestlik derecelerini bildirme
Eşitsiz varyanslar için Welch t testi (Welch-Satterthwaite veya Welch-Aspin olarak da bilinir) genellikle tamsayı olmayan bir serbestlik derecesine sahiptir . Test sonuçlarını bildirirken bu özgürlük dereceleri nasıl belirtilmelidir? Çeşitli kaynaklardan * göre "Standart t tabloları danışmadan önce en yakın tam sayıya yuvarlanacak geleneksel olan." - tutucudur yuvarlanması bu yönü olarak …


1
Birinci mertebeden türev sıfır iken Delta Yöntemi nasıl kullanılır?
http://en.wikipedia.org/wiki/Delta_method Wikipedia makalesinde, ' ning′(θ)g′(θ)g'(\theta) var olması ve g′(θ)g′(θ)g'(\theta) nin sıfır değerinin olmadığı varsayılmıştır . √ için asimtotik dağılım bulmak mümkün mü?n−−√(g(Xn)−g(θ))n(g(Xn)−g(θ))\sqrt{n}(g(X_n)-g(\theta)) göz önüne alındığında,g′(θ)g′(θ)g'(\theta)sıfır ve olabilirn−−√(Xn−θ)→dN(0,σ2)n(Xn−θ)→dN(0,σ2)\sqrt{n}(X_n-\theta) \stackrel{d}{\rightarrow} N(0,\sigma^2)?

3
Madde Yanıt Teorisi ve Doğrulayıcı Faktör Analizi
Madde Tepki Teorisi ile Doğrulayıcı Faktör Analizi arasındaki temel, anlamlı farklılıkların ne olduğunu merak ediyordum. Hesaplamalarda farklılıklar olduğunu anlıyorum (maddeye karşı kovaryanslara daha fazla odaklanma; log-lineer ve lineer). Bununla birlikte, bunun daha üst düzey bir perspektiften ne anlama geldiğine dair hiçbir fikrim yok - bu, IRT'nin bazı durumlarda CFA'dan daha …

5
Sansürlü veriler tam olarak nedir?
Sansürlü verilerin farklı açıklamalarını okudum: A) Bu iş parçacığında açıklandığı gibi, belirli bir eşiğin altında veya üstünde nicelleştirilmemiş veriler sansürlenir. Niteliksiz veri belirli bir eşiğin üzerinde veya altında olduğu anlamına gelir, ancak kesin değeri bilmiyoruz. Veriler daha sonra regresyon modelindeki düşük veya yüksek eşik değerinde işaretlenir . Çok net bulduğum …


1
QQ hattı için güven bantları
Bu soru özellikle ilgili değil R, ama bunu Rgöstermek için kullanmayı seçtim . A (normal) qq-line civarında güven bantları üretme kodunu düşünün: library(car) library(MASS) b0<-lm(deaths~.,data=road) qqPlot(b0$resid,pch=16,line="robust") Ben bu güven bantları nasıl inşa bir açıklama (veya alternatif bir kağıt / çevrimiçi belge açıklayan bir bağlantı) arıyorum (R yardım dosyalarında Fox 2002 …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.