İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

3
Yaygın sayım verileri için uygun model nedir?
Görünüşe göre dağılmış olan R sayım verilerini modellemeye çalışıyorum (Dağılım Parametresi ~ .40). Bu muhtemelen glm, bir family = poissonveya negatif binomial ( glm.nb) modelinin anlamlı olmamasıdır. Verilerimin tanımlayıcılarına baktığımda, sayım verilerinde tipik bir çarpıklık yok ve iki deney koşulumdaki artıklar da homojen. Yani benim sorularım: Sayım verilerim sayım verileri …

3
Gaussian çekirdeği için özellik haritası
x,y∈RnφK(x,y)=exp(−∥x−y∥222σ2)=ϕ(x)Tϕ(y)K(x,y)=exp⁡(−‖x−y‖222σ2)=ϕ(x)Tϕ(y)K(x,y)=\exp\left({-\frac{\|x-y\|_2^2}{2\sigma^2}}\right)=\phi(x)^T\phi(y)x,y∈Rnx,y∈Rnx, y\in \mathbb{R^n}ϕϕ\phi Ben de olmadığını bilmek istiyorum nerede . Şimdi, bunun eşit olmadığını düşünüyorum, çünkü bir çekirdek kullanmak, doğrusal sınıflayıcının çalışmadığı durumu ele alır. x'i sonsuz bir alana biliyorum . Bu yüzden hala doğrusal kalırsa, kaç boyut olursa olsun, svm hala iyi bir sınıflandırma yapamaz. ci∈Rϕ∑iciϕ(xi)=ϕ(∑icixi)∑iciϕ(xi)=ϕ(∑icixi)\sum_ic_i\phi(x_i)=\phi \left(\sum_ic_ix_i \right)ci∈Rci∈Rc_i\in \mathbb …

2
Scikit-learn'deki ortalama mutlak yüzde hatası (MAPE) [kapalı]
Kapalı. Bu soru konu dışı . Şu anda cevapları kabul etmiyor. Bu soruyu geliştirmek ister misiniz? Sorunuzu güncelleyin o yüzden -konu üzerinde Çapraz doğrulanmış için. 2 yıl önce kapandı . Python ve scikit-learn kullanarak tahminlerimizin Ortalama mutlak yüzde hatasını (MAPE) nasıl hesaplayabiliriz? Gönderen dokümanlar , biz bağlanımlar için sadece bu …

5
Değişim noktası analizi için Python modülü
Bir zaman serisinde bir değişim noktası analizi yapan bir Python modülü arıyorum. Çok sayıda farklı algoritma var ve algoritmaların her birini elden almak zorunda kalmadan bazılarının etkinliğini araştırmak istiyorum. İdeal olarak bcp (Bayesian Change Point) ya da R'deki strucchange paketleri gibi bazı modüller istiyorum. Bazılarını Scipy'de bulmayı umuyordum ama hiçbir …

4
Çok değişkenli normal dağılımın miktarları (izolinler) nasıl belirlenir?
Çok değişkenli dağılımın bir miktarını nasıl hesaplayabileceğimle ilgileniyorum. Rakamlarda, belirli bir tek değişkenli normal dağılımın% 5 ve% 95'lik miktarlarını çizdim (solda). Sağdaki çok değişkenli normal dağılım için, bir analogun yoğunluk fonksiyonunun temelini saran bir izolin olacağını hayal ediyorum. Aşağıda bunu paket kullanarak hesaplamaya çalıştığım bir örnek mvtnorm- ancak başarılı olamayacağım. …

6
Yapısal eşitlik modellemeye giriş
Meslektaşlarımdan, bu konuda gerçekten bilmediğim bazı yardımlar isteniyor. Bir çalışmada bazı gizli değişkenlerin rolü hakkında hipotezler yapmışlar ve bir hakem onlardan SEM'de resmi olmalarını istedi. İhtiyacı olan şey çok zor görünmüyor, sanırım bir çekim yapacağım ... şimdilik, konuyla ilgili iyi bir giriş yapacağım! Google bu konuda gerçekten arkadaşım değildi. Şimdiden …

3
ANOVA'dan sonra yapılan hoc testi, R kullanarak tekrarlanan ölçümlerle
Aşağıdaki gibi R'de ANOVA'yı tekrarlı olarak ölçtüm: aov_velocity = aov(Velocity ~ Material + Error(Subject/(Material)), data=scrd) summary(aov_velocity) R'de hangi sözdizimi, bir ANOVA'dan sonra tekrarlanan ölçümlerle post hoc testi yapmak için kullanılabilir? Tukey'nin Bonferroni düzeltmeli testi uygun olur mu? Öyleyse, bu R'de nasıl yapılabilir?

2
Parzen pencere (çekirdek) yoğunluk tahminini mesleğin cinsinden açıklayabilir misiniz?
Parzen pencere yoğunluğu tahmini p ( x ) = 1nΣi = 1n1h2ϕ ( xben- xh)p(x)=1nΣben=1n1h2φ(xben-xh) p(x)=\frac{1}{n}\sum_{i=1}^{n} \frac{1}{h^2} \phi \left(\frac{x_i - x}{h} \right) burada vektörün elemanların sayısı, X bir vektördür p ( x ) bir olasılık yoğunluk olan x , s Parzen pencere boyutu ve φ bir pencere fonksiyonudur.nnnxxxp ( x …

3
'Takma ad katsayıları' nedir?
R ( lm) 'de bir regresyon modeli oluştururken, sık sık bu mesajı alıyorum "there are aliased coefficients in the model" Tam olarak ne anlama geliyor? Ayrıca, bu predict()nedenle de bir uyarı veriyor. Bu sadece bir uyarı olmasına rağmen, bir model oluşturmadan önce takma katsayıları nasıl tespit edeceğimizi / kaldırabileceğimizi bilmek …
24 r  regression 


1
F1 / Zar-Skor vs IoU
F1 skoru, Dice skoru ve IoU (sendika kesişme) arasındaki farklar konusunda kafam karıştı. Şimdiye dek F1 ve Dice'in aynı anlama geldiğini öğrendim (doğru?) Ve IoU'nun diğer ikisine çok benzer bir formülü var. F1 / Zar:2 TP2 TP+ FP+ FN-2TP2TP+FP+FN-\frac{2TP}{2TP+FP+FN} IoU / Jaccard: kırıkTPTP+ FP+ FN-TPTP+FP+FN-\frac{TP}{TP+FP+FN} F1'in gerçek-pozitifleri daha da arttırması …

2
Elastik bir ağ regresyonunda lambda neden “minimumdan bir standart hata içinde” lambda için önerilen bir değerdir?
Lamda'nın esnek-net bir regresyonda oynadığı rolü anlıyorum. Ve neden lambda.min'i seçtiğini anlayabiliyorum, çapraz doğrulanmış hatayı en aza indiren lambda'nın değeri. Benim sorum şudur : İstatistik literatüründe lambda.1se kullanımı tavsiye edilir, yani CV hatasını artı bir standart hatayı en aza indiren lambda değeri nedir? Resmi bir alıntı ya da bunun genellikle …

2
Dropout ve drop connect arasındaki fark nedir?
Dropout ve drop connect arasındaki fark nedir? AFAIK, bırakma, eğitim sırasında gizli düğümleri rastgele düşürür, ancak onları testte tutar ve damla bağlantılarını düşürür. Ancak bağlantıları düşürmek gizli düğümleri düşürmekle eşdeğer değil mi? Düğümler (veya bağlantılar) sadece bir ağırlık seti değil mi?

2
Filtre matrisinin elemanları nasıl başlatılır?
Daha iyi (Convnet veya TensorFlow gibi) kütüphanelere bağlı olmayan Python kodunu yazarak kıvrımlı sinir ağlarını daha iyi anlamaya çalışıyorum ve ne zaman çekirdek matris için değerleri seçmek için literatürde sıkışıp kalıyorum görüntü üzerinde evrişim yapmak. Bir CNN katmanları gösteren aşağıdaki resimde özellik haritaları arasındaki adımda uygulama ayrıntılarını anlamaya çalışıyorum . …

3
1 ile 100 arasında 25 rastgele sayının en fazla birden fazla görünmesi olasılığı nedir?
Birçok çevrimiçi oyunda, oyuncular zor bir görevi tamamladığında, bazen görevi tamamlayan herkesin kullanabileceği özel bir ödül verilir. bu genellikle bir montajdır (taşıma yöntemi) veya başka bir makyaj malzemesidir (karakterin performansını artırmayan ve esas olarak görünüm kişiselleştirmesi için kullanılır). Böyle bir ödül verildiğinde, ödülü kimin kazandığını belirlemenin en yaygın yolu rastgele …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.