İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

3
CIFAR-10% 60'ın üzerinde Doğruluk, Tensorflow arka uçlu Keras [kapalı]
Kapalı. Bu soru konu dışı . Şu anda cevapları kabul etmiyor. Bu soruyu geliştirmek ister misiniz? Sorunuzu güncelleyin o yüzden -konu üzerinde Çapraz doğrulanmış için. Geçen yıl kapalı . CIFAR-10 veri setinde 15 dönemden sonra yapılan eğitim, geçerlilik kaybının artık azalmamasına ve 1.4'e (% 60 doğrulama doğruluğu ile) bağlı kalmayacağı …

2
Yetersizlik testlerinde null değeri kabul edebilir miyiz?
Her zamanki ortalama t-testinde, olağan hipotez test yöntemlerini kullanarak null değerini reddederiz veya null değerini reddedemeyiz, ancak null değerini asla kabul etmeyiz. Bunun bir nedeni, daha fazla kanıtımız olursa, aynı etki büyüklüğünün önemli hale gelmesidir. Fakat aşağılık testinde ne olur? Yani: H0:μ1−μ0≤xH0:μ1−μ0≤xH_0: \mu_1 - \mu_0 \le x vs. H1:μ1−μ0>xH1:μ1−μ0>xH_1: \mu_1 …

1
Rastgele Orman regresörü veya sınıflandırıcı seçmeli miyim?
Ben rastgele orman tarafından bir ikili hedef sınıf ile bir veri kümesi sığdırmak. Python'da bunu randomforestclassifier veya randomforestregressor ile yapabilirim. Sınıflandırmayı doğrudan randomforestclassifier'dan alabilirim veya önce randomforestregressor'u çalıştırabilir ve bir dizi tahmini puan geri alabilirim (sürekli değer). Sonra tahmin sınıfları puan kümesinden türetmek için bir kesme değeri bulabilirim. Her iki …

3
AR (1) katsayısının OLS tahmincisi neden taraflı?
OLS'un neden AR (1) sürecinin taraflı bir tahmincisi verdiğini anlamaya çalışıyorum. Düşünmek ytεt= α + βyt - 1+εt,~ben ben dN-( 0 , 1 ) .yt=α+βyt−1+ϵt,ϵt∼iidN(0,1). \begin{aligned} y_{t} &= \alpha + \beta y_{t-1} + \epsilon_{t}, \\ \epsilon_{t} &\stackrel{iid}{\sim} N(0,1). \end{aligned} Bu modelde katı dışsallık ihlal edilmiştir, yani ytyty_t ve εtϵt\epsilon_t korelasyonlu …

4
AUC, her sınıftan rastgele seçilen bir örneği doğru bir şekilde sınıflandırma olasılığı mıdır?
Bu yazıyı bir makalede okudum ve AUC'nin başka hiçbir yerde bu şekilde tanımlandığını görmedim. Bu doğru mu? Bunu görmenin bir kanıtı veya basit bir yolu var mı? Şekil 2, alıcı-çalışma karakteristik eğrisinin (AUC) altındaki alan olarak ifade edilen, her bir sınıftan (örneğin, erkek ve kadın) rastgele seçilen iki kullanıcının doğru …

3
Holt-Winters veya ARIMA mı kullanıyorsunuz?
Benim sorum Holt-Winters ve ARIMA arasındaki kavramsal fark etrafında. Anladığım kadarıyla Holt-Winters, ARIMA'nın özel bir örneğidir. Ancak bir algoritma diğerine göre ne zaman tercih edilir? Belki Holt-Winters artımlıdır ve bu nedenle satır içi (daha hızlı) bir algoritma olarak hizmet eder? Burada bir fikir bekliyorum.

3
Kademeli regresyonun avantajları nelerdir?
Soruna yaklaşımımdaki çeşitlilik uğruna adım adım gerileme deniyorum. 2 sorum var: Kademeli regresyonun avantajları nelerdir? Özel güçlü yanları nelerdir? Özellikleri seçmek için aşamalı regresyon kullandığınız ve daha sonra seçilen tüm özellikleri bir arada alarak düzenli regresyon uyguladığınız hibrit yaklaşım hakkında ne düşünüyorsunuz?

1
Mantıksallığın sezgisel açıklaması
Çeşitli kaggle yarışmalarında puanlama "mantık" temel alınarak yapıldı. Bu, sınıflandırma hatasıyla ilgilidir. İşte teknik bir cevap ama sezgisel bir cevap arıyorum. Mahalanobis mesafesiyle ilgili bu sorunun cevaplarını çok beğendim , ancak PCA mantık değil. Sınıflandırma yazılımımın ortaya koyduğu değeri kullanabilirim, ama gerçekten anlamıyorum. Neden doğru / yanlış pozitif / negatif …

2
LSTM kullanarak dil modelleme görevlerinde bilinmeyen kelimeleri işleme
Doğal bir dil işleme (NLP) görevi için sözcükler için gömme olarak genellikle word2vec vektörleri kullanılır. Bununla birlikte, word2vec vektörleri tarafından yakalanmayan birçok bilinmeyen kelime olabilir, çünkü bu kelimeler eğitim verilerinde yeterince sık görülmemektedir (birçok uygulama, kelimeye bir kelime eklemeden önce minimum sayıyı kullanır). Bu, özellikle kelimelerin genellikle yanlış yazıldığı Twitter'dan …


1
Bir orantı veya kesir olan bir yanıt değişkenine binom GLMM (glmer) takma
Birisinin nispeten basit bir soru olduğunu düşündüğüm şeylere yardımcı olabileceğini umuyorum ve bence cevabı biliyorum ama onaylamadan emin olamayacağım bir şey haline geldi. Yanıt değişkeni olarak bazı sayım verileri var ve bu değişken bir şeyin orantılı varlığı ile nasıl değiştiğini ölçmek istiyorum. Daha ayrıntılı olarak, yanıt değişkeni, bir dizi alanda …

1
Tren / geçerli / test setinden ortalama çıkarma ile ilgili soru
Ben veri önişleme yapmak ve sonra benim veriler üzerinde bir Convonets inşa edeceğim. Sorum şu: 100 görüntülü toplam veri kümem var, 100 görüntünün her biri için ortalama hesaplıyorum ve sonra görüntülerin her birinden çıkartıyorum, sonra bunu tren ve doğrulama kümesine ayırdım ve aynısını yapıyorum belirli bir test setinde işlem yapmak …



1
İkili enstrüman ve ikili endojen değişken ile enstrümantal değişken regresyonunda ikinci evre katsayısı nasıl yorumlanır?
(oldukça uzun yazı, özür dilerim. Çok fazla arka plan bilgisi içerir, bu yüzden alttaki soruya atlamaktan çekinmeyin.) Giriş: İkili bir endojen değişkenin ( sürekli bir sonuç üzerindeki etkisini tanımlamaya çalıştığımız bir proje üzerinde çalışıyorum , . Rastgele olduğu gibi atandığına kesinlikle inandığımız bir araç geliştirdik .x1x1x_1yyyz1z1z_1 Veriler: Verilerin kendisi, 1000 …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.