İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap


2
Bir denemeyi yeniden çalıştırarak web a / b testlerini doğrulayın - bu geçerli mi?
Geçen gün bir a / b test şirketi tarafından hazırlanan bir web seminerinde yerleşik "Data Scientist" deneyi yeniden çalıştırarak sonuçlarınızı doğrulamanız gerektiğini açıkladı. Öncül,% 95 güven seçerseniz,% 5 (1/20) yanlış pozitif şansı vardır. Denemenizi aynı kısıtlamalarla yeniden çalıştırırsanız, şimdi 1/400 var (bunu 0.05 ^ 2 = 1/400 olarak belirlediklerini varsayıyorum) …

3
Düzenleme teknikleri rastgele etkiler modelinde kullanılabilir mi?
Düzenleme teknikleri ile kement, sırt regresyonu, elastik ağ ve benzerlerinden bahsediyorum. Yatarak tedavi gören hastaların kalış sürelerinin tahmin edildiği demografik ve tanı verilerini içeren sağlık hizmeti verileri üzerinde bir öngörme modeli düşünün. Bazı bireyler için, başlangıç ​​süresi boyunca ilişkili olan çoklu LOS gözlemleri (yani birden fazla IP bölümü) vardır. Örneğin, …

2
Lojistik regresyonda kategorilerin etkilerini ve yaygınlıklarını görselleştirmenin en iyi yolu nedir?
Bir kamuoyu araştırması verilerini kullanarak bir adayın oylarının ana belirleyicileri hakkında bilgi sunmam gerekiyor. Önem verdiğim tüm değişkenleri kullanarak lojistik bir gerileme yaptım, ancak bu bilgiyi sunmanın iyi bir yolunu bulamıyorum. Müvekkilim sadece etkinin büyüklüğünü değil, etkinin büyüklüğü ile bu nitelikteki nüfusun büyüklüğü arasındaki etkileşimi önemsiyor. Bununla bir grafikte nasıl …


3
R'deki karmaşık anket verilerine çok düzeyli modellerin yerleştirilmesi
R'deki çok düzeyli modellerle karmaşık anket verilerinin nasıl analiz edileceğine dair tavsiye arıyorum. Bir seviyeli modellerde surveyeşit olmayan seçim olasılıkları için paketi ağırlık olarak kullandım , ancak bu paket çok düzeyli modelleme için işlevlere sahip değil. lme4Paket düzeyli modelleme için harika ama ben kümeleme farklı düzeylerde ağırlıkları dahil etmek bildiğim …



3
Çapraz onaylı sınıflandırma doğruluğu için güven aralığı
İki giriş x-ray görüntüleri arasında benzerlik metriği hesaplayan bir sınıflandırma sorunu üzerinde çalışıyorum. Görüntüler aynı kişiden geliyorsa ('sağ' etiketi), daha yüksek bir metrik hesaplanır; iki farklı kişinin giriş görüntüleri ('yanlış' etiketi) daha düşük bir metrikle sonuçlanır. Yanlış sınıflandırma olasılığını hesaplamak için tabakalı 10 kat çapraz doğrulama kullandım. Şu anki örnek …

1
Marjinal model ve rastgele etkiler modeli - aralarında nasıl seçim yapılır? Bir görevli için bir tavsiye
Marjinal model ve rastgele etkiler modeli ve aralarında nasıl seçim yapılacağı hakkında herhangi bir bilgi ararken bazı bilgiler buldum ama daha fazla veya daha az matematiksel soyut açıklama (örneğin burada: https: //stats.stackexchange) .com / a / 68753/38080 ). Bir yerde, bu iki yöntem / model ( http://www.biomedcentral.com/1471-2288/2/15/ ) arasında bir …

1
Stokastik süreçlerin ergodisitesini örnek yollarından nasıl kontrol edersiniz?
Geniş anlamda durağan stokastik süreçlerin ergodisitesini örnek yollarından nasıl kontrol edersiniz? Ergodisiteyi tek bir örnek yolundan kontrol edebilir miyiz? Yoksa birden fazla örnek yola mı ihtiyacımız var? Ergodisiteyi kontrol etmenin bir motivasyonu, zaman içindeki örnek yolun ortalamasını, popülasyon ortalaması için tahmin olarak güvenle kullanabilmenizi sağlamak için zaman serilerinde mi?

2
Beklenti ortalama ile aynı mı?
Üniversitemde ML yapıyorum ve Profesör Gauss süreçlerinde bazı şeyleri açıklamaya çalışırken Beklenti (E) teriminden bahsetti. Ancak açıkladığı şekilde E'nin ortalama μ ile aynı olduğunu anladım. Doğru mu anladım? Aynı ise, her iki sembolün neden kullanıldığını biliyor musunuz? Ayrıca E'nin E ( ) gibi bir işlev olarak kullanılabileceğini gördüm , ancak …

1
Maksimum olabilirlik tahmininin geometrik yorumu
Franklin M. Fisher'ın Ekonometri'de Kimlik Sorunu kitabını okuyordum ve olasılık fonksiyonunu görselleştirerek tanımlamayı gösterdiği kısım ile karıştırdım. Sorun şu şekilde basitleştirilebilir: Bir regresyon için , burada , ve parametrelerdir. Varsayalım bir katsayısına sahiptir bire eşittir. Daha sonra uzayındaki olasılık fonksiyonu , gerçek parametreler vektörüne ve skaler katlarına karşılık gelen ışın …

1
Friedman testi vs Wilcoxon testi
Denetimli bir makine öğrenimi sınıflandırma algoritmasının performansını değerlendirmeye çalışıyorum. Gözlemler 99 kişiden oluşan nominal sınıflara (şimdilik 2, ancak bunu çok sınıflı problemlere genelleştirmek istiyorum) düşüyor. Cevaplamak istediğim sorulardan biri, algoritmanın girdi sınıfları arasında sınıflandırma doğruluğunda önemli bir fark göstermesi. İkili sınıflandırma durumu için, eşleştirilmiş bir Wilcoxon testi kullanarak (altta yatan …


Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.