İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap


2
Parametrik olmayan regresyon için en iyi özellik seçim yöntemleri
Burada yeni başlayan bir soru. Şu anda R'deki np paketini kullanarak parametrik olmayan bir regresyon gerçekleştiriyorum. 7 özelliğim var ve kaba kuvvet yaklaşımı kullanarak en iyi 3'ü tanımladım. Ama yakında 7'den fazla özelliğim olacak! Benim sorum parametrik olmayan regresyon için özellik seçimi için mevcut en iyi yöntemler nelerdir. Ve hangi …

1
Metafor paketi kullanarak R'de meta-analiz
Aşağıdaki küçük bir meta-analiz örneğinin gerçek sonuçlarını almak için rmaişlevi metafor paketinden nasıl sözdizimi yapmalıyım ? (rastgele etki, özet istatistik SMD) study, mean1, sd1, n1, mean2, sd2, n2 Foo2000, 0.78, 0.05, 20, 0.82, 0.07, 25 Sun2003, 0.74, 0.08, 30, 0.72, 0.05, 19 Pric2005, 0.75, 0.12, 20, 0.74, 0.09, 29 Rota2008, …
10 r  meta-analysis 


1
İki zaman serisini boşluklar ve farklı zaman tabanlarıyla nasıl ilişkilendirebilirim?
StackOverflow üzerinde bu soruyu sordum ve burada sormak için tavsiye edildi. Farklı zaman tabanlarına (saatler farklı zamanlarda başlatılan, örnekleme zamanı sırasında çok hafif bir sürünme ile) sahip iki zaman serisi 3D ivmeölçer verilerimin yanı sıra farklı boyutlarda birçok boşluk içeren (ayrı yazma ile ilgili gecikmeler nedeniyle) flash cihazlar). Kullandığım ivmeölçerler …

2
R'de karmaşık regresyon grafiği
Görsel veri analizi için karmaşık grafikler çizmem gerekiyor. 2 değişkenim ve çok sayıda vakam var (> 1000). Örneğin (dispersiyonu daha az "normal" yapmak için sayı 100'dür): x <- rnorm(100,mean=95,sd=50) y <- rnorm(100,mean=35,sd=20) d <- data.frame(x=x,y=y) 1) Tesadüflerin göreceli frekansına karşılık gelen nokta boyutu ile ham verileri çizmem gerekiyor, bu yüzden …

1
Standart hata (SE) kullanmadan alternatif huni grafiği
Meta analizimi göndermeden önce, heterojenliği ve yayın yanlılığını test etmek için bir huni grafiği yapmak istiyorum. Her çalışmadan -1 ile +1 arasında değerler alan birleştirilmiş efekt boyutu ve etki boyutları var. Her çalışmadan hastalar ve kontroller için n1, n2 örnek boyutlarına sahibim. Standart hatayı (SE) hesaplayamadığım için Egger'in gerilemesini yapamıyorum. …

4
İstatistiksel yazılımı test etme
İstatistiksel yazılımın testinde hangi teknikler / yaklaşımlar yararlıdır? Özellikle maksimum olasılık kullanarak parametrik tahmin yapan programlarla ilgileniyorum. Başka programlardan veya yayınlanmış kaynaklardan elde edilen sonuçları karşılaştırmak her zaman mümkün değildir, çünkü çoğu zaman kendi başıma bir program yazarken ihtiyacım olan hesaplama zaten mevcut bir sistemde uygulanmamıştır. Doğruluğu garanti edebilecek yöntemlerde …

2
RNG, R, mclapply ve bilgisayar kümesi
R ve bilgisayar kümesinde bir simülasyon çalıştırıyorum ve aşağıdaki sorun var. Çalıştığım X bilgisayarların her birinde: fxT2 <- function(i) runif(10) nessay <- 100 c(mclapply(1:nessay, fxT2), recursive=TRUE) Her biri 16 çekirdekli 32 bilgisayar var. Bununla birlikte, rastgele sayıların yaklaşık% 2'si aynıdır. Bundan kaçınmak için hangi stratejileri benimseyeceksiniz? Bir gecikme ayarlayarak (yani …

1
Kmean kümelenmesi için R'deki istatistik paketini kullanma
Küme paketinin bir veya iki yönünü anlamakta güçlük çekiyorum. Quick-R'deki örneği yakından takip ediyorum , ancak analizin bir veya iki yönünü anlamıyorum. Bu özel örnek için kullandığım kodu dahil ettik. ## Libraries library(stats) library(fpc) ## Data mydata = structure(list(a = c(461.4210925, 1549.524107, 936.42856, 0, 0, 0, 0, 0, 0, 0, …
10 r  clustering 


1
Özellik fazlalığı nasıl ölçülür?
Bir sınıflandırma problemini çözmek için kullandığım üç özelliğim var. Başlangıçta, bu özellikler boole değerleri üretti, bu yüzden pozitif ve negatif sınıflandırma kümelerinin ne kadar örtüştüğüne bakarak artıklıklarını değerlendirebilirim. Şimdi bunun yerine gerçek değerler (skorlar) üretmek için özellikleri genişlettim ve artıklıklarını tekrar analiz etmek istiyorum, ancak bunu nasıl yapacağım konusunda tam …

4
Uygulamalı istatistiklerde kullanılan tekniklere değil, istatistiklerin altında yatan kavramlara ilişkin bir kaynak
İstatistikteki temel kavramların en kapsamlı tedavisi hangi kitaptır? Hesaplama ve prosedür yöntemlerinin detayları hakkında bir kitap istemiyorum, temelde temel kavramları kapsamlı bir şekilde açıklayan bir kitapla ilgileniyorum ... temel fikirlere sezgisel / resimli / görsel bir yaklaşım ... yükten ziyade Kitabın büyüklüğü hiç sorun değil ... çok büyük hacimli bir …
10 references 

1
Ekonometrik yöntemlerin gerçek dünyadaki başarılı uygulamalarının belgelenmiş / tekrarlanabilir örnekleri?
Bu soru kulağa çok geniş gelebilir, ama işte aradığım şey bu. Ekonometrik yöntemlerle ilgili çok sayıda mükemmel kitap ve ekonometrik tekniklerle ilgili pek çok mükemmel açıklayıcı makale olduğunu biliyorum. Bu Çapraz Doğrulanmış soruda açıklandığı gibi ekonometrinin mükemmel tekrarlanabilir örnekleri bile vardır . Aslında bu sorudaki örnekler aradığım şeye çok yakın …

2
JAGS'de Sansür / Kesme
JAGS'ta sansür sorununun nasıl çözüleceğiyle ilgili bir sorum var. X değerlerinin ölçüm hatası olduğu normalde iki değişkenli bir karışım gözlemliyorum. Gözlenen sansür değerlerinin gerçek altında yatan 'araçlarını' modellemek istiyorum. ⌈xtrue+ϵ⌉=xobserved ϵ∼N(0,sd=.5)⌈xtrue+ϵ⌉=xobserved ϵ∼N(0,sd=.5)\begin{align*} \lceil x_{true}+\epsilon \rceil = x_{observed} \ \epsilon \sim N(0,sd=.5) \end{align*} İşte şimdi ne var: for (i in 1:n){ …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.