İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Verilerin öncelikleri dikte etmesine izin verin ve ardından bu öncelikleri kullanarak modeli çalıştırın? (örneğin, aynı veri kümesinden veriye dayalı öncelikler)
Anladığım kadarıyla, analiz ettiğimiz veri kümesine, Bayesian analizinde önceki dağılımların nasıl göründüğünü tanımlamak / tanımlamak için izin vermemeliyiz. Özellikle, bir Bayes analizi için önceki dağılımları tanımlamak, daha sonra bir modele uymak için öncekileri kullanacağınız aynı veri kümesinden özet istatistiklere dayanarak tanımlamak uygun değildir. Herkes bunu uygunsuz olarak özel olarak tartışan …
9 bayesian  prior 

7
Veri görselleştirme örnekleri, öğretim ve araştırma için veri setleri
Araştırdığımız çeşitli veri-vizyon tekniklerini test etmek için kullanabileceğimiz mevcut veri kümelerini arıyorum. R dahil olanlar gibi çeşitli kaynaklar biliyorum (deneyin plot(Orange)veya bakın burada ). Ama bunu bir adım ileri götürmek istiyorum: Bir görselleştirme aracını test etmek için en iyi gerçek dünya veri kümeleri hangileri? Akademik makalelerde hangi veri kümelerini kullandınız …

3
Zaman serisi motor verilerini sınıflandırmak için en iyi algoritma
Bir makine kontrol projesi üzerinde çalışıyorum. Çalışma sırasında motorun akımını ölçebiliriz. İşlemi başarıyla gerçekleştiren iki motordan alınan örnek veriler aşağıdadır. Kırmızı iz bir motordan akımı, mavi iz başka bir akımdan gösterir. Makine davranışı ile ilgili sorunları tanımlamak için bir algoritma bulmaya çalışmak istiyorum. Sorunlar aşırı yüksek motor akımı, sıfıra yakın …


6
R'deki değişkenler nasıl gruplanır / standartlaştırılır?
Kilitli . Bu soru ve cevapları kilitlidir çünkü soru konu dışıdır, ancak tarihsel önemi vardır. Şu anda yeni yanıtları veya etkileşimleri kabul etmiyor. Bildiğim işlevler taban R'den ölçek , ARM'den yeniden ölçeklendirmeyi içerir . Belki de en iyi yol, gruplama değişkenleri olarak kullanılacak bir veya daha fazla değişkeni belirterek bazı …

3
Büyük ölçekte% 1 mikro veri örneği ve küçük alan ölçeğinde toplu istatistikler kullanarak küçük alanlar için nüfus sayımı mikro verilerini nasıl simüle edebilirim?
Küçük coğrafi toplamalarda (Avustralya nüfus sayımı toplama bölgeleri) bireysel düzeyde çok değişkenli analiz yapmak istiyorum. Açıkçası, nüfus sayımı gizlilik nedenleriyle bu küçük toplama seviyelerinde mevcut değildir, bu yüzden diğer alternatifleri araştırıyorum. İlgilenilen hemen hemen tüm değişkenler kategoriktir. Elimde iki veri seti var: % 1 nüfus sayımı örneği çok daha yüksek …

1
0 veya 1'in p-değerleri nasıl yorumlanır?
Örneğin, erkek ve kız çocuklarının hangi sınıflarda farklılık gösterdiğini bilmek istediğimden cinsiyet ve sınıf arasında bir etkileşim bulan bir ANOVA çalıştırdım, ancak çoğu durumda 0 ve 1 p-değerleri buluyorum (ayarladım). Bu nasıl / neden mümkün? Doğru görünmüyor ... as.factor(gender) 1 16 16.2 2.6377 0.104396 as.factor(grade) 7 50077 7153.9 1165.4184 < …
9 r 

3
Rasgele etkiler yalnızca kategorik değişkenler için geçerli olabilir mi?
Bu sorular aptalca gelebilir, ancak ... rastgele etkilerin yalnızca kategorik değişkenlere (bireysel kimlik, nüfus kimliği, ... gibi) uygulanabileceği doğru mu?xixix_i kategorik bir değişkendir: yiyiy_i ~ βxiβxi\beta_{x_i} βxiβxi\beta_{x_i} ~ Norm(μ,δ2)Norm(μ,δ2)Norm(\mu, \delta^2) ancak prensipten rastgele etki sürekli değişkene (yükseklik, kütle ... gibi) uygulanamaz.ziziz_i: yiyiy_i ~ α+β⋅ziα+β⋅zi\alpha + \beta \cdot z_{i} çünkü o …

1
ANOVA, t-testi ve parametrik olmayan testler için bağımsızlık varsayımı hakkında soru
İstatistik konusunda acemi biriyim ve istatistiksel testler için bağımsızlık varsayımı konusunda biraz karışıklığım var. İnterneti araştırdım ve bazı bilgiler t-testi için iki gruptaki gözlemlerin bağımsız olması gerektiğini söylüyor (örnek 1'deki ölçümler ve örnek 2'deki ölçümler farklı olmalı). Diğer bazı bilgiler tüm gözlemlerin (aynı grupta bile) bağımsız olması gerektiğini söylüyor. Hangisi …

2
SPSS çıktısının doğru yorumlanması için tekrarlanan ölçüm ANOVA varsayımlarını anlama
Farklı ödül koşullarının görev performansını etkileyip etkilemeyeceğini araştırıyorum. Her biri n = 20 olan iki gruptan oluşan küçük bir çalışmadan verilerim var. 3 farklı "ödül" koşulunda performans içeren bir görevle ilgili veri topladım. Görev, 3 koşulun her birinde iki kez ancak rastgele sırada performans içeriyordu. Farklı "ödül" koşullarının her birinde, …


2
Fisher dönüşümü kullanılarak üç veya daha fazla korelasyonun önem testi
Daha önceki yayınlarımdan sonra, anlayabildiğim kadarıyla, üç korelasyon katsayım varsa, aralarında önemli bir fark olup olmadığını görmek için bunları çiftler halinde test etmem gerekecek. Bu, r'nin z skorunu ve sonra z'nin p değerini (önceki yazılarda önerilen hesap makinelerinin neyse ki yaptığı) çalışmak için Fishers dönüşümünü kullanmam ve daha sonra p …

1
Koşullu heteroskedastisiteli doğrusal modelde çıkarım
Ben, bağımsız değişken vektörleri gözlemlemek varsayalım ve ve bağımlı değişken . Formun bir modelini sığdırmak istiyorum: burada pozitif değerli iki farklılaştırılabilir bir işlevdir, bilinmeyen bir ölçeklendirme parametresidir ve sıfır ortalama, birim varyanslı Gauss rastgele değişkenidir ( ve ). Bu aslında Koenker'in heteroskedastisite testinin kurulumudur (en azından anladığım kadarıyla).x⃗ x→\vec{x}z⃗ z→\vec{z}yyyy=x⃗ …



Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.