İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap



5
R sadece HATA alternatifleri [kapalı]
Kapalı. Bu soru konu dışı . Şu anda cevapları kabul etmiyor. Bu soruyu geliştirmek ister misiniz? Sorunuzu güncelleyin o yüzden -konu üzerinde Çapraz doğrulanmış için. Geçen yıl kapalı . HATA ve R kullanarak Bayes istatistikleri üzerine bir kurs takip ediyorum. Şimdi, HATA zaten biliyorum, harika ama sadece R yerine ayrı …
13 r  bayesian  bugs 

2
R'de ggplot2 kullanan iki faktöre göre boxplot
Kilitli . Bu soru ve cevapları kilitlidir çünkü soru konu dışıdır, ancak tarihsel önemi vardır. Şu anda yeni yanıtları veya etkileşimleri kabul etmiyor. R ve R'deki herhangi bir pakette çok yeniyim ggplot2 belgelerine baktım ama bulamadım. Ben değişkenin bir kutu arsa istediğiniz boxthisiki faktöre göre f1ve f2. Her ikisini de …
13 r  boxplot  ggplot2 

4
Yüzdelerde ANOVA mı kullanıyorsunuz?
Bağımsız değişken (faktör) olarak dört gruba (4 BMI grubu) sahip bir tablo var. Bağımlı bir değişkenim var: "Gebelikte anne içen yüzdesi". Bunun için ANOVA kullanılmasına izin veriliyor mu yoksa ki-kare veya başka bir test kullanmam gerekiyor mu?
13 anova 

6
Endojenite ve gözlemlenmeyen heterojenliğe karşı
Endogeneite ve gözlemlenmeyen heterojenite arasındaki fark nedir ? Endojenitenin örneğin atlanan değişkenlerden geldiğini biliyorum. Ama anladığım kadarıyla, gözlemlenmemiş heterojenlik aynı soruna neden oluyor. Fakat bu iki kavram arasındaki farkı tam olarak nerede ortaya koyar?

1
N-kollu haydut problemlerini çözmek için en uygun algoritma?
Ben n-silahlı haydut sorunları çözmek için bir dizi algoritmalar hakkında okudum εϵ\epsilon-gözlü, softmax ve UCB1, ama pişmanlığı en aza indirmek için hangi yaklaşımın en iyi olduğunu sıralamakta biraz sorun yaşıyorum. N-kollu haydut problemini çözmek için bilinen bir optimal algoritma var mı? Uygulamada en iyi performansı gösteren algoritma seçeneği var mı?

2
Yapısal bir denklem modelinde çok küçük bir numuneye sahip olmanın komplikasyonları
Amos 18'de yapısal bir denklem modeli (SEM) kullanıyorum. Deneyim için (gevşek olarak kullanıldı) 100 katılımcı arıyordum ki bu muhtemelen başarılı SEM yürütmek için yeterli değildi. SEM'in (EFA, CFA ile birlikte) "büyük örnek" istatistiksel bir prosedür olduğu defalarca söylendi. Uzun lafın kısası, 100 katılımcıya ulaşmadım (ne sürpriz!) Ve iki sorunlu veri …

4
Pratik varyans uygulaması nedir?
Kendime olasılık teorisini öğretiyorum ve standart sapmanın aksine varyansın herhangi bir kullanımını anladığımdan emin değilim. Baktığım pratik durumlarda, varyans aralıktan daha büyük, bu yüzden sezgisel olarak kullanışlı görünmüyor.
13 variance 

4
Farklı yordayıcı kümelerinin önemini karşılaştırabilme
Bir araştırma öğrencisine belirli bir sorunla ilgili tavsiyede bulunuyordum ve bu siteden başkalarının girdisini almaya istekliydim. Bağlam: Araştırmacının üç tip öngörücü değişkeni vardı. Her tür farklı sayıda öngörücü değişken içeriyordu. Her tahminci sürekli bir değişkendi: Sosyal: S1, S2, S3, S4 (yani dört tahminci) Bilişsel: C1, C2 (yani iki öngörücü) Davranışsal: …


3
Daha büyük varyanslı bir belirteç “daha ​​iyi” midir?
"Temel istatistik" kavramıyla ilgili bir sorum var. Bir öğrenci olarak bunu tamamen yanlış düşünüp düşünmediğimi ve neden öyleyse bilmek istiyorum: Diyelim ki "öfke yönetimi sorunları" arasındaki ilişkiye bakmaya çalışıyorum ve lojistik regresyonda boşanma (evet / hayır) diyorum ve iki farklı öfke yönetimi puanı kullanma seçeneğim var - her ikisi de …

4
Değişken grupları arasındaki / içindeki korelasyon nasıl hesaplanır?
1000 gözlem matrisim ve her biri 5 puanlık bir ölçekte ölçülen 50 değişkenim var. Bu değişkenler gruplar halinde düzenlenmiştir, ancak her grupta eşit sayıda değişken yoktur. İki tür korelasyonu hesaplamak istiyorum: Değişken grupları içindeki korelasyon (özellikler arasında): Değişken grubundaki değişkenlerin aynı şeyi ölçüp ölçmediğine dair bir ölçüm. Değişken grupları arasındaki …

2
Nadir rastlanan karşı olgusal olaylardan kaynaklandığı zaman “nadir” olaylarla denetimli öğrenme
Bir pazardaki alıcılar ve satıcılar arasında "eşleşmeleri" gözlemlediğinizi varsayalım. Ayrıca, gelecekteki maçları tahmin etmek ve pazarın her iki tarafına önerilerde bulunmak için kullanmak istediğiniz alıcıların ve satıcıların özelliklerini de gözlemleyebilirsiniz. Basitlik için, N alıcı ve N satıcı olduğunu ve her birinin bir eşleşme bulduğunu varsayalım. N ve (N-1) (N-1) eşleşmeyen …

2
Tabloya konacak anlamlı rakam sayısı?
Yayınlanacak önemli sayıların sayısı için iyi kurulmuş bir kural var mı? İşte bazı özel örnekler / sorular: Önemli rakamların sayısını varyasyon katsayısı ile ilişkilendirmenin bir yolu var mı? Örneğin, tahmin 12.3 ve CV% 50 ise, '.3' ile temsil edilen bilgilerin sıfıra yaklaştığı anlamına mı geliyor? Bir güven aralığı bir dizi …
13 tables 

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.