İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

1
Tekrarlanan deneylerin% 95 güven aralığının açıklanmasıyla ilgili simülasyon çalışmasıyla ilgili sorunlar - nerede yanlış gidiyorum?
% 95 güven aralığının tekrarlanan deneylerin yorumunu simüle etmek için bir R komut dosyası yazmaya çalışıyorum. Bir oranın gerçek popülasyon değerinin numunenin% 95 CI'sinde bulunduğu süreyi orantısını fazla tahmin ettiğini gördüm. Büyük bir fark değil - yaklaşık% 96 vs% 95 ama bu yine de ilgimi çekti. samp_nİşlevim bir Bernoulli dağılımından …



1
Bir popülasyonu nasıl örneklediğiniz önemli mi?
Sonsuz sayıda mermer içeren iyi karıştırılmış bir teknem var. Teknede sonsuz miktarda mermer vardır, ancak sadece bilinmeyen ancak sınırlı sayıda çeşitte gelirler : V= {v1,v2,v3, . . . ,vk}V={v1,v2,v3,...,vk}\mathcal{V} = \{v_{1},v_{2},v_{3},...,v_{k}\} kkk bilinmiyor ve ben ≠ jben≠ji\neq j, çizim vbenvbenv_itipi mermer, vjvjv_jtipi mermer. Bir deneyde, bir makine, bazı bilinmeyen prosedürleri …




2
R'de optim kullanarak bir günlük olabilirlik fonksiyonunu en üst düzeye çıkararak tahmin edilen parametreler için profil oluşturmayı kullanarak% 95 güven aralıklarını nasıl tahmin edebilirim?
R'de optim kullanarak bir günlük olabilirlik fonksiyonunu en üst düzeye çıkararak tahmin edilen parametreler için profil oluşturmayı kullanarak% 95 güven aralıklarını nasıl tahmin edebilirim? Kendir ters çevirerek kovaryans matrisini asemptotik olarak tahmin edebileceğimi biliyorum , ancak verilerimin bu yöntemin geçerli olması için gerekli varsayımları karşılamadığından endişeliyim. Başka bir yöntem kullanarak …

2
Kriging ile ilgili karışıklık
Kriging ile ilgili bu wikipedia makalesini okuyordum . Bunu söylediği zaman kısmı anlamadım Kriging değerlerini hesaplar tarafsız tahmincisi doğrusal iyi, ait öyle ki yansızlık koşulu ile minimize edilmiştir varyansını kriging. Derivasyonu ve ayrıca varyansın nasıl minimize edildiğini anlamadım. Herhangi bir öneri?Z^(x0)Z^(x0)\hat Z (x_0)Z(x0)Z(x0)Z(x_0) Özellikle, tarafsızlık durumuna en aza indirgenen uygulamaların …

1
Dağıtımların simülasyonu
Bir Kapasite Planlama ödevi üzerinde çalışıyorum ve bazı kitaplar okudum. Bu özellikle dağıtımlarla ilgilidir. R kullanıyorum. Veri dağıtımımın ne olduğunu belirlemek için önerilen yaklaşım nedir? Onu tanımlamak için istatistiksel yöntemler var mı? Bu diyagram var. R kullanarak simülasyon yaklaşımları nelerdir? Burada üstel gibi belirli bir dağıtım için veri oluşturmak istiyorum. …

2
Her grupta korelasyon anlamlı fakat hepsinde anlamlı değil mi?
ve gruplarında değişken ve arasındaki Pearson korelasyonunu test ettiğimizi varsayalım . korelasyonunun ve her birinde anlamlı olması , ancak her iki gruptan veriler birleştirildiğinde anlamlı olmaması mümkün müdür ? Bu durumda, lütfen bunun için bir açıklama yapabilir misiniz?xxxyyybirbirABBB( x , y)(x,y)(x,y)birbirABBB


1
Sadece kantillerde verilen dağılım parametrelerini tahmin etmek için bir yöntem var mı?
size sadece birkaç kantil verilirse, belirli bir dağılıma uymanın yolu var mı? Örneğin, size gama dağıtılmış bir veri setim olduğunu söylersem ve sırasıyla ampirik % 20,% 30,% 50 ve% 90 - quantiller şunlardır: 20% 30% 50% 90% 0.3936833 0.4890963 0.6751703 1.3404074 Parametreleri nasıl hesaplayabilirim? Bunu yapmanın birden fazla yolu var …

1
ID (tekdüze veya normal) veriler için özdeğerlerin tahmini dağılımı
İle bir veri setim olduğunu varsayarsak ddd boyutlar (ör. d=20d=20d=20) böylece her boyut Xi∼U[0;1]Xi∼U[0;1]X_i \sim U[0;1] (alternatif olarak, her boyut Xi∼N[0;1]Xi∼N[0;1]X_i \sim \mathcal N[0;1]) ve birbirinden bağımsız. Şimdi bu veri kümesinden rastgele bir nesne çiziyorum ve k=3⋅dk=3⋅dk=3\cdot den yakın komşuları ve PCA'yı bu sette hesaplayın. Beklenenin aksine, özdeğerlerin hepsi aynı …


Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.