İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

1
Biz sonucunu edebilir olduğu bağımsız?
Eh, örneğin göremiyorum https://en.wikipedia.org/wiki/Subindependence ilginç kar¸ıt için. Ama asıl soru şudur: Bağımsızlığı izleyecek şekilde durumu güçlendirmenin bir yolu var mı? Örneğin, bazı vardır grubu fonksiyonları , öyle ki eğer tüm daha sonra bağımsız aşağıdaki? Ve böyle bir işlev kümesi ne kadar büyük olmalı, sonsuz?g1,…,gng1,…,gng_1, \dotsc, g_nEgi(X)gj(Y)=Egi(X)Egj(Y)E⁡gi(X)gj(Y)=E⁡gi(X)E⁡gj(Y)\E g_i(X) g_j(Y) =\E g_i(X) …

1
Bu polinom regresyonunda Bayesiyen güvenilir aralık neden önyargılı iken güven aralığı doğrudur?
Aşağıdaki verileri simüle ettiğim aşağıdaki grafiği düşünün. Gerçek olma olasılığı 1 olan siyah çizgi ile gösterilen ikili sonucuna . Bir ortak değişken ve arasındaki fonksiyonel ilişki , lojistik bağlantı ile 3. dereceden polinomdur (bu nedenle çift yönlü doğrusal değildir).yo b syÖbsy_{obs}xxxp (yo b s= 1 | x )p(yÖbs=1|x)p(y_{obs}=1 | x) …

1
Mgcv cinsinden uyarlamalı GAM pürüzsüzleştirir
Simon Wood'un GAM'ler ve onunla ilişkili R paket mgcv kitabı, GAM teorisi ve gerçek ve simüle edilmiş verilere modelleme konusunda oldukça ayrıntılı ve bilgilendiricidir. 1D pürüzsüzlükler için, kübik, ince plaka ve P-spline pürüzsüzlüklere kıyasla çok farklı tahmin sonuçları verebilen döngüsel ve adaptif temel işlevlerin uygulanıp uygulanmayacağına karar vermek için gerçekten …
9 r  mgcv 

2
Sıfır şişirilmiş verilere sahip GAMM
R'de sıfır şişirilmiş veriler için bir GAMM (Genelleştirilmiş Katkı Karma Modeli) takmak mümkün müdür? Değilse, R'de negatif binom veya yarı Poisson dağılımı olan sıfır şişirilmiş veriler için bir GAM (Genelleştirilmiş Katkı Modeli) yerleştirmek mümkün müdür? ( Poisson dağılımı için COZIGAM :: zigam ve mgcv: ziP fonksiyonlarını buldum )

2
Sosyal bilimlerde yayınlanmış çoğu korelasyon güvenilmez mi ve bu konuda ne yapılmalı? [kapalı]
Kapalı . Bu soru görüş temelli . Şu anda cevapları kabul etmiyor. Bu soruyu geliştirmek ister misiniz? Bu yayını düzenleyerek gerçekler ve alıntılarla yanıtlanabilmesi için soruyu güncelleyin . 2 yıl önce kapalı . Yırtıcı dergilerin uygulamalarını ortaya koymak için bireylerin "gotcha" -istik çabalarının önemli fakat şapırtılı çabalarına rağmen , sosyal …

2
Popülasyonlar arasındaki farklılıkları inceleme
Diyelim ki iki popülasyondan bir örnek aldık: Ave B. Bu popülasyonların bireylerden oluştuğunu varsayalım ve bireyleri özellikler açısından tanımlamayı seçiyoruz. Bu özelliklerin bazıları kategoriktir (örn. İşe giderler mi?) Ve bazıları sayısaldır (örn. Boyları). Şu özellikleri çağıralım: . Bu özelliklerden yüzlerce (örneğin n = 200) toplarız, basitlik olduğunu varsayalım, tüm bireylerde …

4
Neden 1 medyanın başka bir medyandan daha düşük olması, grup 1'deki çoğun grup 2'deki çoğundan daha az olduğu anlamına gelmiyor?
Aşağıdaki kutuların "çoğu erkek çoğu kadından daha hızlı" olarak yorumlanabileceğine inanıyordum (bu veri kümesinde), çünkü medyan erkeklerin zamanı medyan kadınların zamanından daha az olduğu için. Ama R ve istatistik yarışmasında EdX kursu bana bunun yanlış olduğunu söyledi. Lütfen sezgilerimin neden yanlış olduğunu anlamama yardımcı olun. İşte soru: 2002'de New York …

1
Latin karelerinde neden satırların, işlemlerin ve sütunların dik olduğu söylenir
Geometri alanında her zaman "dikey" duydum (ayrıca anadili İngilizce olmadığımı da unutmayın). Latin kareler için aşağıdakileri anlamıyorum (ders kitabından alıntı): Her tedavi (ABCD) her sırada bir kez görülür. Bu nedenle tedaviler ve sıralar diktir. ... Satırlar ve sütunlar tedavilere diktir. 12341birBCD2BCDbir3CDbirB4DbirBC12341birBCD2BCDbir3CDbirB4DbirBC\begin{matrix}\,&1&2&3&4\\1&A&B&C&D\\2&B&C&D&A\\3&C&D&A&B\\4&D&A&B&C\end{matrix} Burada diklikle kastedilen nedir?

1
P değerleri ve olabilirlik ilkesi
Bu soru sınıfında geldi: Biz parçası bir deney üzerinde hipotezler değerlendirmek için p-değerleri kullanıyorsanız Olasılığına İlke : Biz itaat edilmez Yeterlilik veya Koşulluluk ? Sezgim Yeterlilik demek olacaktır , çünkü p değeri hesaplamak bir deneyin gözlemlenmemiş sonuçlarına dayanır ve Yeterlilik tek bir deneyde gözlemlerle daha çok uğraşırken Koşulluluk farklı deneylerle …

2
Kaplan-Meier eğrileri Cox regresyonundan farklı diyor
R'de kanser hastalarının sağkalım veri analizini yapıyorum. CrossValidated ve diğer yerlerde hayatta kalma analizi hakkında çok yararlı şeyler okudum ve Cox regresyon sonuçlarını nasıl yorumlayacağımı anladığımı düşünüyorum. Ancak, bir sonuç hala beni rahatsız ediyor ... Hayatta kalma ile cinsiyet karşılaştırıyorum. Kaplan-Meier eğrileri kadın hastalar için açıktır (Eklediğim efsanenin doğru olduğunu, …


2
Birden çok çarpışmada ters doğum günü sorunu
Uzunluğu bilinmeyen bir uzaylı yılı geçirdiğinizi varsayalım. Söz konusu uzaylıların rastgele bir örneğine sahipseniz ve bazıları doğum günlerini paylaşıyorsa, bu verileri yılın uzunluğunu tahmin etmek için kullanabilir misiniz? Örneğin, 100'lük bir örnekte, iki üçüz (yani her biri üç uzaylı tarafından paylaşılan iki doğum günü) ve beş çift ve seksen dört …

2
Iid olmayan Bernoulli değişkenlerinin bu rastgele toplamının olasılık dağılımı nedir?
Ben aynı dağılmamış değişkenlerin rastgele bir sayı olasılık dağılımını bulmaya çalışıyorum. İşte bir örnek: John bir müşteri hizmetleri çağrı merkezinde çalışıyor. Sorunlu çağrılar alır ve çözmeye çalışır. Çözemedikleri, onları amirine iletir. Bir günde aldığı çağrı sayısının, ortalama ile bir Poisson dağılımını izlediğini varsayalım . Her sorunun zorluğu (kesinlikle başa çıkabileceği) …

1
Deming regresyonu ne zaman kullanılır?
Şu anda iki farklı fosfor test değerini birbirine dönüştürmenin bir yolu üzerinde çalışıyorum. Arka fon Toprakta mevcut bitki fosforunu ölçmek için birçok (ekstraksiyon) yöntem vardır. Farklı ülkeler farklı yöntemler uygulamaktadır, bu nedenle ülkeler arasındaki P-doğurganlığını karşılaştırmak için P-test değerini x, Y-testi değerine dayalı olarak hesaplamak gerekir ve bunun tersi de …

4
İki korelasyonun önemli ölçüde farklı olup olmadığını nasıl belirleyebilirim?
İki veri kümesinden (B1, B2) hangisinin (pearson r) başka bir kümeye (A) daha iyi bağdaştığını belirlemek istiyorum. Tüm veri kümelerinde veri eksik. Ortaya çıkan korelasyonun önemli ölçüde farklı olup olmadığını nasıl belirleyebilirim? Örneğin 8426 değerleri hem A hem de B1'de bulunur, r = 0.74. 8798 hem A hem de B2'de …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.