İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

1
Nlmer () kullanarak tekrarlanan ölçüm verileri için doğrusal olmayan karışık efektler modeline nasıl uyabilirim?
Tekrarlanan ölçüm verilerini analiz etmeye çalışıyorum ve çalışmasını sağlamak için mücadele ediyorum R. Verilerim aslında aşağıdaki, iki tedavi grubum var. Her gruptaki her denek her gün test edilir ve bir puan verilir (bir testte doğru yüzde). Veriler uzun biçimde: Time Percent Subject Group 1 0 GK11 Ethanol 2 0 GK11 …

2
Spearman korelasyonunun Pearson'dan kesin bir miktar az olması ne anlama gelir?
Bir grup ilgili veri setim var. Çiftleri arasındaki pearson korelasyonları tipik olarak mızrakçı korelasyonlarından kesinlikle daha büyüktür. Bu, herhangi bir korelasyonun doğrusal olduğunu gösterir, ancak pearson ve mızrakçı aynı olsa bile beklenebilir. Pearson ve mızrakçı korelasyonu arasında kesin bir boşluk olduğunda ve pearson daha büyük olduğunda ne anlama gelir? Bu, …

3
İki zaman serisi arasındaki ilişki: ARIMA
Aşağıdaki iki zaman serisi göz önüne alındığında ( x , y ; aşağıya bakınız), bu verilerdeki uzun vadeli eğilimler arasındaki ilişkiyi modellemek için en iyi yöntem nedir? Her iki zaman serisi de zamanın bir fonksiyonu olarak modellenirken önemli Durbin-Watson testlerine sahiptir ve ikisi de durağan değildir (terimi anladığım gibi, ya …


4
Önyükleme, Monte Carlo
Ödevin bir parçası olarak şu soruyu belirledim: Tek değişkenli bir veri örneği üzerinden% 95 güven aralığı elde etmek için önyüklemenin performansını incelemek için bir simülasyon çalışması tasarlayın ve uygulayın. Uygulamanız R veya SAS olabilir. Bakmak isteyebileceğiniz performans özellikleri, güven aralığı kapsamıdır (yani, güven aralığının gerçek ortalamayı kaç kez içerdiği) ve …

2
Rastgele Ormanlar tahmin yanlılığı gösterir mi?
Bence bu basit bir soru, ancak neden ya da neden olmasın ardındaki mantık olmayabilir. Sormamın nedeni, yakın zamanda bir RF uygulamamı yazdım ve iyi performans göstermesine rağmen beklediğim kadar iyi performans göstermiyor ( Kaggle Fotoğraf Kalitesi Tahmin yarışması veri setine, kazanan puanlara ve bazılarına dayanarak) hangi tekniklerin kullanıldığı hakkında mevcut …



5
Bir makine öğrenme problemini prototiplemek için hangi programlama dilini önerirsiniz?
Şu anda Octave'de çalışıyor, ancak belgelerin zayıf olması nedeniyle ilerleme çok yavaş. Hangi dili öğrenmek ve kullanmak kolaydır ve makine öğrenimi sorunlarını çözmek için iyi belgelenmiştir? Ben küçük bir veri kümesi üzerinde prototip (binlerce örnek) arıyorum, bu yüzden hız önemli değil. EDIT: Bir öneri motoru geliştiriyorum. Bu nedenle, Düzenli Doğrusal …


1
Örnekler normal olarak dağıtıldığında, ancak farkları olmadığında eşleştirilmiş bir t testi kullanabilir miyim?
Aynı başlangıç ​​koşullarında iki farklı tedavi uyguladığım ve her durumda sonuç olarak 0 ile 500 arasında bir tamsayı ürettiğim bir deneyden verilerim var. İki tedavinin ürettiği etkilerin önemli ölçüde farklı olup olmadığını belirlemek için eşleştirilmiş bir t testi kullanmak istiyorum. Her bir tedavi grubu için sonuçlar, normal olarak dağıtılır, ancak …

1
Normallik ihlali derecesinin iyi bir dizini nedir ve bu dizine hangi açıklayıcı etiketler eklenebilir?
Bağlam: Önceki bir soruda, @Robbie, yaklaşık 600 vaka ile yapılan bir çalışmada , normallik testlerinin neden önemli normallik önermediğini, ancak parsellerin normal dağılımlar önerdiğini sordu . Birkaç kişi normallik önem testlerinin çok yararlı olmadığını vurguladı. Küçük numunelerde, bu tür testlerin hafif normallik ihlallerini tespit etmek için çok fazla gücü yoktur …

5
Tüm normallik testleri null hipotezi reddeder?
Kolgomorov-Smirnov testi, Shapiro testi, vs ... hepsi dağılımın normal olduğu hipotezini reddediyor. Yine de normal nicelikleri ve histogramı çizdiğimde veriler açıkça normaldir. Belki testlerin gücü yüksek olduğu için? Örneklem büyüklüğü yaklaşık 650'dir. Bu testlerden en az biri sıfır hipotezini reddedemez mi? Sonuçlar: Kolmogorov-Smirnov D 0.05031 Pr > D <0.010 Cramer-von …

1
R'deki karışık veriler için sağlam küme yöntemi
Küçük bir veri kümesi (4 aralık değişkenleri ve tek bir üç faktörlü kategorik değişken 64 gözlem) küme arıyorum. Şimdi, küme analizinde oldukça yeniyim, ancak hiyerarşik kümelemenin veya k-araçlarının mevcut tek seçenek olduğu günlerden bu yana önemli ilerlemeler olduğunun farkındayım. Özellikle, chl tarafından belirtildiği gibi , "küme veya sınıfların sayısına karar …


Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.