İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

3
Verilerdeki yeni bilgileri keşfetme yönergeleri
Kendime veya başka birine bir şey ifade etmek için bir şey çiziyorum. Genellikle, bir soru bu süreci başlatır ve genellikle belirli bir cevap için umut isteyen kişi. Verilerle ilgili ilginç şeyleri daha az taraflı bir şekilde nasıl öğrenebilirim? Şu anda bu yöntemi kabaca takip ediyorum: Özet istatistikler. Şerit grafiği. Dağılım …

2
Eşleştirilmiş, tekrarlanan önlemler ANOVA mı yoksa karma bir model mi?
Kan basıncını ölçmek için iki yöntem arayan bir klinik deneyden bazı verileri analiz etmem istendi. 50 denekten verilerim var, her biri her metodu kullanarak 2 ila 57 arasında ölçüme sahip. En iyi nasıl ilerleyeceğimizi merak ediyorum. Açıkçası, kan basıncı ölçümünün eşleştirildiğini (eşzamanlı olarak ölçülen iki yöntem) ve ayrıca zamanla değişen …
9 r  anova  mixed-model  stata 

2
Bir regresyon katsayısının bir gruplama değişkeni tarafından denetlenip denetlenmediğini nasıl test edebilirim?
Ilımlı bir değişkene (örneğin cinsiyet) dayalı iki grup örnek üzerinde bir regresyon var. Bir sette regresyonun öneminin kaybolup kaybolmadığını kontrol ederek diğerinde kalırsa ılımlı etki için basit bir test yapıyorum. S1: Yukarıdaki yöntem geçerli, değil mi? S2: Araştırmamın güven düzeyi% 95 olarak belirlendi. Bir grup için, regresyon .000'de anlamlıdır. Diğeri …


3
Tek tip aday dağılımı olan Metropolis-Hastings için kabul oranları
Metropolis-Hastings algoritmasını tek tip aday dağılımlarla çalıştırırken, kabul oranlarının% 20 civarında olmasının mantığı nedir? Benim düşüncem şudur: true (veya true'ya yakın) parametre değerleri bulunduğunda, aynı tekdüzen aralıktan yeni bir aday parametre değeri kümesi olasılık fonksiyonunun değerini arttıramaz. Bu nedenle, ne kadar çok yineleme yaparsam, almam gereken kabul oranları o kadar …


1
Poisson / loglinear modellerin olasılık oranı testi için sıfır sayımların ayarlanması gerekiyor mu?
Acil durum tablosunda 0'lar varsa glmve bir olasılık oranı testi için iç içe geçmiş poisson / loglinear modelleri (R işlevini kullanarak ) yerleştiriyorsak, glm modellerini takmadan önce verileri ayarlamamız gerekir mi (örn. sayımlar)? Açıkçası bazı parametreler bazı ayarlamalar yapılmadan tahmin edilemez, ancak ayar / ayarlama eksikliği LR testini nasıl etkiler?

1
Çok değişkenli dik polinom regresyonu?
Soruyu motive etmenin bir yolu olarak, gözlemlenen değişkenleri kullanarak tahmin etmeye çalıştığımız bir regresyon problemini düşününYYY{ a , b }{bir,b}\{ a, b \} Çok değişkenli polinom regresyonu yaparken, işlevin en uygun paramitizasyonunu bulmaya çalışıyorum f( y) =c1a +c2b +c3bir2+c4a b +c5b2+ ⋯f(y)=c1bir+c2b+c3bir2+c4birb+c5b2+⋯f(y)=c_{1}a+c_{2}b+c_{3}a^{2}+c_{4}ab+c_{5}b^{2}+\cdots bu da en az kare anlamında verilere en …

2
Bağımlı veriler için Bernoulli rastgele değişkenlerinin toplamı nasıl modellenir?
Bunun gibi hemen hemen aynı sorularım var: Bernoulli rastgele değişkenlerinin toplamını nasıl verimli bir şekilde modelleyebilirim? Ancak ayar oldukça farklıdır: S=Σi = 1 , NXbenS=Σben=1,N-XbenS=\sum_{i=1,N}{X_i} , , ~ 20, ~ 0.1P(Xben= 1 ) =pbenP(Xben=1)=pbenP(X_{i}=1)=p_iN-N-Npbenpbenp_i Bernoulli rastgele değişkenlerinin sonuçları için verilerimiz var: ,Xi , j,Xben,jX_{i,j}Sj=Σi = 1 , NXi , j,Sj=Σben=1,N-Xben,jS_j=\sum_{i=1,N}{X_{i,j}} …

2
R'de gürültü (DBSCAN) kümelemesi olan uygulamaların yoğunluk tabanlı uzamsal kümelenmesi
Bu soru " R'deki uzamsal verileri kümeleme " olarak başladı ve şimdi DBSCAN sorusuna taşındı. İlk soruya verilen yanıtların önerdiği gibi, DBSCAN hakkında bilgi aradım ve hakkında bazı belgeleri okudum. Yeni sorular ortaya çıktı. DBSCAN bazı parametreler gerektirir, bunlardan biri "mesafe" dir. Verilerim üç boyutlu, boylam, enlem ve sıcaklık olduğundan, …
9 r  clustering  spatial 

2
R ile tobit modeli
Herkes AER paketleri ile tobit modelini kullanarak iyi uygulama ve örnekleri (el kitabı ve R ile uygulanan ekonometri kitaplarının yanı sıra) nerede bulacağını biliyor mu? Düzenle Ben y için marjinal etkileri hesaplamak için bir komut arıyorum (gizli değişken y * için değil). Gibi görünüyor , std.normal kümülatif dağılım fonksiyonudur. Fakat …



3
R'deki veri çerçevesinde sütun adları nasıl değiştirilir? [kapalı]
Kapalı. Bu soru konu dışı . Şu anda cevapları kabul etmiyor. Bu soruyu geliştirmek ister misiniz? Sorunuzu güncelleyin o yüzden -konu üzerinde Çapraz doğrulanmış için. 6 yıl önce kapalı . names(mydat)[c(name)]<-c("newname") Bundan, veri çerçevesi mydat sütun / değişken adı "adı" yerine "yeni ad" biliyorum. Benim sorum şu, ben bir döngü …
9 r 

4
Değişken düzen doğrusal regresyonda önemli midir?
İki değişken ( ve ) arasındaki etkileşimi araştırıyorum . Bu değişkenler arasında ile büyük oranda doğrusal korelasyon vardır . Sorunun doğasından nedensellik hakkında hiçbir şey söyleyemem ( veya başka bir yöne neden olup olmadığı ). Aykırı değerleri tespit etmek için regresyon çizgisinden sapmaları incelemek istiyorum. Bunu yapmak için ben de …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.