İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Küçük ile tekrarlanan önlemler
Dört farklı zaman noktasında bir tedavinin demir seviyeleri üzerindeki etkilerini inceleyen bir çalışmayı analiz etmem için veriler verildi (tedaviden önce, günlük tedavi sona erdi, tedaviden 4 hafta sonra ve tedaviden 2-4 ay sonra). Kontrol grubu yok. Tedavi sonrası 3 zaman noktasının her birinde demir seviyelerinde tedavi öncesi (taban çizgisi) seviyesine …

3
Cronbach alfa değerleri için tanımlayıcılar nereden geliyor (örn. Zayıf, mükemmel)?
Cronbach'ın alfa değerlerini şu şekilde tanımlamak oldukça yaygın görünmektedir: α ≥ 0.9 Mükemmel 0.7 ≤ α <0.9 İyi 0,6 ≤ α <0,7 Kabul edilebilir 0.5 ≤ α <0.6 Kötü α <0.5 Kabul edilemez Bu değerler nereden geliyor? Bunları açıklayan özgün bir araştırma makalesi bulamıyorum. Düzenleme: Ben sadece kongre dayalı% 90 …


1
Bağımlı değişkenin gecikmesini bir regresyon modeline ne zaman eklemek gerekir ve hangi gecikme?
Bağımlı değişken olarak kullanmak istediğimiz veriler şöyle görünür (sayım verisidir). Döngüsel bir bileşen ve trend yapısına sahip olduğu için regresyonun bir şekilde önyargılı olduğu ortaya çıkıyor. Yardımcı olması durumunda negatif bir binom regresyonu kullanacağız. Veriler, kişi başına bir kukla (durum) olan dengeli bir paneldir. Gösterilen görüntü, tüm durumlar için bağımlı …

2
K-araçları neden degrade iniş kullanılarak optimize edilmiyor?
K-araçlarının genellikle Beklenti Maksimizasyonu kullanılarak optimize edildiğini biliyorum . Bununla birlikte, kayıp fonksiyonunu diğerlerini optimize ettiğimiz gibi optimize edebiliriz! Büyük ölçekli k-araçları için aslında stokastik gradyan kökenli bazı makaleler buldum , ancak sorumun yanıtını alamadım. Peki, bunun neden olduğunu bilen var mı? Beklenti Maksimizasyonu daha hızlı birleştiği için mi? Özel …

1
Scipy'de beta dağıtım bağlantısı
Wikipedia'ya göre beta olasılık dağılımının iki şekil parametresi vardır: ve .βαα\alphaββ\beta aralığındaki bir grup sayı scipy.stats.beta.fit(x)olan Python'u aradığımda 4 değer döndürülür. Bu bana tuhaf geliyor.x[ 0 , 1 ][0,1][0,1] Google'dan sonra aradığımda üçüncü değişken 0 olduğu için dönüş değerlerinden birinin 'konum' olması gerektiğini buldum scipy.stats.beta.fit(x, floc=0). Dördüncü değişkenin ne olduğunu …

4
Güvenilmez / karışık / geçersiz çalışmaların veya modellerin kötüye kullanıldığı halk sağlığı politikası araştırmalarında vaka çalışmaları nelerdir?
Verilerin karıştırıldığı mevcut bir halk sağlığı sorunu üzerine bir literatür taraması hazırlıyorum: Halk sağlığı / epidemiyoloji eğitiminde, geçersiz veya birbirine bağlı ilişkilerin veya çıkarımların kasıtlı veya hatalı olarak halk sağlığı politikası ve mevzuatında kullanıldığı yaygın tarihsel vaka çalışmaları nelerdir? Yasa gereği yapılmalıdır hava yastıkları sonunda emniyet kemerleri belirlenir ve 1960 …

2
Sayısal verileri doğal olarak oluşturulmuş “parantezler” halinde nasıl gruplandırabilirim? (örneğin gelir)
Aşağıdaki, neyi başarmaya çalıştığımı açıklıyor, ancak alternatif bir sorun ifadesi hedefimi tanımlayabilir: istiyorum aşağıdaki sayıları, her gruptaki sayıların varyanslarının çok büyük olmadığı ve grupların ortalamaları arasındaki farkların çok küçük olmadığı gruplara ayırın sonuçta elde edilen dağılımı "mükemmel" olanlarla karşılaştırır ve mükemmel olmaktan ne kadar "farklı" olduğunu görür. Layman'ın hedef açıklaması …

1
R'de doğrusal olmayan karışık etkiler regresyonu
Şaşırtıcı bir şekilde, Google'ı kullanarak aşağıdaki soruya bir cevap bulamadım: Birkaç kişiden zaman içinde kabaca sigmoid büyüme davranışı gösteren bazı biyolojik verilerim var. Bu yüzden standart bir lojistik büyüme kullanarak modellemek istiyorum P(t) = k*p0*exp(r*t) / (k+p0*(exp(r*t)-1)) p0, t = 0'da başlangıç ​​değeridir, k, t-> sonsuzda asimptotik sınırdır ve r, …

1
Üstel bir düzeltme modelinde eksik verilerle ilgilenme
Üstel yumuşatma modelleri ailesi bağlamında eksik verilerle başa çıkmanın standart bir yolu yoktur. Özellikle, tahmin paketinde ets olarak adlandırılan R uygulaması , eksik veri olmadan en uzun alt diziyi ve Hyndman ve ark. Tarafından "Üstel Düzgünleştirme ile Tahmin" kitabını alıyor gibi görünmektedir. hiç eksik veri hakkında konuşmak gibi görünmüyor. Kullanıcılarım …

1
Medyan-tarafsız bir tahminci ortalama mutlak sapmayı en aza indirir mi?
Bu bir takip değil, aynı zamanda farklı bir sorudur benim öncekinden . Wikipedia'da " Medyan-tarafsız bir tahmin edicinin, Laplace'ın gözlemlediği gibi, mutlak sapma kaybı fonksiyonu ile ilgili riski en aza indirdiğini " okudum . Ancak, Monte Carlo simülasyon sonuçlarım bu argümanı desteklemiyor. Bir günlük normal popülasyon, , burada, ve günlük …

4
MCMC için pratik bir örnek
MCMC ile ilgili dersler veriyordum. Ancak, nasıl kullanıldığına dair iyi bir örnek bulamıyorum. Biri bana somut bir örnek verebilir mi? Tüm görebildiğim bir Markov zinciri çalıştırmak ve sabit dağılımının istenen dağılım olduğunu söylemek. İstenilen dağılımın örneklenmesinin zor olduğu iyi bir örnek istiyorum. Bu yüzden bir Markov zinciri yaratıyoruz. Geçiş matrisinin …

3
Eşit dağıtılmış ve ilişkilendirilmiş rasgele sayı çiftleri üret
Belirli korelasyon ile rastgele sayılar çiftleri oluşturmak istiyorum. Bununla birlikte, iki normal değişkenin doğrusal bir kombinasyonunu kullanmaya ilişkin olağan yaklaşım burada geçerli değildir, çünkü tekdüze değişkenlerin doğrusal bir kombinasyonu artık tekdüze dağıtılmış bir değişken değildir. Tekdüze olmak için iki değişkene ihtiyacım var. Belirli bir korelasyon ile tekdüze değişken çiftlerinin nasıl …

2
Optimizasyon: İstatistiklerdeki tüm kötülüklerin kökü mü?
Daha önce aşağıdaki ifadeyi duydum: "Optimizasyon, istatistikteki tüm kötülüklerin köküdür". Örneğin, bu konudaki en önemli yanıt, bu ifadeyi model seçimi sırasında çok agresif bir şekilde optimize etme tehlikesine atıfta bulunur. İlk sorum şu: Bu alıntı özellikle herhangi birine atfedilebilir mi? (örneğin istatistik literatüründe) Anladığım kadarıyla, ifade aşırı uyum risklerini ifade …

4
Şüpheci (ama matematikten değil) okuyucu için çıkarım
İstatistiksel çıkarım ("oranları ve araçları karşılaştırma"), çevrimiçi istatistiklere giriş dersinin bir bölümünü izledim. Malzeme bana her zamanki gibi az mantıklı geldi (şimdiye kadar bu şeyleri onlarca kez görmüştüm, son otuz yılda yayılmış olmalı). Şüpheci bir okuyucuyu ikna etme sorununu ciddiye alan "temel İstatistikler-101" (nokta tahmini, tahmin değerlendirmesi, istatistiksel çıkarım, hipotez …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.