İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Bireysel çalışma beni ne kadar ileri götürür?
Resmi veya yapılandırılmış bir veri analizi veya makine öğrenimi kursuna (son çevrimiçi teklifler dışında) hiç katılmadım ve bildiklerimin çoğunu okuma ve denemeden öğrendim. İş bulamamaktan çok uzak olduğumu biliyorum. Sorum daha iyi olan şey değil ( bu soru gibi ) , daha ziyade, bir işe başvurabileceğim bir seviyeye ulaşabilir miyim …

1
Oranları analiz etme teknikleri
Oranların ve oranların analizi ile ilgili tavsiye ve yorumlar arıyorum. Özellikle oranların analizinin yapıldığı alanda yaygındır, ancak bunun sorunlu olabileceğini öne süren birkaç makale okudum, düşünüyorum: Kronmal, Richard A. 1993. Sahte korelasyon ve oran standardının yanlışlığı yeniden gözden geçirildi. Kraliyet İstatistik Kurumu Seri A 156 (3): 379-392 ve ilgili makaleler. …

2
Stata'daki bir probit modelini nasıl yorumlayabilirim?
Stata'da koştuğum bu probit regresyonunu nasıl yorumlayacağından emin değilim. Veriler kredi onayı üzerindedir ve beyaz, bir kişi beyazsa = 1, kişi değilse = 0 olan bir kukla değişkendir. Bunu nasıl okuyacağınıza ilişkin herhangi bir yardım çok takdir edilecektir. En çok aradığım şey, hem beyazlar hem de beyaz olmayanlar için tahmini …

2
poisson vs lojistik regresyon
Farklı takip süresine sahip bir hasta grubum var. Şimdiye kadar zaman yönünü göz ardı ediyorum ve sadece bir ikili sonuç hastalığı modellemem gerekiyor / hastalık yok. Bu çalışmalarda genellikle lojistik regresyon yapıyorum, ancak başka bir kolejim Poisson regresyonunun da uygun olup olmadığını sordu. Ben bu poisson içine değil ve bu …



2
Sürekli uzunlamasına ikili yanıtlar için bir R paketi var mı?
bildPaket seri ikili yanıtlar için mükemmel bir paket olarak görünmektedir. Ama ayrık bir zamandır. Geçerli yanıtın Y'nin daha erken zamanlarda ölçülen ikili yanıtlarla oran oranı bağlantısı veya bunun en azından birinci dereceden bir Markov versiyonu için yumuşak bir zaman fonksiyonu belirtmek istiyorum. Buna alternatif lojistik regresyon denir. Sürekli süreyi işleyen …


2
R'deki stokastik diferansiyel denklemler için sayısal çözücüler var mı?
Euler-Maruyama şemasını, Milstein şemasını (veya başka bir yöntemi) kullanarak (1) gibi homojen olmayan doğrusal olmayan bir difüzyon yollarını simüle etmek için genel, temiz ve hızlı (yani C ++ rutinleri kullanarak) R paketi arıyorum. Bu, daha büyük bir tahmin koduna gömülmeye yöneliktir ve bu nedenle optimize edilmeyi hak eder. dXt=f(θ,t,Xt)dt+g(θ,t,Xt)dWt,(1)(1)dXt=f(θ,t,Xt)dt+g(θ,t,Xt)dWt,dX_t = …

1
Örnek ortalama önyükleme yaparken merkezleme gerekli mi?
Örneklemin dağılımının yaklaşık olarak nasıl hesaplanacağını okurken parametrik olmayan önyükleme yöntemiyle karşılaştım. Görünüşe göre nin dağılımı dağılımı ile yaklaşık olabilir , burada , önyükleme örneği. ˉ X ∗ n - ˉ X n ˉ X ∗ nX¯n−μX¯n−μ\bar{X}_n-\muX¯∗n−X¯nX¯n∗−X¯n\bar{X}_n^*-\bar{X}_nX¯∗nX¯n∗\bar{X}_n^* O zaman sorum şu: Merkezlemeye ihtiyacım var mı? Ne için? Değil sadece yaklaşık …

2
P> n ise, kement en fazla n değişken seçer
Elastik ağ için motivasyonlardan biri LASSO'nun aşağıdaki sınırlamasıydı: Gelen durumda, çünkü dışbükey optimizasyon problemine doğasının kement en fazla seçer n değişkenler ondan önce doymuş bileşikler,. Bu, değişken seçim yöntemi için sınırlayıcı bir özellik gibi görünmektedir. Ayrıca, katsayıların L1-normuna bağlı belirli bir değerden daha küçük olmadığı sürece, kement iyi tanımlanmamıştır.p>np>np > …

1
Optimizasyon sorunu
Bir arkadaşım modelleri karıştırıcı satıyor . Bazı karıştırıcılar çok basit ve ucuz, diğerleri çok sofistike ve daha pahalıdır. Verileri, her ay için, her bir blenderın (kendisi tarafından sabitlenen) fiyatlarından ve her model için satılan birimlerin sayısından oluşur. Bir gösterim oluşturmak için vektörleri burada ayı boyunca blender modeli fiyatıdır ve ayı …

1
Doğrusal Regresyon ve Mekansal-Otokorelasyon
Uzaktan algılama yoluyla elde edilen bazı değişkenleri kullanarak belirli bir alandaki Tree Heights'ı tahmin etmek istiyorum. Yaklaşık Biyokütle, vb.Gibi ilk önce doğrusal bir regresyon kullanmak istiyorum (bunun en iyi fikir olmadığını biliyorum, ancak projem için bir zorunluluk adımdır). Uzamsal otokorelasyonun bunu ne kadar kötü etkileyebileceğini ve hatta mümkünse bunu düzeltmenin …

1
Önyükleme medyan tahminin belirsizliğini değerlendirmek için geçerli bir yöntem midir?
Bootstrapping ortalama tahmindeki belirsizliğe erişmek için iyi çalışır, ancak bootstrap'ın kantil tahminlerdeki (özellikle medyan) belirsizliği değerlendirmede iyi bir iş yapmadığını bir yerde okuduğumu hatırlıyorum. Bunu nerede okuduğumu hatırlamıyorum ve hızlı bir Google aramasıyla fazla bir şey bulamadım. Bu ve herhangi bir referans hakkındaki düşünceler çok takdir edilecektir.

5
Zamansal veriler için uygun kümeleme teknikleri?
Etkinlik sıklıkları hakkında geçici verilerim var. Verilerdeki benzer aktivite seviyelerine sahip farklı zaman aralıklarını gösteren kümeleri tanımlamak istiyorum. İdeal kümeleri tanımlamak istediğiniz olmadan kümeler önsel sayısını belirterek. Uygun kümeleme teknikleri nelerdir? Sorumun yanıtlaması için yeterli bilgi içermiyorsa, uygun kümeleme tekniklerini belirlemek için sağlamam gereken bilgiler nelerdir? Aşağıda hayal ettiğim veri …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.