İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Cox PH modelinden tahmin edilen tehlike oranları nasıl hesaplanır?
Aşağıdaki Cox PH modelim var: (Zaman, Etkinlik) ~ X + Y + Z Ben tahmin tehlike almak istiyorum oranları (i tehlike oranları bahsediyorum DEĞİL spesifik değerler verilmiş tehlike oranları) X, Y, Z. Muhaz R paketinin gözlemlenen tehlike oranlarını hesaplayabileceğini biliyorum , ancak tahmin edilen modelle ilgileniyorum. Bunu R'de yapmanın bir …
11 r  survival  hazard  cox-model 

4
Hangi sayıların piyangodaki insanlar tarafından seçilme olasılığı daha düşüktür?
Mega Millions bugün 500 milyon doların üzerinde. Seçilmesi mümkün olmayan bazı numaralar hakkında bir JSTOR makalesi okuduğumu hatırlıyorum. Örneğin, birçok insan 7'yi seçiyor çünkü şanslı sayıları ve bunun tam tersini istiyorum. Ancak JSTOR üyeliğim sona erdi. Hangi sayıların insanlar tarafından 1 ve 80 arasındaki bir piyango seçimleri olarak seçilmesi en …


1
Modelin uyumunu dönüştürülmüş ve dönüştürülmemiş yanıtla karşılaştırın
Üç farklı grup arasında orantı veren verileri karşılaştırmak istiyorum, örneğin: ID Group Prop.Nitrogen 1 A 0.89 2 A 0.85 3 B 0.92 4 B 0.97 Wharton ve Hui'nin ardından (doi: 10.1890 / 10-0340.1 1 ) Bu verilerin dönüştürülmüş bir logit kullanımı ile daha iyi ilgilenip ilgilenmeyeceğini anladım. Dönüştürülmüş ve dönüştürülmemiş …

3
Verilerle pratik PCA eğitimi
İnternette PCA eğitimi için arama yapmak binlerce sonuç (hatta videolar) verir. Eğiticilerin çoğu çok iyi. Ancak, PCA'nın gösterim için kullanabileceğim bazı veri kümeleri kullanılarak açıklandığı pratik bir örnek bulamıyorum. PCA analizi öncesi ve sonrası (100s boyutu ile veri satırları 10000s değil) çizmek kolay bazı küçük veri seti sağlayan bir öğretici …

1
Anomali tespiti için otomatik özellik seçimi
Anomali tespiti için özellikleri otomatik olarak seçmenin en iyi yolu nedir? Önemli olan çıkış: Ben normalde özellikleri insan uzmanlar tarafından seçilir bir algoritma olarak Anomali Detection tedavi aralık o kadar hatta birçok özellikleri ile siz - ( "anormal çıkış anormal giriş" gibi) olabilir birleştirerek çok daha küçük bir alt kümesi …

2
AI'nin Drosophila'sı şimdi ne?
1960'ların ortalarında, araştırmacılar satranca ünlü " AI Drosophila " olarak bahsettiler : meyve sineği gibi, satranç oyunu deneysel olarak erişilebilir ve nispeten basit bir problemdi, bu da önemli bilgileri daha karmaşık problemler üretti. Şimdi insanlar "satranç sadece bir arama problemidir" ve "satranç yöntemleri yapay zeka topluluğuna daha fazla ilgi göstermeyecek" …

4
Bazı bağlantıları kaldırarak daha iyi bir YSA elde etmek mümkün mü?
Bazı koşullarda ANN'lerin daha iyi performans göstermesinin mümkün olup olmadığını merak ediyordum, örneğin bazı bağlantıları budanırsanız: A ve B'nin gizli katmanları arasına birkaç "iletişim" bağlantısı ekleyerek iki çok katmanlı ANN'nin A ve B'yi paralel (aynı giriş ve çıkış düğümleri) alarak bir YSA oluşturmak? Daha iyi genelleme sonuçları elde edilebilir mi? …

1
Markov battaniyesi ve Bayes ağında normal bağımlılık
Bayes ağları hakkında okurken, " Markov battaniyesi " terimiyle karşılaştım ve Bayes ağ grafiğindeki bağımsızlığı ile ciddi bir şekilde karıştım. Markov battaniyesi kısaca her düğümün sadece ebeveynlerine, çocuklarına ve çocuk ebeveynlerine bağlı olduğunu söylüyor (resimde A düğümü için gri alan). Bu BN, P(M,S,G,I,B,R)P(M,S,G,I,B,R)P(M,S,G,I,B,R) ortak olasılığı nedir ? (kaynak: aiqus.com ) …


4
Bir regresyon modelinde hata nasıl kavramsallaştırılır?
Bir veri analizi sınıfına katılıyorum ve köklü fikirlerimden bazıları titriyor. Yani, hatanın (epsilon) ve diğer herhangi bir varyansın bir gruba (örnek veya tüm popülasyon) sadece (bu yüzden düşündüm) için geçerli olduğu fikri. Şimdi, regresyon varsayımlarından birinin varyansın "tüm bireyler için aynı" olduğu öğretiliyor. Bu beni bir şekilde şok ediyor. Her …


1
Referans popülasyonu verildiğinde başarı olasılığını tahmin etme
Aşağıdaki duruma sahip olduğunuzu varsayalım: Zaman içinde her biri nispeten az sayıda oyun oynayan 1000 bowling oyuncusu gözlemlediniz (1 ile 20 arasında). Bu oyuncuların her birinin, bu oyuncuların oynadığı oyun sayısı üzerinden grev yüzdesini not ettiniz. Yeni bir bowling oyuncusu geliyor ve 10 oyun oynuyor ve 3 grev alıyor. Herhangi …

1
2-sınıf modelleri çok-sınıflı problemlere genişletme
Adaboost'taki bu çalışma , 2 sınıf modellerin K sınıfı sorunlara genişletilmesi için bazı öneriler ve kodlar (sayfa 17) sunmaktadır. Bu kodu genelleştirmek istiyorum, böylece kolayca farklı 2 sınıf modelleri takabilir ve sonuçları karşılaştırabilirim. Çoğu sınıflandırma modeli bir formül arayüzüne ve bir predictyönteme sahip olduğundan, bunların bazıları nispeten kolay olmalıdır. Ne …


Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.