«predictive-models» etiketlenmiş sorular

Öngörücü modeller, amacı belirli bir hipotezi test etmek veya bir olguyu mekanik olarak açıklamak olan modellerin aksine, birincil amacı bir sistemin diğer gözlemlerini en iyi şekilde tahmin etmek olan istatistiksel modellerdir. Bu nedenle, öngörücü modeller yorumlanabilirliğe daha az, performansa daha fazla vurgu yapmaktadır.

1
Nadir olayları nasıl tahmin edebiliriz?
Sigorta riski tahmin modelini geliştirmek için çalışıyorum. Bu modeller, havayolu no-show tahmini, donanım arıza tespiti, vb. Gibi "nadir olaylara" sahiptir. Veri setimi hazırlarken sınıflandırmayı uygulamaya çalıştım, ancak negatif vakaların yüksek oranı nedeniyle yararlı sınıflandırıcılar alamadım . Bir lise istatistik dersinin ötesinde istatistik ve modelleme verileri konusunda çok fazla deneyimim yok, …

1
Spline / pürüzsüz regresyon ile yeni veriler nasıl tahmin edilir?
Bir model için düzleştirmeler / spline'lar kullanırken yeni veriler için tahminlerin nasıl yapıldığına dair kavramsal bir açıklama yapmaya yardımcı olabilir misiniz? Örneğin, kullanılarak oluşturulan bir model verilmiş gamboostiçinde mboostp-yivler ile, R paketin ne kadar yeni veri tahminleri yapılır? Eğitim verilerinden ne kullanılır? Diyelim ki x bağımsız değişkeninin yeni bir değeri …

7
Model yapımında sosyal ayrımcılığı önleme
Amazon'da yeni işe alım skandalından esinlenerek sorularım var, burada işe alım süreçlerinde kadınlara karşı ayrımcılık yapmakla suçlanıyorlar. Daha fazla bilgi burada : Amazon.com Inc'in makine öğrenimi uzmanları büyük bir sorunu ortaya çıkardı: yeni işe alım motorları kadınları sevmedi. Ekip, 2014 yılından bu yana en iyi yetenek arayışını mekanize etmek için …


3
Doğrusal regresyon modeli veya doğrusal olmayan regresyon modeli arasında karar verme
Doğrusal regresyon modeli veya doğrusal olmayan regresyon modeli kullanma arasında nasıl karar verilmelidir? Amacım Y'yi tahmin etmektir. Basit ve veri kümesi durumunda, bir dağılım grafiği çizerek hangi regresyon modelinin kullanılması gerektiğine kolayca karar verebilirim.xxxyyy ve gibi çoklu değişkenlerde . Hangi regresyon modelinin kullanılacağına nasıl karar verebilirim? Yani, basit doğrusal model …

1
Uzamsal verilere uyumu dağıtma
Bazı istatistiklere özel yardım bulmak için sorumu mathoverflow'dan yayınlayın . Negatif olmayan değerlerle iki boyuta güzel bir şekilde yansıyan veri üreten fiziksel bir süreç üzerinde çalışıyorum. Her işlemin - y noktalarının (yansıtılan) bir izi vardır - aşağıdaki resme bakın.xxxyyy Örnek pistler mavidir, zahmetli bir pist elle yeşil olarak çizilmiştir ve …

1
Anova () ve drop1 () neden GLMM'ler için farklı cevaplar verdi?
Formun bir GLMM var: lmer(present? ~ factor1 + factor2 + continuous + factor1*continuous + (1 | factor3), family=binomial) Kullandığımda , araç paketinden veya drop1(model, test="Chi")kullandığımdan farklı sonuçlar alıyorum . Bu son ikisi aynı cevapları verir.Anova(model, type="III")summary(model) Bir grup uydurma veri kullanarak, bu iki yöntemin normalde farklı olmadığını gördüm. Dengeli doğrusal …
10 r  anova  glmm  r  mixed-model  bootstrap  sample-size  cross-validation  roc  auc  sampling  stratification  random-allocation  logistic  stata  interpretation  proportion  r  regression  multiple-regression  linear-model  lm  r  cross-validation  cart  rpart  logistic  generalized-linear-model  econometrics  experiment-design  causality  instrumental-variables  random-allocation  predictive-models  data-mining  estimation  contingency-tables  epidemiology  standard-deviation  mean  ancova  psychology  statistical-significance  cross-validation  synthetic-data  poisson-distribution  negative-binomial  bioinformatics  sequence-analysis  distributions  binomial  classification  k-means  distance  unsupervised-learning  euclidean  correlation  chi-squared  spearman-rho  forecasting  excel  exponential-smoothing  binomial  sample-size  r  change-point  wilcoxon-signed-rank  ranks  clustering  matlab  covariance  covariance-matrix  normal-distribution  simulation  random-generation  bivariate  standardization  confounding  z-statistic  forecasting  arima  minitab  poisson-distribution  negative-binomial  poisson-regression  overdispersion  probability  self-study  markov-process  estimation  maximum-likelihood  classification  pca  group-differences  chi-squared  survival  missing-data  contingency-tables  anova  proportion 

2
İkili ve sürekli yanıtı birleştirmenin en iyi yolu
Bir tahsilat ajansı için ödeme tutarını tahmin etmenin en iyi yolunu bulmaya çalışıyorum. Bağımlı değişken yalnızca bir ödeme yapıldığında sıfır değildir. Anlaşılır şekilde, çok sayıda sıfır var, çünkü çoğu insana ulaşılamıyor veya borcu geri ödeyemiyor. Ayrıca borç tutarı ile ödeme yapma olasılığı arasında çok güçlü bir negatif korelasyon vardır. Tipik …

3
Online tanışma siteleri için istatistikler
Çevrimiçi tanışma sistemlerinin eşleşmeleri belirlemek için anket verilerini nasıl kullanabileceğini merak ediyorum. Geçmiş maçlardan sonuç verisi olduğunu varsayalım (örneğin, 1 = mutlu bir şekilde evlendi, 0 = 2. tarih yok). Şimdi diyelim ki 2 tercih soruları var, "Açık hava etkinliklerinden ne kadar hoşlanırsınız? (1 = kesinlikle beğenmedim, 5 = kesinlikle …


2
Örnek dışı tahminleri iyileştirmeyen '' önemli değişken '' - nasıl yorumlanır?
Birçok kullanıcı için oldukça basit olacağını düşündüğüm bir sorum var. (İ) çeşitli açıklayıcı değişkenlerle yanıt değişkenimin ilişkisini araştırmak için doğrusal regresyon modelleri kullanıyorum ve (ii) açıklayıcı değişkenleri kullanarak yanıt değişkenimi tahmin ediyorum. Belirli bir açıklayıcı değişken X'in yanıt değişkenimi önemli ölçüde etkilediği görülmektedir. Bu açıklayıcı değişken X'in katma değerini yanıt …

2
Bayes lineer regresyonunda posterior prediktif dağılımın değerlendirilmesi
Bayes lineer regresyon için posterior doğrusal regresyonun nasıl değerlendirileceği konusunda kafam karıştı, burada sayfa 3'te açıklanan ve aşağıda kopyalanan temel vakayı geçti . p (y~∣ y) = ∫p (y~∣ β,σ2) p ( β,σ2∣ y)p(y~|y)=∫p(y~|β,σ2)p(β,σ2|y) p(\tilde y \mid y) = \int p(\tilde y \mid \beta, \sigma^2) p(\beta, \sigma^2 \mid y) Temel …

4
R'de Kesikli Zaman Olay Geçmişi (Hayatta Kalma) Modeli
R'de ayrık zamanlı bir model yerleştirmeye çalışıyorum, ancak nasıl yapılacağından emin değilim. Bağımlı değişkeni farklı satırlarda, her bir zaman gözlemi için bir tane düzenleyebileceğinizi ve glmbir logit veya cloglog bağlantısıyla işlevi kullanabileceğinizi okudum. Bu anlamda, üç sütun vardır: ID, Event(her zaman atıl 1 ya da 0) ve Time Elapsedek olarak, …
10 r  survival  pca  sas  matlab  neural-networks  r  logistic  spatial  spatial-interaction-model  r  time-series  econometrics  var  statistical-significance  t-test  cross-validation  sample-size  r  regression  optimization  least-squares  constrained-regression  nonparametric  ordinal-data  wilcoxon-signed-rank  references  neural-networks  jags  bugs  hierarchical-bayesian  gaussian-mixture  r  regression  svm  predictive-models  libsvm  scikit-learn  probability  self-study  stata  sample-size  spss  wilcoxon-mann-whitney  survey  ordinal-data  likert  group-differences  r  regression  anova  mathematical-statistics  normal-distribution  random-generation  truncation  repeated-measures  variance  variability  distributions  random-generation  uniform  regression  r  generalized-linear-model  goodness-of-fit  data-visualization  r  time-series  arima  autoregressive  confidence-interval  r  time-series  arima  autocorrelation  seasonality  hypothesis-testing  bayesian  frequentist  uninformative-prior  correlation  matlab  cross-correlation 

2
Yüksek boyutlu veri setleri için Gauss Süreci regresyonu
Sadece yüksek boyutlu veri kümelerine Gauss süreç regresyonu (GPR) uygulayan herhangi bir deneyim olup olmadığını görmek istedim. İdeal özellik seçimi parametre seçim sürecinin bir parçası olduğu yüksek boyutlu veri kümeleri için ne işe yarayacağını görmek için çeşitli seyrek GPR yöntemleri (örneğin seyrek sözde girişler GPR) içine bakıyorum. Kağıtlar / kod …

1
R doğrusal regresyon kategorik değişkeni “gizli” değer
Bu sadece birkaç kez karşılaştığım bir örnektir, bu yüzden örnek verilerim yok. R'de doğrusal regresyon modeli çalıştırmak: a.lm = lm(Y ~ x1 + x2) x1sürekli bir değişkendir. x2kategoriktir ve üç değeri vardır, örneğin "Düşük", "Orta" ve "Yüksek". Bununla birlikte, R tarafından verilen çıktı aşağıdaki gibi olacaktır: summary(a.lm) Estimate Std. Error …
10 r  regression  categorical-data  regression-coefficients  categorical-encoding  machine-learning  random-forest  anova  spss  r  self-study  bootstrap  monte-carlo  r  multiple-regression  partitioning  neural-networks  normalization  machine-learning  svm  kernel-trick  self-study  survival  cox-model  repeated-measures  survey  likert  correlation  variance  sampling  meta-analysis  anova  independence  sample  assumptions  bayesian  covariance  r  regression  time-series  mathematical-statistics  graphical-model  machine-learning  linear-model  kernel-trick  linear-algebra  self-study  moments  function  correlation  spss  probability  confidence-interval  sampling  mean  population  r  generalized-linear-model  prediction  offset  data-visualization  clustering  sas  cart  binning  sas  logistic  causality  regression  self-study  standard-error  r  distributions  r  regression  time-series  multiple-regression  python  chi-squared  independence  sample  clustering  data-mining  rapidminer  probability  stochastic-processes  clustering  binary-data  dimensionality-reduction  svd  correspondence-analysis  data-visualization  excel  c#  hypothesis-testing  econometrics  survey  rating  composite  regression  least-squares  mcmc  markov-process  kullback-leibler  convergence  predictive-models  r  regression  anova  confidence-interval  survival  cox-model  hazard  normal-distribution  autoregressive  mixed-model  r  mixed-model  sas  hypothesis-testing  mediation  interaction 

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.