İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

2
Numunenin dağılımından bağımsız olmayan bir istatistik örneği?
Bu wikipedia'da istatistiğin tanımıdır Daha resmi olarak, istatistiksel teori, istatistiğin örneğin fonksiyonunun numunenin dağılımından bağımsız olduğu bir numunenin fonksiyonu olarak tanımlar; yani işlev, verilerin gerçekleştirilmesinden önce belirtilebilir. İstatistik terimi, belirli bir örnekteki hem işlev hem de işlevin değeri için kullanılır. Sanırım bu tanımın çoğunu anlıyorum, ancak fonksiyonun numunenin dağılımından bağımsız …

2
Dağıtımı örneklemek için dağıtım anlarını kullanabilir miyim?
İstatistik / makine öğrenme yöntemlerinde fark ettim ki, dağılım genellikle Gaussian tarafından tahmin ediliyor ve sonra Gaussian'ın örnekleme için kullanıldığını görüyorum. Dağılımın ilk iki anını hesaplayarak başlarlar ve bunları μμ\mu ve σ2σ2\sigma^2 tahmin etmek için kullanırlar . Sonra Gaussian'dan örnek alabilirler. Bana öyle geliyor ki, hesapladığım anlar ne kadar iyi …

5
Doğrusal regresyonumun bilinen bir teorik çizgiden istatistiksel olarak anlamlı bir farkı olup olmadığını nasıl hesaplayabilirim?
Kabaca doğrusal bir çizgi boyunca uygun bazı veriler var: Bu değerlerin doğrusal bir regresyonunu yaptığımda doğrusal bir denklem alıyorum: y= 0.997 x - 0.0136y=0.997x−0.0136y = 0.997x-0.0136 İdeal bir dünyada, denklem gerektiğini olmak y= xy=xy = x . Açıkçası, doğrusal değerlerim bu ideale yakın , ama tam olarak değil. Sorum şu: …


3
Eğer olan IID, o zaman işlem , burada
Soru Eğer , IID, o zaman işlem olup , .X1,⋯,Xn∼N(μ,1)X1,⋯,Xn∼N(μ,1)X_1,\cdots,X_n \sim \mathcal{N}(\mu, 1)E(X1∣T)E(X1∣T)\mathbb{E}\left( X_1 \mid T \right)T=∑iXiT=∑iXiT = \sum_i X_i Deneme : Lütfen aşağıdakilerin doğru olup olmadığını kontrol edin. Diyelim ki, şu koşullu beklentilerin toplamını alalım, böylece Her demektir yana IID vardır.∑iE(Xi∣T)=E(∑iXi∣T)=T.∑iE(Xi∣T)=E(∑iXi∣T)=T.\begin{align} \sum_i \mathbb{E}\left( X_i \mid T \right) = \mathbb{E}\left( …


6
Daha önemli istatistik: 'tüm kadınların yüzde 90'ı kurtuldu' veya 'hayatta kalanların yüzde 90'ı kadındı'?
Titanik için aşağıdaki ifadeleri göz önünde bulundurun: Varsayım 1: Gemide sadece erkekler ve kadınlar vardı Varsayım 2: Kadınların yanı sıra çok sayıda erkek vardı Açıklama 1: Tüm kadınların yüzde 90'ı hayatta kaldı İfade 2: Hayatta kalanların yüzde 90'ı kadındı Birincisi, kadınların kurtarılmasının muhtemelen yüksek önceliğe sahip olduğunu gösterir (erkeklerin kurtarılıp …


1
Hangi torbalama algoritmaları Random Forest'ın ardıllarına layık?
Algoritmaları artırmak için, oldukça iyi geliştiklerini söyleyebilirim. 1995'in başlarında AdaBoost tanıtıldı, bir süre sonra Gradient Boosting Machine (GBM) oldu. Son zamanlarda, doğru, aşırı uyumu ele alan ve birden fazla Kaggle yarışmasının galibi haline gelen XGBoost 2015 civarında piyasaya sürüldü. 2017 yılında LightGBM Microsoft tarafından tanıtıldı, XGBoost'a kıyasla önemli ölçüde daha …

3
Uygulamalı bilim adamları ile işbirlikleri konusunda tavsiyeler
İstatistikte yüksek lisans öğrencisiyim ve bu yüzden uygulamalı bilim adamları (ekonomistler, ormancılar,…) ile birkaç işbirliğine katıldım. Bu işbirlikleri eğlencelidir (çoğu zaman) ve çok şey öğreniyorum, ancak bazı komplikasyonlar da var, örneğin: Bazen iyi bir istatistiksel modelin ne olduğuna ilişkin görüşüm, ortak çalışanların geçmişinden ve alanlarındaki ortak uygulamalardan farklıdır. Onları yeni …
14 references 

6
“İlişkili” nin aktif / pasif kullanımı hakkında nitpick
Bunu burada StackExchange istatistiklerinde mi yoksa dilbilimde / İngilizce mi diye sormaktan çekiniyorum, ancak burada diğer forumdaki istatistik meraklı kullanıcılardan daha fazla dil nitpike kullanıcısı olabileceğini tahmin ediyorum;) Sıklıkla, “Daha sonra A'yı B ile ilişkilendirip bulduk ...” bölümünde olduğu gibi, aktif seste bir fiil olarak korelasyondan bahseden raporları okurum. Bana …

1
Sinir ağları dışındaki şeyler için degrade olarak uygun olmayan öğrenme oranlarını neden kullanmıyoruz?
Derin öğrenme literatürü, degrade inişte sabit olmayan öğrenme oranları kullanarak akıllı hilelerle doludur. Üstel bozunma, RMSprop, Adagrad gibi şeylerin uygulanması kolaydır ve her derin öğrenme paketinde mevcuttur, ancak sinir ağlarının dışında var gibi görünmektedir. Bunun için herhangi bir nedeni var mı? Eğer insanlar umursamıyorlarsa, sinir ağlarının dışına bakmamıza gerek yok …

1
Aptallar için Hamiltonian Monte Carlo
Hamiltonian Monte Carlo'nun nasıl çalıştığına dair aptallar için adım adım açıklama sağlayabilir misiniz? Not: Zaten cevapları burada okudum, Hamiltonian monte carlo , ve burada, Hamiltonian Monte Carlo vs. Sıralı Monte Carlo ve burada, Hamiltonian Monte Carlo: Metropolis-Hasting önerisini nasıl anlayabilirim? ve bunu adım adım ele almıyorlar.
14 bayesian  hmc 


3
Kuantum hesaplamadan ne tür istatistiksel problemler faydalanabilir?
Simülasyonlu kuantum bilgisayarlar için artık yüksek ve düşük seviyelerde donanım kuantum bilgisayarları öngören kuantum dilleri ile kuantum hesaplamanın başlangıcındayız . Kuantum hesaplama , kubitlerin dolanması ve ışınlanması , kubitlerin ölçülmesi ve kubitlerin üst üste binmesi gibi yeni temel işlevleri getirir . Kuantum hesaplamasından ne tür istatistiksel problemler yararlanabilir? Örneğin, kuantum …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.