İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

5
Doğrusal regresyon neden hipotez ile giriş veri noktası arasındaki dikey mesafeye dayalı bir maliyet fonksiyonu kullanıyor?
Diyelim ki A, B, C, D, E giriş (tahminci) ve çıkış (yanıt) veri noktalarına sahibiz ve noktalardan bir çizgi sığdırmak istiyoruz. Bu, sorunu göstermek için basit bir sorundur, ancak daha yüksek boyutlara da genişletilebilir. Sorun bildirimi Mevcut en iyi uyum veya hipotez yukarıdaki siyah çizgi ile temsil edilir . Mavi …

3
Bir dağılım ailesinin tanımı?
Bir dağıtım ailesinin istatistik için diğer disiplinlerden farklı bir tanımı var mı? Genel olarak, bir eğri ailesi , her biri bir veya daha fazla parametrenin değiştiği bir fonksiyon veya parametrelerle verilen bir eğriler kümesidir. Bu tür aileler, örneğin, elektronik bileşenleri karakterize etmek için kullanılır . İstatistikler için, bir kaynağa göre …

2
Sağlam istatistiksel test nedir? Güçlü bir istatistiksel test nedir?
Bazı istatistiksel testler sağlamdır, bazıları değildir. Sağlamlık tam olarak ne anlama geliyor? Şaşırtıcı bir şekilde, bu sitede böyle bir soru bulamadım. Dahası, bazen, bir testin sağlamlığı ve güçlülüğü birlikte tartışılmaktadır. Ve sezgisel olarak, iki kavram arasında ayrım yapamadım. Güçlü test nedir? Güçlü bir istatistiksel testten farkı nedir?

4
Sıfır Hipotezinin Doğru Olma Olasılığı
Yani, bu yaygın bir soru olabilir, ama asla tatmin edici bir cevap bulamadım. Sıfır hipotezinin doğru (veya yanlış) olma olasılığını nasıl belirliyorsunuz? Diyelim ki öğrencilere bir testin iki farklı sürümünü veriyorsunuz ve sürümlerin eşdeğer olup olmadığını görmek istiyorsunuz. Bir t-Testi gerçekleştirirsiniz ve p02 değeri verir. Ne güzel bir p değeri! …


5
Efekt boyutları gerçekten p-değerlerinden daha mı üstün?
Uygulamalı araştırmada p-değerlerinden ziyade etki büyüklüklerine güvenmek ve bunları raporlamaya çok fazla önem verilmektedir (örneğin, aşağıdaki alıntılar). Ama bu durum böyle değildir etki boyutu sadece gibi p-değeri a, rastgele değişken ve bu şekilde kutu aynı deney tekrarlanmıştır zaman örnekten örneğe değişebilir? Başka bir deyişle, hangi istatistiksel özelliklerin (örneğin, etki büyüklüğünün …

4
Bir eyer noktasında nasıl sıkışabilir?
Şu anda, mini-toplu degrade inişinin bir eyer noktasında nasıl sıkışabileceğinden biraz şaşkınım. Çözüm, bunu alamayacağım kadar önemsiz olabilir. Her çağ bir yeni örnek almak ve maliyet fonksiyonu her parti, sadece statik yani, yeni bir parti dayalı yeni hatayı hesaplar hangi degrade da her bir mini seri için değiştirmek .. ama …

1
Kementte 0 bileşen veren en küçük
Kement tahminini burada \ mathbb {R} ^ {n \ times p} tasarım matrisinin X \ i {{} x_i \ satırı {R} ^ p bir vektördür stokastik cevabı açıklamak için ortak değişkenler y_i ( i = 1, \ dots n için ).β^λ=argminβ∈Rp12n∥y−Xβ∥22+λ∥β∥1,β^λ=arg⁡minβ∈Rp12n‖y−Xβ‖22+λ‖β‖1,\hat\beta^\lambda = \arg\min_{\beta \in \mathbb{R}^p} \frac{1}{2n} \|y - X \beta\|_2^2 …


6
Maksimum olasılık tahmini kullandık mı?
İstatistikte şimdiye kadar maksimum olabilirlik tahmininin kullanılıp kullanılmadığını merak ediyorum. Biz kavramını öğreniyoruz ama ne zaman kullanıldığını merak ediyorum. Verilerin dağılımını varsayarsak, biri ortalama diğeri varyans için olmak üzere iki parametre buluruz, ancak gerçekte gerçek durumlarda kullanıyor musunuz? Birisi bana bunun için kullanıldığı basit bir durumu söyleyebilir mi?

2
Sinir ağlarında uygunluğun ötesinde evrişimin matematiksel nedenleri var mı?
Evrişimli sinir ağlarında (CNN), her adımdaki ağırlık matrisi, evrişime devam etmeden önce çekirdek matrisini elde etmek için satırlarını ve sütunlarını döndürür. Bu Hugo Larochelle tarafından video dizisiyle açıklanmıştır burada : Gizli haritaların hesaplanması, bir çekirdek matrisi [...] kullanarak önceki katmandaki bir kanalla ayrı bir kıvrım yapmaya karşılık gelir ve bu …

2
Neden lineer regresyon rezidüel, ancak genelleştirilmiş lineer modelde varsayım vardır?
Neden doğrusal regresyon ve Genelleştirilmiş Model tutarsız varsayımlara sahiptir? Doğrusal regresyonda artık Gauss'tan gelir Diğer regresyonlarda (lojistik regresyon, zehir regresyonu), bazı dağılımlardan (binom, zehir vb.) Yanıt geldiğini varsayıyoruz . Neden bazen kalan ve diğer zamanın yanıt aldığını varsayıyoruz? Farklı özellikler elde etmek istediğimiz için mi? EDIT: mark999's iki form eşit …



7
Poisson dağılımının neden binom dağılımının sınırlayıcı vakası olduğunu sezgisel olarak anlayın
DS Sivia'nın "Veri Analizi" nde Poisson dağılımının binom dağılımından bir türevi vardır. olduğunda Poisson dağılımının binom dağılımının sınırlayıcı vakası olduğunu iddia ederler; burada , deneme sayısıdır.M→∞M→∞M\rightarrow\inftyMMM Soru 1: Bu argüman sezgisel olarak nasıl anlaşılabilir? Soru 2: Büyük sınırı neden eşittir Burada , başarı sayısıdır. denemeler? (Bu adım türetmede kullanılır.)MMMM!N!(M−N)!M!N!(M−N)!\frac{M!}{N!(M-N)!}MNN!MNN!\frac{M^{N}}{N!}NNNMMM

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.