İstatistikler ve Büyük Veri

İstatistik, makine öğrenmesi, veri analizi, veri madenciliği ve veri görselleştirmesi ile ilgilenen kişiler için soru cevap

3
Bir uzamsal süreç için parametreleri tahmin etme
Pozitif tamsayı değerlerin bir ızgarası verildi . Bu sayılar, o ızgara konumunu işgal eden bir kişinin inancının gücüne karşılık gelmesi gereken bir yoğunluğu temsil eder (daha yüksek bir inancı gösteren daha yüksek bir değer). Bir kişi genel olarak çoklu ızgara hücreleri üzerinde bir etkiye sahip olacaktır.n × nn×nn\times n Yoğunluğun …

5
İyi bir renk yoğunluğu ölçeği nasıl yapılır?
İstatistikte hiçbir şekilde iyi değilim ama bence doğru yere geldim. Sorum basit: Benim sorunum, küçük bir ülkedeki birçok devletin nüfusunu karşılaştırmaktan ibaret, ancak bazı eyaletlerin nüfusu 3000.000, bazıları ise 2.000. Bir harita üzerinde resim yapıyorum ve rengin “yoğunluğu” her eyaletteki nüfusun tüm ülkenin nüfusuyla nasıl karşılaştırıldığına bağlı. Sorun, çok nüfusa …


4
Çok yüksek boyutsal veriler için PCA nasıl yapılır?
Temel bileşen analizi (PCA) yapmak için, her bir sütunun ortalamalarını verilerden çıkarmanız, korelasyon katsayı matrisini hesaplamanız ve sonra özvektörleri ve özdeğerleri bulmanız gerekir. Daha doğrusu, Python'da uygulamak için yaptığım şey, sadece korelasyon katsayısı matrisini (corrcoef) bulma yöntemi yüksek boyutsallığa sahip bir dizi kullanmama izin vermediği için sadece küçük matrislerle çalışıyor. …
12 pca  python 


4
Genel olarak değiştirilmeden, büyük bir listeden 10'dan fazla örnek nasıl alınır
10 veri noktasının tekrarlanan örneklerini almak istediğim geniş bir veri setim var (20.000 veri noktası). Ancak, bu 10 veri noktasını seçtikten sonra, tekrar seçilmemelerini istiyorum. sampleFonksiyonu kullanmayı denedim , ancak fonksiyonun birden fazla çağrısı yerine değiştirmeden örnekleme seçeneği yok gibi görünüyor. Bunu yapmanın kolay bir yolu var mı?
12 r  sample 

1
Fraktal matematiğe dayalı istatistikler
Fraktal matematiğe dayalı istatistikler üzerine kitaplar / ders kitapları arıyorum. Çok iyi bilinen bir alan olmadığını biliyorum ve iyi literatür bulmak oldukça zor. Herhangi bir öneri bekliyoruz (kitaplar, ders kitapları, çevrimiçi malzemeler).

3
Neden gecikmeli DV'yi enstrümantal değişken olarak kullanmalıyım?
Bir ekonometriçi değil, anlamaya çalıştığım bazı veri analizi kodlarını miras aldım. Bir model, aşağıdaki Stata komutuyla bir enstrümantal değişken regresyonunu çalıştırır ivreg my_dv var1 var2 var3 (L.my_dv = D2.my_dv D3.my_dv D4.my_dv) Bu veri kümesi, bu değişkenler kümesi için çoklu ardışık gözlemlere sahip bir paneldir. Bu kod neden DV'nin gecikmeli değerlerini …

4
Büyük alfa ve beta içeren bir beta dağıtımı için yaklaşık değerleri sayısal olarak nasıl hesaplayabilirim
Büyük tamsayı alfa, beta (örn. Alfa, beta> 1000000) için bir beta dağılımının değerlerini hesaplamanın sayısal olarak kararlı bir yolu var mı ? Aslında, bir şekilde sorunu daha kolay hale getirirse, mod çevresinde sadece% 99 güven aralığına ihtiyacım var. Ekle : Üzgünüm, sorum düşündüğüm kadar net bir şekilde ifade edilmedi. Yapmak …


3
İkili veri kümelememin önemli olup olmadığını nasıl test edebilirim
Alışveriş sepeti analizleri veri setim, satın alınan ürünlerle işlem vektörleri kümesi yapıyorum. İşlemlere k-ortalamaları uygularken, her zaman bir sonuç alacağım . Rastgele bir matris muhtemelen bazı kümeler de gösterir. Bulduğum kümelenmenin önemli olup olmadığını test etmenin bir yolu var mı, yoksa bu bir tesadüf olabilir. Evet ise, bunu nasıl yapabilirim.

4
Belirli bir tahmin tekniği ve parametreleri için bir örnek ne kadar büyük olmalıdır?
Belirli bir sayıda parametreye sahip bir modeli tahmin etmek için bir numunenin ne kadar büyük olması gerektiğini anlatmanın bir kuralı veya hatta herhangi bir yolu var mı? Yani, örneğin, 5 parametreli en küçük kareler regresyonunu tahmin etmek istersem örnek ne kadar büyük olmalı? Hangi tahmin tekniğini kullandığınız (örn. Maksimum olasılık, …

1
Noktanın iki değeri arasında istatistiksel olarak anlamlı büyük aykırı oranlara sahip örnek noktalar nasıl bulunur?
Örnek bir uygulama olarak, Stack Overflow kullanıcılarının iki özelliğini izlemeyi düşünün: itibar ve profil görünümü sayıları . Çoğu kullanıcı için bu iki değerin orantılı olması beklenir: yüksek rep kullanıcıları daha fazla dikkat çeker ve bu nedenle daha fazla profil görünümü elde eder. Bu nedenle, toplam itibarlarına kıyasla çok sayıda profil …
12 ratio 

1
(Pandalar) otokorelasyon grafiği neyi gösterir?
Ben bir acemiyim ve otokorelasyon grafiğinin ne gösterdiğini anlamaya çalışıyorum. Burada bahsetmediğim , bu sayfa veya ilgili Wikipedia sayfası gibi farklı kaynaklardan çeşitli açıklamalar okudum . Bir yıl için dizinimde tarihleri ​​olan ve değerler her dizin için 0'dan 365'e yükselen bu çok basit koda sahibim .. ( 1984-01-01:0, 1984-01-02:1 ... …

2
ML'deki softmax fonksiyonu ile termodinamikteki Boltzmann dağılımı arasındaki bağlantı ne kadar derindir?
Sinir ağlarında gerçek sayıları olasılıklara dönüştürmek için yaygın olarak kullanılan softmax fonksiyonu, Boltzmann dağılımı ile aynı işlevdir, termodinamikte belirli bir sıcaklıkta T termal dengede parçacıkların enerjileri üzerindeki olasılık dağılımı. Bunun pratik olmasının açık sezgisel nedenlerini görebiliyorum: Girdi değerleri negatif olursa olsun, softmax bire karşılık gelen pozitif değerler verir. Her zaman …

Sitemizi kullandığınızda şunları okuyup anladığınızı kabul etmiş olursunuz: Çerez Politikası ve Gizlilik Politikası.
Licensed under cc by-sa 3.0 with attribution required.