İstatistik Sözlüğü
A B C D E F G H İ K L M N O P R S T U V W Y Z
Sonuç Bulunamadı

Aradığınız terime uygun bir kayıt sözlüğümüzde yer almıyor.

A

A Katsayısı / Sabit Intercept

Bir regresyon doğrusu eşitliğindeki ($Y=a+bX$) sabit terim, $a$ katsayısıdır. Regresyon doğrusunun Y eksenini kestiği noktanın ordinatıdır. X (bağımsız değişken) sıfır olduğunda, bağımlı değişken Y'nin alacağı değere eşittir.

Absis Abscissa

Bir grafiğin yatay eksenidir. X ekseni olarak bilinir.

Açıklanabilen Değişkenlik Explained Variation

Dağılımın ortalaması hakkında tahmin edilen puanların değişkenliğidir. Bu açıklanan varyansa veya regresyon kareler toplamına (regSS) karşı gelir.

Açıklanamayan Değişkenlik Unexplained Variation

Regresyon doğrusu (veya tahmin edilen puanlar) etrafındaki puanların değişkenliğidir. Bu değişkenlik $\sum(Y-Y')^2$ formülü ile açıklanır ve bu açıklanamayan değişkenliğe ya da artık kareler toplamına karşılık gelir. İki değişken arasında mükemmel bir ilişki varsa, hiç açıklanamayan varyans olmayacak ve bu durumda bütün puanlar regresyon doğrusu üzerinde olacaktır. İlişki zayıfladıkça puanların doğruya göre sapmaları artacak ve açıklanamayan varyans söz konusu olacaktır.

Açıklayıcı Değişken Predictor / Explanatory Variable

Bir ilişkideki bilinen puanların diğer değişkendeki bilinmeyen puanları kestirmede kullanıldığı değişkene denir.

Açımlayıcı Veri Analizi Exploratory Data Analysis

Verilerin nasıl dağıldığı ile ilgili bir varsayım gerektirmeyen, istatistiksel sonuç çıkarım ihtiva etmeyen, verileri göstermek, açıklamak ve özetlemek üzere kullanılan yöntemlerdir. Bu teknikler gövde-yaprak ve kutu (box plot) diyagramlarını içerir. Bu teknikler J. Tukey tarafından geliştirilmiştir.

Ağırlıklandırılmamış Ortalama Unweighted Mean

Eşit ağırlıklı ortalama olarak bilinir. Bazı gözlemlere daha büyük ağırlık verilmeden hesaplanan ortalamadır.

Ağırlıklı Ortalama Weighted Mean

Birden fazla veri kümesinin bulunduğu bir durumda, bunların farklı katsayılarla ($a_1, a_2, \dots, a_n$) ağırlıklandırılması gerekebilir. Ölçmelerin farklı katsayılarla çarpılmasından sonra hesaplanan ortalamaya, ağırlıklı ortalama denir.

Aldatıcı İlişki Spurious Relationship

Bir kontrol ya da test değişkeninin girmesi ile bağımsız ve bağımlı değişken arasındaki ilişkinin kaybolması ya da manidar bir biçimde zayıflaması demektir.

Alfa Hatası (1. Tip Hata) Alpha Error

$H_0$ null hipotezine göre, bir istatistiksel testin hata üretme olasılığıdır. Doğru olan bir null hipotezinin reddedilmesi olasılığıdır. Bir örnekleme dağılımının ret bölgesinin büyüklüğünü gösterir. 1. tip hata yapma olasılığına alpha ($\alpha$) denir. Bu olasılık manidarlık düzeyidir. Doğru olan bir null hipotezinin kabul edilmesi ise doğru bir karar olup, $1-\alpha$ (güven aralığı) ile gösterilir.

Algoritma Algorithm

Özellikle hesaplamalarda, belli bir miktarın gerçek değerine dönüştürülmesine tekrarlayan bir süreç ile olanak veren kesin bir ilişki veya kurallar dizisi anlamına gelmektedir.

Alt Örneklem Subsample

Bir örneklemin kendi içinden tekrar seçilen örneklemi anlamındadır.

Amaçlı Örneklem Purposive Sample

Bireysel birimlerin araştırmacının amacına ve yargısına dayalı yöntemlerle seçildiği bir örneklemdir. Yanlılığa (bias) açık olmasından dolayı seyrek olarak kullanılmaktadır.

Ampirik Bilgi Empirical Knowledge

Gözlemler, deneyler ve somut ölçümler sonucu elde edilen objektif bilgiler.

Anlamlılık / Manidarlık Düzeyi Significance Level

Hipotez test etmede, $H_0$ (null) hipotezini reddetmek için kullanılan bir kriterdir. $H_0$ hipotezinin doğru olduğu halde reddedilme olasılığına anlamlılık düzeyi denir. 1. tür hata yapma olasılığını verir, $\alpha$ sembolü ile gösterilir. Genelde $\alpha$ değerleri 0.05, 0.01 ve 0.001 olarak alınır. Hesaplanan $p$ değeri bu eşikten küçükse sonuç istatistiksel olarak manidardır.

Ara Değişken Intervening Variable

Diğer iki değişkeni sebep-sonuç ilişkisiyle bağlayan, araya giren değişkendir. Örneğin, düşük motivasyon ile düşük başarı arasındaki ilişkide, motivasyon bir ara değişkendir.

Aralık Ölçeği Interval Scale

Bağıl (itibari) bir başlangıç (sıfır) noktası olan, iki ardışık ölçme birimi arasındaki uzaklığın aynı olduğu bir ölçektir. Bu ölçeğe ait puanlar toplanabilir ve çıkarılabilir ancak gerçek bir sıfır noktası olmadığı için oransal (kat) karşılaştırmalara uygun değildir (Örn: Termometre sıcaklıkları).

Araştırma (Alternatif) Hipotezi Alternative Hypothesis

$H_0$ (Null) hipotezinin reddedilmesi durumunda kabul edilen hipotezdir. Araştırmacının doğrulanmasını beklediği, değişkenler arasında bir ilişkinin ya da farkın olduğunu savunan hipotezdir. $H_1$ ya da $H_a$ sembolü ile gösterilir.

Artık / Hata (Residual) Residual

Bağımlı değişken Y'nin gözlenen değeri ile yordanan (tahmin edilen) değeri ($Y-Y'$) arasındaki sapma puanları olan, regresyonda yapılan açıklanamayan hatadır.

Asimetrik Dağılım Asymmetrical Distribution

Simetrik olmayan, herhangi bir merkezi değer etrafında eşit dağılmayan, sağa ya da sola çarpık olan dağılımdır.

Aşamalı (Stepwise) Regresyon Stepwise Regression

Çoklu regresyonda bağımlı değişkenin en önemli yordayıcılarının aşama aşama modele dahil edildiği tekniktir. Bağımlı değişkenle en yüksek korelasyon veren değişkenle başlanır, modelin açıklayıcılığına ($R^2$) katkı sağlayan diğer değişkenler sırayla modele alınır.

Ayırıcı (Diskriminant) Analizi Discriminant Analysis

Birimleri ya da bireyleri, ölçülen özelliklerine bakarak en az hata ile ait oldukları önceden bilinen gruplara ayırmak ve sınıflandırmak üzere yapılan çok değişkenli bir analiz tekniğidir.

B

Bağdaşmaz / Birbirini Dışta Tutan Olaylar Mutually Exclusive Events

İki olayın aynı anda ortaya çıkmasının imkansız olduğu olaylardır. Bir deneme durumunda sonuçlardan biri gözlendiğinde diğeri gözlenemiyorsa bunlar bağdaşmazdır (Örn: Zar atıldığında aynı anda hem tek hem çift gelmesi imkansızdır).

Bağımlı Değişken Dependent Variable

Deneysel bir çalışmada, bağımsız değişkene bağlı olarak ortaya çıkan, araştırmanın "sonucu" durumunda olan ve ölçülen değişkene denir. (Örn: Öğretim yönteminin matematik başarısı üzerindeki etkisinde "matematik başarısı" bağımlı değişkendir).

Bağımsız Değişken Independent Variable

Araştırmacı tarafından manipüle edilebilen (değiştirilebilen) ve bağımlı değişken üzerindeki "etkisi araştırılan" (sebep konumundaki) değişkenlere denir.

Bağımsız Örneklem Independent Sample

Birbirleri üzerinde hiçbir etkisi olmayacak şekilde, aynı evrenden ya da farklı evrenlerden seçilen farklı denek gruplarıdır (Örn: Deney ve Kontrol grupları, Kadınlar ve Erkekler).

Bar (Sütun) Grafik Bar Chart

Sınıflamalı (kategorik) verileri özetlemenin bir yoludur. Barlar birbirini izler ancak kategorik oldukları için birbirlerine dokunmayacak şekilde (aralıklı) yerleştirilir.

Bartlett Testi Bartlett's Test

Bağımsız normal örneklemlerden elde edilen grupların varyanslarının homojenliğini (eşitliğini) test eden bir istatistiksel testtir. Sapan değerlere (outliers) karşı Levene testinden daha hassastır.

Basıklık Kurtosis

Bir dağılımın sivri olup olmadığının ölçüsüdür. Basıklık katsayısının sıfırdan küçük olması dağılımın basık (platykurtic), sıfırdan büyük olması ise sivri (leptokurtic) olduğunu gösterir. Sıfır olması normal dağılım basıklığıdır (mesokurtic).

Basit Doğrusal Regresyon Simple Linear Regression

Bir bağımlı ve yalnızca bir bağımsız (yordayıcı) değişken arasındaki doğrusal ilişkiyi en küçük kareler yöntemi ile bulmaya yönelik matematiksel bir modeldir ($Y = a + bX$).

Beklenen Değer / Evren Ortalaması Expected Value

Bir tesadüfi değişkenin beklenen değeri, onun örnekleme dağılımının ortalamasını (merkezi değerini) gösterir ve $E(X)$ veya $\mu$ sembolü ile ifade edilir.

Beta Hatası (2. Tip Hata) Beta Error

Karşıt hipotezin ($H_1$) gerçekte doğru olduğu halde, $H_0$ hipotezinin reddedilememesi ile yapılan hatadır. $\beta$ ile gösterilir. Testin gücü ile ters orantılıdır ($\beta = 1 - \text{Testin Gücü}$).

Binom Dağılımı Binomial Distribution

Sadece iki çıktısı olan (başarı/başarısızlık, yazı/tura) birbirinden bağımsız $n$ sayıdaki deneydeki başarı sayısının olasılık dağılımıdır. Beklenen değer $E(X)=np$, varyans ise $npq$'dur.

Bonferroni Düzeltmesi Bonferroni Correction

Birden fazla karşılaştırma yapıldığında 1. Tip hata oranının (Alpha) kontrolsüzce artmasını engellemek için kullanılan, anlamlılık düzeyinin test sayısına bölündüğü istatistiksel bir düzeltmedir.

C

Cochran Q Testi Cochran Q Test

K sayıda bağımlı/ilişkili örneklem söz konusu olduğunda, üç veya daha fazla eşleştirilmiş kategorik (genellikle 1 ve 0 olarak ikili) veri setinin birbirlerinden farklı olup olmadığını test eden parametrik olmayan yöntemdir.

Çok Değişkenli Varyans Analizi (MANOVA) MANOVA

Bir ya da daha fazla bağımsız değişkene göre oluşan grupların, iki veya daha fazla "bağımlı değişken" bütünü (vektörü) bakımından aynı anda farklılık gösterip göstermediğini test eder.

Çoklu Bağlantı / Birlikte Doğrusallık Multicollinearity

Çoklu regresyon analizinde, yordayıcı (bağımsız) değişkenlerin kendi aralarında çok yüksek derecede korelasyon göstermesi sorunudur. Modelin güvenilirliğini düşürür (VIF ve Tolerans değerleri ile tespit edilir).

Çoklu Determinasyon Katsayısı ($R^2$) Multiple R-Squared

İki veya daha fazla bağımsız değişkenin, bir bağımlı değişkendeki varyansın (değişkenliğin) % kaçını ortaklaşa açıklayabildiğini gösteren orandır.

D

Değişim / Varyasyon Katsayısı ($V$) Coefficient of Variation

Grupların değişkenlik açısından standartlaştırılarak karşılaştırılmasında kullanılır. Standart sapmanın ortalamaya bölünüp 100 ile çarpılmasıyla elde edilen yüzdelik bir ifadedir. $V$ değeri küçük olan grup daha homojendir.

Deneysel Desen Experimental Design

İlgilenilen hipotezlere cevap verebilmek ve neden-sonuç ilişkilerini izole edebilmek için, verilerin toplanması, grupların atanması ve bağımsız değişkenlerin manipüle edilmesine yönelik araştırmacı tarafından kurulan istatistiksel plandır.

Doğrulayıcı Faktör Analizi Confirmatory Factor Analysis

Araştırmacının önceden belirlediği bir teorik yapıya veya hipoteze göre, hangi değişkenlerin (maddelerin) hangi faktörler (boyutlar) altında toplanması gerektiğini önceden modele tanımlayıp, verilerin bu teoriyle ne kadar uyumlu olduğunu test ettiği gelişmiş analizdir.

Dummy (Kukla/Boş) Değişken Dummy Variable

Regresyon analizine kategorik (isimsel) verileri dahil edebilmek için oluşturulan, sadece 1 ve 0 değerlerini alabilen yapay değişkenlerdir (Örn: Erkek=0, Kadın=1).

E

Eğim ($b$) Slope

Regresyon eşitliğinde ($Y = a + bX$), bağımsız değişken $X$'teki 1 birimlik artışa karşılık, bağımlı değişken $Y$'de meydana gelecek ortalama değişimi belirten katsayıdır.

En Küçük Kareler Yöntemi Least Squares Method

Regresyon doğrusunun (veya modelinin) katsayılarını hesaplarken, gözlenen değerler ile modelin tahmin ettiği değerler arasındaki hata paylarının kareleri toplamını ($\sum(Y-Y')^2$) minimum yapmayı amaçlayan temel matematiksel optimizasyon yöntemidir.

Eta Kare ($\eta^2$) Eta Squared

Varyans analizi (ANOVA) sonucunda, gruplar arası kareler toplamının, genel kareler toplamına bölünmesiyle bulunur. Bağımsız değişkenin (işlemin) bağımlı değişkende ne kadarlık bir varyansı (etkiyi) tek başına açıkladığını gösteren etki büyüklüğü indeksidir.

Evren (Anakütle) Population

Araştırmacının hakkında genelleme yapmak istediği, belirli ortak özelliklere sahip tüm birimlerin ya da gözlemlerin oluşturduğu bütündür. Evren ortalaması $\mu$, standart sapması $\sigma$ ve varyansı $\sigma^2$ gibi evrene ait değişmez kesin değerlere Parametre denir.

F

F İstatistiği ve Dağılımı F Distribution

İki farklı varyans tahmininin (örneğin Gruplar Arası Varyans / Grup İçi Varyans) birbirine oranından doğan asimetrik ve her zaman pozitif bir dağılımdır. ANOVA testlerinde gruplar arası farkın rastlantısal olup olmadığını test etmek için kullanılır.

Faktör Analizi Factor Analysis

Çok sayıdaki birbiriyle ilişkili değişkeni (örneğin bir anketin 50 maddesi), kendi aralarındaki korelasyonları temel alarak "Faktör" adı verilen daha az sayıdaki anlamlı, bağımsız, alt ve gizil (latent) boyuta indirgemeyi amaçlayan çok değişkenli istatistik tekniğidir.

Fisher'in Kesin Testi Fisher's Exact Test

2x2 formatındaki çapraz tablolarda (kontingensi), hücrelerdeki beklenen frekansların 5'in altına düştüğü durumlarda, Ki-Kare testi varsayımları bozulduğu için olasılıkları faktöriyeller üzerinden "kesin (exact)" olarak hesaplayan asimptotik olmayan testtir.

Frekans ($f$) Frequency

Bir veri setinde, belirli bir puanın (veya aralığın) kaç defa gözlendiğini/tekrarlandığını belirten sayıdır.

G

Geçerlilik Validity

Bir ölçme aracının (test, anket, cihaz), ölçmeyi amaçladığı yapıyı, başka özellikleri işin içine karıştırmadan ne derece doğru ve amacına uygun ölçebildiğinin göstergesidir.

Güven Aralığı Confidence Interval

Örneklem istatistiklerinden yola çıkarak, bilinmeyen gerçek evren parametresinin, belirlenen bir olasılık derecesiyle (örn: %95 veya %99) içine düşmesinin beklendiği tahmin alt ve üst sınır aralığıdır.

Güvenirlik Reliability

Bir ölçme aracının aynı nesneleri, farklı zamanlarda veya aynı testin alternatif formlarıyla ölçtüğünde ne kadar tutarlı, kararlı ve hatalardan arınmış sonuçlar verdiğinin bir indeksidir.

H

Hipotez Testi Hypothesis Testing

Örneklemden alınan veriler yardımıyla, evrene ait ortaya atılan iddiaların (hipotezlerin) olasılık kuralları çerçevesinde doğruluğunun sorgulanması ve bir karara bağlanması sürecidir.

Histogram Histogram

Sürekli değişkenlerin veri dağılımlarını göstermek için tasarlanan grafik türüdür. Yatay eksende veri aralıkları (gerçek sınırlarıyla), dikey eksende frekanslar yer alır ve sütunlar birbirine bitişik çizilir.

İ

İki-Yönlü Varyans Analizi Two-Way ANOVA

Bağımlı değişken üzerinde, bağımsız iki farklı faktörün hem ayrı ayrı (temel etkiler) hem de birbirleriyle olan etkileşimlerinin (ortak etki) eş zamanlı test edilmesini sağlayan parametrik testtir.

İki-Yönlü Test Two-Tailed Test

Araştırma hipotezinde farkın veya ilişkinin bir yöne (büyüktür/küçüktür) odaklanmadığı, "sadece fark vardır" hipotezinin kurulduğu durumlarda, normal dağılım eğrisinin her iki ucundaki ret bölgelerinin ($\alpha/2$) aynı anda kontrol edildiği test yaklaşımıdır.

İlişkili (Bağımlı) Örneklemler t-Testi Paired Samples t-Test

Aynı deneklerin iki farklı zamanda (Ön-Test / Son-Test gibi) veya iki farklı koşul altındaki sürekli ölçümleri arasındaki farkın istatistiksel olarak anlamlı olup olmadığını test eden parametrik yöntemdir.

İlişkisiz (Bağımsız) Örneklemler t-Testi Independent Samples t-Test

Aralarında hiçbir bağ bulunmayan iki farklı grubun (örn: Kadınlar vs Erkekler) belirli bir sürekli değişkene ait ortalamaları arasındaki farkın evrende anlamlı olup olmadığını inceleyen parametrik testtir.

İstatistik Statistics

Evreni temsil etmek üzere seçilen bir "örneklemden" elde edilen ve o örneklemi özetleyen sayısal değerlerdir (Örneklem ortalaması $x$, standart sapması $s$ gibi). Aynı zamanda verilerin toplanması, özetlenmesi ve evren hakkında tahmin yürütülmesini (Kestirisel İstatistik) sağlayan bilim dalıdır.

K

Karar Kuralı Decision Rule

Hesaplanan P-değerinin önceden belirlenen $\alpha$ (0.05 gibi) eşik değerinden küçük olması durumunda $H_0$ hipotezinin reddedilerek sonucun anlamlı bulunması esasına dayanan kesin test mantığıdır.

Ki-Kare Bağımsızlık Testi Chi-Square Test of Independence

Çapraz (Kontingensi) tablolarda sınıflandırılmış iki kategorik (nitel) değişkenin, evrende birbirinden bağımsız olup olmadığını, "Gözlenen" ve "Beklenen" frekanslar arasındaki sapmaları toplayarak test eden parametrik olmayan bir istatistiktir.

Korelasyon Katsayısı ($r$) Correlation Coefficient

İki değişken arasındaki ilişkinin hem "Yönünü" (+ veya -) hem de "Gücünü" ölçen istatistiktir. Daima -1 ile +1 arasında değer alır. 0'a yaklaşması ilişkinin zayıfladığını veya olmadığını, 1'e yaklaşması mükemmel doğrusal ilişkiyi gösterir.

Kovaryans Analizi (ANCOVA) Analysis of Covariance

Bağımsız değişkenlerin bağımlı değişken üzerindeki etkisini incelerken, bağımlı değişkeni etkileyebilecek ancak araştırmanın asıl odağı olmayan ikincil sürekli değişkenlerin (Kovaryet / Ortak değişken) etkisini matematiksel olarak dışarıda tutan istatistiksel modeldir.

Kruskal-Wallis Testi Kruskal-Wallis H Test

Üç veya daha fazla bağımsız grubun medyanlarının (sıralamalarının) farklı olup olmadığını karşılaştıran, Tek Yönlü ANOVA'nın "parametrik olmayan (non-parametrik)" dağılımsız versiyonudur.

Kutu Grafiği Boxplot

John Tukey tarafından geliştirilen; verilerin Minimum, Q1 (25. Yüzdelik), Medyan, Q3 (75. Yüzdelik) ve Maksimum olmak üzere 5-sayılı özetini aynı anda sunan, aykırı değerleri harika görselleştiren modern grafik türüdür.

L

Levene Testi Levene's Test

İki veya daha fazla grubun varyanslarının birbirine eşit (homojen) olup olmadığını test eden yöntemdir. ANOVA veya bağımsız t-testi öncesinde "Varyansların Homojenliği" varsayımının kontrolünde sıkça kullanılır.

Lojistik Regresyon Logistic Regression

Bağımlı değişkenin sürekli olmadığı, sadece iki (Evet/Hayır, Yaşıyor/Öldü) ya da birkaç kategoriden oluştuğu durumlarda, olayların "gerçekleşme olasılıklarını (odds)" tahmin etmek için kullanılan, normallik gerektirmeyen gelişmiş regresyon modelidir.

M

Mahalanobis Uzaklığı Mahalanobis Distance

Çok değişkenli analizlerde, veri noktalarının merkeze (vektörel ortalamaya) olan standartlaşmış uzaklıklarını ölçerek çok değişkenli aykırı değerleri (multivariate outliers) yakalamada kullanılan ölçüttür.

Mann-Whitney U Testi Mann-Whitney U Test

İki "bağımsız" grubun puanlarının aynı evren dağılımından gelip gelmediğini, verilerin ham değerleri yerine onları sıraya dizerek (rank) test eden, Bağımsız Örneklemler t-Testi'nin parametrik olmayan en güçlü alternatifidir.

Merkezi Eğilim Ölçümleri Measures of Central Tendency

Bir veri setindeki yığılmanın veya toplanma merkezinin neresi olduğunu tek bir sayı ile özetleyen değerlerdir. En yaygın olanları Aritmetik Ortalama, Medyan (Ortanca) ve Mod'dur.

N

Normal Dağılım Normal Distribution

Ortalama etrafında simetrik, çan şeklinde olan, Ortalama = Medyan = Mod eşitliğine sahip olan, evrendeki pek çok doğal fenomenin dağılım şeklidir. Sürekli veriler için t-test, ANOVA gibi parametrik tekniklerin kullanılması verilerin normal dağılım göstermesi varsayımına (sayıltısına) dayanır.

O

Olasılık Değeri (P-Değeri) P-Value

Null hipotezinin ($H_0$) doğru olduğu varsayımı altında, testte hesaplanan veya ondan daha uç bir istatistiği şans eseri elde etme olasılığıdır. $\alpha$ (0.05) seviyesinden küçük olması bulgunun şans olmadığını, anlamlı olduğunu gösterir.

Oran Ölçeği Ratio Scale

Mutlak bir "Gerçek Sıfır" noktası bulunan, bu sayede veriler arasında "iki katı, yarısı" gibi oransal mantıkların (çarpma/bölme) kurulabildiği en üst düzey ölçme seviyesidir (Örn: Ağırlık, Boy, Yaş).

Ortalama Mean

Bir dağılımdaki tüm puanların toplanıp gözlem sayısına bölünmesiyle elde edilen denge (merkez) noktasıdır. Çarpık dağılımlarda ve uç değerlerden fazlasıyla etkilenerek kolayca kayabilir.

Ortanca (Medyan) Median

Büyüklük sırasına göre küçükten büyüğe dizilmiş bir veri setini tam ortadan ikiye ayıran, ölçümlerin %50'sini altında %50'sini üstünde tutan değerdir. Uç değerlerden etkilenmez, çarpık dağılımlar için en güvenilir merkezi ölçüdür.

Ö

Ölçek Türleri Scale Types

Değişkenlerin veri tipini ve taşıdığı matematiksel gücü belirten seviyelerdir. Dört gruba ayrılır: Sınıflama (Nominal), Sıralama (Ordinal), Eşit Aralıklı (Interval) ve Oranlı (Ratio).

Örneklem Sample

Ulaşılması zor olan devasa bir Evrenin (Popülasyon) özelliklerini istatistiksel genellemeler yoluyla anlamak için, o evrenden bilimsel kurallara göre çekilen daha küçük, ulaşılabilir ve temsil yeteneği olan gruptur.

Örnekleme Hatası Sampling Error

Aynı evrenden çekilseler bile, istatistiklerin şans faktörü yüzünden örneklemden örnekleme farklılık (dalgalanma) göstermesidir. Evren parametresi ile elde edilen örneklem istatistiği arasındaki doğal matematiksel farklılıktır.

P

Parametrik Olmayan Test Non-Parametric Test

Verilerin normal dağılım göstermesi gibi zorunlu evren parametre varsayımları gerektirmeyen "Dağılımsız" istatistiksel tekniklerdir (Örn: Mann-Whitney, Kruskal-Wallis, Wilcoxon). Verileri sıralamaya dönüştürerek çalışırlar.

Parametrik Test Parametric Test

Verilerin "Aralık" veya "Oran" ölçeğinde olmasını, evrende "Normal Dağılım" göstermesini ve grup varyanslarının eşit olmasını zorunlu kılan, istatistiksel gücü çok yüksek hipotez testleridir (Örn: t-test, ANOVA).

R

Ranj (Açıklık) Range

Bir veri setindeki en kaba değişim (dağılım) ölçüsüdür. Sadece serideki en büyük değerden en küçük değerin çıkarılmasıyla bulunur. Uç değerlerden aşırı etkilenir.

Reddetme (Kritik) Bölgesi Rejection Region

Standart normal (veya test) dağılımı eğrisinin uç noktalarında yer alan, eğer hesaplanan test istatistiği bu bölgenin içine düşerse Null ($H_0$) hipotezinin tereddütsüz olarak reddedileceği karar aralığıdır. Büyüklüğü $\alpha$ ile belirlenir.

Regresyon Doğrusu Regression Line

X ve Y değişkenlerinin birleşimlerini gösteren saçılma diyagramı üzerindeki nokta bulutunun içinden, tüm noktalara "en yakın" mesafeden geçecek şekilde matematiksel (En Küçük Kareler) olarak çizilen yordama (tahmin) doğrusudur.

S

Sıfır (Yokluk) Hipotezi Null Hypothesis

$H_0$ sembolü ile gösterilen ve her zaman test edilen asıl hipotezdir. İstatistikte peşin olarak "Gruplar arasında fark yoktur", "İki değişken arasında ilişki yoktur" savını öne sürer ve deney verileriyle aksinin kanıtlanması beklenir.

Sınıflama Ölçeği Nominal Scale

Değişkenleri yalnızca özelliklerine göre isimlendirip ayırmaya yarayan (Cinsiyet, Kan Grubu, Renk) en alt düzey ölçektir. Bu ölçekteki rakamların (1=Kadın, 2=Erkek) büyüklük/küçüklük veya matematiksel işlem değeri kesinlikle yoktur.

Sıralama Ölçeği Ordinal Scale

Gözlemlerin belli bir özelliğe göre büyükten küçüğe dizilebildiği, ancak dizilen değerler arasındaki birimsel uzaklıkların "eşit" olmadığı ölçek türüdür. (Örn: Rütbeler, Eğitim düzeyi: İlkokul, Lise, Üniversite).

Standart Hata Standard Error

Bir evrenden seçilecek örneklemlerin vereceği sonuçların kendi içlerindeki dalgalanmasını gösteren, teorik bir örneklem dağılımının standart sapmasıdır. Örneklem hacmi ($n$) büyüdükçe küçülür.

Standart Sapma Standard Deviation

Örneklemdeki verilerin Aritmetik Ortalama'dan ortalama olarak ne kadar saptığını (uzaklaştığını) gösteren en yaygın değişim ölçüsüdür. Varyansın karekökü alınarak formülüze edilir. Evren parametresi $\sigma$, örneklem istatistiği ise $S$ ile gösterilir.

T

t Dağılımı Student's t Distribution

Evrenin varyansının bilinmediği ve örneklem sayısının düşük olduğu durumlarda normal dağılım yerine kullanılan simetrik istatistiksel dağılımdır. Örneklem büyüdükçe (serbestlik derecesi arttıkça) normal Z dağılımına dönüşür.

Tek-Yönlü Test One-Tailed Test

Kurulan alternatif hipotezin ($H_1$) farkın "yönünü" kesin olarak belirttiği durumlarda (örn: "A, B'den büyüktür"), standart olasılık dağılımının sadece belirtilen tek bir ucundaki reddetme bölgesi ($\alpha$) ile yapılan testtir.

Tek-Yönlü Varyans Analizi One-Way ANOVA

Yalnızca "tek bir bağımsız kategorik değişkenin" ikiden fazla düzeyi (grubu) arasındaki ortalamaların, bir bağımlı değişkene göre istatistiksel olarak fark yaratıp yaratmadığını Toplam Kareler hesabı ile test eden tekniktir.

Testin Gücü Statistical Power

Gerçekte evrende var olan "Yanlış" bir $H_0$ hipotezini, analiz sonucunda testin başarıyla reddedebilme kapasitesi ve olasılığıdır. Güç = $1-\beta$ formülüyle açıklanır. Numune boyutu ($n$) arttıkça testin gücü artar.

V

Varyans Variance

Puanların aritmetik ortalamadan olan sapmalarının karelerinin toplanarak örneklem genişliğinin bir eksiğine ($n-1$) bölünmesiyle ulaşılan kareli bir yayılım (değişkenlik) ölçütüdür ($\sigma^2$ veya $S^2$).

Varyansın Homojenliği Homogeneity of Variance

Karşılaştırma yapılacak olan bağımsız grupların iç dağılımlarının (yayılımlarının) evrende birbirine eşit olduğu (homoscedasticity) teorik varsayımıdır. ANOVA testleri için en kritik kurallardan biridir.

W

Wilcoxon İşaretli Sıralar Testi Wilcoxon Signed Ranks Test

İlişkili (bağımlı) iki veri seti veya Ön-Test/Son-Test tasarımındaki farkların anlamlılığını dağılımsız olarak sorgulayan, t-testinin "Parametrik Olmayan" versiyonudur.

Y

Yansız (Seçkisiz) Atama Randomization

Deneysel bilimlerde ve örneklem çekiminde; birimlerin deney, kontrol gruplarına veya anket listelerine araştırmacının müdahalesi, yönlendirmesi (yanlılığı) olmadan tamamen olasılığa (kuraya) bağlı dağıtılması işlemidir.

Z

z-Puanı z-Score

Farklı birimlerde ölçülmüş herhangi bir ham veri serisini alıp ortalaması "0", standart sapması "1" olan tek bir evrensel ölçüye oturtan, bireysel verinin ortalamadan kaç birim uzaklaştığını gösteren standardize puandır.