Yöntem ve kaynakça
Buradaki her sayısal iddianın bir künyesi var. Kelime listeleri kimin yayınından geldiğini, seviye testinin neyi ölçüp neyi ölçmediğini ve içeriğin hangi otomatik kontrollerden geçtiğini bu sayfada bulacaksınız.
Kısaca: bu site neye dayanıyor
Pratik İngilizcem özgün bir dil öğretim kuramı ileri sürmez. Yaptığı iş, yayımlanmış ve atıf verilebilir dilbilim çalışmalarını çalışılabilir bir sisteme dönüştürmektir. Kelime listeleri türetilmemiş, kaynak yayınlardan alınmıştır; ölçüm yöntemi uydurulmamış, kabul görmüş bir testin mantığını izler.
Sitedeki 3076 kelimenin tamamı aşağıdaki kaynak listelerden gelir. 16 gramer konusunun seviye etiketleri CEFR çerçevesine göre verilir. 40 soruluk seviye testi Nation ve Beglar'ın örnekleme mantığını uygular.
Kelime dağarcığı neden sayılmaz, örneklenir
Kimse bir kişinin bildiği kelimeleri tek tek soramaz. Bu yüzden kelime dağarcığı ölçümü örnekleme ile yapılır: kelimeler sıklık sırasına göre bantlara bölünür, her banttan eşit sayıda kelime sorulur ve bir banttaki isabet oranı o bandın tamamı için bilme oranı kabul edilir.
Seviye testi dört bantta bant başına 8
soru sorar. Tahmini dağarcık Σ (oran × bant büyüklüğü), metin kapsama
oranı ise Σ (oran × kapsam payı) ile hesaplanır.
Testin üç tasarım kararı
- Test kelimeleri hiçbir havuzda geçmez. Örnekleme ancak sitede çalışılmayan kelimelerden oluşursa geçerli kalır; havuza sızan bir test kelimesi ölçümü kendi kendine şişirir. Bu kural bir temenni değil: derleme sırasında otomatik olarak denetlenir ve ihlâlinde yayın durur.
- Akademik bant bir holdout rezervinden örnekler. Akademik liste
(570 kelime ailesi) sitede baştan sona çalışılabildiği için
"öğretilmeyen listeden örnekleme" mümkün değil. Bunun yerine alt liste 4–10'a
dağılmış 30 kelime kalıcı olarak havuzların dışında tutuluyor ve
test yalnızca bu rezervden soru seçiyor — makine öğrenmesindeki eğitim/test
ayrımının aynısı. Bedeli açık: o kelimeleri burada çalışamazsınız. Karşılığında
akademik sonucunuz, çalıştığınız kelimeleri tekrar sorup kendini doğrulayan bir
ölçüm olmaktan kurtuluyor.
Havuzların dışında kalan akademik başlık sayısı toplamda 33: rezervdeki 30 kelimeye, b2–b3 bantlarının ölçüm kelimesi olan üç akademik başlık ekleniyor. Havuzlarda çalışılabilen 537 kelimeyle birlikte listenin tamamı hesapta: 537 + 33 = 570. Bu toplam her derlemede yeniden ölçülüyor; tutmazsa yayın durur. - Doğru cevap test sırasında gösterilmez. Göstermek sonraki bantların ölçümünü etkiler. Kaçırılan kelimelerin tamamı sonuç ekranında anlamlarıyla listelenir.
Rezerv soru sayısından (bant başına 8) daha büyük olduğu için her çalıştırmada farklı kelimeler seçilir; testi ikinci kez girmek ezberle geçilebilir bir şey olmaktan çıkar.
Testin ölçmediği şey: Bu bir yeterlilik sınavı değildir ve YDS, YÖKDİL, TOEFL veya IELTS puanı tahmin etmez. Yalnızca kelime tanıma kapasitesini ölçer — dinleme, yazma, konuşma ve okuduğunu yorumlama becerileri kapsam dışıdır. Sonuç bir sertifika değil, nereden başlanacağını gösteren bir yönlendirmedir.
%92 ve %98: sitedeki iki sayı nereden geliyor
En sık kullanılan yaklaşık 2.800 kelime, genel İngilizce metinlerin %92'sini kapsar — bu, NGSL'in kendi kapsama iddiasıdır ve seviye testinin puanlamasına gömülüdür. Tam puanlı bir çalıştırma tam da bu sayıyı üretir.
Bir metni sözlüğe bakmadan anlayabilmek için ise sözcüklerin yaklaşık %98'inin tanınması gerekir; bu eşik Hu ve Nation'ın (2000) çalışmasından gelir. Aradaki fark somut bir şeye karşılık geliyor: %90 kapsamda her on kelimeden biri bilinmezken, %98'de bu oran elli kelimede bire iner.
Akademik sınavların ayrıştığı yer bu aralıktır — ve bu aralık gramerle değil, kelimeyle kapanır.
Neden the ve of kelime kartı değil
Sıklık listesinin ilk yüz sırası büyük ölçüde işlev sözcüğüdür: artikeller, zamirler, edatlar, bağlaçlar, yardımcı fiiller. Kapsama hesabında sayılırlar — ama kelime kartına girmezler.
Sebebi basit: the için bir Türkçe karşılık ezberlemek işe yaramaz. Bu sözcükler tek başlarına anlam taşımaz, kurala göre çalışırlar. Ne zaman the konacağı bir çeviri sorusu değil, belirlilik sorusudur; hangi edatın geleceği ezber değil, yapı meselesidir. Bu yüzden ilk bin kelimenin 140'ı sıklık havuzlarına alınmadı ve gramer referansına bırakıldı: artikeller isim grubu, zamirler zamirler, edatlar edatlar, bağlaçlar bağlaçlar ve yardımcı fiiller modallar sayfasında işlenir.
Havuzlarda gördüğünüz sayı bu yüzden bandın tamamı değil, bandın içerik sözcükleridir. Eksiklik değil, iş bölümü.
Aralıklı tekrar nasıl uygulanıyor
Kelime motoru Leitner'in kutu sistemini uygular. Kutu yükseldikçe aralık uzar ve sorunun türü zorlaşır — çünkü bir kelimeyi "tanımak" ile "üretebilmek" aynı şey değildir.
| Kutu | Aralık | Soru türü |
|---|---|---|
| 0–1 | Aynı oturum · 1 gün | Tanıma — dört seçenekten anlamı seçilir |
| 2 | 3 gün | Üretim — Türkçesi verilir, İngilizcesi yazılır |
| 3+ | 7 · 21 · 60 gün | Bağlam — örnek cümledeki boşluk doldurulur |
Hız antrenmanı ayrı bir eksendir ve tekrar kutularına dokunmaz. 2,5 saniyede yetişememek kelimenin unutulduğu anlamına gelmez; tekrar takvimini bozmamalıdır.
Dinleme neden ayrı bir eksen
Yukarıdaki üç soru türü de kelimeyi yazıyla sorar. Oysa bir kelimeyi okurken tanımak, onu duyunca tanımakla aynı beceri değildir: konuşulan dilde kelimeler birbirine yapışır, vurgusuz heceler düşer ve yazılı biçimde apaçık duran bir kelime seste hiç beklenmedik bir şeye benzer. Ders almadan kapanması en zor açık budur.
Dinleme antrenmanı bu yüzden var ve bağlam modunun kulakla çalışan hâlidir: örnek cümle sesli okunur, cümle ekranda hedef kelimenin yeri boş bırakılarak gösterilir, duyduğunuz kelime yazılır. Cümlenin tamamı okunur, kelime tek başına değil — amaç kelimeyi akış içinde yakalayabilmektir. Yalıtılmış okunan bir kelime kolaydır ama gerçek dinlemeyi eğitmez.
Hız antrenmanında olduğu gibi, dinleme sonucu da tekrar kutularına dokunmaz. Bir kelimeyi duyunca çıkaramamak onu unuttuğunuz anlamına gelmez; iki ayrı beceriyi tek bir takvime bağlamak ölçümü de çalışmayı da bozardı.
Okuma parçalarının sonundaki anlama soruları YDS biçimindedir: soru kökü ve beş şık İngilizce, açıklama Türkçe. Soru kökleri bilerek sadeleştirilmemiştir — It can be inferred… gibi kalıplar sınavda aynen bu hâlde gelir ve onları tanımak da ölçülen becerinin parçasıdır.
Ses, tarayıcınızın kendi konuşma sentezinden gelir; site ses dosyası barındırmaz ve mikrofonunuza erişmez. Cihazınızda İngilizce ses yoksa özellik hiç açılmaz — Türkçe bir sesle İngilizce okutmak yanlış telaffuz öğretirdi ve bu, hiç öğretmemekten kötüdür.
İçerik hangi kontrollerden geçiyor
İçerik doğruluğu editoryal bir niyet beyanına bırakılmamıştır. Her yayın öncesi altı otomatik denetim çalışır ve başarısız olan bir kontrol yayını durdurur:
- Kaynak bütünlüğü: tablo sütun tutarlılığı, kapatılmamış bileşenler, kopuk konu zincirleri, var olmayan test referansları, seviye testinden havuza sızmış kelimeler ve havuzlar arası tekrarlar.
- Render doğrulaması: üretilen HTML taranarak render edilmemiş vurgu işaretleri aranır. Kaynağa değil çıktıya bakılmasının sebebi, markdown'ın vurgu kurallarının kaynak metinden güvenilir biçimde taklit edilememesidir.
- İlerleme bütünlüğü: çalışma kayıtlarınızı dışa/içe aktarma kuralları sınanır — birleştirmenin tekrar kutularını hiçbir koşulda geri götürmemesi ve aynı dosyayı iki kez aktarmanın hiçbir şeyi değiştirmemesi dâhil.
- Ses seçimi: telaffuz için yalnızca gerçek bir İngilizce konuşma sesi seçildiği doğrulanır. İşletim sistemlerinin sunduğu şaka sesleri (çizgi film, robot, şarkı söyleyen sesler) bu kontrolde elenir; hiçbiri geçemezse özellik kapatılır.
- Okuma kapsaması: her okuma parçasının, ilan ettiği sıklık bandını gerçekten tuttuğu ölçülür. Sözlüksüz okumanın eşiği olan %98'in altında kalan bir parça yayına giremez — böylece "bu bandı bitirdiyseniz bu metni okuyabilirsiniz" cümlesi bir temenni değil, ölçülmüş bir iddia olur.
- Kelime notları eşitliği: eşdizim ve kelime ailesi tablosu değişip havuzlar yeniden üretilmediyse yayın durur.
Kaynak deposu herkese açık değildir, bu yüzden kontrollerin koduna bağlantı verilmez. Buradaki her iddia yine de sınanabilir: sayfalardaki sayılar künyelenmiş kaynaklara dayanır ve gördüğünüz bir hatayı bildirebilirsiniz.
Kaynakça
Aşağıdaki künyeler sitedeki içeriğin dayandığı yayınlardır. Her kaynağın hangi bölümde kullanıldığı ayrıca belirtilmiştir.
Sıklık havuzları kaynaktan türetilir. Genel izdeki havuzların hangi kelimeyi içerdiği ve hangi banda düştüğü elle girilmez: NGSL 1.2'nin resmî veri dosyası kaynak olarak tutulur ve havuzlar bir üreteçle o dosyadan çıkarılır. Listede yer almayan bir kelime havuza giremez; bunu her derlemede otomatik bir kontrol denetler. Kaynak listenin kendisi yayıncısının sitesinde herkese açık ↗ — sıralamayı bizim havuzlarımızla karşılaştırmak isterseniz oradan doğrulayabilirsiniz.
AWL doğrulama durumu. Alt liste 1–4 havuzları, Victoria University of Wellington'un yayımladığı resmî başlık kelimeleri belgesiyle birebir karşılaştırılarak girildi. Alt liste 5–10 havuzları henüz bu karşılaştırmadan geçmedi: kelimelerin AWL'ye ait olduğu değil, hangi alt listeye düştükleri doğrulama bekliyor. Her havuzun künyesinde bu not ayrıca yer alır ve doğrulama tamamlandığında kaldırılacaktır.
-
Browne, C., Culligan, B. & Phillips, J. (2013). The New General Service List (NGSL).
Genel İngilizce sıklık listesi. Sitedeki genel kelime havuzları bu listenin 1–2818 bandından türetildi. Listenin kendi kapsama iddiası olan %92, yerleştirme testinin puanlamasına gömülüdür.
Kullanıldığı yer: Genel kelime havuzları · yerleştirme testi bantları · Kaynağa git ↗
-
Coxhead, A. (2000). A New Academic Word List.
TESOL Quarterly, 34(2), 213–238. Akademik Kelime Listesi'nin (AWL) kaynak yayını. Sitedeki akademik havuzlar bu listenin on alt listesinden derlendi. Alt listelerin tamamı (1–10) yayımlanmış AWL başlık kelimeleri dökümüyle karşılaştırıldı: havuzlardaki 537 kelimenin hepsi listede yer alıyor ve hepsi ilan edilen alt listeye düşüyor. Karşılaştırma artık her derlemede yeniden yapılıyor, bir kereye mahsus değil.
Kullanıldığı yer: Akademik kelime havuzları · yerleştirme testinin akademik bandı · Kaynağa git ↗
-
Hu, M. & Nation, P. (2000). Unknown vocabulary density and reading comprehension.
Reading in a Foreign Language, 13(1), 403–430. Sitedeki %98 akıcı okuma eşiği iddiasının kaynağı. Bir metni yardımsız anlayabilmek için sözcüklerin yaklaşık %98'inin tanınması gerektiğini ortaya koyar.
Kullanıldığı yer: Ana sayfadaki %92 → %98 aralığı · sonuç yorumları · Kaynağa git ↗
-
Nation, I.S.P. & Beglar, D. (2007). A vocabulary size test.
The Language Teacher, 31(7), 9–13. Yerleştirme testinin yöntemi buradan geliyor: kelime dağarcığı sayılamaz, sıklık bantlarından örneklenir; bir banttaki isabet oranı o bandın tamamı için bilme oranı kabul edilir.
Kullanıldığı yer: Yerleştirme testinin tasarımı ve puanlaması · Kaynağa git ↗
-
Leitner, S. (1972). So lernt man lernen.
Aralıklı tekrarın kutu sistemi. Kelime motorundaki 0–5 kutu düzeni ve artan aralıklar (aynı oturum · 1 · 3 · 7 · 21 · 60 gün) bu modelin uygulamasıdır.
Kullanıldığı yer: Kelime motorunun tekrar takvimi
-
Council of Europe (2001). Common European Framework of Reference for Languages (CEFR).
Gramer sayfalarındaki A1–C1 seviye etiketleri bu çerçeveye göre verilir. Etiketler bir sertifikasyon değil, konunun hangi yeterlilik aralığına yayıldığını gösteren yönlendirmedir.
Kullanıldığı yer: Gramer sayfalarının seviye etiketleri · Kaynağa git ↗
Hata bulursanız
Kelime listelerinde, gramer açıklamalarında veya test sorularında hata görürseniz bildirin. Doğrulanan her bildirim düzeltilir ve ilgili sayfanın güncelleme tarihi değişir — böylece neyin ne zaman değiştiği izlenebilir kalır. İçeriği derleyen kişi hakkında bilgi için Necmeddin Cunedioğlu sayfasına, bildirim kanalları için İletişim sayfasına bakabilirsiniz.