Лема, словоформа чи «слово»: чому 2000 непорівнянні
Розмір словника має сенс лише коли ви знаєте одиницю. Три лінійки, приклади EN/ES і чесна карта: без диплома і без порівняння несумісних «2000».

Ви відкриваєте застосунок і бачите «у мене 2000 слів». Друг каже, що для B2 треба 3500. У дослідженні на екрані - 8000. Відчуття як з банківськими рахунками в різних валютах: цифри схожі, а лінійки - ні.
Питання, яке майже ніколи не ставлять: що саме рахується за одне слово?
Коротка відповідь. «Мої 2000 слів» майже нічого не значать, доки невідома одиниця. Словоформа - написання, яке ви бачите (goes, went). Лема - словниковий заголовок (go). Сім'я слів збирає споріднені похідні (nation, national, nationalize). CEFR не публікує офіційну квоту слів; орієнтирні таблиці ближчі до частих лем. Застосунки й дослідження часто користуються різними лінійками - тож два чесні «B2 = 3000» все одно можуть не збігатися.
Нижче - три одиниці простими словами, живі приклади англійської та іспанської, історія «трьох людей з 2000», що робити з CEFR-таблицями і як читати прогрес на карті без фальшивого диплома.

У MovaReader мови навчання - англійська та іспанська. Українська тут - мова інтерфейсу й статті; шляху «вивчай українську як цільову» немає.
Що насправді рахується за одне слово?
Перш ніж порівнювати колоду з таблицею, назвіть лінійку. Три одиниці живуть поруч і постійно плутають людей.

| Одиниця | Що рахує | Як впливає на цифри | Побутний приклад |
|---|---|---|---|
| Словоформа | Кожне окреме написання / словозміна, яке ви бачите | Цифри швидко роздуваються | go, goes, went, gone = 4 |
| Лема | Заголовок словникової статті | Ближче до багатьох CEFR-орієнтирів | go покриває goes / went / gone у списковій логіці |
| Сім'я слів | Набір споріднених похідних | Часто виглядає «більшою» за чисті леми в reading-дослідженнях | nation, national, nationally, nationalize |
Практичне правило: якщо не можете відповісти «яка одиниця?», порівняння - розвага, не вимірювання.
Живі приклади: англійська та іспанська
Англійська: go і «друзі»
Тиждень практики past simple може виглядати як десятки «нових слів», якщо кожна форма - окрема картка.
| Стиль підрахунку | Що може потрапити в список | Приблизно |
|---|---|---|
| Словоформи | go, goes, going, went, gone | 5 |
| Лема | go (іноді окремо іменник - залежить від правил списку) | ~1 |
| Вільна «сімейна» логіка | go, going (як процес), goer, outgoing… | залежить від агресивності сім'ї |
На лемній карті ці форми можуть лишатися під одним заголовком, доки ви не додасте справді нові одиниці (leave, arrive, depart).
Англійська ще ховає багатослівні одиниці. Look after, look up, look into для учня можуть бути «одним дієсловом у голові» і трьома різними словниковими проблемами. Лічильники лише лем недооцінюють цей біль; лічильники форм переоцінюють шум написань. Більше про слова й вирази: слова vs вирази в CEFR.
Іспанська: correr і реальна парадигма
Морфологія іспанської робить розрив форма / лема очевидним.

| Стиль підрахунку | Що з'являється | Відчуття учня |
|---|---|---|
| Словоформи | corro, corres, corre, corremos, corréis, corren, corrí, corrió, corría, corrido, corriendo… | Величезний список після кількох часів |
| Лема | correr як позиція каталогу | Одна одиниця, доки ви справді не додасте carrera, corredor тощо |
| Споріднені, але окремі леми | carrera, corredor, corrido (інші значення) | Справжні нові сенси, не лише дієвідміна |
Учень, який «знає correr», може все одно зависати на corrió, corría чи hayan corrido. Це часто навичка розбору й морфології, а не обов'язково відсутній корінь. Навпаки: позначати кожну особову форму як «вивчено» роздуває прогрес каталогу без нового кореня на кшталт tropezar.
Рід і число додають ще форм (nuevo / nueva / nuevos / nuevas). Формні застосунки можуть нарахувати чотири «слова», де дослідницький орієнтир говорить про один прикметник.
Чому «мої 2000 слів» непорівнянні
Уявіть трьох людей. Усі кажуть «дві тисячі». Ніхто не ділить одиницю.

- Колода Anki з 2000 карток поверхневих форм (багато дієвідмін і множин).
- Прогрес по частотному списку з 2000 лем.
- Оцінка з reading-досліджень у сім'ях слів.
Перший може мати слабше покриття реального тексту, ніж другий. Цифра третього сидить на іншій шкалі: сім'ї згортають похідні.
Тож коли хтось каже «у мене вже більше слів, ніж треба для B2», запитайте: форми, леми чи сім'ї? Потім порівняйте зі смугою орієнтиру на карті лексики - вона задана для частих лем, а не для кожного написання.
Чому каталоги застосунків рідко збігаються з науковими статтями
Різні інструменти роблять різну роботу. Вони не «помилкові» - просто не та сама лінійка.
| Джерело | Задача | Звичка щодо одиниці |
|---|---|---|
| Класні частотні тести (традиція X-Lex) | Оцінити розмір відносно високочастотних списків | Часто лема / чеклист |
| Reading-дослідження в дусі Nation | Зв'язати % покриття з комфортом читання | Часто сім'ї |
| SRS-застосунки | Планувати повторення карток користувача | Те, що користувач набрав |
| Кураторські каталоги продукту | Прогресивні списки за рівнями | Кураторські леми / позиції, не чиста корпусна наука |
Каталоги MovaReader - кураторські прогресивні списки. Вони допомагають орієнтуватися в смугах A1-C2. Вони не тотожні дослідницьким діапазонам Milton/Alexiou, не тотожні інвентарям Instituto Cervantes і не замінюють DELE, IELTS чи Cambridge.
Дрібний шрифт правил списку
Навіть «лема» - не один закон:
- email / e-mail - одна позиція чи дві?
- Чи входять власні назви?
- Чи є багатослівні вирази окремими записами?
- Чи виносить іспанська окремо конструкції з se?
- Чи ділить англійська phrasal verbs?
Два чесні лемні списки все одно можуть розійтися на сотні позицій.
Впізнавання vs продукція
Впізнавання («я це бачив») дешевше за продукцію («я це витягну під тиском»). Позначка в каталозі зазвичай означає: ви вирішили, що одиниця вивчена для вашого workflow, а не що лабораторія підтвердила продуктивний контроль. Тримайте цю скромність, коли відсоток на карті росте.
Як це впливає на «таблиці слів CEFR»
Сам CEFR не публікує офіційну квоту слів. Публічні таблиці й застосунки запозичують орієнтовні смуги, щоб у учня була карта - не диплом.
На вільному хабі MovaReader - дослідницькі орієнтири частих лем (ті самі смуги, що в pillar-статті):
| Рівень | Орієнтир (часті леми) |
|---|---|
| A1 | до ~1 500 |
| A2 | ~1 500-2 500 |
| B1 | ~2 500-3 250 |
| B2 | ~3 250-3 750 |
| C1 | ~3 750-4 500 |
| C2 | ~4 500-5 000+ |
Читайте ці цифри з дисципліною одиниці:
- Це навігація, не сертифікати.
- Вони ближчі до мислення лемами, ніж до сирих звалищ форм.
- Цифри reading-досліджень у сім'ях можуть виглядати більшими при тій самій реальній здатності.
- Розмір каталогу рівня в застосунку може бути меншим або більшим за дослідницьку смугу: список кураторський для навчання, а не для наукової публікації.
- Plan Curricular Instituto Cervantes описує зміст навчання; це не одна обов'язкова квота слів на рівень. Детальніше: іспанська лексика й Plan Curricular.
Коли одна таблиця каже «B2 = 4000 слів», а інша «B2 = 3500 лем», вони можуть описувати суміжну реальність різними лінійками. Деталі смуги B2: Скільки слів для B2?. Повна драбина: Скільки слів для A1-C2?. Міф «5000 = C2»: чи 5000 слів означає C2?.
Як працює прогрес каталогу на карті мови
Порівнювати «скільки слів» між застосунками майже завжди приблизно. Особистий прогрес у MovaReader рахує позиції каталогу, які ви позначили як вивчені, а не сертифікований іспит і не лабораторний X-Lex.
Проста модель:
- Публічні діапазони карти показують дослідницький орієнтир за рівнями. Дивитися можна безкоштовно на карті лексики.
- Особистий прогрес з'являється після входу, вибору англійської або іспанської як мови навчання і позначення слів як вивчених у каталозі.
- Прогрес - приблизно позначені позиції vs розмір каталогу для цього шляху. Це аналітика навчання, не претензія на точне наукове покриття всієї англійської чи іспанської.
- Позначки зазвичай ростуть із реального використання: читання з перекладом у контексті, збереження в персональний словник, рішення, що одиниця вже «ваша».
Чим прогрес не є:
- не DELE / IELTS / Cambridge
- не «офіційний рівень CEFR за 60 секунд безкоштовно»
- не обіцянка, що 100% каталогу B2 = вільне говоріння
- не доказ, що «2000 слів» у двох застосунках рівні
- не безкоштовний повний іспит чи сертифікат CEFR
Практичний обсяг перекладів під час читання й персонального словника, який живить ці позначки, зручніше будувати на Reader від €1/міс. Freemium дає спробувати цикл (20 перекладів слів на день), а не «на дозвіллі заповнити всю карту». Немає безкоштовного повного тесту рівня CEFR.
Корисні шляхи: карта лексики, слова B1 і слова B2 (потрібен вхід), як користуватися, ціни. Опційно після збереження слів: тренажери (повний unlimited-режим тренажерів більше про Pro). Як чесно вести прогрес: відстеження словникового прогресу.
Практична порада: одна узгоджена система краща за «абсолютну істину»
Вам не потрібне ідеальне універсальне визначення слова. Потрібна стабільна одиниця для вашого шляху.
- Оберіть основну систему. Позначки каталогу, одна SRS-колода або один частотний список - не три несумісні трофеї.
- Для планування смуг CEFR віддавайте перевагу лемам. Форми корисні для граматики; для «его розміру» вони шумні.
- Оцінюйте реальні сторінки за щільністю невідомого. Якщо в кожному реченні lookup - текст вище комфортного покриття, навіть якщо total виглядає «майже B2».
- Зростайте через читання, не лише через закриття списку. Контекст тримається краще, ніж ізольований підрахунок трофеїв. Практичний шлях: будувати B1-словник читанням.
- Тренуйте складні форми, не подвоюючи его. Знати correr не скасовує практику corrió; це просто не завжди друга «словна» нагорода за кожну особу present.
- Розділяйте прогрес англійської та іспанської. Морфологічне навантаження й багатослівні патерни різні; не копіюйте цифру між мовами.
Одна дія на сьогодні: відкрийте карту, прийміть, що діапазони - орієнтир, прочитайте щось трохи вище комфорту й позначте лише те, чим справді володієте - не кожен погляд на слово.
FAQ
Чи лема - це те саме, що «слово» в побуті?
Побутне «слово» розмите. Лінгвісти кажуть лема про заголовок, який шукають у словнику. Застосунки часто мають на увазі «картку» або «форму». Завжди перевіряйте, яку одиницю ховає число, перш ніж порівнювати.
Чи рахувати went окремо від go?
Для планування розміру проти CEFR-лемних смуг - зазвичай ні. Для практики - так: неправильні минулі форми потребують retrieval. Розмір і практика - різні задачі; не змішуйте трофеї.
Чому застосунок показує більше слів, ніж смуга карти для мого рівня?
Можливо, рахує форми, multiword-картки, власні назви або інший список. Розмір каталогу також кураторський і не тотожний дослідницьким діапазонам. Спочатку порівняйте одиниці, потім вирішуйте, чи розрив справжній.
Чи потрібен англійській і іспанській однаковий метод підрахунку?
Проблема трьох одиниць та сама (форма / лема / сім'я). Іспанська сильніше тисне поверхневими формами через дієвідміну й узгодження; англійська ховає складність у phrasal verbs і класах написань. Та сама ідея карти, різне тертя - ведіть окремий прогрес по мовах.
Чи позначка «вивчено» доводить мій рівень CEFR?
Ні. Це аналітика навчання для вашого шляху каталогу після входу й вибору англійської або іспанської. Іспити й жива розмова все одно оцінюють performance. Карта - не безкоштовний повний тест рівня й не сертифікат.
Чи 5000 слів = C2?
Не автоматично. ~4 500-5 000+ частих лем - пізній орієнтир на деяких шкалах: навігація, не диплом. Навички, покриття тексту й іспити все одно мають значення. Див. скільки слів для CEFR і чи 5000 слів означає C2?.
Наступні кроки
- Подивіться діапазони на вільній карті лексики з дисципліною лем.
- Візьміть pillar A1-C2 і глибокий B2, коли потрібні цифри по рівнях.
- Увійдіть, оберіть англійську або іспанську й ведіть один каталог послідовно під час читання; позначте лише те, чим справді володієте.
- Коли freemium-ліміти перекладів блокують потрібний обсяг, Reader від €1/міс - чесний крок для unlimited-читання + словника, а не купівля сертифіката.
- Метод: як користуватися; опційно тренажери.
Розмір словника - корисна ментальна модель. Вона стає шумом, щойно ви порівнюєте несумісні одиниці. Рахуйте як картограф: одна лінійка, зрозумілі підписи, без фальшивого диплома.
Вивчайте мови читаючи!
Спробуйте MovaReader всього за €1 — читайте тексти з миттєвим перекладом та інтерактивним тренуванням слів.
Безкоштовно: 20 перекладів слів/день і необмежене прослуховування. Pro (€5/міс) відкриває повні тренажери.