CEFR-рівень слова: як оцінюється рівень без підгону
«Це слово рівня B2» — хто це вирішив і на якій підставі? Розбираємось, що насправді означає рівень слова і чому оцінка так часто буває непослідовною.
Коротко: CEFR-рівень слова — це орієнтовна оцінка того, на якому етапі вивчення мови людина зазвичай зустрічає й активно використовує це слово, за шкалою A1–C2. Це не точна наука: різні словники й іспитові організації можуть оцінювати те саме слово по-різному на пів рівня. Головна проблема — не сама шкала, а те, що інструменти на основі AI часто підлаштовують оцінку під контекст розмови, а не оцінюють слово окремо й послідовно.
Що таке CEFR і звідки взялась ця шкала
CEFR (Common European Framework of Reference for Languages) — загальноєвропейська шкала мовних рівнів, від A1 (початківець) до C2 (вільне володіння). Спершу вона описувала рівень людини загалом — що вона вміє сказати, зрозуміти, написати. Пізніше на її основі почали оцінювати й окремі слова: на якому рівні мовець типово починає впевнено розуміти й використовувати конкретне слово.
| Рівень | Що означає | Приклад слова |
|---|---|---|
| A1–A2 | Базова лексика, повсякденні теми | house, happy, walk |
| B1 | Розширена побутова й описова лексика | experience, achieve, however |
| B2 | Абстрактні поняття, думки, аргументація | controversy, imply, sustainable |
| C1 | Нюанси значення, формальний і академічний стиль | ambiguous, discrepancy, unprecedented |
| C2 | Рідковживана, стилістично тонка лексика | ubiquitous, ephemeral, esoteric |
Чому оцінка рівня буває непослідовною
Тут дві окремі причини, і їх варто розрізняти.
Перша — сама шкала не точна за визначенням. CEFR описує типову практику, а не математичну формулу. Різні видавництва (Cambridge, Oxford, British Council) можуть оцінювати те саме слово з розбіжністю на пів рівня — це нормально, так само як різні викладачі можуть трохи по-різному оцінити складність тексту.
Друга причина серйозніша — і специфічна саме для AI-інструментів. Коли мовна модель працює в режимі відкритого діалогу, вона схильна підлаштовувати відповідь під контекст розмови. Якщо кілька повідомлень тому йшлося про щось складне — модель може «підняти» оцінку наступного слова, навіть якщо об'єктивно воно простіше. І навпаки. Це не помилка моделі як такої — це властивість діалогу: кожна відповідь частково залежить від того, що було сказано перед нею.

Як оцінити рівень послідовніше
Найнадійніший спосіб — оцінювати кожне слово окремо, поза контекстом попередньої розмови, за одним і тим самим критерієм щоразу. Це саме те, чим відрізняється фіксований алгоритм від відкритого чату: коли слово оцінюється як самостійна одиниця, а не як частина довгого діалогу, воно не «дрейфує» залежно від того, що обговорювалось до цього.
Для викладачів це особливо важливо: якщо ви готуєте матеріали для конкретного рівня групи, розбіжність на пів рівня в кожному п'ятому слові з часом накопичується і зміщує складність усього уроку.
У Boostabulary кожне слово в згенерованому словнику отримує CEFR-оцінку окремо від інших слів того самого запиту — без підгону під тему тексту чи попередній запит. Це не сертифікована експертиза (жоден автоматичний інструмент не замінює офіційне тестування), а орієнтир — але послідовний орієнтир, однаковий сьогодні й за місяць.
