Вставте український текст. Профілювач лематизує його за списком із 12 000 лем і показує, яку частку слововживань читач знає: на вивіреному рівні CEFR або проти тих самих слів, які пройшов ваш клас. Те, що лишилося, повертається як глосарій, який можна експортувати.
Нічого вставленого не покидає ваш браузер: лексикон завантажується один раз, а аналіз виконується на вашому пристрої. Текст не зберігається, не логується й нікуди не надсилається.
Вивірена карта PULS відносить до рівня 6 284 із 12 000 лем. Слова, яких вона не досягла, рахуються невідомими на кожному рівні, тож це читання є нижньою межею.
Профілювач запущено в режимі рівня на 29 українських текстах, рівень яких стверджує незалежне джерело (A1: 9, A2: 10, B1: 10). Для кожного тексту: суворе покриття проти кожного вивіреного рівня, перший рівень, що досягає цілі 95 відсотків, і чи збігається він із заявленим. Результат опубліковано таким, яким він вийшов.
placement in the course's core CEFR track (a1 / a2 / b1), aligned by the course to the Ukrainian State Standard 2024. The course modules are machine-drafted and audited by that project's own review pipeline, not graded readers vetted by a testing body. The level is the course's assertion, independent of this profiler, and weaker than a published graded reader's.
learn-ukrainian (Krisztian Koos and contributors), the open A1 to C2 Ukrainian course, CC-BY-SA-4.0 (curriculum content; LICENSE-CONTENT.md in the course repository).
For each thematic module page, keep the Ukrainian-language prose blocks (a block with more than 25 Cyrillic letters and more than four times as many Cyrillic as Latin letters) outside the learner-path, self-check, textbook-check, error-work and summary sections; drop fill-in blanks and cross-references; join in page order; em dashes normalized to a hyphen (punctuation is not profiled). Modules yielding fewer than 60 Ukrainian words are skipped, at most 10 per level.
Суворе покриття ніколи не досягає цілі: 0 з 29 текстів збігаються із заявленим рівнем, а 28 не досягають 95 відсотків на жодному вивіреному рівні, навіть коли відомі всі слова від A1 до C1. Стелею є карта: у цих текстах 8 відсотків слововживань лежать поза списком із 12 000 лем, а 6.4 відсотків є у списку без вивіреного рівня.
Грубе впорядкування тримається, і лише грубе. На сталому рівні (відомі A1 до B1) тексти A1 читаються на 84.3 відсотків, тексти A2 на 84.8, а тексти B1 на 77.4. Тексти B1 лежать на 6.9 пункту нижче за дві легші групи, але A1 і A2 різняться на 0.5, чого дев'ять і десять текстів розрізнити не можуть. Цей набір відрізняє B1 від рівнів A; він не відрізняє A1 від A2.
За умовним читанням (у знаменнику лише слова з вивіреним рівнем) 2 з 29 збігаються точно, а 26 лежать у межах одного рівня: профіль читає майже кожен текст на рівень вище за заявлений курсом. Або тексти курсу йдуть на рівень попереду початкових рівнів PULS, або 95 відсотків є надто суворою планкою для тексту уроку. Цей набір не може сказати, що саме, і сторінка не вдає, ніби може.
| текст | заявлено | на рівні | вердикт (суворий) | вердикт (з рівнем) | поза списком |
|---|---|---|---|---|---|
| Мій ранок | A1 | 55.7% | жоден | B1 | 20.3% |
| Погода | A1 | 68.1% | жоден | A2 | 16.5% |
| Моє місто | A1 | 90.4% | A2 | A2 | 0% |
| У кафе | A1 | 66% | жоден | B1 | 18% |
| Покупки | A1 | 72.2% | жоден | A2 | 5.6% |
| Вільний час | A1 | 79.6% | жоден | A2 | 8% |
| Транспорт | A1 | 71.1% | жоден | B1 | 7% |
| Мій день | A1 | 67.9% | жоден | A2 | 7.6% |
| У місті | A1 | 82.4% | жоден | A2 | 5.1% |
| Яка вона людина? Описуємо людей навколо нас | A2 | 71.5% | жоден | B1 | 6.9% |
| На ринку та у лікаря | A2 | 75.1% | жоден | B1 | 6.2% |
| На пошті | A2 | 67.9% | жоден | B1 | 11.9% |
| Професії та кулінарія | A2 | 75.8% | жоден | B1 | 7.4% |
| Мій дім, мій день | A2 | 83.1% | жоден | B1 | 5.3% |
| Розповіді та подорожі | A2 | 82.3% | жоден | B1 | 3.3% |
| Навчання і робота | A2 | 72.6% | жоден | B1 | 2.8% |
| Пори року і свята | A2 | 76.8% | жоден | B1 | 5.4% |
| Чим ти захоплюєшся? Дозвілля та хобі | A2 | 83.8% | жоден | B1 | 3.5% |
| Я обираю, я вважаю | A2 | 70.3% | жоден | B1 | 3.7% |
| Людина і стосунки | B1 | 73.3% | жоден | B2 | 10.6% |
| Щоденне життя | B1 | 76.7% | жоден | B2 | 9.3% |
| Робота і кар'єра | B1 | 77.4% | жоден | B2 | 6.2% |
| Здоров'я і медицина | B1 | 76.9% | жоден | B2 | 9.9% |
| Ресторан і їжа | B1 | 76.6% | жоден | B1 | 13.3% |
| Покупки і послуги | B1 | 77.6% | жоден | B2 | 7.4% |
| Житло і оренда | B1 | 79.8% | жоден | B2 | 7% |
| Подорож Україною | B1 | 82.4% | жоден | B1 | 6.5% |
| Природа і довкілля | B1 | 73.8% | жоден | B2 | 9.5% |
| Освіта і навчання | B1 | 79.1% | жоден | B2 | 7.3% |
Покриття є покриттям суцільного тексту (за слововживаннями): відомі слова серед усіх українських слів, власні назви відкладено. Латинські слова й числа не рахуються. Слово відоме, коли його лема є в наборі відомих; словоформа зводиться до леми через таблиці парадигм Вікісловника з четвертого потоку.
Ця таблиця покриває 70,6 відсотка лем. Справжня форма леми без таблиці читається як позасписочна, тож кількість позасписочних слів є верхньою межею, а покриття нижньою. Вихідний список новинний: побутові слова на кшталт снідати чи сметана в ньому взагалі відсутні й лишаються поза списком на кожному рівні.
Рівні є лише вивіреними початковими рівнями PULS (6 284 з 12 000 лем). Нічого не вгадується. Родинні зв'язки взято зі словотвірного графа Вікісловника (1 917 родин, що торкаються списку), а видові зв'язки з таблиці відношень B1, тож дієслово поза цією таблицею тут пари не має. Попередження про розрив використовують вивірені рівні, тож непозначений родич підняти їх не може.
Постачаються два опубліковані набори: лексичні мінімуми Бородіної A1 та A2 (CC BY 4.0). Багатослівні вирази (сполучні слова, фрази Бородіної) поки не зіставляються; фраза рахується слово за словом.
Laufer і Nation 1995 (лексичний частотний профіль); Laufer 1989 та Hu і Nation 2000 (95 відсотків); Nation 2006 (98 відсотків).