УкраїнськоюEnglish
Українська частотність / Профілювач текстів

Яку частину цього тексту зможуть прочитати ваші учні?

Вставте український текст. Профілювач лематизує його за списком із 12 000 лем і показує, яку частку слововживань читач знає: на вивіреному рівні CEFR або проти тих самих слів, які пройшов ваш клас. Те, що лишилося, повертається як глосарій, який можна експортувати.

Нічого вставленого не покидає ваш браузер: лексикон завантажується один раз, а аналіз виконується на вашому пристрої. Текст не зберігається, не логується й нікуди не надсилається.

Пакет лексикону (відкриті дані)До частотного списку
01

Вимірювати проти

Рівень

Вивірена карта PULS відносить до рівня 6 284 із 12 000 лем. Слова, яких вона не досягла, рахуються невідомими на кожному рівні, тож це читання є нижньою межею.

02

Текст для профілювання

1
04

Чи це правильно? Перевірний прогін

Профілювач запущено в режимі рівня на 29 українських текстах, рівень яких стверджує незалежне джерело (A1: 9, A2: 10, B1: 10). Для кожного тексту: суворе покриття проти кожного вивіреного рівня, перший рівень, що досягає цілі 95 відсотків, і чи збігається він із заявленим. Результат опубліковано таким, яким він вийшов.

Що це за тексти

placement in the course's core CEFR track (a1 / a2 / b1), aligned by the course to the Ukrainian State Standard 2024. The course modules are machine-drafted and audited by that project's own review pipeline, not graded readers vetted by a testing body. The level is the course's assertion, independent of this profiler, and weaker than a published graded reader's.

learn-ukrainian (Krisztian Koos and contributors), the open A1 to C2 Ukrainian course, CC-BY-SA-4.0 (curriculum content; LICENSE-CONTENT.md in the course repository).

For each thematic module page, keep the Ukrainian-language prose blocks (a block with more than 25 Cyrillic letters and more than four times as many Cyrillic as Latin letters) outside the learner-path, self-check, textbook-check, error-work and summary sections; drop fill-in blanks and cross-references; join in page order; em dashes normalized to a hyphen (punctuation is not profiled). Modules yielding fewer than 60 Ukrainian words are skipped, at most 10 per level.

Що вийшло

Суворе покриття ніколи не досягає цілі: 0 з 29 текстів збігаються із заявленим рівнем, а 28 не досягають 95 відсотків на жодному вивіреному рівні, навіть коли відомі всі слова від A1 до C1. Стелею є карта: у цих текстах 8 відсотків слововживань лежать поза списком із 12 000 лем, а 6.4 відсотків є у списку без вивіреного рівня.

Грубе впорядкування тримається, і лише грубе. На сталому рівні (відомі A1 до B1) тексти A1 читаються на 84.3 відсотків, тексти A2 на 84.8, а тексти B1 на 77.4. Тексти B1 лежать на 6.9 пункту нижче за дві легші групи, але A1 і A2 різняться на 0.5, чого дев'ять і десять текстів розрізнити не можуть. Цей набір відрізняє B1 від рівнів A; він не відрізняє A1 від A2.

За умовним читанням (у знаменнику лише слова з вивіреним рівнем) 2 з 29 збігаються точно, а 26 лежать у межах одного рівня: профіль читає майже кожен текст на рівень вище за заявлений курсом. Або тексти курсу йдуть на рівень попереду початкових рівнів PULS, або 95 відсотків є надто суворою планкою для тексту уроку. Цей набір не може сказати, що саме, і сторінка не вдає, ніби може.

текстзаявленона рівнівердикт (суворий)вердикт (з рівнем)поза списком
Мій ранокA155.7%жоденB120.3%
ПогодаA168.1%жоденA216.5%
Моє містоA190.4%A2A20%
У кафеA166%жоденB118%
ПокупкиA172.2%жоденA25.6%
Вільний часA179.6%жоденA28%
ТранспортA171.1%жоденB17%
Мій деньA167.9%жоденA27.6%
У містіA182.4%жоденA25.1%
Яка вона людина? Описуємо людей навколо насA271.5%жоденB16.9%
На ринку та у лікаряA275.1%жоденB16.2%
На поштіA267.9%жоденB111.9%
Професії та кулінаріяA275.8%жоденB17.4%
Мій дім, мій деньA283.1%жоденB15.3%
Розповіді та подорожіA282.3%жоденB13.3%
Навчання і роботаA272.6%жоденB12.8%
Пори року і святаA276.8%жоденB15.4%
Чим ти захоплюєшся? Дозвілля та хобіA283.8%жоденB13.5%
Я обираю, я вважаюA270.3%жоденB13.7%
Людина і стосункиB173.3%жоденB210.6%
Щоденне життяB176.7%жоденB29.3%
Робота і кар'єраB177.4%жоденB26.2%
Здоров'я і медицинаB176.9%жоденB29.9%
Ресторан і їжаB176.6%жоденB113.3%
Покупки і послугиB177.6%жоденB27.4%
Житло і орендаB179.8%жоденB27%
Подорож УкраїноюB182.4%жоденB16.5%
Природа і довкілляB173.8%жоденB29.5%
Освіта і навчанняB179.1%жоденB27.3%
Перевірний набір 2026-09-13, прогін 2026-09-13, поріг 95 відсотків.validation.json
05

Як воно рахує і де йому не варто довіряти

Покриття є покриттям суцільного тексту (за слововживаннями): відомі слова серед усіх українських слів, власні назви відкладено. Латинські слова й числа не рахуються. Слово відоме, коли його лема є в наборі відомих; словоформа зводиться до леми через таблиці парадигм Вікісловника з четвертого потоку.

Ця таблиця покриває 70,6 відсотка лем. Справжня форма леми без таблиці читається як позасписочна, тож кількість позасписочних слів є верхньою межею, а покриття нижньою. Вихідний список новинний: побутові слова на кшталт снідати чи сметана в ньому взагалі відсутні й лишаються поза списком на кожному рівні.

Рівні є лише вивіреними початковими рівнями PULS (6 284 з 12 000 лем). Нічого не вгадується. Родинні зв'язки взято зі словотвірного графа Вікісловника (1 917 родин, що торкаються списку), а видові зв'язки з таблиці відношень B1, тож дієслово поза цією таблицею тут пари не має. Попередження про розрив використовують вивірені рівні, тож непозначений родич підняти їх не може.

Постачаються два опубліковані набори: лексичні мінімуми Бородіної A1 та A2 (CC BY 4.0). Багатослівні вирази (сполучні слова, фрази Бородіної) поки не зіставляються; фраза рахується слово за словом.

Laufer і Nation 1995 (лексичний частотний профіль); Laufer 1989 та Hu і Nation 2000 (95 відсотків); Nation 2006 (98 відсотків).