Кожна лема з двох опублікованих українських джерел базової лексики для початківців, з’єднана й зіставлена.
Українська тепер має дві незалежні відкриті відповіді на питання, на яке кожен курс для початківців мусить відповісти першим, і побудовано їх для відповіді на різні питання.
| Мінімуми | Профіль | |
|---|---|---|
| що | «1000 і 1 слово», A1 і A2 | Профіль української лексики (PULS) |
| хто | Бородін і Туркевич; Бородін і Лазаренко | Синчак, Старко, Бурак, Свистун |
| тип | навчальна програма | описова карта |
| обсяг | близько 2 000 слів | 10,194 записи лем, від A1 до C1 |
| метод | експертний добір на основі корпусної частотності, зважений за корисністю на етапі навчання | корпусно вивірені рівні CEFR |
Досі їх ніхто не з’єднав. Навчальна програма й описовий профіль мають право не погоджуватися, і найцікавіше саме там, де вони розходяться, тож краще було це виміряти, ніж здогадуватися.
По одному рядку на лему, на корпусній частотній основі (UberText 2.0, перші 12 000 лем).
| Клас | Рядки | Значення |
|---|---|---|
| agree | 1,200 | обидва ставлять слово на той самий рівень |
| earlier | 583 | програма викладає слово раніше, ніж профіль його вивіряє |
| later | 174 | програма викладає слово пізніше |
| absent | 776 | вивірене на A1 (84) або A2 (692), але немає в жодному томі |
| unprofiled | 172 | є в томі, але поза межами профілю |
| beyond | 7,461 | вивірене на B1 або вище, поза програмою на 2 000 слів |
Два проєкти, побудовані різними методами, ставлять 1,200 слів на той самий рівень CEFR. Це результат збіжності: базове ядро української лексики є реальним об’єктом, який можуть знайти два незалежні методи.
Профіль вивіряє всі п’ять слів на A1. Том A1 відкладає кожне з них до A2.
| Слово | Ранг у корпусі | Профіль | Том |
|---|---|---|---|
| до | 9 | A1 | A2 |
| для | 21 | A1 | A2 |
| від | 22 | A1 | A2 |
| якщо | 87 | A1 | A2 |
| без | 130 | A1 | A2 |
Водночас том A1 містить по, про і через. Отже, це проведена межа, а не пропуск.
Майже напевно це свідоме методичне рішення, і слушне: що учень може зробити з прийменником, доки не знає відмінків, які після нього стоять? Але саме такі міркування не доживають до опублікованого списку слів, і саме тому зіставлення варто мати.
Три обмеження. Жодне прочитання не витримає, якщо ними знехтувати.
Тож стовпець absent це перелік кандидатів на перевірку, а ніколи не перелік пропусків. Слів із вивіреним рівнем A1, яких немає в жодному томі, 84; у 40 з них немає жодного спорідненого слова в жодному з томів, і саме з них варто почати: ситуація, кожний, момент, музей, ну, мільярд, продукт, герой.
Ще в 19 рядках класу absent названо сполуку, через яку слово таки потрапляє до томів, тож такий читається разом із такий самий, а жаль разом із На жаль.
По одному рядку на лему. Відфільтруйте стовпець class відповідно до свого питання.
later і absent це ваші списки кандидатів.earlier показує, де програма випереджає вивірений профіль, із частотним рангом біля кожного слова.unprofiled це те, що програма викладає, а профіль не охоплює. Здебільшого власні назви та утворені від них прикметники, тобто питання меж профілю, а не прогалина.Стовпець entry дослівно містить опублікований рядок словникової статті, тож кожен рядок можна простежити до книжки, з якої він походить.