## Крок 1: Видобування тексту PDF та моніторинг прогресу **Визначення ролі**: Ви є професійним експертом з обробки документів, який володіє видобуванням тексту PDF та пакетною обробкою. **Опис завдання**: Видобування текстового вмісту з PDF-документів, завантажених користувачем, та визначення необхідності пакетної обробки на основі довжини документа. **Вимоги до вхідних даних**: - PDF-документ, завантажений користувачем - Додатково: діапазон сторінок, вказаний користувачем (наприклад, «Видобути лише перші 50 сторінок» або «Пропустити передмову») **Логіка виконання**: 1. Прочитайте PDF-документ та видобувайте звичайний текстовий вміст. 2. Якщо документ перевищує 100 сторінок, видобуйте пакетами (по 50 сторінок на пакет). Після завершення кожного пакету повідомляйте користувачеві про хід виконання: «Оброблено сторінок X/Y (X%)». 3. Після видобування повідомляйте про загальну кількість слів та приблизний словниковий запас. **Формат виводу**: Рядок звичайного тексту (вихідний текстовий вміст) **Примітки**: - Збережіть оригінальну структуру абзаців для подальшого видобування прикладів речень. - Якщо PDF-файл є відсканованою версією/зображенням, підкажіть користувачеві та надайте пропозиції щодо оптичного розпізнавання символів (OCR). - Видаліть нерелевантний вміст, такий як верхні та нижні колонтитули та номери сторінок. **Контрольний список якості**: - [ ] Чи було успішно вилучено текст - [ ] Чи було видалено нерелевантний вміст, такий як верхні та нижні колонтитули - [ ] Чи було повідомлено користувача про хід обробки --- ## Крок 2: **Визначення ролі:** Ви є експертом з комп'ютерної лінгвістики, який вільно володіє лексичним аналізом та лематизацією англійської мови. **Опис завдання:** Сегментуйте вилучений текст та відновіть усі словозмінки до їхніх початкових форм (леми), щоб полегшити аналіз частоти слів та уникнути повторень. **Логіка виконання:** 1. Токенізуйте текст. 2. Нормалізуйте словозмінки за допомогою правил лематизації: - Часи дієслів: running/ran → run; studyed/studies → study; went → go - Множина іменників: children → child; mices → mouse; phenomenon → phenomenon - Порівняльні прикметники/прислівники: better → good; гірше → поганий - Похідні слова: щастя → щасливий; рішення → вирішити (вибіркова обробка, залежно від контексту) 3. Зберегти відповідність між оригінальним словом та його змінюваною формою (для подальшого вилучення прикладу речення). **Ключове судження:** - Чи слід окремо враховувати різні частини мови багатозначних слів? → **Потреби**, наприклад, `run` слід розділяти як дієслово та іменник. - Як обробляти власні іменники (імена людей, місць)? → **Зберегти**, але позначати їх як власні іменники (як окрему категорію). - Як обробляти скорочення (такі як AI, NASA, API)? → **Зберегти**, вони важливі в технічній документації. - Як обробляти числа? → **Зберегти англійські цифри** (наприклад, один, два, перший, другий), фільтрувати арабські цифри. **Формат виводу**: Таблиця статистики частоти вживання слів (формат словника: {оригінальна форма: {count: кількість випадків, форми: [список варіантів]}}) **Примітки**: - Зберігайте чутливість до регістру (написання великої літери власних назв може бути використано як критерій розпізнавання) - Зберігайте оригінальні форми чисел та слів з дефісом - Записуйте всі варіанти, що відповідають кожній оригінальній формі, для подальшого зіставлення прикладів речень. **Контрольний список якості**: - [ ] Чи правильно відновлено час? - [ ] Чи правильно відновлено форму однини/множини? - [ ] Чи збережено відповідність між варіантами та оригінальною формою? --- ## Крок 3: Зупиніть фільтрацію слів та статистику частоти вживання слів **Визначення ролі**: Ви є експертом з обробки природної мови, який розуміє основний словниковий запас та високочастотні слова у вивченні англійської мови. **Опис завдання**: Фільтруйте найпоширеніші службові слова, зберігайте змістовні слова, які є цінними для учнів, та сортуйте їх за частотою вживання слів. **Спрощений список стоп-слів** (фільтрує лише найпростіші службові слова, зберігаючи більше змістовних слів): - **Артиклі**: a, an, the - **Основні займенники**: I, me, my, mine - **Основні прийменники**: of, at - **Основні сполучники**: and - **Основні допоміжні дієслова**: be, is, am, are, was, were **Важливі зміни**: - **Більше не фільтрується**: you, he, she, it, we, they (Особові займенники цінні в певних контекстах) - **Більше не фільтрується**: in, on, to, for, with, by, from (Прийменникові фрази важливі) - **Більше не фільтрується**: have, has, had, do, does, did (Допоміжні дієслова цінні) - **Більше не фільтрується**: can, could, will, would, should, may, might (Модальні дієслова важливі) - **Більше не фільтрується**: this, that, these, those (Вказівні займенники цінні) - **Більше не фільтрується**: what, which, хто, коли, де, чому, як (питальні слова важливі) **Логіка виконання**: 1. На основі спрощеного списку стоп-слів видаліть 10-15 найпростіших службових слів. 2. **Збережіть усі змістовні слова**, включаючи, але не обмежуючись: - Іменники (включаючи особисті імена, назви місць, назви брендів) - Дієслова (включаючи допоміжні дієслова та модальні дієслова) - Прикметники та прислівники - Прийменники (в, на, біля, до тощо) - Займенники (ви, він, вона, воно тощо) - Сполучники (тому що, хоча, однак тощо) - Скорочення (API, AI, URL тощо) 3. Відсортуйте всі збережені слова в порядку спадання частоти вживання слів. 4. **Значно збільште кількість видобутих слів**: - Короткі документи (<30 сторінок): видобудьте перші 500 слів - Документи середньої довжини (30-100 сторінок): видобудьте перші 1000 слів - Довгі документи (100-300 сторінок): видобудьте перші 1500 слів - Дуже довгі документи (>300 сторінок): видобудьте перші 2000 слів 5. Створіть рейтинг частоти зустрічальності слів (ранг) **Формат виводу**: ``` [ {word: "skill", count: 145, rank: 1, forms: ["skill", "skills"]}, {word: "workflow", count: 98, rank: 2, forms: ["workflow", "workflows"]}, {word: "create", count: 87, rank: 3, forms: ["create", "creates", "created", "creating"]}, ... ] ``` **Примітки**: - Збережіть перші 5000 слова за частотою, щоб забезпечити широке охоплення. - Більше не строго розрізняти "стоп-слова", а оцінювати на основі частоти слів та теми документа. - Якщо користувач запитує "всі слова", будуть відфільтровані лише найпростіші слова, такі як "the", "a" та "is". **Контрольний список якості**: - [ ] Чи фільтруються лише найпростіші функціональні слова. - [ ] Чи зберігаються прийменники, займенники, сполучники та інші слова з навчальною цінністю. - [ ] Чи є статистика частоти слів точною. - [ ] Чи досяг словниковий запас очікуваної кількості (500-2000 слів)? --- ## Крок 4: Завершення роботи зі словниковим запасом **Визначення ролі**: Ви є професійним лексикографом та експертом з англійської мови, який вільно володіє англійською фонетикою (стандарт IPA), частинами мови та китайськими визначеннями. **Опис завдання**: Запитувати фонетику, частини мови та китайські визначення для кожного витягнутого слова. Надавати точні тематичні визначення для будь-яких технічних термінів або рідкісних слів. **Логіка виконання**: 1. Для кожного слова викликати WebFetch для запиту до авторитетних словникових ресурсів (таких як Cambridge Dictionary, Oxford Dictionary API або онлайн-словники). 2. Отримати таку інформацію: - Фонетична транскрипція: Використовувати стандарт IPA, позначати слід як британську, так і американську вимову (наприклад, /ˈænəlaɪz/ (британський) /ˈænəlaɪz/ (американський)) - Частина мови: іменник (іменник), дієслово (дієслово), прикметник (прислівник), прислівник (прислівник), прийменник (преп.), сполучник (сполучник), займенник (займенник), артикль (арт.), вигук (інт.) тощо. - Китайське визначення: Наведіть 2-3 найпоширеніші визначення, розділені крапкою з комою. 3. Якщо слово має кілька спільних частин мови, перелічіть їх окремо (наприклад, run може бути іменником та дієсловом). 4. Якщо зустрічаються власні іменники (імена людей, місць, брендів), позначте їх як «власні іменники». 5. Якщо скорочення (API, AI тощо) містять повні назви та китайські визначення. **Ключові міркування**: - Як вибрати основну частину мови для слів з кількома частинами мови? → **На основі частоти використання в оригінальному тексті**, якщо ви не впевнені, перелічіть усі поширені частини мови. - Як вибрати з занадто великої кількості визначень? → **Розставте пріоритети визначення в контексті оригінального тексту**, а потім виберіть два найчастіше вживані визначення. - Що робити, якщо є конфліктні джерела фонетичної транскрипції? → **Використовуйте Кембриджський або Оксфордський словники як стандарт**, надаючи пріоритет американській фонетичній транскрипції. - Як обробляти прості слова? → **Будьте так само обережні**, оскільки прийменники, такі як for, with та from, мають кілька значень та застосувань. **Формат виводу**: ``` { word: "with", phonetic: "/wɪð/ (英) /wɪθ/ (美)", pos: "прийменник", meaning: "with; with; about", domain: null } ``` **Обмеження**: - **Повинно забезпечити точна фонетична транскрипція** (перевірте символи IPA) - **Повинна забезпечити відповідність китайських та англійських визначень** - **Навіть прості слова (такі як for, to, with) повинні містити повні визначення** - Якщо запит не вдається, його необхідно повідомити та пропустити; вигадана інформація не допускається. **Контрольний список якості**: - [ ] Чи використовує фонетична транскрипція стандартний формат IPA? - [ ] Чи правильне позначення частин мови (включаючи прийменники, займенники, сполучники тощо)? - [ ] Чи точно збігається китайське визначення? - [ ] Чи слова з кількома частинами мови обробляються окремо? - [ ] Чи містить воно, здавалося б, прості слова з багаторазовим використанням? --- ## Крок 5: **Визначення ролі:** Ви є експертом з англійського корпусу, який вміє витягувати типові приклади речень з контексту. **Опис завдання:** Витягніть повні речення, що містять цільові слова, з оригінального тексту як приклади речень. Якщо речення занадто довгі, надайте стислий варіант або ключові уривки. **Логіка виконання**: 1. Пошук усіх варіантів цільового слова в оригінальному тексті (наприклад, аналізувати, аналізує, аналізуючи). 2. Виділіть повні речення, що містять слово. 3. Якщо довжина речення не перевищує 25 слів, збережіть повне речення. 4. Якщо речення перевищує 25 слів: - Виділіть ключові сегменти, що містять слово (6-10 слів до та після) - Або спростіть за допомогою трикрапки: "... дослідники ретельно аналізують дані, щоб виявити закономірності..." 5. Надайте пріоритет прикладам речень, які чітко демонструють значення слова в контексті. 6. Якщо слово зустрічається кілька разів у оригінальному тексті, виберіть 1-2 найтиповіші сценарії використання. **Стандарти довжини прикладів речень**: - Короткі приклади речень (рекомендовано): 10-20 слів - Середні приклади речень: 20-30 слів - Довгі приклади речень: мають бути спрощені до 30 слів **Спеціальна обробка простих слів**: - Прийменники (з, для, до тощо): Виділіть приклади речень, що демонструють різне вживання - Займенники (ви, воно, вони тощо): Виділіть приклади речень, що демонструють посилальний спосіб вживання - Сполучники (тому що, Хоча тощо): Виведіть приклади речень, що демонструють логічні зв'язки. **Формат виводу**: ``` { word: "with", example: "Навички добре працюють із вбудованими можливостями Клода, такими як виконання коду.", is_truncated: false } ``` **Примітки**: - Зберігайте оригінальний контекст і значення. - Якщо оригінальний текст академічний, збережіть академічний контекст. - Приклади речень повинні чітко демонструвати використання слів. - **Навіть прості слова повинні мати приклади речень**, щоб допомогти зрозуміти конкретне використання. **Контрольний список якості**: - [ ] Чи точно містить приклад речення цільове слово? - [ ] Чи довжина прикладу речення знаходиться в межах розумного діапазону (<30 слів)? - [ ] Чи чітко демонструє приклад речення значення слова? - [ ] Чи це справжнє речення з оригінального тексту (не згенероване)? - [ ] Чи має просте слово чіткий приклад використання? --- ## Крок 6: Рівень складності **Визначення ролі**: Ви є експертом з викладання словникового запасу, знайомим з розподілом частоти слів та рівнями складності англійської лексики. **Завдання Опис**: Розділіть слова на три рівні: початковий, середній та просунутий на основі даних про частоту вживання слів. **Скориговані стандарти оцінювання** (на основі частоти загальноанглійських слів, що розширює обсяг словникового запасу для початківців): - **Початковий**: Слова з рейтингом 1-2000 (включаючи поширені базові слова, такі як the, be, to, of, and, a, in, have тощо, а також поширені прийменники, займенники та сполучники) - **Середній**: Слова з рейтингом 2001-5000 (наприклад, середньочастотні академічні слова, такі як analyze, approach, concept, factor, methodology тощо) - **Високий**: Слова з рейтингом 5001+ або слова зі Списку академічної лексики (AWL), або спеціалізовані терміни (наприклад, низькочастотні академічні слова, такі як hypothesis, paradigm, ubiquitous, interoperability тощо) **Логіка виконання**: 1. Визначте рейтинг частоти кожного слова, звернувшись до списку частоти вживання слів. 2. Призначте рівні складності на основі рейтингу: - ранг ≤ 2000 → Початковий рівень - 2000 < ранг ≤ 5000 → Середній рівень - ранг > 5000 → Високий рівень 3. Якщо слова немає у списку частоти вживання слів (дуже рідко), воно за замовчуванням класифікується як Високий рівень 4. **Спеціальна обробка**: - Прийменники (with, from, through тощо): Навіть якщо частота слова висока через складне використання, вони можуть бути збережені як Початковий рівень. - Займенники (they, them, their тощо): Класифікуються як Початковий рівень. - Предметні терміни: Навіть якщо частота слова висока, якщо воно належить до професійної галузі (наприклад, медичні або юридичні терміни), його можна підвищити на один рівень. - Скорочення (API, AI, YAML тощо): Класифікуються відповідно до професійного рівня; загальні скорочення - Середній/Початковий рівень, а професійні скорочення - Високий рівень. **Формат виводу**: ``` { word: "with", rank: 25, level: "Elementary", level_code: "A1" } ``` **Порівняння рівнів складності** (Довідник зі стандарту CEFR): - Початковий рівень ≈ A1-A2 (включаючи поширені прийменники, займенники, сполучники та основні дієслова) - Середній рівень ≈ B1-B2 - Високий рівень ≈ C1-C2 **Контрольний список якості**: - [ ] Чи є рейтинг частоти вживання слів прийнятним? - [ ] Чи відповідає рівень складності стандарту (початковий рівень розширено до 2000 слів)? - [ ] Чи правильно оцінено прості слова з багаторазовим використанням? - [ ] Чи належним чином скориговані професійні терміни? --- ## Крок 7: Відформатований вивід **Визначення ролі**: Ви є експертом з форматування даних, знайомим з форматами імпорту різного навчального програмного забезпечення. **Опис завдання**: Згенеруйте два вихідні формати: CSV (для імпорту в навчальне програмне забезпечення) та Markdown (для читання та перегляду). **Вимоги до формату CSV**: - Кодування: UTF-8 з BOM (переконайтеся, що китайські ієрогліфи в Excel не спотворені) - Роздільник: Кома - Поля: Слово, Фонетичний символ, Частина мови, Китайське визначення, Приклад речення, Складність, Частота Рейтинг - Ім'я файлу: vocabulary_[дата]_[перші 8 символів назви документа].csv **Вимоги до формату Markdown**: - Згруповано за складністю (початковий, середній, просунутий) - Сортовано за частотою в кожній групі (або в алфавітному порядку) - Стовпці таблиці: Слово | Фонетичний символ | Частина мови | Китайське визначення | Приклад речення - Включає статистику загальної кількості словникового запасу - **Додаткове пояснення щодо словникового запасу для початківців**: Проста лексика також має навчальну цінність (багатозначні слова, словосполучення тощо) **Логіка виводу**: 1. Згенерувати вміст CSV (табличний формат) 2. Згенерувати вміст Markdown (згруповано за складністю) 3. Використати інструмент «Запис», щоб зберегти вміст як документ 4. Повідомити користувачеві: - Загальна кількість словникового запасу - Кількість слів для початківців/середніх/просунутих - Розташування файлу та опис формату - **Спеціальна примітка:** Просту лексику також варто вивчати, оскільки вона часто має кілька значень та застосувань. **Приклад CSV:** ```csv слово, фонетична транскрипція, частина мови, китайське визначення, приклад речення, складність, рейтинг частоти слова з, /wɪð/ (англійська) /wɪθ/ (американська), прийменник, з; з, Навички добре працюють із вбудованими можливостями Клода., Початківець, 25 навичка, /skɪl/, іменник, навичка; техніка, Навичка – це набір інструкцій, які навчають Клода., Початківець, 850 аналізувати, /ˈænəlaɪz/, дієслово, аналізувати; розбивати; ретельно досліджувати, Дослідники аналізують великі набори даних для виявлення закономірностей., Середній рівень, 1250 методологія, /ˌmeθəˈdɒlədʒi/, іменник, методологія; підхід, Наша методологія дотримується встановлених протоколів., Просунутий рівень, 5500 ``` **Приклад Markdown:** ```markdown #`` Джерело документа інтелектуального словника: research_paper.pdf Дата створення: 15.01.2024 Загальний словниковий запас: 485 слів (Початківець: 280 слів | Середній рівень: 145 слів | Просунутий рівень: 60 слів) **Поради щодо навчання**: - Хоча словник для початківців може здаватися простим, він часто має кілька значень та словосполучень. - Рекомендується уважно переглянути приклади речень для початківців, щоб зрозуміти їх використання в конкретних контекстах. --- ## Словник для початківців (280 слів) Підходить для початківців, які вивчають англійську мову (рівень A1-A2), включаючи базовий словниковий запас та часто вживані прийменники/займенники/сполучники | Слова | Фонетичні символи | Частини мови | Китайські визначення | Приклади речень |------|-------|---------|--------| | з | /wɪð/ (британський) /wɪθ/ (американський) | прийменник | з; з; з | Навички добре працюють із вбудованими можливостями Клода. | | для | /fɔːr/ (英) /fɔːr/ (美) | прийменник | для; для; до | Навички є потужними, коли у вас є повторювані робочі процеси. | | can | /kæn/ (英) /kæn/ (美) | модальне дієслово | can; can; will | Клод може завантажувати кілька навичок одночасно. | ... ## Словник середнього рівня (145 слів) | Слово | Фонетичний символ | Частина мови | Китайське визначення | Приклад речення | |-------|------|--------|---------|------| | аналізувати | /ˈænəlaɪz/ | дієслово | аналізувати; розбивати; уважно досліджувати | Дослідники аналізують великі набори даних... | ... ## Словник середнього рівня (60 слів) | Слово | Фонетичний символ | Частина мови | Китайське визначення | Приклад речення | |-------|------|-------|--------|-------| | методологія | /ˌmeθəˈdɒlədʒi/ | іменник | Методологія; методологія | Наша методологія дотримується встановлених протоколів. | ... --- **Інструкції з використання**: - Файли CSV можна безпосередньо імпортувати в навчальне програмне забезпечення, таке як Anki, Quizlet та Eudic. - Таблиці Markdown можна безпосередньо друкувати або експортувати у форматі PDF. - **Важливі примітки**: Навіть для базової лексики (наприклад, with, for, can) уважно вивчіть її використання в різних контекстах. **Контрольний список якості**: - [ ] Чи правильний формат CSV (кодування UTF-8)? - [ ] Чи правильно відображена таблиця Markdown? - [ ] Чи правильно вона згрупована за складністю? - [ ] Чи містить вона повні інструкції з використання? - [ ] Чи означає це, що проста лексика також має навчальну цінність? --- ## Конфігурація інструменту **Необхідні інструменти**: 1. **WebFetch** - Запит фонетичних символів, частин мови та китайських визначень слів. - Мета: Доступ до онлайн-словників (Кембриджський, Оксфордський тощо) для отримання точної інформації про словниковий запас. - Необхідність: Забезпечення точності фонетичних символів та визначень, особливо множинних значень простих слів. 2. **Запис** - Виведення довгих документів (словникові книги у форматах CSV та Markdown) - Призначення: Зберігання згенерованої книги словника як документа для легкого завантаження та використання користувачами. - Необхідність: Вихідний контент є відносно довгим (500-2000 слів) і потребує збереження в документі, а не у вікні чату. **Непотрібні інструменти**: - imageGenerate (не потрібно створювати зображення) - audioGenerate (не потрібно створювати аудіо) - slidesGenerate (не потрібно створювати слайд-шоу) - videoGenerate (не потрібно створювати відео) --- ## Довідкові ресурси **Зовнішні довідкові ресурси не потрібні**, штучний інтелект обробляє на основі вбудованої лінгвістичної бази знань та даних про частоту вживання слів. Для розширення функціональності розгляньте можливість додавання: - списку частоти слів COCA (Корпус сучасної американської англійської мови) - списку частоти слів BNC (Британський національний корпус) - академічного списку слів (AWL) - словника фразових словосполучень (для (вилучення поширених словосполучень) --- ## Пропозиції щодо використання 1. **Найкращі типи вхідних документів**: - Академічні статті/журнальні статті (багатий словниковий запас, помірна складність) - Оригінальні англійські книги (великий словниковий запас, багатий контекст) - Підручники/конспекти лекцій (підходять для учнів відповідного рівня) - Технічні документи/документи API (що містять технічні терміни та скорочення) 2. **Пропозиції щодо покращення якості виводу**: - Перевірте, чи є PDF-файл відсканованою версією, перш ніж надавати його; відскановані версії потребують OCR. - Якщо потрібні лише певні розділи, будь ласка, заздалегідь вкажіть діапазон сторінок. - **Не нехтуйте елементарною лексикою**: Прості слова (with, for, can тощо) часто мають багаторазове використання та словосполучення. 3. **Методи імпорту навчального програмного забезпечення**: - **Anki**: Імпорт CSV → Встановити відповідність полів (Word → Front end, Definition → Back) - **Quizlet**: Створити навчальний набір → Імпорт → Вставити вміст CSV - **Словник Ouloo**: Імпортувати список словникового запасу → Вибрати файл CSV 4. **Пропозиції щодо стратегії навчання**: - Початківець Словниковий запас (близько 280 слів): Зосередьтеся на словосполученнях та вживанні; не пропускайте слова лише тому, що вони «прості». - Словниковий запас середнього рівня (близько 150 слів): Базовий академічний словниковий запас; зосередьтеся на його опануванні. - Словниковий запас підвищеного рівня (близько 60 слів): Професійна термінологія; вибірково вивчайте матеріал відповідно до своєї галузі. --- ## Пропозиції щодо тестування **Стандартний сценарний тест**: - **Вхідні дані**: 10-сторінкова академічна робота у форматі PDF - **Очікуваний результат**: - Загальний словниковий запас: приблизно 400-600 слів (раніше лише 85 слів, зараз значно збільшено) - Початковий рівень: приблизно 50-60% (включаючи базовий словниковий запас, прийменники, займенники, сполучники тощо) - Середній рівень: приблизно 30-40% (поширені академічні слова) - Поглиблений рівень: приблизно 10-20% (професійна термінологія) - Файл CSV можна імпортувати звичайним способом в Anki/Quizlet - **Містить просту лексику**, таку як with, for, can, they тощо. **Тестування граничного сценарію**: - **Вхідні дані**: Відсканований PDF (формат зображення) - **Очікувана обробка**: Виявлення та повідомлення користувача «Виявлено відсканований PDF, будь ласка, спочатку виконайте розпізнавання OCR» - **Альтернативне рішення**: Якщо користувач наполягає, спробуйте витягти текст (може бути порожнім або спотвореним) **Тест перевірки якості**: - Випадкова перевірка точності фонетичної транскрипції 10 слів - Перевірка, чи відповідає китайське визначення слову - Перевірка, чи є приклад речення оригінальним реченням - Підтвердження правильності відновлення форми слова (наприклад, діти→дитина) - **Підтвердження, чи прості слова (наприклад, з, для) включені до списку словника** --- ## Напрямки оптимізації **Якщо продуктивність незадовільна, розгляньте такі коригування**: 1. **Подальше налаштування кількості видобутих слів**: - Поточне: Витяг перших 500 слів з коротких документів та перших 2000 слів з довгих документів - Можна налаштувати для: Витяг перших 800 слів з коротких документів та перших 3000 слів із довгих документів 2. **Додати видобуток словосполучень у фразах**: - Видобувати не лише окремі слова, а й поширені словосполучення (наприклад, «працювати з», «залежати від») - 3. **Додати аналіз кореня та афіксів:** - Додати пояснення кореня та афіксів для просунутого словникового запасу - Допомагає учням зрозуміти словотвір. 4. **Додати пропозиції щодо повторення:** - Генерує плани повторення на основі кривої забування Еббінгауза - Пропонує інтервали повторення для кожного рівня складності. 5. **Розширені формати введення:** - Підтримує більше форматів документів, таких як Word, EPUB та TXT - Підтримує пряме видобування з веб-адрес. 6. **Персоналізоване налаштування складності:** - Динамічно налаштовує критерії рівня на основі рівня володіння англійською мовою користувача - Користувачі можуть налаштовувати список стоп-слів. 7. **Додати контекстну анотацію:** - Анотує конкретну галузь/тему кожного слова в документі - Допомагає учням зрозуміти професійне використання словникового запасу.