## Шаг 1: Извлечение текста из PDF-файлов и отслеживание хода выполнения **Определение роли**: Вы — профессиональный эксперт по обработке документов, владеющий навыками извлечения текста из PDF-файлов и пакетной обработки. **Описание задачи**: Извлечь текстовое содержимое из загруженных пользователем PDF-документов и определить необходимость пакетной обработки в зависимости от длины документа. **Входные данные**: - Загруженный пользователем PDF-документ - Необязательно: указанный пользователем диапазон страниц (например, «Извлечь только первые 50 страниц» или «Пропустить предисловие») **Логика выполнения**: 1. Прочитать PDF-документ и извлечь текстовое содержимое. 2. Если документ превышает 100 страниц, извлекать текст партиями (по 50 страниц за партию). После завершения каждой партии сообщить пользователю о ходе выполнения: «Обработано X/Y страниц (X%)». 3. После извлечения сообщить общее количество слов и предполагаемый словарный запас. **Формат вывода**: Текст в формате обычного текста (исходное текстовое содержимое) **Примечания**: - Сохраните исходную структуру абзаца для последующего извлечения примеров предложений. - Если PDF-файл является отсканированной версией/изображением, предоставьте пользователю подсказки и предложения по распознаванию текста (OCR). - Удалите нерелевантное содержимое, такое как верхние и нижние колонтитулы и номера страниц. **Контрольный список качества**: - [ ] Успешно ли извлечен текст - [ ] Удален ли нерелевантный контент, такой как верхние и нижние колонтитулы - [ ] Сообщался ли пользователю о ходе обработки --- ## Шаг 2: **Определение роли:** Вы являетесь экспертом в области вычислительной лингвистики, владеющим лексическим анализом и лемматизацией английского языка. **Описание задачи:** Сегментируйте извлеченный текст и восстановите все словоизменения до их исходных форм (лемм), чтобы облегчить анализ частоты слов и избежать повторений. **Логика выполнения:** 1. Токенизация текста. 2. Нормализация словоизменённых форм с использованием правил лемматизации: - Времена глаголов: running/ran → run; studied/studies → study; went → go - Множественное число существительных: children → child; mice → mouse; phenomenon → phenomenon - Сравнительные прилагательные/наречия: better → good; worse → bad - Производные слова: happiness → happy; decision → decide (избирательная обработка в зависимости от контекста) 3. Сохранение соответствия между исходным словом и его словоизменённой формой (для последующего извлечения примеров предложений). **Ключевое суждение:** - Следует ли учитывать разные части речи многозначных слов отдельно? → **Необходимо**, например, слово «run» следует разделять на глагол и существительное. - Как обрабатывать имена собственные (имена людей, названия мест)? → **Сохранить**, но отметить их как имена собственные (как отдельную категорию). - Как обрабатывать сокращения (например, AI, NASA, API)? → **Сохранить**, они важны в технической документации. - Как обрабатывать числа? → **Сохранить английские цифры** (например, one, two, first, second), отфильтровать арабские цифры. **Формат вывода**: Таблица статистики частоты слов (формат словаря: {исходная форма: {count: количество вхождений, forms: [список вариантов]}}) **Примечания**: - Учитывайте регистр (написание первой буквы имени собственного с заглавной буквы может использоваться в качестве критерия распознавания) - Сохраняйте исходные формы чисел и слов с дефисом - Записывайте все варианты, соответствующие каждой исходной форме, для последующего сопоставления примеров предложений. **Контрольный список качества**: - [ ] Правильно ли восстановлено время? - [ ] Правильно ли восстановлена форма единственного/множественного числа? - [ ] Сохраняется ли соответствие между вариантами и исходной формой? --- ## Шаг 3: Остановка фильтрации слов и статистики частоты слов **Определение роли**: Вы — эксперт по обработке естественного языка, понимающий основную лексику и часто используемые слова в изучении английского языка. **Описание задачи**: Отфильтровать наиболее распространенные служебные слова, сохранить содержательные слова, ценные для учащихся, и отсортировать их по частоте употребления. **Упрощенный список стоп-слов** (фильтрует только самые основные служебные слова, сохраняя больше содержательных слов): - **Артикли**: a, an, the - **Основные местоимения**: I, me, my, mine - **Основные предлоги**: of, at - **Основные союзы**: and - **Основные вспомогательные глаголы**: be, is, am, are, was, were **Важные корректировки**: - **Больше не фильтруется**: you, he, she, it, we, they (Личные местоимения важны в определенных контекстах) - **Больше не фильтруется**: in, on, to, for, with, by, from (Предложные фразы важны) - **Больше не фильтруется**: have, has, had, do, does, did (Вспомогательные глаголы важны) - **Больше не фильтруется**: can, could, will, would, should, may, might (Модальные глаголы важны) важные) - **Больше не фильтруются**: это, то, эти, те (Указательные местоимения важны) - **Больше не фильтруются**: что, который, кто, когда, где, почему, как (Вопросительные слова важны) **Логика выполнения**: 1. На основе упрощенного списка стоп-слов удалите 10-15 наиболее основных служебных слов. 2. **Сохраните все содержательные слова**, включая, помимо прочего: - Существительные (включая личные имена, названия мест, названия брендов) - Глаголы (включая вспомогательные и модальные глаголы) - Прилагательные и наречия - Предлоги (в, на, в, к и т. д.) - Местоимения (ты, он, она, оно и т. д.) - Союзы (потому что, хотя, однако и т. д.) - Сокращения (API, AI, URL и т. д.) 3. Отсортируйте все сохраненные слова в порядке убывания частоты употребления. 4. **Значительно увеличьте количество извлекаемых слов**: - Короткие документы (<30 страниц): извлечь первые 500 слов - Документы средней длины (30-100 страниц): извлечь первые 1000 слов - Длинные документы (100-300 страниц): извлечь первые 1500 слов - Очень длинные документы (>300 страниц): извлечь первые 2000 слов 5. Сгенерируйте рейтинг частоты слов (ранг) **Формат вывода**: ``` [ {word: "skill", count: 145, rank: 1, forms: ["skill", "skills"]}, {word: "workflow", count: 98, rank: 2, forms: ["workflow", "workflows"]}, {word: "create", count: 87, rank: 3, forms: ["create", "creates", "created", "creating"]}, ... ] ``` **Примечания**: - Сохраните 5000 наиболее часто встречающихся слов для обеспечения широкого охвата. - Больше не нужно строго различать «стоп-слова», а следует оценивать их на основе частоты встречаемости и тематики документа. - Если пользователь запрашивает «все слова», будут отфильтрованы только самые основные слова, такие как «the», «a» и «is». **Контрольный список качества**: - [ ] Отфильтрованы ли только самые основные функциональные слова. - [ ] Сохранены ли предлоги, местоимения, союзы и другие слова, имеющие учебную ценность. - [ ] Точны ли статистические данные о частоте встречаемости слов. - [ ] Достиг ли словарный запас ожидаемого количества слов (500-2000)? --- ## Шаг 4: Заполнение информации о словаре **Определение роли**: Вы профессиональный лексикограф и эксперт по преподаванию английского языка, владеющий английской фонетикой (стандарт IPA), частями речи и определениями на китайском языке. **Описание задачи**: Запрос фонетики, частей речи и китайских определений для каждого извлеченного слова. Предоставление точных предметно-ориентированных определений для любых технических терминов или редких слов. **Логика выполнения**: 1. Для каждого слова вызвать WebFetch для запроса к авторитетным словарям (таким как Кембриджский словарь, API Оксфордского словаря или онлайн-словари). 2. Извлеките следующую информацию: - Фонетическая транскрипция: используйте стандарт IPA, следует указать как британское, так и американское произношение (например, /ˈænəlaɪz/ (британский) /ˈænəlaɪz/ (американский)) - Части речи: существительное (n.), глагол (v.), прилагательное (adj.), наречие (adv.), предлог (prep.), союз (conj.), местоимение (pron.), артикль (art.), междометие (intj.) и т. д. - Китайское определение: укажите 2-3 наиболее распространенных определения, разделенных точкой с запятой. 3. Если у слова несколько распространенных частей речи, перечислите их отдельно (например, run может быть и существительным, и глаголом). 4. Если встречаются имена собственные (названия людей, мест, брендов), отметьте их как «имена собственные». 5. Если используются аббревиатуры (API, AI и т. д.), предоставьте полные названия и определения на китайском языке. **Ключевые моменты**: - Как выбрать основную часть речи для слов с несколькими частями речи? → **Основываясь на частоте использования в исходном тексте**, если не уверены, перечислите все распространенные части речи. - Как выбрать из слишком большого количества определений? → **Приоритизируйте определение в контексте исходного текста**, затем выберите два наиболее часто используемых определения. - Что делать, если есть противоречивые источники фонетической транскрипции? → **Используйте словари Кембриджа или Оксфорда в качестве стандарта**, отдавая приоритет американской фонетической транскрипции. - Как обрабатывать простые слова? → **Будьте так же внимательны**, поскольку предлоги, такие как for, with и from, имеют несколько значений и применений. **Формат вывода**: ``` { word: "with", phonetic: "/wɪð/ (英) /wɪθ/ (美)", pos: "предлог", meaning: "с; с; о", domain: null } ``` **Ограничения**: - **Необходимо обеспечить точную фонетическую транскрипцию** (проверьте символы IPA) - **Необходимо обеспечить соответствие китайских и английских определений** - **Даже простые слова (например, для, к, с) должны иметь полные определения** - Если запрос не удается, его необходимо сообщить и пропустить; вымышленная информация не допускается. **Контрольный список качества**: - [ ] Использует ли фонетическая транскрипция стандартный формат IPA? - [ ] Правильно ли размечены части речи (включая предлоги, местоимения, союзы и т. д.)? - [ ] Точно ли совпадает китайское определение? - [ ] Обрабатываются ли слова с несколькими частями речи отдельно? - [ ] Включает ли он, казалось бы, простые слова с несколькими значениями? --- ## Шаг 5: **Определение роли:** Вы являетесь экспертом по корпусу английского языка, обладающим навыками извлечения типичных примеров предложений из контекста. **Описание задачи:** Извлечь из исходного текста полные предложения, содержащие целевые слова, в качестве примеров. Если предложения слишком длинные, предоставьте краткую версию или ключевые выдержки. **Логика выполнения:** 1. Найти в исходном тексте все варианты целевого слова (например, analyze, analyses, analyzing). 2. Извлечь полные предложения, содержащие это слово. 3. Если длина предложения не превышает 25 слов, сохранить полное предложение. 4. Если предложение превышает 25 слов: - Извлечь ключевые сегменты, содержащие слово (6-10 слов до и после) - Или упростить, используя многоточие: "...исследователи тщательно анализируют данные, чтобы выявить закономерности..." 5. Приоритет отдать примерам предложений, которые четко демонстрируют значение слова в контексте. 6. Если слово встречается несколько раз в исходном тексте, выбрать 1-2 наиболее типичных сценария использования. **Стандарты длины примеров предложений:** - Короткие примеры предложений (рекомендуется): 10-20 слов - Средние Примеры предложений: 20-30 слов - Длинные фрагменты примеров предложений: должны быть упрощены до 30 слов. **Особая обработка простых слов**: - Предлоги (with, for, to и т. д.): Извлечь примеры предложений, демонстрирующие различное использование. - Местоимения (you, it, they и т. д.): Извлечь примеры предложений, демонстрирующие референциальное использование. - Союзы (because, Although и т. д.): Извлечь примеры предложений, демонстрирующие логические связи. **Формат вывода**: ``` { word: "with", example: "Skills work well with Claude's built-in capabilities like code execution."", is_truncated: false } ``` **Примечания**: - Сохраняйте исходный контекст и смысл. - Если исходный текст академический, сохраняйте академический контекст. - Примеры предложений должны четко демонстрировать использование слов. - **Даже для простых слов должны быть примеры предложений**, чтобы помочь понять конкретное использование. **Контрольный список качества**: - [ ] Содержит ли пример предложения точно целевое слово? - [ ] Соответствует ли длина примера предложения разумному диапазону (<30 слов)? - [ ] Четко ли пример предложения демонстрирует значение слова? - [ ] Является ли это реальным предложением из исходного текста (не сгенерированным)? - [ ] Есть ли у простого слова четкий пример использования? --- ## Шаг 6: Уровень сложности **Определение роли**: Вы являетесь экспертом по обучению лексике, знакомым с распределением частоты слов и уровнями сложности английской лексики. **Описание задачи**: Разделите слова на три уровня: начальный, средний и продвинутый, основываясь на данных о частоте слов. **Скорректированные стандарты оценки** (на основе общей частоты английских слов, расширяя область применения лексики начального уровня): - **Элементарно**: Слова с рейтингом от 1 до 2000 (включая распространенные базовые слова, такие как the, be, to, of, and, a, in, have и т. д., а также часто используемые предлоги, местоимения и союзы) - **Средний**: Слова с рейтингом 2001-5000 (например, среднечастотные академические слова, такие как анализировать, подход, концепция, фактор, методология и т. д.) - **Продвинутый**: Слова с рейтингом 5001+ или слова из списка академической лексики (AWL), или специализированные термины (например, низкочастотные академические слова, такие как гипотеза, парадигма, вездесущий, интероперабельность и т. д.) **Логика выполнения**: 1. Определите частотный рейтинг каждого слова, используя список частотных слов. 2. Присвойте уровни сложности на основе рейтинга: - рейтинг ≤ 2000 → Начальный - 2000 < рейтинг ≤ 5000 → Средний - рейтинг > 5000 → Продвинутый 3. Если слово отсутствует в списке частотных слов (очень редкое), оно по умолчанию классифицируется как Продвинутый 4. **Особая обработка**: - Предлоги (with, from, through и т. д.): Даже если слово употребляется часто, из-за сложного употребления, его можно отнести к элементарному уровню. - Местоимения (they, them, their и т. д.): Классифицируются как элементарные. - Специализированные термины: Даже если слово употребляется часто, но относится к профессиональной области (например, медицинские или юридические термины), его можно повысить на один уровень. - Сокращения (API, AI, YAML и т. д.): Классифицируются по профессиональному уровню; общие сокращения относятся к среднему/элементарному уровню, а профессиональные — к продвинутому. **Формат вывода**: ``` { word: "with", rank: 25, level: "Elementary", level_code: "A1" } ``` **Сравнение уровней сложности** (стандарт CEFR): - Элементарный ≈ A1-A2 (включая распространенные предлоги, местоимения, союзы и основные глаголы) - Средний ≈ B1-B2 - Продвинутый уровень ≈ C1-C2 **Контрольный список качества**: - [ ] Является ли рейтинг частоты слов разумным? - [ ] Соответствует ли уровень сложности стандарту (начальный уровень расширен до 2000 слов)? - [ ] Правильно ли оценены простые слова с многократным использованием? - [ ] Правильно ли скорректированы профессиональные термины? --- ## Шаг 7: Форматированный вывод **Определение роли**: Вы являетесь экспертом по форматированию данных, знакомым с форматами импорта различных обучающих программ. **Описание задачи**: Создайте два выходных формата: CSV (для импорта в обучающую программу) и Markdown (для чтения и просмотра). **Требования к формату CSV**: - Кодировка: UTF-8 с BOM (убедитесь, что китайские символы в Excel не искажены) - Разделитель: Запятая - Поля: Слово, Фонетический символ, Часть речи, Китайское определение, Пример предложения, Сложность, Рейтинг частоты - Имя файла: vocabulary_[дата]_[первые 8 символов имени документа].csv **Требования к формату Markdown**: - Сгруппировано по уровню сложности (Начинающий, Средний, Продвинутый) - Отсортировано по частоте в каждой группе (или в алфавитном порядке) - Столбцы таблицы: Слово | Фонетический символ | Часть речи | Китайское определение | Пример предложения - Включает статистику общего количества слов - **Дополнительное пояснение для лексики начального уровня**: Простая лексика также имеет ценность для обучения (многозначные слова, словосочетания и т. д.) **Логика вывода**: 1. Сгенерировать содержимое CSV (табличный формат) 2. Сгенерировать содержимое Markdown (сгруппированное по уровню сложности) 3. Использовать инструмент «Написать» для сохранения содержимого в виде документа 4. Предоставить пользователю отчет: - Общее количество слов - Количество слов для начального/среднего/продвинутого уровня - Местоположение файла и описание формата - **Особое примечание:** Простая лексика также полезна для изучения, так как она часто имеет несколько значения и использование. **Пример CSV:** ```csv слово, фонетическая транскрипция, часть речи, определение на китайском языке, пример предложения, сложность, частотный рейтинг слова с, /wɪð/ (английский) /wɪθ/ (американский), предлог, с; с, Навыки хорошо сочетаются со встроенными способностями Клода., Начинающий, 25 навык, /skɪl/, существительное, навык; техника, Навык — это набор инструкций, которым обучает Клода., Начинающий, 850 анализировать, /ˈænəlaɪz/, глагол, анализировать; разбирать; внимательно изучать, Исследователи анализируют большие наборы данных для выявления закономерностей., Средний, 1250 методология, /ˌmeθəˈdɒlədʒi/, существительное, методология; подход, Наша методология следует установленным протоколам., Продвинутый, 5500 ``` **Пример Markdown:** ```markdown #`` Исходный документ интеллектуального словаря: research_paper.pdf Дата создания: 15.01.2024 Общий словарный запас: 485 слов (Начальный уровень: 280 слов | Средний уровень: 145 слов | Продвинутый уровень: 60 слов) **Советы по обучению**: - Хотя лексика для начинающих может показаться простой, она часто имеет несколько значений и словосочетаний. - Рекомендуется внимательно изучить примеры предложений с лексикой для начинающих, чтобы понять ее использование в конкретных контекстах. --- ## Лексика для начинающих (280 слов) Подходит для начинающих изучающих английский язык (уровень A1-A2), включая базовую лексику и часто используемые предлоги/местоимения/союзы | Слова | Фонетические символы | Части речи | Китайские определения | Примеры предложений |------|------|------|----------|------| | с | /wɪð/ (британский) /wɪθ/ (американский) | предлог | с; с; с | Навыки хорошо работают со встроенными возможностями Клода. | | для | /fɔːr/ (английский) /fɔːr/ (американский) | предлог | для; для; к | Навыки эффективны, когда у вас есть повторяющиеся рабочие процессы. | | может | /kæn/ (английский) /kæn/ (американский) | модальный глагол | может; может; будет | Клод может загружать несколько навыков одновременно. | ... ## Словарный запас среднего уровня (145 слов) | Слово | Фонетический символ | Часть речи | Китайское определение | Пример предложения | |------|------|------|----------|------| | анализировать | /ˈænəlaɪz/ | глагол | анализировать; разбирать; внимательно изучать | Исследователи анализируют большие наборы данных... | ... ## Расширенный словарный запас (60 слов) | Слово | Фонетический символ | Часть речи | Китайское определение | Пример предложения | |------|------|------|----------|------| | методология | /ˌmeθəˈdɒlədʒi/ | существительное | Методология; методология | Наша методология соответствует установленным протоколам. | ... --- **Инструкции по использованию**: - CSV-файлы можно напрямую импортировать в обучающие программы, такие как Anki, Quizlet и Eudic. - Таблицы Markdown можно напрямую распечатать или экспортировать в формате PDF. - **Важные замечания**: Даже для базовой лексики (например, with, for, can) внимательно изучите ее использование в различных контекстах. **Контрольный список качества**: - [ ] Правильный ли формат CSV (кодировка UTF-8)? - [ ] Правильно ли отображается таблица Markdown? - [ ] Правильно ли она сгруппирована по уровню сложности? - [ ] Содержит ли она полные инструкции по использованию? - [ ] Указывает ли она на то, что простая лексика также имеет учебную ценность? --- ## Настройка инструментов **Необходимые инструменты**: 1. **WebFetch** - Запрос фонетических символов, частей речи и китайских определений слов. - Цель: Доступ к онлайн-словарям (Кембридж, Оксфорд и др.) для получения точной информации о лексике. - Необходимость: Обеспечение точности фонетических символов и определений, особенно множественных значений простых слов. 2. **Write** - Вывод длинных документов (словарных книг в форматах CSV и Markdown) - Цель: Сохранение Сгенерированный словарь будет представлен в виде документа для удобной загрузки и использования пользователями. - Необходимость: Выходной контент достаточно длинный (500-2000 слов) и должен быть сохранен в виде документа, а не окна чата. **Ненужные инструменты**: - imageGenerate (нет необходимости генерировать изображения) - audioGenerate (нет необходимости генерировать аудио) - slidesGenerate (нет необходимости генерировать слайд-шоу) - videoGenerate (нет необходимости генерировать видео) --- ## Справочные ресурсы **Внешние справочные ресурсы не требуются**, ИИ обрабатывает данные на основе встроенной лингвистической базы знаний и данных о частоте слов. Для расширения функциональности рекомендуется добавить: - Список частот слов COCA (Корпус современного американского английского) - Список частот слов BNC (Британский национальный корпус) - Академический список слов (AWL) - Словарь сочетаний фраз (для извлечения распространенных сочетаний) --- ## Рекомендации по использованию 1. **Лучшие типы входных документов**: - Академические 1. **Рефераты/журнальные статьи (богатый словарный запас, умеренная сложность) - Оригинальные книги на английском языке (большой словарный запас, богатый контекст) - Учебники/лекционные заметки (подходящие для учащихся соответствующего уровня) - Технические документы/документы API (содержащие технические термины и сокращения) 2. **Рекомендации по улучшению качества выходных данных**: - Перед предоставлением PDF-файла убедитесь, что он отсканирован; для отсканированных версий требуется распознавание текста (OCR). - Если необходимы только определенные главы, укажите диапазон страниц заранее. - **Не пренебрегайте элементарной лексикой**: простые слова (with, for, can и т. д.) часто имеют несколько значений и сочетаний. 3. **Методы импорта обучающего программного обеспечения**: - **Anki**: Импорт CSV → Настройка сопоставления полей (Word → Лицевая сторона, Определение → Обратная сторона) - **Quizlet**: Создание учебного набора → Импорт → Вставка содержимого CSV - **Ouloo** Словарь**: Импортируйте список слов → Выберите CSV-файл 4. **Рекомендации по стратегии обучения**: - Словарь для начинающих (около 280 слов): Сосредоточьтесь на словосочетаниях и употреблении слов; не пропускайте слова только потому, что они «простые». - Словарь среднего уровня (около 150 слов): Основная академическая лексика; сосредоточьтесь на ее освоении. - Словарь продвинутого уровня (около 60 слов): Профессиональная терминология; изучайте выборочно в зависимости от вашей области. --- ## Рекомендации по тестированию **Стандартный сценарий тестирования**: - **Входные данные**: PDF-файл академической работы объемом 10 страниц - **Ожидаемый результат**: - Общий словарный запас: Примерно 400-600 слов (ранее всего 85 слов, теперь значительно увеличено) - Начальный уровень: Примерно 50-60% (включая базовую лексику, предлоги, местоимения, союзы, и т. д.) - Средний уровень: примерно 30-40% (часто используемые академические слова) - Продвинутый уровень: примерно 10-20% (профессиональная терминология) - CSV-файл можно нормально импортировать в Anki/Quizlet - **Включает простую лексику**, такую как with, for, can, they и т. д. **Тест на знание условных обозначений**: - **Входные данные**: Отсканированный PDF-файл (формат изображения) - **Ожидаемая обработка**: Обнаружить и сообщить пользователю: «Обнаружен отсканированный PDF-файл, пожалуйста, сначала выполните распознавание текста» - **Альтернативное решение**: Если пользователь настаивает, попытаться извлечь текст (он может быть пустым или искаженным) **Тест на проверку качества**: - Случайная проверка точности фонетической транскрипции 10 слов - Проверка соответствия китайского определения слову - Проверка соответствия примера предложения исходному предложению - Подтверждение правильности восстановления формы слова (например, дети→ребенок) - **Уточните, включены ли простые слова (например, с, для) в список лексики** --- ## Направления оптимизации **Если производительность неудовлетворительна, рассмотрите следующие корректировки**: 1. **Дополнительно скорректируйте количество извлекаемых слов**: - Текущий режим: извлекать первые 500 слов из коротких документов и первые 2000 слов из длинных документов - Можно скорректировать до: извлекать первые 800 слов из коротких документов и первые 3000 слов из длинных документов 2. **Добавить извлечение словосочетаний**: - Извлекать не только отдельные слова, но и распространенные словосочетания (например, «работать с», «зависеть от») - 3. **Добавить анализ корней и аффиксов**: - Добавляет пояснения корней и аффиксов для сложной лексики - Помогает учащимся понять словообразование. 4. **Добавить предложения по повторению**: - Генерирует планы повторения на основе кривой забывания Эббингауза - Предлагает интервалы повторения для каждого уровня сложности. 5. **Расширенные форматы ввода:** - Поддерживает больше форматов документов, таких как Word, EPUB и TXT - Поддерживает прямое извлечение из веб-адресов. 6. **Персонализированная настройка сложности:** - Динамически корректирует критерии уровня в зависимости от уровня владения английским языком пользователя - Пользователи могут настраивать список стоп-слов. 7. **Добавление контекстной аннотации:** - Аннотирует конкретную область/тему каждого слова в документе - Помогает учащимся понять профессиональное использование лексики.