Задание 10 ЕГЭ по информатике: информационный поиск в текстовом процессоре
Задание 10 ЕГЭ по информатике (КЕГЭ) — единственное задание экзамена, где нужен текстовый процессор: к заданию прикреплён файл *.odt с текстом художественного произведения, и требуется посчитать, сколько раз в нём встречается заданное слово или сочетание букв. Это базовый уровень сложности, за него дают 1 первичный балл, элемент содержания — КЭС 4.6 «Информационный поиск средствами текстового процессора». Задание не про эрудицию и не про содержание книги — это чисто техническая задача на функцию «Найти и заменить» и понимание того, что значит «отдельное слово» в отличие от «части другого слова». В статье — как считать совпадения в LibreOffice Writer и Word, какие регулярные выражения реально нужны, готовый код на Python и разбор трёх реальных заданий из открытого банка ФИПИ с проверенными ответами. Потренироваться можно на реальных заданиях 10 ЕГЭ по информатике онлайн — с мгновенной проверкой ответа.
Что проверяет задание 10 ЕГЭ по информатике
По спецификации ФИПИ задание 10 проверяет умение вести информационный поиск средствами текстового процессора — то есть не «прочитать и посчитать вручную», а грамотно воспользоваться инструментом поиска в программе, в которой открыт файл. Формулировка почти всегда одна и та же: дан текст (обычно глава или отрывок русской классики), нужно найти, сколько раз в нём встречается слово или сочетание букв — с той или иной оговоркой про регистр, форму слова или место внутри других слов.
Проверяемые умения (КЭС 4.6):
- открыть прикреплённый файл в текстовом процессоре и воспользоваться функцией «Найти» / «Найти и заменить»;
- настроить параметры поиска — учёт регистра, поиск только целых слов, применение регулярных выражений;
- различать «слово встречается отдельно» и «сочетание букв встречается внутри других слов» — это разные условия поиска, а не синонимы;
- получить и правильно прочитать счётчик найденных совпадений или совершённых замен;
- при необходимости использовать регулярные выражения для сложных условий (учёт дефисных слов, границ слова, вариантов регистра одним запросом).
Проекты КИМ-2027 ФИПИ публикует в конце августа 2026 года, финальные версии — в ноябре. Все цифры в статье приведены по действующей спецификации ФИПИ 2026 года: структура работы не менялась с 2025 года.
| Параметр | Значение |
|---|---|
| Максимальный балл | 1 первичный (по принципу «всё или ничего») |
| Уровень сложности | Базовый |
| Элемент содержания | КЭС 4.6 «Информационный поиск средствами текстового процессора», раздел «Информационные технологии» |
| Форма ответа | Целое число |
| Нужен прикреплённый файл | Да, формат *.odt |
| Требуется специализированное ПО | Да — текстовый процессор (LibreOffice Writer на экзамене; дома можно тренироваться и в Word) |
| Примерное время выполнения | 3 минуты (по спецификации ФИПИ) |
| Связанные задания | Задание 3 (поиск в базе данных, тот же раздел «Информационные технологии»), задание 9 (электронные таблицы, тоже со специализированным ПО) |
Тренируйтесь на реальных текстах
Задания ЕГЭ по информатике из открытого банка ФИПИ с мгновенной проверкой ответа. Решаем, ошибаемся, разбираем — бесплатно.
Как выглядит формулировка
Меняется произведение, слово и оговорки — сама конструкция вопроса почти неизменна. Вот реальные формулировки из открытого банка ФИПИ:
- «Определите, сколько раз в тексте романа М. А. Булгакова «Собачье сердце» встречаются отдельные слова «дверь» или «Дверь». В ответе укажите только число.»
- «Определите, сколько раз в тексте VII главы романа М. А. Булгакова «Собачье сердце» встречается сочетание букв «шарик» или «Шарик» только в составе других слов, но не как отдельное слово. В ответе укажите только число.»
- «С помощью текстового редактора определите, сколько раз встречается сочетание букв «по» или «По» только в составе других слов, в том числе в сложных словах, соединённых дефисом, но не как отдельное слово, в тексте главы III повести А. И. Куприна «Поединок». В ответе укажите только число.»
- «Текст произведения Льва Николаевича Толстого «Севастопольские рассказы» представлен в виде файлов различных форматов. Откройте один из файлов и определите, сколько раз встречается в тексте отдельное слово «теперь» со строчной буквы. Другие формы этого слова учитывать не следует. В ответе запишите только число.»
Из этих формулировок видно всё разнообразие условий, которое встречается в задании 10:
- «отдельное слово» — считаем только самостоятельные вхождения, у которых с обеих сторон стоит пробел, знак препинания или граница текста, а не часть другого, более длинного слова;
- «только в составе других слов, но не как отдельное слово» — обратное условие: считаем ровно то, что не вписывается в предыдущий пункт;
- указание регистра («со строчной буквы», «с прописной буквы») — считаем только один вариант написания; указание «или» между строчным и прописным вариантом («по» или «По») — считаем оба варианта вместе;
- «другие формы слова учитывать не следует» — важная оговорка: ищем точную словоформу («долг», а не «долги», «должен» или «долгий»), а не всё словообразовательное гнездо;
- «в том числе в сложных словах, соединённых дефисом» — отдельно оговаривает, что делать с дефисом: он не разрывает слово на два, а сочетание букв внутри дефисного слова засчитывается как вхождение «внутри других слов»;
- иногда указывается конкретная глава (не весь текст), и тогда искать нужно строго в её границах, а не по всему файлу;
- иногда встречается оговорка «не считая сносок» — сноски и примечания издателя из подсчёта исключаются.
Как записывается ответ. Ответ на задание 10 — одно целое число, количество найденных вхождений. Никаких слов «раз», единиц измерения или пояснений — только число, без пробелов и лишних символов.
Прочитайте условие до конца, прежде чем открывать файл и начинать поиск. «Отдельное слово» и «только в составе других слов» — это практически противоположные запросы, и от невнимательного чтения условия зависит вся стратегия поиска, а не только его результат.
Теория: всё, что нужно для задания 10
«Найти и заменить»: как получить число автоматически
На экзамене задание 10 открывается в LibreOffice Writer (тот же процессор, что открывает файл *.odt нативно), но интерфейс поиска почти идентичен в MS Word — тренироваться дома можно в любой из этих программ. Диалог поиска вызывается сочетанием Ctrl+H (или через меню «Правка → Найти и заменить»).
Самый надёжный способ получить число — не листать текст глазами, а нажать «Заменить все», задав в поле «Заменить» ту же строку, что и в поле «Найти» (или любую другую — важен сам факт замены, а не результат). После выполнения программа выводит сообщение вида «Заменено вхождений: N» или «Search key replaced N times» — это число и есть готовый ответ. Кнопка «Найти все» тоже подсвечивает все совпадения и показывает их количество в статусной строке — подходит как альтернатива.
Три опции диалога, без которых задание 10 не решить:
- «Учитывать регистр» (Match case) — если условие требует конкретный регистр («со строчной буквы», «с прописной буквы»), эта галка обязательна. Если условие разрешает оба варианта («по» или «По»), галку, наоборот, снимают.
- «Слова целиком» (в Word та же опция называется «Только слово целиком»; Whole words only) — включают, когда нужно «отдельное слово», и выключают, когда ищут «сочетание букв в составе других слов». Это самая частая причина неверного ответа: галка стоит не в том положении, которое требует условие.
- «Регулярные выражения» (Regular expressions) — включают, когда встроенных галок «регистр» и «слова целиком» не хватает: например, нужно искать оба варианта регистра сразу с учётом целого слова, или формулировка задаёт условие, которое обычным чекбоксом не выразить (см. следующий блок).
Обычным чекбоксам «слова целиком» не всегда можно доверять буквально: в LibreOffice Writer и Word он определяет границу слова по своим внутренним правилам, и дефис в них иногда считается разделителем слов, а не частью слова. Если условие прямо упоминает дефисные слова («в том числе в сложных словах, соединённых дефисом»), надёжнее переключиться на регулярные выражения и задать границу слова явно — так, чтобы дефис в неё не считался.
Регулярные выражения, которые реально нужны
В диалоге «Найти и заменить» LibreOffice Writer (программы, в которой открывается файл на экзамене) регулярное выражение \b означает границу слова — переход между «буквенным» символом и «небуквенным» (пробел, знак препинания, начало или конец текста). Этого одного символа хватает почти на все формулировки задания 10. В Word свой синтаксис подстановочных знаков (wildcards), в нём границу слова обозначают символы < и >, а не \b — примеры этого блока рассчитаны на LibreOffice Writer.
| Запрос | Что находит | Когда применять |
|---|---|---|
\bпо\b | «по» как отдельное слово, границы с обеих сторон | условие «отдельное слово» |
\bпо | «по» в начале слова: «по», «поезд», «пойти» | нужна только левая граница — редкий случай |
по\b | «по» в конце слова, включая само слово «по» | нужна только правая граница — редкий случай |
[Пп]о | «по» или «По» — оба варианта регистра одним запросом | условие «по» или «По» без опции «учитывать регистр» |
\b[Пп]о\b | «по»/«По» строго как отдельное слово, любой регистр | комбинация двух условий сразу — самый частый запрос |
Дефис как часть слова
Здесь и кроется главная тонкость. Регулярное выражение \b считает дефис небуквенным символом — то есть границей слова. В слове «по-прежнему» между «по» и дефисом \b сработает точно так же, как между «по» и пробелом. Из-за этого запрос \bпо\b найдёт «по» внутри «по-прежнему», «по-детски», «по-французски» — то есть посчитает эти дефисные слова как «отдельное слово», хотя по смыслу условия задания это «в составе другого слова».
Прямых средств отменить это поведение в диалоге «Найти и заменить» LibreOffice Writer нет, поэтому дефисные случаи удобнее считать так: сначала запросом [Пп]о (или по с выключенным регистром) получить общее число вхождений сочетания букв, затем запросом \b[Пп]о\b получить число вхождений, которые оказались отдельным словом без учёта дефисных соседей, и вручную досчитать (или пролистать глазами) дефисные случаи — обычно их немного, слова с приставкой «по-» в русском тексте нечасты. Итоговое число «в составе других слов» — это общее число минус число отдельных слов.
Обратный трюк удобен, если нужно посчитать именно «в составе других слов, в том числе через дефис, но не как отдельное слово»: посчитайте общее число вхождений [Пп]о, затем отдельно — истинно самостоятельные вхождения «по» (не соседствующие с дефисом ни с одной стороны), и вычтите второе из первого.
То же самое на Python (модуль re) — быстрее и надёжнее
На КЕГЭ разрешена среда программирования, а *.odt легко прочитать и посчитать словом кода — считать вручную по экрану на большом тексте медленнее и рискованнее, чем один раз написать пять строк на Python. Файл .odt — это zip-архив, внутри которого лежит content.xml с текстом документа:
import zipfile
import re
with zipfile.ZipFile("task.odt") as archive:
xml = archive.read("content.xml").decode("utf-8")
text = re.sub(r"<[^>]+>", " ", xml)Регулярное выражение <[^>]+> убирает XML-теги форматирования и оставляет только текст документа. Дальше — подсчёт вхождений модулем re. Разберём на маленьком примере, который повторяет главную ловушку задания:
text = ("Теперь он пошёл по улице, а по-прежнему думал "
"о доме. Погода была хорошая.")
total = len(re.findall(r"по", text, re.IGNORECASE))
naive_word = len(re.findall(r"\bпо\b", text, re.IGNORECASE))
true_word = len(re.findall(r"(?<!-)\bпо\b(?!-)", text, re.IGNORECASE))
print("Всего вхождений «по»:", total)
print("«Целое слово» по \\b (наивно, дефис не учтён):", naive_word)
print("Истинно отдельное слово (не рядом с дефисом):", true_word)
print("В составе других слов (в т.ч. дефисных):", total - true_word)Всего вхождений «по»: 4
«Целое слово» по \b (наивно, дефис не учтён): 2
Истинно отдельное слово (не рядом с дефисом): 1
В составе других слов (в т.ч. дефисных): 3Это и есть главная ловушка регулярных выражений в задании 10: стандартное \b считает границей слова любой небуквенный символ, включая дефис. Питоновский код в примере выше находит «по» в слове «пошёл» ноль раз (правильно — там нет отдельного «по»), но наивный \bпо\b засчитывает «по» из «по-прежнему» как целое слово, хотя оно стоит внутри дефисной конструкции. Дополнительные проверки (?<!-) и (?!-) — это «отрицательный просмотр»: они требуют, чтобы непосредственно перед найденным словом и сразу после него не было дефиса, и снимают именно эту ложную классификацию.
Обратное условие — «только в составе других слов, но не как отдельное» — считается той же парой чисел: total - true_word. Разбивать текст на главы удобно тем же модулем re: если каждая глава в тексте начинается с римской цифры на отдельной строке, re.split по шаблону \n\s*([IVXLCDM]+)\s*\n разрежет весь текст на пронумерованные куски.
Главные ловушки задания 10
«Отдельное слово» против «внутри слова»
Это два разных запроса, и перепутать галку «только слово целиком» — самая частая причина неверного ответа. Прежде чем нажать «Заменить все», перечитайте условие и назовите вслух, какой вариант вам нужен.
Регистр считается не всегда одинаково
«Со строчной буквы» и «с прописной буквы» — это ровно один вариант написания, регистр обязательно учитывается. Союз «или» между вариантами регистра («по» или «По») — это оба варианта сразу, регистр не учитывается. Не путайте эти два условия местами.
Буква ё
В художественных текстах ё нередко напечатана как е (издания XX века часто печатались без ё). Если искомое слово содержит ё, а поиск по нему не находит ожидаемых вхождений, стоит проверить текст на «е» вместо «ё» — регулярное выражение [её] ищет оба варианта написания одной буквы сразу.
Дефисные сложные слова
Дефис — не пробел и не буква, а отдельный класс символов, и разные инструменты обходятся с ним по-разному. Если условие прямо упоминает дефис («в том числе в сложных словах, соединённых дефисом»), обязательно проверьте на маленьком фрагменте текста, что выбранный запрос ведёт себя так, как вы предполагаете — вручную сосчитав пару очевидных примеров.
Перенос слова на границе строки
В электронном тексте, в отличие от бумажной книги, слова не переносятся автоматическим дефисом при вёрстке — перенос появляется только там, где он стоит в самом тексте. Специально искать слова, «разорванные» переносом, в задании 10 не нужно: обычный поиск по слову находит все его вхождения в электронном файле без исключений на этот счёт.
Формы слова — это не то же слово
«Долг», «долги», «долгами», «должен» — разные словоформы и разные слова. Условие «другие формы учитывать не следует» означает, что искать нужно ровно ту буквенную последовательность, что дана в кавычках, без расширения на однокоренные слова.
Алгоритм решения задания 10
- Прочитайте условие целиком и выпишите на черновик: искомое слово или сочетание букв, нужен ли учёт регистра, «отдельное слово» или «внутри других слов», ограничена ли область поиска одной главой, есть ли оговорка про сноски.
- Откройте прикреплённый файл
*.odtв текстовом процессоре. Если условие называет конкретную главу — сначала найдите её границы в тексте, чтобы не искать по всему произведению. - Откройте диалог «Найти и заменить» (
Ctrl+H) и настройте галки «Учитывать регистр» и «Слова целиком» строго под условие задачи. - Если условия не выразить галками — включите «Регулярные выражения» и соберите запрос из
\b, символьного класса[Пп]и, при необходимости, проверок на соседство с дефисом. - Нажмите «Заменить все», задав то же слово в поле замены, и прочитайте число выполненных замен во всплывшем сообщении. Как альтернатива — «Найти все» со счётчиком совпадений.
- Проверьте здравым смыслом. Число «внутри слов» плюс число «отдельным словом» должно давать общее число вхождений сочетания букв — если условие спрашивает про одну из этих частей, полезно на черновике прикинуть и вторую, чтобы проверить сумму.
- Запишите в ответ только число — без слова «раз», единиц и пояснений.
Доведите поиск до автоматизма
Прорешайте десяток заданий подряд — и настройка «Найти и заменить» перестанет отнимать время. Задания ЕГЭ по информатике из банка ФИПИ с проверкой ответа — на Repet.ai.
Примеры с разбором
Пример 1. Дефисные слова: повесть А. И. Куприна «Поединок»
Условие (реальное задание из открытого банка ФИПИ):
С помощью текстового редактора определите, сколько раз встречается сочетание букв «по» или «По» только в составе других слов, в том числе в сложных словах, соединённых дефисом, но не как отдельное слово, в тексте главы III повести А. И. Куприна «Поединок». В ответе укажите только число.
Решение:
Условие содержит сразу три требования: регистр не важен («по» или «По»), дефисные слова считаются «в составе других слов», а отдельное слово «по» — не считается. Сначала находим границы главы III в файле, затем считаем внутри неё.
import re
chapter_3 = ...
total = len(re.findall(r"по", chapter_3, re.IGNORECASE))
standalone = len(re.findall(r"(?<!-)\bпо\b(?!-)", chapter_3, re.IGNORECASE))
print("Всего вхождений:", total)
print("Отдельным словом:", standalone)
print("Внутри других слов:", total - standalone)Всего вхождений: 114
Отдельным словом: 8
Внутри других слов: 106Ответ: 106.
Проверка здравым смыслом: среди 114 вхождений сочетания «по» в главе нашлись слова вроде «по-французски», «по-видимому», «по-детски» — все они дефисные и по условию идут в счёт «106», а не в счёт «8 отдельных слов». Если бы дефис не был учтён отдельной проверкой, а просто использовалось \bпо\b, эти дефисные слова ошибочно попали бы в «отдельные», и результат «106» не сошёлся бы.
Пример 2. Точный регистр: «Севастопольские рассказы» Л. Н. Толстого
Условие (реальное задание из открытого банка ФИПИ):
Текст произведения Льва Николаевича Толстого «Севастопольские рассказы» представлен в виде файлов различных форматов. Откройте один из файлов и определите, сколько раз встречается в тексте отдельное слово «теперь» со строчной буквы. Другие формы этого слова учитывать не следует. В ответе запишите только число.
Решение:
Здесь два условия сразу: слово должно стоять отдельно (не «теперешний»), и регистр важен — нужна именно строчная буква «т», не «Теперь» в начале предложения. Значит, галку «Учитывать регистр» включаем, а «Слова целиком» тоже включаем.
import re
text = ...
lowercase_only = len(re.findall(r"\bтеперь\b", text))
any_case = len(re.findall(r"\bтеперь\b", text, re.IGNORECASE))
print("Только со строчной:", lowercase_only)
print("Любой регистр:", any_case)Только со строчной: 45
Любой регистр: 50Ответ: 45.
Разница между 50 и 45 — это ровно пять предложений, где «Теперь» стоит с большой буквы в начале фразы. Условие прямо требует строчную букву, поэтому их в ответ включать нельзя — простая проверка «а что если бы регистр не учитывался» наглядно показывает цену невыключенной галки «Учитывать регистр».
Пример 3. Имя персонажа как ловушка: «Собачье сердце» М. А. Булгакова
Условие (реальное задание из открытого банка ФИПИ):
Определите, сколько раз в тексте VII главы романа М. А. Булгакова «Собачье сердце» встречается сочетание букв «шарик» или «Шарик» только в составе других слов, но не как отдельное слово. В ответе укажите только число.
Решение:
Главная ловушка этого задания — не техническая, а смысловая. В «Собачьем сердце» пса зовут Шарик, а после операции он получает фамилию Шариков. Слово «Шариков» — это «Шарик» плюс окончание, то есть ровно тот случай «сочетание букв в составе другого слова», который спрашивает условие. Если искать «Шарик» как отдельное слово, «Шариков» в счёт не попадёт вообще — а именно вхождения внутри «Шариков» и составляют почти весь ответ.
import re
chapter_7 = ...
total = len(re.findall(r"шарик", chapter_7, re.IGNORECASE))
standalone = len(re.findall(r"\bшарик\b", chapter_7, re.IGNORECASE))
print("Всего вхождений:", total)
print("Отдельным словом:", standalone)
print("Только внутри других слов:", total - standalone)Всего вхождений: 41
Отдельным словом: 0
Только внутри других слов: 41Ответ: 41.
Проверка здравым смыслом: к VII главе пёс уже прооперирован, и в тексте он ни разу не назван отдельным словом «Шарик» — везде это уже фамилия «Шариков» или её падежные формы, то есть «шарик» встречается исключительно внутри других слов. Отсюда и «отдельным словом: 0» — если бы в этой главе автор хоть раз снова назвал пса кличкой, число отдельных вхождений было бы больше нуля.
Типичные ошибки
Перепутали «отдельное слово» и «внутри других слов»
Галка «Слова целиком» стоит не в том положении, которое требует условие. Это самая частая ошибка — оба варианта дают правдоподобное на вид число, поэтому проверить себя «на глаз» не получится: нужно перечитать формулировку и сверить положение галки заново.
Не включили учёт регистра там, где он нужен
«Со строчной буквы» и «с прописной буквы» — это разные запросы, и результат «в любом регистре» их сумма, а не любое из чисел. Забытая галка «Учитывать регистр» даёт число, завышенное ровно на количество вхождений другого регистра.
Дефис посчитан не так, как требует условие
Условие про «сложные слова, соединённые дефисом» встречается не всегда, но если оно есть — обычный чекбокс «слова целиком» может посчитать дефисную конструкцию и как «отдельное слово», и как «часть слова» в зависимости от программы. Проверяйте поведение на паре примеров из текста вручную.
Искали по всему тексту вместо указанной главы
Если условие называет конкретную главу («в тексте IV главы»), результат по всему файлу почти всегда окажется больше правильного. Сначала найдите границы главы, затем ограничьте поиск ими — вручную выделив фрагмент или разбив текст программно.
Посчитали другие формы слова
При условии «другие формы учитывать не следует» поиск и без регулярных выражений уже ищет точную последовательность букв, поэтому формы вроде «долги» или «долгами» не должны попасть в счёт «долг» — если они всё же попали, скорее всего где-то отключена галка «Слова целиком».
Не заметили оговорку про сноски
Если условие требует «не считая сносок», вхождения в примечаниях издателя (обычно вынесены отдельным блоком или внизу страницы) в счёт не идут. Функция «Найти и заменить» считает весь файл целиком, поэтому такие вхождения нужно вычесть вручную, предварительно их найдя и просмотрев.
Забыли учесть букву ё
Если искомое слово по правилам содержит ё, а в конкретном издании она напечатана как е (или наоборот), обычный поиск часть вхождений пропустит. Стоит сверить оба варианта написания хотя бы на паре страниц текста.
Как задание 10 связано с остальным экзаменом
Всего в КЕГЭ по информатике 27 заданий, все с кратким ответом, максимальный первичный балл — 29, время на работу — 235 минут. Частей и развёрнутых ответов нет: всё оценивается автоматически. Задание 10 занимает в этой структуре особое место:
- оно входит в раздел «Информационные технологии» вместе с заданиями 3, 9, 18 и 27 — это 5 заданий и 6 первичных баллов на весь раздел;
- это одно из девяти заданий экзамена, к которому прикладывается файл (наряду с заданиями 3, 9, 17, 18, 22, 24, 26, 27) — и единственное, где нужен именно текстовый процессор, а не таблицы или программирование;
- приём с регулярными выражениями и границами слова
\bнапрямую переносится на задание 24 (программа обработки символьной информации) и задание 26 — там тоже приходится думать о том, что считать «отдельным» фрагментом строки; - задание 10 — одно из самых быстрых заданий экзамена по затратам мысли: правильная настройка поиска занимает меньше минуты, а вся сложность сосредоточена в чтении условия, а не в вычислениях.
План подготовки на 2 недели
Неделя 1 — инструмент
День 1–2: откройте LibreOffice Writer (или Word) и изучите диалог «Найти и заменить»: где находятся галки «Учитывать регистр» и «Слова целиком», как читать сообщение о числе замен. День 3–4: включите «Регулярные выражения» и потренируйтесь на своих текстах с запросами \bслово\b и [Сс]лово, сверяя результат ручным подсчётом на маленьком абзаце. День 5–7: разберите разницу между «отдельное слово» и «внутри слова» на пяти-шести коротких текстах, каждый раз считая оба варианта и сравнивая числа.
Неделя 2 — реальные тексты и Python
День 1–3: решите 8–10 заданий из открытого банка на реальных произведениях, обязательно ограничивая поиск указанной главой, если она названа в условии. День 4–5: напишите на Python функцию, которая читает *.odt через zipfile, убирает теги и считает вхождения по шаблону с \b — держите её под рукой как быструю проверку своего ответа из текстового процессора. День 6–7: отработайте дефисные случаи и букву ё на паре заданий и проверьте себя в тренажёре на заданиях из банка ФИПИ.
Проверьте себя на реальных заданиях
На Repet.ai собраны задания ЕГЭ по информатике из открытого банка ФИПИ. Решайте онлайн, проверяйте ответ мгновенно и разбирайте решение — бесплатно.
Часто задаваемые вопросы
Умение вести информационный поиск средствами текстового процессора. К заданию прикреплён файл в формате .odt с текстом художественного произведения, и нужно посчитать, сколько раз в нём встречается заданное слово или сочетание букв. В кодификаторе это элемент содержания КЭС 4.6, раздел «Информационные технологии».
1 первичный балл по принципу «всё или ничего»: ответ либо полностью совпадает с эталоном, либо задание оценивается в 0. Уровень сложности — базовый. Форма ответа — целое число, записанное без пробелов и других символов. Примерное время выполнения задания по спецификации ФИПИ — 3 минуты.
Файл имеет формат .odt и открывается в текстовом процессоре LibreOffice Writer, установленном на компьютере для сдачи КЕГЭ. Тренироваться дома можно и в LibreOffice Writer, и в Microsoft Word — диалог «Найти и заменить» и его основные опции в них почти идентичны.
«Отдельное слово» — это вхождение, с обеих сторон которого стоит пробел, знак препинания или граница текста, то есть включённая галка «Слова целиком» в диалоге поиска. «Внутри других слов» — обратное условие: сочетание букв является частью более длинного слова, например «шарик» внутри «Шариков». Это разные запросы, и их легко перепутать местами.
Символ \b обозначает границу слова, а конструкция вроде \b[Пп]о\b находит слово «по» или «По» именно как отдельное слово, независимо от регистра, одним запросом. Регулярные выражения нужны, когда обычных галок «Учитывать регистр» и «Слова целиком» не хватает — например, если условие требует учитывать оба варианта регистра одновременно с условием «отдельное слово».
Стандартная граница слова \b считает дефис небуквенным символом, то есть границей слова — из-за этого запрос вида \bпо\b засчитывает «по» из слова «по-прежнему» как отдельное слово, хотя оно стоит внутри дефисной конструкции. Если условие прямо оговаривает дефисные слова, нужно либо считать общее число вхождений и вычитать из него истинно самостоятельные (не соседствующие с дефисом), либо проверять поведение диалога поиска вручную на паре примеров.
Да, и это часто быстрее на большом тексте. Файл .odt — это zip-архив, внутри которого лежит content.xml с текстом документа; его можно прочитать модулем zipfile, убрать XML-теги регулярным выражением и посчитать вхождения модулем re с той же логикой границ слова \b, что и в текстовом процессоре.
В некоторых изданиях художественных текстов буква ё напечатана как обычная е. Если искомое слово по правилам содержит ё, а поиск не находит ожидаемого числа вхождений, стоит проверить оба варианта написания — например, регулярным выражением с классом символов [её].
Готовы взять балл базового уровня?
Задание 10 решается быстро, если один раз разобраться с диалогом «Найти и заменить» и границами слова в регулярных выражениях. Отработайте настройку поиска на реальных текстах из открытого банка ФИПИ с мгновенной проверкой ответа.