>_ IzzyLab

Практическое задание

Повторяющиеся слова

средне

В /root/prose.txt есть места, где слово случайно продублировано подряд (the the). Найди строки с такими повторами и выведи в /root/dupes.txt.

Что потренируешь:
  • grep
  • regex
  • backreference
  • группы

Разбор темы

Обычные квантификаторы описывают форму совпадения, но не умеют требовать «то же самое значение ещё раз» — для этого нужны группы в скобках и обратные ссылки (backreference). Группа запоминает конкретный совпавший текст, а ссылка вида \1 требует его повторения дальше по строке — так ловится именно дублированное слово, а не любые два слова подряд. Границы слова \b защищают от ложных срабатываний внутри более длинных слов; всё это доступно в grep -E.

Что проверяется

  1. Повтор найден
  2. Нормальные строки отсеяны

Как это выглядит