>_ IzzyLab

Практическое задание

awk: топ-3 по частоте

средне

В /root/words.txt по одному слову в строке. Посчитай частоту каждого слова и выведи топ-3 самых частых в /root/top.txt в формате слово частота, по убыванию частоты.

Что потренируешь:
  • awk
  • ассоциативные массивы
  • подсчёт частот
  • sort
  • head

Разбор темы

Подсчёт частот — это накопление в ассоциативном массиве awk, где ключ (слово) индексирует счётчик, а инкремент на каждой строке даёт итоговое число повторов. Массив awk неупорядочен, поэтому «топ-N» — это отдельный этап: вывод из блока END отправляют по конвейеру во внешние сортировку и head. Здесь важно уметь сортировать sort по конкретной колонке как числа и в обратном порядке, а не лексикографически.

Что проверяется

  1. топ-3 по частоте верный

Как это выглядит