grep

grep

보통

소개

동네 도서관에서 오래된 책들을 정리하는 일을 맡게 됐어요. 도서관을 찾는 학생들은 학기말 논문에 인용할, 어렴풋이 기억나는 구절을 찾느라 자주 헤매곤 하죠. 책을 한 권씩 처음부터 끝까지 직접 읽는 대신, 그런 부분 인용구를 찾아 훑어볼 작은 도구를 만들기로 해요.

지침

검색 문자열과 일치하는 줄을 파일에서 찾아, 일치하는 모든 줄을 반환해요.

Unix grep 명령은 정규 표현식과 일치하는 줄을 파일에서 검색해요. 이번 과제는 고정 문자열 검색을 지원하는 단순화한 grep 명령을 구현하는 거예요.

grep 명령은 세 가지 인자를 받아요:

  1. 검색할 문자열.
  2. 명령의 동작을 바꾸는 0개 이상의 플래그.
  3. 검색할 파일 하나 이상.

그런 다음 지정된 파일의 내용을 (지정된 순서대로) 읽고, 검색 문자열을 포함하는 줄을 찾아, 마지막으로 찾은 순서대로 그 줄들을 반환해요. 여러 파일을 검색할 때는 일치하는 각 줄 앞에 파일 이름과 콜론(':')을 붙여요.

플래그

grep 명령은 다음 플래그를 지원해요:

  • -n 출력의 각 줄 앞에 줄 번호와 콜론(':')을 붙여요. 번호는 파일 이름이 있으면 파일 이름 뒤에 와요.
  • -l 일치하는 줄이 하나 이상 있는 파일의 이름만 출력해요.
  • -i 대소문자를 구분하지 않고 비교해서 일치 여부를 판단해요.
  • -v 동작을 반대로 뒤집어요. 일치하지 않는 모든 줄을 모아요.
  • -x 검색 문자열이 줄 전체와 일치하는 줄만 검색해요.

워드

다음을 구현해요:

  • grep ( pattern flags files -- lines )

pattern은 검색 문자열이고, flags는 플래그 문자열 "-n", "-l", "-i", "-v", "-x" 중 0개 이상을 담은 배열이며, files는 파일 이름 하나 이상을 담은 배열이에요. 일치하는 줄을 (요청한 경우에는 파일 이름과 줄 번호 접두사를 붙여서) 문자열 배열로 반환해요.

-l 플래그를 주면, 일치하는 줄이 하나 이상 있는 파일 이름의 배열을 반환해요.

파일 읽기

file-lines로 파일의 줄을 읽어요. 이때 인코딩을 함께 넘겨요:

USING: io.encodings.utf8 io.files ;

"iliad.txt" utf8 file-lines
! => { "Achilles sing, O Goddess! Peleus' son;" ... }

세 개의 픽스처 파일(iliad.txt, midsummer-night.txt, paradise-lost.txt)은 연습 문제와 함께 작업 디렉터리에 들어 있어요. 그래서 이름으로 그냥 읽으면 돼요.

GitHub에서 편집 링크가 새 창이나 탭에서 열려요
Factor Exercism

grep 문제를 시작해 볼 준비가 됐나요?

Exercism에 가입하고 Factor 트랙을 개념 47개연습 문제 163개, 그리고 실제 사람의 멘토링과 함께 배우고 익혀 보세요. 모두 무료예요.