你在当地一家图书馆找了份工作,帮忙整理馆藏的旧书。常来的学生读者常常要翻找那些记不全的引文,好写进自己的学期论文里。与其一本一本地从头读到尾,你决定做一个小工具来扫描这些书,找出那些残缺的引文。
在文件中搜索与搜索字符串匹配的行,并返回所有匹配的行。
Unix 的grep命令会在文件中搜索匹配正则表达式的行。你的任务是实现一个简化版的grep命令,它支持搜索固定字符串。
grep命令接受三个参数:
然后它会按指定的顺序读取这些文件的内容,找出包含搜索字符串的行,最后按找到它们的顺序返回这些行。在多个文件中搜索时,每条匹配的行前面都会加上文件名和一个冒号(':')。
grep命令支持以下标志:
-n在输出的每一行前面加上行号和冒号(':'),并把行号放在文件名之后(如果有文件名的话)。-l只输出至少包含一条匹配行的文件名。-i使用不区分大小写的比较进行匹配。-v反转程序,即收集所有不匹配的行。-x只搜索搜索字符串与整行完全匹配的行。你不需要实现完整的命令行解析:标志会以空格分隔的字符串形式提供,拆开很容易。
gawk -f grep.awk -v flags="l v" -v pattern="hello" file1.txt file2.txt
和真正的 grep 一样,当_没有找到任何匹配_时,你的程序会返回非零退出状态。