关于《利用Lex进行词法分析》

文章介绍了如何利用Lex工具进行词法分析,包括安装Flex,配置环境变量,编辑.l文件,用Flex生成.c文件,然后用GCC编译并执行。作者提醒注意GCC版本,Lex对头文件的处理以及.y.h文件的使用。提供了一个GitHub资源链接供读者参考学习。
摘要由CSDN通过智能技术生成

利用Lex进行词法分析

写在前面

目前开展编译原理这门课程,许多同学说实话学不到什么东西,知识一昧地做题,我个人是不建议的。当我看到课本上有一页是来介绍利用Lex和Yacc做词法分析和语法分析的时候,我觉得可以试一试,没想到Lex使用起来还有些难度,大概花费了我一周的时间才大部分可以看懂。下面将介绍利用Lex(Flex)进行词法分析的流程。

学习流程

  1. 首先需要安装Lex

    推荐安装的博客:手把手教程-lex与yacc/flex与bison入门(一)(使用windows环境)D-Cierra, 个人觉得这篇文章中的环境配置部分写的不错,值得学习。明确以下几点。
    1. flex是lex的替代品,也大致可以说就是一样的东西。
    2. 配置环境变量的目的就是方便在任何的命令框中调用flex和bison,如果对于windows命令不是很熟悉的同学推荐将其放在环境变量中。
    3. 这里最好安装的没有中文路径的目录下,默认的目录是有些问题的。比如program file (x86)这个目录我的计算机上是识别不了的,推荐直接安装的C盘根目录下。
    4. 最后的测试可以不使用管理员身份打开,我测试的时候是没有问题的。
  2. 认识Lex

    这里推荐的博客:Lex使用指南 火雨_Nick,写的比较好,但是时间较长了,这都2023年了 😄 但是其大体内容是完全没有问题的。
  3. 使用Lex(flex)

    1. 编辑词法分析的程序(.l / .L)程序,这里我在某个官网上找到了一个可以使用的,并且比较全面,这里不做过多的介绍,感兴趣的可以使用任何博客中的程序,但是目前看来都不是很全面。
    2. 利用Flex编译成xxx.yy.c文件。flex lex.l
    3. 利用gcc编译xxx.yy.c文件,默认生成a.exe(windows上)。
    4. 执行a.exe。
  4. 下面看我的演示过程

关于《利用Lex进行词法分析》

  1. 其他需要注意的地方

    1. 这里的gcc的version可以用gcc --version 来查看,视频里面没有。
    2. lex好像无法识别头文件,这是lex.l文件如此,但是我尊重原创没有改lex.l文件,所以大家这里需要注意,如果想要识别头文件的话,可以自行修改。
    3. y.tab.h 是我利用bison生成的,这里是和lex.l中的文件是对应的,如果大家不想使用这个文件的话,那么在lex.l中所有return的东西都需要在lex.l的前面定义,比如#define xxx 111这种。
  2. 如果非常不熟悉的人,可以直接看源码

lex免费测试用:https://github.com/zhanzhanblue/lex-using
源码:https://mbd.pub/o/bread/Y56amZ9t

实验二 词法分析器 一、实验目的 掌握词法分析器的构造原理,掌握手工编程或LEX编程方法之一。 二、实验内容 编写一个LEX源程序,使之生成一个词法分析器,能够输入的源程序转换为单词序列输出。 三、实验环境 Flex+VC6.0 四、实验注意 1.Id正则表达式:{letter}({letter}|{digit})* 2.Num正则表达式:{digit}+(\.{digit}+)?(E[+-]?{digit}+)? 3.注释:(\/\*(.)*\*\/) 4.关键字再加上其他字符就又能编程id,所以在词法分析时,id的判断应该放在关键字前面,这样才不会误判 5.由于本程序知识简单的打印数字,因此没有考虑数字的转换 6.">="比">"多一个字符,它应该放在前面判断,其他类似的也应该如此安排 五、实验代码 ******************************************************************************* 实验文件:lex.l、lex.yy.c 实验结果:lex.exe 运行方式:打开lex.exe,弹出input.txt,在其中输入所要测试的程序,保存并关闭,即可在output.txt中看到所得结果 ******************************************************************************* %{ void Install(char *type); %} %option noyywrap delim [ \t] newline [\n] digit [0-9] num {digit}+(\.{digit}+)?(E[+-]?{digit}+)? letter [A-Za-z] id {letter}({letter}|{digit})* key ("if"|"while"|"do"|"break"|"true") basic ("int"|"float"|"bool"|"char") op (">="|""|"<"|"="|"!="|"+"|"-"|"*"|"/") comment (\/\*(.)*\*\/) %% delim {;} newline {printf("\n");} {num} {Install("Num");} {key} {Install("Key");} {basic} {Install("Basic");} {op} {Install("Op");} ";" {Install("Comma");} {id} {Install("ID");} {comment} {Install("Comment");} "(" | "[" | "{" {Install("lbracket");} ")" | "]" | "}" {Install("rbracket");} %% void Install(char *s) { fprintf(yyout, "%s:%s ", s, yytext); } int main() { printf("please input the test program in input.txt\n"); system("input.txt"); yyin = fopen("input.txt", "r"); yyout = fopen("output.txt", "w" ); yylex(); fclose(yyout); fclose(yyin); printf("analysis result in output.txt\n"); system("output.txt"); return 0; } 六、实验小结 本次的实验由于使用了flex,所以代码较短,麻烦的事flex的正则式表达,由于该使用规则只有简单介绍,而网上找的教程难免有比重就轻之嫌,所以得到上述表达式着实费力,且有的没有成功,例如bracket的(\ ((.)*\ ))或者("("(.)*")")使用时都没有成功,所以便单独写出,有点不伦不类。至于其他的,都较为简单,完。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值