flex词法分析器1Word文档格式.docx-资源下载

flex词法分析器1Word文档格式.docx

1、Floata-zA-Za-zA-Z0-9*printf（Var+-*/%Op“.”Unknown : %cn,yytext0）;在命令行下执行命令flex解析，会自动生成lex.yy.c文件：rootlocalhost liweitestflex exfirst.l进行编译生成parser可执行程序：rootlocalhost liweitestcc -o parser lex.yy.c ll或者rootlocalhost liweitestgcc lex.yy.c ll -o parser注意：如果不加-ll链结选项，cc编译时会出现以下错误，后面会进一步说明。/tmp/cciACkbX.o

2、（.text+0x37b）: In function yylex undefined reference to yywrap/tmp/cciACkbX.o（.text+0xabd）: In function input创建待解析的文件file.txt：titlei=1+3.9;a3=909/6bcd=4%9-333通过已生成的可执行程序，进行文件解析。rootlocalhost liweitest# ./parser file.txt title i = 1 + 3.9 ; a3 909 / 6 bcd 4 % 9 - 333到此Lex用法会有个直观的了解：a.定义Lex描述文件b.通过lex

3、，flex工具解析成lex.yy.c文件c.使用cc或gcc编译lex.yy.c生成可执行程序再来看一个比较完整的Lex描述文件exsec.l：int linenum;“title”showtitle（）;linenum+;showtitle（）- Lex Example -n）;int main（）linenum=0;yylex（）; /*进行分析*/nLine Count: %dn,linenum）;return 0;int yywrap（）return 1;进行解析编译：rootlocalhost liweitestflex exsec.lrootlocalhost liweitestc

4、c -o parser lex.yy.crootlocalhost liweitest./parser - Lex Example -Line Count:这里就没有加-ll选项，但是可以编译通过。下面开始着重整理下Lex描述文件.l。2.Lex（Lexical Analyzar）描述文件的结构介绍Lex工具是一种词法分析程序生成器，它可以根据词法规则说明书的要求来生成单词识别程序，由该程序识别出输入文本中的各个单词。一般可以分为用户子程序部分。其中规则部分是必须的，定义和用户子程序部分是任选的。（1）定义部分定义部分起始于%符号，终止于%符号，其间可以是包括include语句、声明语句在内的

5、C语句。这部分跟普通C程序开头没什么区别。（2）规则部分规则部分起始于%符号，终止于符号，其间则是词法规则。词法规则由模式和动作两部分组成。模式部分可以由任意的正则表达式组成，动作部分是由C语言语句组成，这些语句用来对所匹配的模式进行相应处理。需要注意的是，lex将识别出来的单词存放在yytext字符数据中，因此该数组的内容就代表了所识别出来的单词的内容。类似yytext这些预定义的变量函数会随着后面内容展开一一介绍。动作部分如果有多行执行语句，也可以用括起来。title.A.规则部分的正则表达式规则部分是Lex描述文件中最为复杂的一部分，下面列出一些模式部分的正则表达式字符含义：A-Z, 0

6、-9, a-z构成模式部分的字符和数字。-指定范围。例如：a-z指从a到z之间的所有字符。转义元字符。用来覆盖字符在此表达式中定义的特殊意义，只取字符的本身。表示一个字符集合。匹配括号内的任意字符。如果第一个字符是那么它表示否定模式。例如: abC匹配a, b,和C的任何一个。表示否定。*匹配0个或者多个上述模式。+ 匹配1个或者多个上述模式。?匹配0个或1个上述模式。$作为模式的最后一个字符时匹配一行的结尾。表示一个模式可能出现的次数。例如: A1,3表示A可能出现1次或3次。a-z5表示长度为5的，由a-z组成的字符。此外，还可以表示预定义的变量。匹配任意字符，除了n。（）将一系列常

7、规表达式分组。如：Letter（Letter|Digit）*|表达式间的逻辑或。一些符号字符的字面含义。元字符具有。*相当于*。/向前匹配。如果在匹配的模式中的/后跟有后续表达式，只匹配模版中前面的部分。模式为ABC/D输入ABCD，时ABC会匹配ABC/D，而D会匹配相应的模式。输入ABCE的话，ABCE就不会去匹配ABC/D。B.规则部分的优先级规则部分具有优先级的概念，先举个简单的例子：printf（ONEn;AATWOnAAAATHREEn此时，如果输入内容：rootlocalhost liweitest# cat file1.txtAAAAAAA file1.txtTHREETWOO

8、NELex分析词法时，是逐个字符进行读取，自上而下进行规则匹配的，读取到第一个A字符时，遍历后发现三个规则皆匹配成功，Lex会继续分析下去，读至第五个字符时，发现AAAA只有一个规则可用，即按行为进行处理，以此类推。可见Lex会选择最长的字符匹配规则。如果将规则改为AAAAA./parser file1.txt输出结果为：再来一个特殊的例子：并输入title，Lex解析完后发现，仍然存在两个规则，这时Lex只会选择第一个规则，下面的则被忽略的。这里就体现了Lex的顺序优先级。把这个例子稍微改一下：Lex编译时会提示：warning, rule cannot be matched.这时处理tit

9、le字符时，匹配到第一个规则后，第二个规则就无效了。再把刚才第一个例子修改下，加深下印象！Cannot be executed!显示效果是一样的，最后一项规则肯定是会忽略掉的。C.规则部分的使用变量且看下面示例：int0-9+float0-9*.0-9+intfloat在%和%之间，加入了一些类似变量的东西，注意是没有;的，这表示int，float分别代指特定的含义，在两个%之间，可以通过intfloat进行直接引用，简化模式定义。（3）用户子程序部分最后一个%后面的内容是用户子程序部分，可以包含用C语言编写的子程序，而这些子程序可以用在前面的动作中，这样就可以达到简化编程的目的。这里需要注意

10、的是，当编译时不带-ll选项时，是必须加入main函数和yywrap（yywrap将下后面说明）。.进行Lex分析3.Lex（Lexical Analyzar）一些的内部变量和函数内部预定义变量：yytextchar *当前匹配的字符串yyleng当前匹配的字符串长度yyinFILE *lex当前的解析文件，默认为标准输出yyoutlex解析后的输出文件，默认为标准输入yylineno int当前的行数信息内部预定义宏：ECHO#define ECHO fwrite（yytext, yyleng, 1, yyout）也是未匹配字符的默认动作内部预定义的函数：int yylex（void）调用L

11、ex进行词法分析int yywrap（void）在文件（或输入）的末尾调用。如果函数的返回值是1，就停止解析。因此它可以用来解析多个文件。代码可以写在第三段，这样可以解析多个文件。方法是使用文件指针指向不同的文件，直到所有的文件都被解析。最后，yywrap（）可以返回1来表示解析的结束。lex和flex都是解析Lex文件的工具，用法相近，flex意为fast lexical analyzer generator。可以看成lex的升级版本。相关更多内容就需要参考flex的man手册。4.关于Lex的一些综述Lex其实就是词法分析器，通过配置文件*.l，依据正则表达式逐字符去顺序解析文件，并动

12、态更新内存的数据解析状态。Lex善长于模式匹配。四、实验内容1、进入ubuntu的终端，查看系统中有没有安装flex，若没有则安装。2、有下面是简单C语言的词法：1.关键字：else if int return void while所有的关键字都是保留字，并且必须是小写。2. 下面是专用符号：+ - * / = = != = ; , （） 3. 其他标记是ID 和NUM ，通过下列正则表达式定义：ID = letter letter*NUM = digit digit*letter = a|.|z|A|.|Zdigit = 0|.|9小写和大写字母是有区别的。要求：编写其对应的lex程序，然后编译，生成该简单C语言的词法分析器，然后用此词法分析器分析简单C语言的程序段。

邮箱/手机：
温馨提示：	快捷下载时，用户名和密码都是您填写的邮箱或者手机号，方便查询和重复下载（系统自动生成）。如填写123，账号就是123，密码也是123。
特别说明：	请自助下载，系统不会自动发送文件的哦；如果您已付费，想二次下载，请登录后访问：我的下载记录
支付方式：
验证码：	换一换

账号：
密码：
验证码：	换一换
当日自动登录忘记密码？