【编译原理】语法分析:从顶向下、最左推导

简介: 【编译原理】语法分析:从顶向下、最左推导

从顶向下、最左推导的语法分析

文法:已知语言的文法,给定一个词素串,判定它是否符合文法,符合的话,得出语法分析树


基于自顶向下和最左推导的语法分析存在三个问题:


左递归

左公因子

选择哪个产生式进行推导

左递归

何为左递归问题?当我们对id1+id2+id3+id4进行推导,发现推导是从输入串的最右端开始逆向逐一来匹配:不切合实际


针对左递归,我们要采用新的文法来消除它,如下

因此id1+id2+id3+id4变成了

消除了左递归存在好处和坏处

好处:实现了对输入串从左至右逐一匹配

代价:多引入了一个非终结符,语法树变得复杂,效率

下面是通用处理文法表达,这样就消除了左递归


但是如果存在间接的左递归,则需要消除一个变量,如下

左公因子

左公因子问题是指某个非终结符,它有多个产生式,其产生式体的左端有公因子;导致在推导时,有多个产生式匹配,不知道选哪个才对


解决办法:把非公因式部分单独拿出来,新引入一个非终结符,来表达它


A→α β1 |α β2 |α β3| γ


转为


A→α A’ | γ

A’→β1 | β2 | β3


举例:

选择哪个产生式进行推导

前两步只是进行预处理,选择哪个产生式进行推导才是关键,一个产生式子,可能由多个分号相隔,不清楚推导的时候选哪个


对于非终结符A,它仅有两个产生式:A→α和A→β;选择其中的哪一个产生式进行推导?是问题的关键


FIRST(α)的含义是从α推导得到的串的第一个终结符的集合

FIRST(β)的含义是从α推导得到的串的第一个终结符的集合


如何FIRST(α)和FIRST(β)不相交(肯定不会相交,因为左公因子已经除掉了),则对当前输入符a


a∈FIRST(α) ,选A→α


a∈FIRST(β) , 选A→β


对于非终结符A,它仅有两个产生式:A→α和A→θ;选择其中的哪一个产生式进行推导?


FIRST(α)的含义是从α推导得到的串的第一个终结符的集合

FOLLOW(A)的含义跟在A之后的终结符的集合


如何FIRST(α)和FOLLOW(A)不相交(肯定不会相交,因为左公因子已经除掉了),则对当前输入符a


a∈FIRST(α) ,选A→α


a∈FOLLOW(A) , 选A→θ


FIRST()的求法

对非终结符号,由低到高排序,逐一扫描其产生式, 计算每一产生式的FIRST()

FOLLOW()求法

对非终结符,从起始非终结符S开始,由高到低依次排序

天然的已知:FOLLOW(S) 包含$ 这个终结符

规则:

举例:

因此综上,FIRST()存在的意义是选择哪一个产生式子(不含ε),FOLLOW()存在的意义存在ε的产生式,是非要选择它:

自顶向下的语法分析中,设当前输,入符为a,要推导的非终结符A:产生式A→α能被选用的条件为

a∈FIRST(α) OR (ε∈FIRST(α) ANDa∈FOLLOW(A))

如果FOLLOW()循环依赖,则另相互依赖的非终结符的FOLLOW()相等,并取它们的并集

我们计算FIRST()和FOLLOW()就是为了得到预测分析表,

预测分析表是从文法得出的,是元信息

表中的某个格子中,如果有不止一个产生式,那么该文法就不是LL(1)文法

预测表解决了产生式的选择问题

文法分析树的推导过程是一个压栈,弹栈的过程


最后:自顶向下、最左推导的语法分析LL(1)的流程?

  1. 1.对文法作消除左递归,提取左公因子处理
  2. 2.对每个产生式,计算FIRST()
  3. 3.对每个非终结符号,计算FOLLOW()
  4. 4.填写预测分析表
  5. 5.判断其是否是LL(1)文法
  6. 6.对输入串推导出语法分析树
相关文章
|
分布式计算 资源调度 Hadoop
十二、Spark的安装与部署详情(Local模式,Standalone模式,Spank on YARN模式)
十二、Spark的安装与部署详情(Local模式,Standalone模式,Spank on YARN模式)
1959 0
十二、Spark的安装与部署详情(Local模式,Standalone模式,Spank on YARN模式)
|
监控 供应链 Java
【PMO项目管理】深入了解项目管理 | Stakeholder 利益相关者 | 利益相关者之间的立场差异
【PMO项目管理】深入了解项目管理 | Stakeholder 利益相关者 | 利益相关者之间的立场差异
856 0
|
Java 关系型数据库 MySQL
Java项目实战(图书管理系统)
本项目为简易图书管理系统,实现图书增删改查、用户借阅归还及基础用户管理功能。采用Java语言,结合MySQL数据库与MVC架构,涵盖JDBC、Servlet、JSP等技术,适合初学者学习Java Web开发流程与项目结构设计。
605 2
编译原理----0型,1型,2型,3型文法
编译原理----0型,1型,2型,3型文法
910 1
|
数据库 数据安全/隐私保护
RBAC用户权限管理数据库设计
原文来自:http://minjiechenjava.iteye.com/blog/1759482 最近正在为下一项目版本设计权限管理的。看到了这篇文章,可以参考参考! RBAC(Role-Based Access Control,基于角色的访问控制),就是用户通过角色与权限进行关联。
8708 1
|
缓存 算法 内存技术
计算机组成原理(4)-----Cache的原理及相关知识点(2)
计算机组成原理(4)-----Cache的原理及相关知识点
894 1
|
缓存 NoSQL 算法
解决Redis缓存雪崩问题的有效方法
解决Redis缓存雪崩问题的有效方法
469 2
|
人工智能
【经验分享】如何快速转化笔记格式为标准的MarkDown格式并进行博客发布,提高生产力?
本文介绍如何将笔记转换为Markdown格式以快速发布博客。通过使用特定的Prompt和AI工具Claude 3 Sonnet,可以将Notepad++笔记转为适合CSDN博客的Markdown格式。转换要求包括:正确标记代码段、调整缩进和格式、使用Markdown标题、列表、链接和图片语法。Claude 3 Sonnet能有效处理格式转换,将转换后的Markdown内容复制到编辑器,即可便捷发布博客。
980 2
【经验分享】如何快速转化笔记格式为标准的MarkDown格式并进行博客发布,提高生产力?
|
消息中间件 缓存 Kafka
为什么微服务架构需要聚合
为什么微服务架构需要聚合
290 3
|
数据采集 机器学习/深度学习 算法
【计算机二级Python】模拟试卷第4套选择题
第四套计算机二级Python考试的模拟选择题,包含40道题目,内容涉及需求分析、数据流图、黑盒测试、E-R图、二叉树、算法复杂度、Python文件后缀、浮点数精度、保留字、字符编码、循环结构、第三方库、列表操作、文件读写、CSV文件、turtle图形库、网络爬虫、数据分析、机器学习、字符串操作、类型转换、随机数、列表推导、字典、字符串格式化等方面,旨在帮助考生复习和准备考试。
617 4