小C语言--词法分析程序
Problem Description
小C语言文法
1. <程序>→(){<声明序列><语句序列>}
2. <声明序列>→<声明序列><声明语句>|<声明语句>|<空>
3. <声明语句>→<标识符表>;
4. <标识符表>→<标识符>,<标识符表>|<标识符>
5. <语句序列>→<语句序列><语句>|<语句>
6. <语句>→< if语句>|< while语句>|< for语句>|<复合语句>|<赋值语句>
7. < if语句>→< if关键字>(<表达式>)<复合语句>|(<表达式>)<复合语句>< else关键字><复合语句>
8. < while语句>→< while关键字>(<表达式>)<复合语句>
9. < for语句>→< for关键字>(<表达式>;<表达式>;<表达式>)<复合语句>
10. <复合语句>→{<语句序列>}
11. <赋值语句>→<表达式>;
12. <表达式>→<标识符>=<算数表达式>|<布尔表达式>
13. <布尔表达式>→<算数表达式> |<算数表达式><关系运算符><算数表达式>
14. <关系运算符>→>|<|>=|<=|==|!=
15. <算数表达式>→<算数表达式>+<项>|<算数表达式>-<项>|<项>
16. <项>→<项>*<因子>|<项>/<因子>|<因子>
17. <因子>→<标识符>|<无符号整数>|(<算数表达式>)
18. <标识符>→<字母>|<标识符><字母>|<标识符><数字>
19. <无符号整数>→<数字>|<无符号整数><数字>
20. <字母>→a|b|…|z|A|B|…|Z
21. <数字>→0|1|2|3|4|5|6|7|8|9
22. < main关键字>→main
23. < if关键字>→if
24. < else关键字>→else
25. < for关键字>→for
26. < while关键字>→while
27. < int关键字>→int
小C语言文法如上,现在我们对小C语言写的一个源程序进行词法分析,分析出关键字、自定义标识符、整数、界符
和运算符。
关键字:main if else for while int
自定义标识符:除关键字外的标识符
整数:无符号整数
界符:{ } ( ) , ;
运算符:= + - * / < <= > >= == !=
Input
输入一个小C语言源程序,源程序长度不超过2000个字符,保证输入合法。
Output
按照源程序中单词出现顺序输出,输出二元组形式的单词串。
(单词种类,单词值)
单词一共5个种类:
关键字:用keyword表示
自定义标识符:用identifier表示
整数:用integer表示
界符:用boundary表示
运算符:用operator表示
每种单词值用该单词的符号串表示。
Example Input
main()
{
int a, b;
if(a == 10)
{
a = b;
}
}
Example Output
(keyword,main)
(boundary,()
(boundary,))
(boundary,{)
(keyword,int)
(identifier,a)
(boundary,,)
(identifier,b)
(boundary,;)
(keyword,if)
(boundary,()
(identifier,a)
(operator,==)
(integer,10)
(boundary,))
(boundary,{)
(identifier,a)
(operator,=)
(identifier,b)
(boundary,;)
(boundary,})
(boundary,})
#include<bits/stdc++.h>
using namespace std;
string a[10]= {"keyword","identifier","integer","boundary","operator"};
char key[10][10]={"main","int","if","else","for","while"};
char s[2010];
int main()
{
while(gets(s)!=NULL)
{
int l=strlen(s);
char *p=s;
while(l>0)
{
if(*p>='0'&&*p<='9')
{
cout<<"("<<a[2]<<",";
while(*p>='0'&&*p<='9')
{
cout<<*p;
p++;
l--;
}
cout<<")"<<endl;
}
else if(*p==' '||*p=='\n'||*p=='\t')
{
p++;
l--;
}
else if(*p=='+'||*p=='-'||*p=='*'||*p=='/'||*p=='='||*p=='<'||*p=='>'||*p=='!')
{
cout<<"("<<a[4]<<","<<*p;
l--;
p++;
char p1=*p;
if(p1=='=')
{
cout<<"="<<")"<<endl;
p++;
l--;
}
else cout<<")"<<endl;
}
else if(*p=='('||*p==')'||*p=='{'||*p=='}'||*p==','||*p==';')
{
cout<<"("<<a[3]<<","<<*p<<")"<<endl;
p++;
l--;
}
else if(*p<='z'&&*p>='A')
{
int flag=0;
char c[20];
int t=0;
while(l>0&&(*p>='0'&&*p<='9'||(*p>='A'&&*p<='z')))
{
c[t++]=*(p++);
l--;
}
c[t]='\0';
for(int j=0; j<6; j++)
{
if(strcmp(key[j],c)==0)
{
flag=1;
break;
}
}
if(flag==1)
cout<<"("<<a[0]<<","<<c<<")"<<endl;
else
cout<<"("<<a[1]<<","<<c<<")"<<endl;
}
}
}
}
本文介绍了一种名为小C的语言的基本文法,并提供了一个词法分析程序来解析小C语言源代码。程序能够识别关键字、自定义标识符、整数、界符和运算符等元素。
1932

被折叠的 条评论
为什么被折叠?



