因为老师要求，近期在做oceanbase存储过程的实现，在oceanbase 0.4曾经是不支持存储过程的。实现的主要步骤主要包含

1、语法解析

2、词法解析

3、详细运行语法树的步骤

如今先来说说语法解析吧，在这一块主要是使用的flex（词法分析器生成工具）和bison(语法分析器生成器) 这两个是对用户输入的存储过程语句进行解析的

来详细说说该怎么实现对sql语句的分析吧

1、首先建立一个lex的文件

%option noyywrap nodefault yylineno case-insensitive

%{

#include "prosql.tab.hpp"

#include <stdarg.h>

#include <string.h>

#include <stdlib.h>

#include <stdio.h>

#include <malloc.h>

//YYSTYPE yylval;

int oldstate;

extern "C" int yylex();

//extern "C" int yyparse();

extern "C" void yyerror(const char *s, ...);

extern char globalInputText[10000];

extern int readInputForLexer( char *buffer, int *numBytesRead, int maxBytesToRead );

#undef YY_INPUT

#define YY_INPUT(b,r,s) readInputForLexer(b,&r,s)

%}

%x COMMENT

%%

CREATE		{ return CREATE; }

PROCEDURE	{ return PROCEDURE; }

SQL		{ return SQL; }

DECLARE		{ return DECLARE; }

SET		{ return SET; }

BEGIN		{ return BEGINT; }

END		{ return END; }

INT		{ return INT; }

VARCHAR		{ return VARCHAR; }

DATE		{ return DATE; }

TIME		{ return TIME; }

DOUBLE		{ return DOUBLE; }

IF		{ return IF; }

THEN		{ return THEN; }

ELSE		{ return ELSE; }

ENDIF		{ return ENDIF; }

FOR		{ return FOR; }

WHEN		{ return WHEN; }

WHILE		{ return WHILE; }

[0-9]+	{ yylval.strval = strdup(yytext);/*printf("number=%s\n",yylval.strval);*/ return INTNUM; }/*number*/

[0-9]+"."[0-9]* |

"."[0-9]+	|

[0-9]+E[-+]?[0-9]+	|

[0-9]+"."[0-9]*E[-+]?[0-9]+ |

"."[0-9]*E[-+]?[0-9]+	{ yylval.strval = strdup(yytext);/*printf("float=%s\n",yylval.strval);*/ return APPROXNUM; }/*double*/

TRUE	{ yylval.strval = "1";/*printf("bool=%s\n",yylval.strval);*/ return BOOL; }/*bool*/

FALSE	{ yylval.strval = "0";/*printf("bool=%s\n",yylval.strval);*/ return BOOL; }/*bool*/

'(\\.|''|[^'\n])*'	|

\"(\\.|\"\"|[^"\n])*\"  {

				char *temp = strdup(yytext);

				yylval.strval = strdup(yytext);

				//GetCorrectString(yylval.strval, temp);

				/*printf("string=%s\n",yylval.strval);*/

				return STRING;

			}/*string*/

'(\\.|[^'\n])*$		{ yyerror("Unterminated string %s", yytext); }

\"(\\.|[^"\n])*$		{ yyerror("Unterminated string %s", yytext); }

X'[0-9A-F]+' |

0X[0-9A-F]+  	{ yylval.strval = strdup(yytext); return STRING; }

0B[01]+      |

B'[01]+'     { yylval.strval = strdup(yytext); return STRING; }

[-+&~|^/%*(),.;!]   { return yytext[0]; }

"&&"	{ return ANDOP; }

"||"	{ return OR; }

"<"	{ yylval.subtok = 1; return COMPARISON; }

">"	{ yylval.subtok = 2; return COMPARISON; }

"!="	|

"<>"	{ yylval.subtok = 3; return COMPARISON; }

"="	{ yylval.subtok = 4; return COMPARISON; }

"<="	{ yylval.subtok = 5; return COMPARISON; }

">="	{ yylval.subtok = 6; return COMPARISON; }

"<=>"	{ yylval.subtok = 12; return COMPARISON; }

"<<"	{ yylval.subtok = 1; return SHIFT; }

">>"	{ yylval.subtok = 2; return SHIFT; }

[A-Za-z][A-Za-z0-9_]*	{ yylval.strval = strdup(yytext);

			  /*printf("name 1=%s\n",yylval.strval);*/

                          return NAME; }

`[^`/\\.\n]+`           { yylval.strval = strdup(yytext+1);

			  /*printf("name 2=%s\n",yylval.strval);*/

                          yylval.strval[yyleng-2] = 0;

                          return NAME; }

`[^`\n]*$               { yyerror("unterminated quoted name %s", yytext); }

@[0-9a-z_.$]+ |

@\"[^"\n]+\" |

@`[^`\n]+` |

@'[^'\n]+' { yylval.strval = strdup(yytext+1);  return USERVAR; }

@\"[^"\n]*$ { yyerror("unterminated quoted user variable %s", yytext); }

@`[^`\n]*$ { yyerror("unterminated quoted user variable %s", yytext); }

@'[^'\n]*$ { yyerror("unterminated quoted user variable %s", yytext); }

":="     { return ASSIGN; }

#.*		;

"--"[ \t].*	;

"/*"            { oldstate = YY_START; BEGIN COMMENT; }

<COMMENT>"*/"   { BEGIN oldstate; }

<COMMENT>.|\n   ;

<COMMENT><<EOF>> { yyerror("unclosed comment"); }

[ \t\n]         /* white space */

.               { yyerror("mystery character '%c'", *yytext); }

%%

这一部分呢就是对每一个我们自己定义的满足正则的识别

接下来是对词的语法识别

%{

#include <stdlib.h>

#include <stdarg.h>

#include <string.h>

#include <stdio.h>

#include <malloc.h>

char * parsetreeroot=NULL;

extern "C" int yylex();

extern "C" int yyparse();

extern "C" void yyerror(const char *s, ...);

char globalInputText[10000];

int globalReadOffset;

int readInputForLexer( char *buffer, int *numBytesRead, int maxBytesToRead );

char * mystrcat(char *s1,char *s2)

{

	char *p1=(char *)malloc(strlen(s1)+strlen(s2)+1);

	strcpy(p1,s1);

	strcat(p1,s2);

	return p1;

}

%}

%locations

%union {

	int intval;

	double floatval;

	char *strval;

	int subtok;

}

%token <strval> NAME

%token <strval> STRING

%token <strval> INTNUM

%token <strval> BOOL

%token <strval> APPROXNUM

%token <strval> USERVAR

%type <strval> stmt_root  create_stmt para_list definition  data_type pro_block pro_parameters declare_list set_list

%type <strval> assign_var  pro_body pro_stmt_list sql_stmt expr

%right ASSIGN

%left OR

%left XOR

%left ANDOP

%left NOT '!'

%left BETWEEN

%left <subtok> COMPARISON /* = <> < > <= >= <=> */

%left '|'

%left '&'

%left <subtok> SHIFT /* << >> */

%left '+' '-'

%left '*' '/' '%' MOD

%left '^'

%token CREATE

%token PROCEDURE

%token PRONAME

%token DECLARE

%token SET

%token BEGINT

%token END

%token SQL

%token INT

%token VARCHAR

%token DATE

%token TIME

%token DOUBLE

%token IF

%token NOT

%token EXISTS

%token THEN

%token ELSE

%token ENDIF

%token FOR

%token WHEN

%token WHILE

%start stmt_root

%%

stmt_root: create_stmt pro_block { $$=mystrcat($1,$2); parsetreeroot=$$;}

;

create_stmt: CREATE PROCEDURE  NAME '(' para_list ')'

		{

			char *temp=mystrcat("create procedure ",$3);

			temp=mystrcat(temp,"(");

			temp=mystrcat(temp,$5);

			$$=mystrcat(temp,")(create)\n");

		}

;

/*

opt_if_not_exists:	      { $$ = 0; }

   | IF NOT EXISTS            { $$ = 1; }

   ;

*/

para_list: definition { $$=$1; }

|definition ',' para_list

		{	

			char *temp=mystrcat($1,",");

			$$=mystrcat(temp,$3);

		}

;

definition: USERVAR data_type

		{	

			char *temp=mystrcat($1," ");

			$$=mystrcat(temp,$2);

		}

;

data_type:

   DATE 					{$$="date"; }

   | TIME					{$$="time"; }

   | VARCHAR '(' INTNUM ')' 			{$$="varchar"; }

   | INT 					{$$="int"; }

   | DOUBLE 					{$$="double"; }

   ;

pro_block: BEGINT pro_parameters pro_body END

		{

			char *temp=mystrcat("begin\n",$2);

			temp=mystrcat(temp,"");

			temp=mystrcat(temp,$3);

			$$=mystrcat(temp,"end");

			//printf("pro_body %s\n",$3);

		}

;

pro_parameters: declare_list ';' { $$=mystrcat($1,";(declare)\n");}

|pro_parameters  declare_list ';'

		{

			char *temp=mystrcat($1,$2);

			$$=mystrcat(temp,";(declare)\n");

		}

|pro_parameters  set_list ';'

		{

	 		char *temp=mystrcat($1,$2);

			$$=mystrcat(temp,";(set)\n");

		}

;

declare_list:

|DECLARE definition

		{

			$$=mystrcat("declare ",$2);

		}

|declare_list ',' definition

		{

			char *temp=mystrcat($1,",");

			$$=mystrcat(temp,$3);

		}

;

set_list:

|SET assign_var

		{

			$$=mystrcat("set ",$2);

		}

| set_list ',' assign_var

		{

			char *temp=mystrcat($1,",");

			$$=mystrcat(temp,$3);

		}

;

assign_var : USERVAR COMPARISON expr

		{

			char *temp=mystrcat($1,"=");

			$$=mystrcat(temp,$3);

		}

;

expr: NAME         { $$=$1;}

   | STRING        { $$=$1;}

   | INTNUM        { $$=$1;}

   | APPROXNUM 	   { $$=$1;}

   | BOOL          { $$=$1;}

   ;

pro_body :  pro_stmt_list { $$=$1; }

;

pro_stmt_list: sql_stmt {$$=$1; }

|pro_stmt_list  sql_stmt

		{

			$$=mystrcat($1,$2);

		}

;

sql_stmt:

|SQL NAME ';' { $$=mystrcat($2,";(sql)\n");}

;

%%

/*

int main(int argc, char* argv[])

{

	yyparse();

}*/

int readInputForLexer( char *buffer, int *numBytesRead, int maxBytesToRead ) {

	int numBytesToRead = maxBytesToRead;

	int bytesRemaining = strlen(globalInputText)-globalReadOffset;

	int i;

	if ( numBytesToRead > bytesRemaining ) { numBytesToRead = bytesRemaining; }

	for ( i = 0; i < numBytesToRead; i++ ) {

		buffer[i] = globalInputText[globalReadOffset+i];

	}

	*numBytesRead = numBytesToRead;

	globalReadOffset += numBytesToRead;

	return 0;

}

void yyerror(const char *s, ...)

{

    fprintf(stderr, "error: %s\n", s);

}

void zzerror(const char *s, ...)

{

	extern int  yylineno;

	va_list ap;

	va_start(ap, s);

	fprintf(stderr, "%d: error: ", yylineno);

	vfprintf(stderr, s, ap);

	fprintf(stderr, "\n");

}

int yywrap(void)

{

    return 1;

}

char* getsql()

{

	return parsetreeroot;

}

这部分就是对上一个识别出来的词进行顺序上的确定，构成一个完整的语法

这些须要在linux环境下进行调试

bison -d 文件名称

flex 文件名称

使用flex和bison实现的sql引擎解析的更多相关文章

flex and bison学习笔记01
工作需要,学习一下Flex and bison,以前在编译原理的课上听老师说过他们的前辈,lex and yacc.Flex and bison就是lex and yacc的升级版. 参考书:flex ...
flex与bison
flex与bison 中文版目录: 第一章:flex和bison简介第二章:使用flex 第三章:使用bison 第四章:分析sql 第五章:flex规范参考第六章:bison规范参考第七章: ...
flex 和bison的安装和使用
1.在ubutu上安装 yacc的命令: sudo apt-get install flex bison flex:词法分析器 flex是一个词法分析器.用来将一个.l文件生成一个.c程序文件.即生成 ...
PostgreSQL内核学习笔记四（SQL引擎）
PostgreSQL实现了SQL Standard2011的大部分内容,SQL处理是数据库中非常复杂的一部分内容. 本文简要介绍了SQL处理的相关内容. 简要介绍 SQL文的处理分为以下几个部分: P ...
Kafka - SQL 引擎分享
1.概述大多数情况下,我们使用 Kafka 只是作为消息处理.在有些情况下,我们需要多次读取 Kafka 集群中的数据.当然,我们可以通过调用 Kafka 的 API 来完成,但是针对不同的业务需求 ...
Kafka - SQL 引擎
Kafka - SQL 引擎分享 1.概述大多数情况下,我们使用 Kafka 只是作为消息处理.在有些情况下,我们需要多次读取 Kafka 集群中的数据.当然,我们可以通过调用 Kafka 的 AP ...
在windows下安装flex和bison
学习Stellar-core 需要依赖项flex .bison .gcc三个依赖项下载得网址:链接: https://pan.baidu.com/s/1mitCLcs 密码: 3jaj 通过 w ...
DRDS分布式SQL引擎—执行计划介绍
摘要: 本文着重介绍 DRDS 执行计划中各个操作符的含义,以便用户通过查询计划了解 SQL 执行流程,从而有针对性的调优 SQL. DRDS分布式SQL引擎 — 执行计划介绍前言数据库系统中,执 ...
六大主流开源SQL引擎
导读本文涵盖了6个开源领导者:Hive.Impala.Spark SQL.Drill.HAWQ 以及Presto,还加上Calcite.Kylin.Phoenix.Tajo 和Trafodion.以 ...

随机推荐

一切从编辑器说起：web前端代码编辑器
俗话说:工欲善其事,必先利其器. 工欲善其事必先利其器.谓工匠想要使他的工作做好,一定要先让工具锋利.比喻要做好一件事,准备工作非常重要. 前端写代码也是一样,需要一个好的适合自己的代码编辑器. 我想 ...
【转】tomcat 访问软连接文件夹下的网页出现404错误，description The requested resource (/xxx.html) is not available.
在 tomcat/webapps/ROOT/ 下建立一个软连接文件ln -s /home/ubuntu/report report 再到report软连接目录里建立个 report.html通过浏 ...
一个可以跑的Hadoop的WordCount程序
搭个新环境时总要折腾一下,于是干脆记下来. 程序: package com.my; import java.io.IOException; import java.util.Iterator; imp ...
概率统计（DP）
问题叙述性说明生成n个月∈[a,b]随机整数.并且将它们输出到x概率. 输入格式输入线跟四个整数n.a,b,x,用空格分隔. 输出格式输出一行包括一个小数位和为x的概率.小数点后保留四位小数例 ...
第22题 Rotate List
Given a list, rotate the list to the right by k places, where k is non-negative. For example: Given ...
Path和ClassPath差异
1.Path角色 Path它用于指定Java路径的命令,当我们想编译Java当需要使用的程序javac.exe并运行.class当文件需要使用java.exe,此时Path设置的路径就发生作用了.由于 ...
Nginx模块开发入门（转）
前言 Nginx是当前最流行的HTTP Server之一,根据W3Techs的统计,目前世界排名(根据Alexa)前100万的网站中,Nginx的占有率为6.8%.与Apache相比,Nginx在高并 ...
strchr,wcschr 及strrchr, wcsrchr,_tcschr,_tcsrchr函数
strchr,wcschr 及strrchr, wcsrchr,_tcschr,_tcsrchr函数 (1) char *strchr( const char *string, int ...
boxfilter 实现
A implementation of boxfilter boxfilter 是均值滤波的一种改进.在以下这篇blog里面有介绍. http://www.cnblogs.com/easymind22 ...
关于接收POST请求 $GLOBALS['HTTP_RAW_POST_DATA']
总是产生变量包含有原始的 POST 数据.否则,此变量仅在碰到未识别 MIME 类型的数据时产生.不过,访问原始 POST 数据的更好方法是 php://input.$HTTP_RAW_POST_DA ...

使用flex和bison实现的sql引擎解析

1、语法解析

2、词法解析

3、详细运行语法树的步骤

使用flex和bison实现的sql引擎解析的更多相关文章

随机推荐

热门专题