(再声明一下,为了简单暴力的讲解AST的转换过程,这里的编译内容以"'Hello' + ' World'"做为案例)
上一篇基本上花了一整篇讲完了scanner的Init方法,接下来就是Scan了,Init的方法基本上都是在Stream类下操做,可是本节回到了scanner层级。
void Scanner::Scan() { Scan(next_); }
void Scanner::Scan(TokenDesc* next_desc) {
next_desc->token = ScanSingleToken();
next_desc->location.end_pos = source_pos();
}复制代码
虽然这里只有简简单单的两步(砍掉了全部的CHECK和DEBUG内容),但这个ScanSingleToken已经够讲了。从字面意思理解,就是对单个词法的解析,源码以下。
V8_INLINE Token::Value Scanner::ScanSingleToken() {
Token::Value token;
do {
next().location.beg_pos = source_pos();
if (V8_LIKELY(static_cast<unsigned>(c0_) <= kMaxAscii)) {
token = one_char_tokens[c0_];
switch (token) {
case Token::LPAREN:
case Token::RPAREN:
return Select(token);
case Token::STRING:
return ScanString();
default:
UNREACHABLE();
}
}
} while (token == Token::WHITESPACE);
return token;
}复制代码
做为一个词法解析方法,长度其实仍是能够接受的,已经删掉了大部分的case判断,因为本系列专一于"'Hello' + ' World'"的编译,因此留下了STRING类型。
讲两个点,第一个是那个source_pos,位置的属性和方法是真的多,比较简单,看看就好了。
static const int kCharacterLookaheadBufferSize = 1;
int source_pos() {
return static_cast<int>(source_->pos()) - kCharacterLookaheadBufferSize;
}复制代码
而后那个mapping数组能够稍微给一下出处,源码以下。
#define INT_0_TO_127_LIST(V) \ V(0) V(1) V(2) V(3) V(4) V(5) V(6) V(7) V(8) V(9) \
V(120) V(121) V(122) V(123) V(124) V(125) V(126) V(127)
static const constexpr Token::Value one_char_tokens[128] = {
#define CALL_GET_SCAN_FLAGS(N) GetOneCharToken(N),
INT_0_TO_127_LIST(CALL_GET_SCAN_FLAGS)
#undef CALL_GET_SCAN_FLAGS
};
constexpr Token::Value GetOneCharToken(char c) {
return
c == '(' ? Token::LPAREN :
c == ')' ? Token::RPAREN :
IsDecimalDigit(c) ? Token::NUMBER :
IsAsciiIdentifier(c) ? Token::IDENTIFIER :
Token::ILLEGAL;
}复制代码
以前说过,c0_表明的是当前解析字符的Unicode编码,因而这里直接经过数组索引查找其对应的类型,按照例子中,咱们的字符是一个单引号,而单引号的类型以下。
c == '"' ? Token::STRING :
c == '\'' ? Token::STRING :
c == '`' ? Token::TEMPLATE_SPAN :复制代码
因此,当前token被赋值为Token::STRING,所以,case分支进入ScanString的方法。这个方法内容比较多,下一篇讲吧,午休时间。