#ifndef TOOLS_GN_TOKENIZER_H_
#define TOOLS_GN_TOKENIZER_H_
#include <stddef.h>
#include <string_view>
#include <vector>
#include "gn/err.h"
#include "gn/token.h"
class InputFile;
enum class WhitespaceTransform {
kMaintainOriginalInput,
kInvalidToSpace,
};
class Tokenizer {
public:
static std::vector<Token> Tokenize(
const InputFile* input_file,
Err* err,
WhitespaceTransform whitespace_transform =
WhitespaceTransform::kMaintainOriginalInput);
static size_t ByteOffsetOfNthLine(std::string_view buf, int n);
static bool IsNewline(std::string_view buffer, size_t offset);
static bool IsIdentifierFirstChar(char c);
static bool IsIdentifierContinuingChar(char c);
static Token::Type ClassifyToken(char next_char, char following_char);
private:
Tokenizer(const InputFile* input_file,
Err* err,
WhitespaceTransform whitespace_transform);
~Tokenizer();
std::vector<Token> Run();
void AdvanceToNextToken();
Token::Type ClassifyCurrent() const;
void AdvanceToEndOfToken(const Location& location, Token::Type type);
bool AtStartOfLine(size_t location) const;
bool IsCurrentWhitespace() const;
bool IsCurrentNewline() const;
bool IsCurrentStringTerminator(char quote_char) const;
bool CanIncrement() const { return cur_ < input_.size() - 1; }
void Advance();
Location GetCurrentLocation() const;
Err GetErrorForInvalidToken(const Location& location) const;
bool done() const { return at_end() || has_error(); }
bool at_end() const { return cur_ == input_.size(); }
char cur_char() const { return input_[cur_]; }
bool has_error() const { return err_->has_error(); }
std::vector<Token> tokens_;
const InputFile* input_file_;
const std::string_view input_;
Err* err_;
WhitespaceTransform whitespace_transform_;
size_t cur_ = 0;
int line_number_ = 1;
int column_number_ = 1;
Tokenizer(const Tokenizer&) = delete;
Tokenizer& operator=(const Tokenizer&) = delete;
};
#endif