-record(word_piece_tokenizer, { vocab :: gleam@dict:dict(binary(), integer()), inverse_vocab :: gleam@dict:dict(integer(), binary()), unk_id :: integer(), cls_id :: integer(), sep_id :: integer(), pad_id :: integer(), max_input_chars_per_word :: integer() }).