LHC88 commited on
Commit
f783202
·
verified ·
1 Parent(s): 964a2aa

Add missing tokenizer.json (fast tokenizer for TEI compatibility)

Browse files

The 0.6B model includes tokenizer.json but the 4B does not. This prevents HuggingFace Text Embeddings Inference (TEI) from loading the model, since TEI requires the fast tokenizer format.

Generated from the same Qwen3 tokenizer files (vocab.json + merges.txt) that are already in the repo. Identical to the tokenizer.json in pplx-embed-v1-0.6B.

Files changed (2) hide show
  1. .gitattributes +1 -0
  2. tokenizer.json +3 -0
.gitattributes CHANGED
@@ -42,3 +42,4 @@ onnx/model.onnx_data_4 filter=lfs diff=lfs merge=lfs -text
42
  onnx/model.onnx_data_5 filter=lfs diff=lfs merge=lfs -text
43
  onnx/model.onnx_data_6 filter=lfs diff=lfs merge=lfs -text
44
  onnx/model.onnx_data_7 filter=lfs diff=lfs merge=lfs -text
 
 
42
  onnx/model.onnx_data_5 filter=lfs diff=lfs merge=lfs -text
43
  onnx/model.onnx_data_6 filter=lfs diff=lfs merge=lfs -text
44
  onnx/model.onnx_data_7 filter=lfs diff=lfs merge=lfs -text
45
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c6fb5c5bbba5fa5f8332edfb6d8aa67bd7fb3d75365b1765f108201698eaebf5
3
+ size 11422837