mirror of
https://github.com/ggerganov/llama.cpp.git
synced 2024-12-27 06:39:25 +01:00
92139b90af
* tests : add test-tokenizer-0.sh * unicode : add all unicode number ranges * starcoder : fix pre-tokenizer * tests : add test that fails with DeepSeek tokenizers * falcon : fix regex * unicode : regenerate unicode tables * refact : add tokenizer model * lint : fix * tests : disable failing tests ggml-ci * refact : add tests files ggml-ci * convert : print -> logging ggml-ci * lint : fix * unicode : digit -> number * phi-3 : update
44 lines
1.8 KiB
Plaintext
44 lines
1.8 KiB
Plaintext
728 577 24142 2607
|
|
39 26288 6554
|
|
|
|
209
|
|
50276
|
|
50275
|
|
186
|
|
187
|
|
535
|
|
2756
|
|
186 187
|
|
12092 1533
|
|
24387 1533
|
|
12092 3645
|
|
24387 3645
|
|
24387 3645 2
|
|
12092 13 1533 2
|
|
24387 13 1533 2
|
|
436 310 22692 101 236 15 14161
|
|
88 27244 818 16853 16392 20505 4989 11917
|
|
32520 11514 1068 8713 38177 13396 3415 9925 12559 10453 1389
|
|
18081 211 18081 116 18081 230 39936 222 18081 226 39936 213 18081 233 18081 117 18081 242 39936 212 18081 242 18081 97 18081 116 18081 216 18081 212 18081 238 18081 216 39936 212 18081 220
|
|
14931 237 211 313 6320 10 49042 116 325 224 14931 223 106 171 118 226 313 34263 802 13511 261 32147 456 10 3384 239 216 313 7483 802 80 8020 326 556 697 1211 10669 10
|
|
12092
|
|
24387
|
|
50276 12092
|
|
50275 12092
|
|
50274 12092
|
|
50274 12092 187 50274 12092
|
|
313
|
|
187 426
|
|
8 8685
|
|
12092 13 340 8 455 2 1359 403 368 49042 212 3736 15367 41197 13610 19934 41869 21275 1012 1047 18795 40120 20422 241
|
|
20
|
|
1610
|
|
20084
|
|
26409
|
|
1610 20084
|
|
26409 1610
|
|
26409 20084
|
|
26409 26409
|
|
26409 1610 20084
|
|
586 1744 33525 186 209 623 28910 187 50276 187 50275 187 50274 187 50273 187 14931 237 211 313 6320 10 49042 116 325 224 14931 223 106 171 118 226 313 34263 802 13511 261 32147 456 10 3384 239 216 22692 101 236 14931 101 236 495 5922 30057 495 20084 495 26409 30057 20084 495 26409 1610 495 26409 20084 495 15 20 495 537 20 495 1051 20 209 18081 211 18081 116 18081 230 39936 222 18081 226 39936 213 18081 233 18081 117 18081 242 39936 212 18081 242 18081 97 18081 116 18081 216 14931 235 212 3736 15367 41197 13610 19934 41869 21275 1012 1047 18795 40120 20422 241 16081 6877 12880 11514 1068 8713 38177 13396 3415 9925 12559 10453 1389 42011 35033 34842 11202 9739 9739 33021 18963 4672 25561 8220 309 1849 644 686 42618 344 434 627 13 686 1848 368 2119 32 686 46 417 2119 309 1833 1056 352 13 686 37 368 751 690 10331 32 844 8 31516 247 8 77 45
|