llama_vocab::impl::load() when loading GGUF with mismatched scores/token array sizes. 100 tokens but 1 score entry → 396-byte heap overread.1git clone https://github.com/ggml-org/llama.cpp && cd llama.cpp
2mkdir build && cd build
3cmake .. -DCMAKE_BUILD_TYPE=Debug \
4 -DCMAKE_C_FLAGS="-fsanitize=address -fno-omit-frame-pointer" \
5 -DCMAKE_CXX_FLAGS="-fsanitize=address -fno-omit-frame-pointer"
6cmake --build . --target llama-tokenize -j$(nproc)
7./bin/llama-tokenize -m ../poc_vocab_scores_oob.gguf -p "hello"heap-buffer-overflow READ at llama-vocab.cpp:2145