Views
No views yet
1from mlc_llm import MLCEngine
2
3# Create engine
4engine = MLCEngine(
5 model="NiekWork/qwen25-logql-finetune-v1.2.0",
6 mode="local"
7)
8
9# Generate text
10response = engine.chat.completions.create(
11 messages=[
12
13 ]
14)
15
16print(response.choices[0].message.content)mlc_llm chat NiekWork/qwen25-logql-finetune-v1.2.0mlc-chat-config.json - MLC configurationndarray-cache.json - Weight metadataparams_shard_*.bin - Quantized model weightstokenizer.json - Tokenizertokenizer_config.json - Tokenizer configuration