Views
No views yet
1from mlc_llm import MLCEngine
2
3# Create engine
4engine = MLCEngine(
5 model="NiekWork/gemma-3-12b-logql-finetune",
6 mode="local"
7)
8
9# Generate text
10response = engine.chat.completions.create(
11 messages=[
12
13 ]
14)
15
16print(response.choices[0].message.content)mlc_llm chat NiekWork/gemma-3-12b-logql-finetunemlc-chat-config.json - MLC configurationndarray-cache.json - Weight metadataparams_shard_*.bin - Quantized model weightstokenizer.json - Tokenizertokenizer_config.json - Tokenizer configuration