Views
No views yet




1uv venv hichunk --python 3.12
2source hichunk/bin/activate
3uv pip install torch==2.7.0 vllm==0.9.1 transformers==4.53.0 liger_kernel
4uv pip install nltk
5python -c "import nltk; nltk.download('punkt_tab')"1import os
2os.environ['OPENAI_BASE_URL'] = "http://{serve_ip}:{serve_port}"
3from HiChunk import HiChunkInferenceEngine, PROMPT
4
5engine = HiChunkInferenceEngine(window_size=16*1024, line_max_len=100, max_level=10, prompt=PROMPT)
6document_text = open('doc.txt', 'r').read()
7chunked_document, chunks = engine.inference(document_text, recurrent_type=2)
8print(chunked_document)

@misc{hi-chunk-2025,
title={HiChunk: Evaluating and Enhancing Retrieval-Augmented Generation with Hierarchical Chunking},
author={Tencent Youtu Lab},
year={2025},
publisher = {GitHub},
journal = {GitHub repository},
howpublished = {\url{https://github.com/TencentYoutuResearch/HiChunk.git}},
}