<|fim_prefix|>code before
some more code before<|fim_suffix|>code after
some more code after<|fim_middle|>
This is pretty standard format also used in other models like qwen or deepseek. Be sure to cofigure inference server to stop when <|eos|> token is generated.