Run embedding models locally on Alpine Linux in Docker using Node.js — zero Python, zero glibc, pure WASM inference.
What is this?
A lightweight REST API that generates text embeddings using transformer models. Runs entirely in a ~100MB Docker container on Alpine Linux with no native dependencies.
Feature
Detail
Runtime
Node.js 20 on Alpine Linux
Inference
ONNX Runtime (WASM backend) via @xenova/transformers
1# Use a different model2docker run -p 3000:3000 -e MODEL=Xenova/all-MiniLM-L6-v2 embeddings
34# Different port5docker run -p 8080:8080 -e PORT=8080 embeddings