Everything runs entirely locally in your browser on WebGPU — no data leaves your device.
The entire LLM runs entirely on your device. No data ever leaves your machine.