Tagged "webgpu-acceleration"
3 articles tagged webgpu-acceleration, 14 February 2026 to 1 September 2026. Newest first.
-
Running LLMs in the Browser: WebGPU and Local Inference
Guide to running language models directly in web browsers using WebGPU, enabling client-side inference without server dependencies or data transmission.
-
Liquid AI's LFM2-24B Achieves 50 Tokens/Second in Web Browser via WebGPU
Liquid AI has demonstrated their LFM2-24B mixture-of-experts model running at 50 tokens/second in a web browser on M4 Max hardware using WebGPU. The 8B variant achieves over 100 tokens/second, showcasing practical edge inference in browser environments.
-
GPT-OSS 20B Now Runs 100% Locally in Browser via WebGPU
GPT-OSS 20B can now run entirely in web browsers using WebGPU acceleration through Transformers.js v4 and ONNX Runtime Web, enabling client-side AI without server dependencies.