Hugging Face выпустил 200+ WebGPU-ядер для локального ИИ
Hugging Face представил @huggingface/kernels — коллекцию из более чем 200 WebGPU-ядер, предназначенных для выполнения AI-моделей локально в браузере. Библиотека использует возможности современного GPU через WebGPU API, что позволяет запускать инференс без отправки данных на сервер.
Ядра оптимизированы для популярных архитектур (трансформеры, свёрточные сети и др.) и поддерживают как inference, так и тонкую настройку. Разработчики могут подключать их через npm, получая готовые примитивы для ускорения вычислений.
Это важный шаг к демократизации AI: теперь сложные модели могут работать на пользовательских устройствах, снижая нагрузку на облака и повышая приватность. Hugging Face продолжает развивать экосистему локального ИИ, делая его доступным для веб-разработчиков.