Aucun modèle chargéConfigurez la barre latérale
Pour les sitesConvertirChangelog

Brimkern · Inférence WebGPU locale

Version standalone optimisée exploitant des compute shaders WGSL écrits sur mesure. Vos modèles et calculs s'exécutent entièrement en local sans aucun serveur tiers.

Téléchargé une fois, gardé sur cet appareil : les prochaines visites démarrent en quelques secondes. 100 % local.
étape 1
Choisissez un modèle
Un clic suffit — les poids arrivent en streaming. Ou glissez-déposez votre propre GGUF (Qwen, Gemma, Llama…).
étape 2
Calculez sur le GPU
Le parser JS extrait les tenseurs et nos kernels WGSL effectuent le forward pass en direct.
SDK
Intégrez-le à votre site
Une balise <script> donne à n'importe quelle page un assistant IA local, gratuit et privé. →
Brimkern s'exécute de manière isolée sans transférer vos données à l'extérieur.