Aucun modèle chargéConfigurez la barre latérale
Brimkern · Inférence WebGPU locale
Version standalone optimisée exploitant des compute shaders WGSL écrits sur mesure. Vos modèles et calculs s'exécutent entièrement en local sans aucun serveur tiers.
Téléchargé une fois, gardé sur cet appareil : les prochaines visites démarrent en quelques secondes. 100 % local.
étape 1
Choisissez un modèle
Un clic suffit — les poids arrivent en streaming. Ou glissez-déposez votre propre GGUF (Qwen, Gemma, Llama…).
étape 2
Calculez sur le GPU
Le parser JS extrait les tenseurs et nos kernels WGSL effectuent le forward pass en direct.
Testez n’importe quel modèle de Hugging Face
GGUF mono-fichier et .brik, directement depuis le Hub. Rien à régler : la meilleure quantification est choisie, et le tokenizer suit le fichier. Rien ne sort de votre navigateur.
Exemples :
Brimkern — moteur WebGPU open, conçu par Romain Khanoyan. IA locale, WebGPU, moteurs on-device.
Brimkern s'exécute de manière isolée sans transférer vos données à l'extérieur.