Aucun modèle chargéConfigurez la barre latérale
DocumentationChangelog

Brimkern · Inférence WebGPU locale

Version standalone optimisée exploitant des compute shaders WGSL écrits sur mesure. Vos modèles et calculs s'exécutent entièrement en local sans aucun serveur tiers.

Téléchargé une fois, gardé sur cet appareil : les prochaines visites démarrent en quelques secondes. 100 % local.
étape 1
Choisissez un modèle
Un clic suffit — les poids arrivent en streaming. Ou glissez-déposez votre propre GGUF (Qwen, Gemma, Llama…).
étape 2
Calculez sur le GPU
Le parser JS extrait les tenseurs et nos kernels WGSL effectuent le forward pass en direct.
Testez n’importe quel modèle de Hugging Face
GGUF mono-fichier et .brik, directement depuis le Hub. Rien à régler : la meilleure quantification est choisie, et le tokenizer suit le fichier. Rien ne sort de votre navigateur.
Exemples :
SDK
Intégrez-le à votre site
Une balise <script> donne à n'importe quelle page un assistant IA local, gratuit et privé. →

Brimkern — moteur WebGPU open, conçu par Romain Khanoyan. IA locale, WebGPU, moteurs on-device.

Brimkern s'exécute de manière isolée sans transférer vos données à l'extérieur.