Brimkerndocs

Documentation

Toutes les briques du projet et comment s'en servir : le chat, le SDK embarquable, le convertisseur, les modèles publiés, le code source. Le menu latéral mène à la page de chaque sujet.

Ouvrir le chat
L'application : chargez un modèle et discutez, entièrement sur votre GPU.
SDK embarquable
Posez un assistant local sur votre site avec une balise script. Démo live incluse.
CLI WGSL Terminal
Exécutez des modèles de code sur votre GPU depuis votre terminal avec des pipes Unix.
Convertisseur GGUF → .brik
Ré-empaquetez un modèle pour le streaming, dans votre navigateur. Rien n'est envoyé.
Changelog
Ce qui a changé, version par version, avec les mesures derrière chaque affirmation.
Modèles publiés
Nos modèles .brik pré-quantifiés sur Hugging Face, prêts à streamer.
Code source
Tout le moteur sous licence MIT : kernels WGSL, format .brik, chargeurs, application.

Démarrer

Ouvrez l'application et cliquez sur l'unique bouton de l'accueil. Le modèle arrive en streaming une fois (149 Mo pour celui par défaut), est mis en cache sur votre appareil, et chaque visite suivante démarre en quelques secondes : hors-ligne compris. Rien n'est jamais envoyé : les poids descendent chez vous et le calcul se fait sur votre GPU.

Prérequis : un navigateur avec WebGPU (Chrome, Edge, ou Safari 18+). Un GPU dédié aide au-delà de 1 Md de paramètres, mais un portable fait tourner les petits modèles confortablement.

Pour aller plus loin : charger n'importe quel modèle Hugging Face, poser l’assistant sur votre propre site, ou utiliser la CLI dans votre terminal.

Stockage & hors-ligne

Les poids vivent dans le cache du navigateur, par site. C'est le navigateur qui décide de l'espace accordé : souvent des dizaines de gigaoctets sur un profil normal, mais ~1,5 Go seulement en navigation privée, où un gros modèle ne pourra pas rester en cache. Le navigateur de modèles vous avertit avant un téléchargement qui ne tiendra pas.

Les modèles inutilisés depuis 30 jours sont nettoyés automatiquement (réglable, ou désactivable, dans le panneau Stockage). Les conversations et les .brik convertis en local ne sont jamais touchés.

Brimkern : moteur WebGPU open, conçu par Romain Khanoyan. IA locale, WebGPU, moteurs on-device.