Modèles & format .brik
Ce que le moteur charge et comment : les GGUF mono-fichier directement depuis Hugging Face, les liens de test partageables, et le format streamé .brik avec son convertisseur intégré.
N'importe quel modèle Hugging Face
Brimkern lit directement les GGUF mono-fichier — le format que le Hub héberge déjà, sans étape de conversion ni de compilation. Collez n'importe laquelle de ces formes dans le champ de l'accueil (ou du navigateur de modèles) :
Qwen/Qwen3-0.6B-GGUF https://huggingface.co/Qwen/Qwen3-0.6B-GGUF https://huggingface.co/Qwen/Qwen3-0.6B-GGUF/blob/main/Qwen3-0.6B-Q8_0.gguf https://example.com/my-model.gguf
La meilleure quantification est choisie pour vous (Q4_K_M d'abord, puis Q4_K_S, Q5, Q8…), et le tokenizer suit le fichier — rien à régler. Les GGUF shardés (-00001-of-0000N) et les projecteurs vision (mmproj) sont refusés avec un message explicite plutôt que chargés à moitié.
Liens de test instantané
N'importe quel modèle peut devenir un lien qui le charge directement — pratique pour partager une démo, joindre un rapport de bug, ou renvoyer un collègue vers une quantification précise.
https://brimkern.com/chat?model=Qwen/Qwen3-0.6B-GGUF https://brimkern.com/chat?model=Qwen/Qwen3-0.6B-GGUF&file=Qwen3-0.6B-Q8_0.gguf https://brimkern.com/chat?gguf=https://example.com/model.gguf https://brimkern.com/chat?brik=https://example.com/model.brik
?model= interroge l'API du Hub et choisit le meilleur fichier chargeable (un .brik gagne sur un GGUF). ?file= force une quantification précise. ?gguf= et ?brik= prennent une URL directe, pour les modèles que vous hébergez vous-même.
Le format .brik & le convertisseur
Un .brik est un GGUF ré-empaqueté pour le navigateur : poids déjà quantifiés en int4/int8, disposés pour qu'une couche soit une seule plage HTTP contiguë, tokenizer embarqué. Effet concret : le modèle se charge par plages (reprise possible, partiellement, vraiment hors-ligne ensuite) au lieu d'un téléchargement de plusieurs gigaoctets.
Vous pouvez convertir un GGUF vous-même, dans le navigateur — le fichier ne quitte jamais votre machine : ouvrir le convertisseur.
Brimkern — moteur WebGPU open, conçu par Romain Khanoyan. IA locale, WebGPU, moteurs on-device.