Version standalone optimisée exploitant des compute shaders WGSL écrits sur mesure. Vos modèles et calculs s'exécutent entièrement en local sans aucun serveur tiers.
étape 1
Insérez votre GGUF
Glissez-déposez n'importe quel modèle GGUF de petite taille (ex: Qwen 0.5B, Gemma 2 2B).
étape 2
Calculez sur le GPU
Le parser JS extrait les tenseurs et nos kernels WGSL effectuent le forward pass en direct.
Ou sélectionnez un modèle Hugging Face de test rapide :
Brimkern s'exécute de manière isolée sans transférer vos données à l'extérieur.