IA dans le navigateur

De vrais modèles, téléchargés une fois et exécutés sur votre GPU (ou en WASM sans WebGPU). Rien n'est précalculé.

Recherche sémantique

all-MiniLM-L6-v2 (23 Mo) vectorise une fois ~200 extraits de documentation publique Dudoxx, puis les classe par similarité cosinus avec votre requête. Aucune donnée patient, rien de pré-indexé.

Xenova/all-MiniLM-L6-v2
~23 Mo

Modèle pas encore chargé.

Exécuter surréel : —

WASM est le défaut, volontairement : un modèle de 23 Mo en une passe est limité par le dispatch, l'aller-retour WebGPU coûte plus que le calcul. Passez sur WebGPU pour comparer.