KI im Browser
Echte Modelle, einmal geladen und auf deiner GPU ausgeführt (oder in WASM, wenn WebGPU fehlt). Nichts ist vorberechnet.
Semantische Suche
all-MiniLM-L6-v2 (23 MB) bettet ~200 Abschnitte öffentlicher Dudoxx-Dokumentation einmal ein und ordnet sie per Kosinus-Ähnlichkeit zu deiner Anfrage. Keine PHI, nichts vorindiziert.
Xenova/all-MiniLM-L6-v2
~23 MB
Modell noch nicht geladen.
Ausführen auftatsächlich: —
WASM ist absichtlich der Standard: ein 23-MB-Modell mit einem Durchlauf ist dispatch-gebunden, der WebGPU-Umweg kostet mehr als die Rechnung. Zum Vergleich auf WebGPU wechseln.