KI im Browser

Echte Modelle, einmal geladen und auf deiner GPU ausgeführt (oder in WASM, wenn WebGPU fehlt). Nichts ist vorberechnet.

Semantische Suche

all-MiniLM-L6-v2 (23 MB) bettet ~200 Abschnitte öffentlicher Dudoxx-Dokumentation einmal ein und ordnet sie per Kosinus-Ähnlichkeit zu deiner Anfrage. Keine PHI, nichts vorindiziert.

Xenova/all-MiniLM-L6-v2
~23 MB

Modell noch nicht geladen.

Ausführen auftatsächlich: —

WASM ist absichtlich der Standard: ein 23-MB-Modell mit einem Durchlauf ist dispatch-gebunden, der WebGPU-Umweg kostet mehr als die Rechnung. Zum Vergleich auf WebGPU wechseln.