Das funktioniert, und es bedeutet, dass der interessante Teil deiner Daten das Haus verlassen hat. Es bedeutet auch, dass die Funktion in dem Moment aufhört zu existieren, in dem die Verbindung weg ist — was für eine App, die in Untergeschossen und in den Bergen benutzt wird, kein Detail ist.
cronoWiz geht den anderen Weg. Das Modell wird per WebLLM im Browser geladen und mit WebGPU auf der GPU ausgeführt. Die Gewichte liegen im OPFS und überstehen Updates, also sind die rund 700 MB einmalige Kosten, und danach ist die Engine in Sekunden zurück. Die Generierung passiert auf dem Gerät: Der Prompt wird dort gebaut und dort verbraucht.
Beim Kompromiss lohnt Genauigkeit. Ein Modell dieser Größe ist kein Spitzenmodell: Es ist gut darin, dir deine eigenen Zahlen zu erklären, und schwach im Allgemeinwissen. Genau diese Aufgabe hat es bekommen, und deshalb reicht ein kleines lokales Modell.
-
WebLLM im Browser
Keine native Laufzeit, kein Serverweg, kein API-Schlüssel.
-
Gewichte lokal gehalten
Im OPFS, überstehen Updates: einmal geladen, nicht pro Einheit.
-
Du bestimmst das Vorwärmen
Beim Start der App, beim Beginn der Einheit oder faul bei der ersten Nutzung.
-
Eine offen genannte Grenze
Ein Modell mit 1–2 Milliarden Parametern erklärt deine Daten gut und ist kein Allzweckassistent.
Kostenlos. Privat. Deine.
Kein Konto. Kein Server. Keine Cookies. Nur du, dein Handy und eine App, die sich um ihre eigenen Angelegenheiten kümmert. cronoWiz ist eine kostenlose PWA, die vollständig auf deinem Gerät läuft — deine Daten gehen nicht raus. Nie.
Die Fragen, die wirklich gestellt werden
Was ist WebGPU, und habe ich es?
Es ist die Browser-API, die aus einer Seite heraus Zugriff auf die GPU gibt. Aktuelle Chrome- und Edge-Versionen haben es auf dem Desktop und auf den meisten aktuellen Android-Geräten; sonst variiert es. Fehlt es, bleibt der Coach aus und nichts anderes ändert sich.
Wie lange dauert der erste Ladevorgang?
Der Download umfasst rund 700 MB, hängt also an deiner Verbindung. Danach ist die Engine meist in einigen Sekunden zurück, und du kannst sie beim Start einer Einheit vorwärmen lassen, damit sie bereit ist, wenn du fragst.
Wird das Gespräch gespeichert?
Der Verlauf bleibt auf dem Gerät und reist im verschlüsselten Backup mit, wenn du eines anlegst. Die Modellgewichte nicht: Sie sind erneut ladbar, es gibt keinen Grund, sie mitzuschleppen.
