ToolCabana

Privater lokaler KI-Chat

Ermöglicht Chats mit einem lokalen WebGPU-Modell oder einem konfigurierten KI-Dienst.

Favorites are saved in this browser. Find them in My favorites.

Privater lokaler KI-Chat

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.
Load sample text to explore what this tool can do. This replaces your current input.
0 charactersClear the source text.

So verwendest du Privater lokaler KI-Chat

Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.

  1. Füge die Quelle in den Eingabe-Editor ein oder lade das integrierte Beispiel.
  2. Lege die Verarbeitung fest.
  3. Führe den privaten lokalen KI-Chat aus, prüfe die Ausgabe und verwende dann die verfügbaren Bedienelemente zum Kopieren oder Herunterladen.

Was dieses Tool unterstützt

Lädt beim ersten Durchlauf ein Inferenzmodell herunter. Chat und Generierung erfordern WebGPU; kleinere Erkennungsmodelle verwenden WebAssembly im Browser. KI-Ausgaben können Details auslassen oder erfinden. Prüfe sie vor der Verwendung.

Verarbeitung
Lokal im Browser

Grenzen und Verarbeitung

Chat-Quellen: 8.000 Zeichen; Generierung: bis zu 1.400 Ausgabe-Tokens. Die ersten Modell-Downloads können mehrere Hundert MB groß sein. WebGPU-Chat und Browser-Speicheranforderungen variieren je nach Gerät. Modellausgaben sind ein Entwurf.

Beispielquelle
A useful tool makes everyday work easier. Review the results before sharing.

Häufige Fragen

Why does the local AI chat say my browser needs WebGPU?

The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.

How big is the model download for local AI chat?

The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.

Does the local AI chat remember previous messages?

No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.

Wo wird meine Eingabe verarbeitet?

Der lokale Modus lädt öffentliche Modell- und Laufzeit-Assets herunter und behält die Eingabe in diesem Browser. Modelle können auf diesem Gerät zwischengespeichert bleiben.

Welche Eingabelimits gelten?

Chat-Quellen: 8.000 Zeichen; Generierung: bis zu 1.400 Ausgabe-Tokens. Die ersten Modell-Downloads können mehrere Hundert MB groß sein. WebGPU-Chat und Browser-Speicheranforderungen variieren je nach Gerät. Modellausgaben sind ein Entwurf.