Chat AI locale privata
Chatta con un modello WebGPU locale o un servizio AI configurato.
Chat AI locale privata
Come usare Chat AI locale privata
Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.
- Incolla l'origine nell'editor di input, oppure carica l'esempio integrato.
- Imposta l'elaborazione.
- Esegui la chat AI locale privata, esamina il risultato, poi usa i controlli disponibili per copiare o scaricare.
Cosa supporta questo strumento
Al primo utilizzo viene scaricato un modello di inferenza. La chat e la generazione richiedono WebGPU; i modelli di riconoscimento più piccoli usano WebAssembly del browser. L'output dell'AI può omettere o inventare dettagli. Esaminalo prima dell'uso.
- Elaborazione
- Browser locale
Limiti ed elaborazione
Origini per la chat: 8.000 caratteri; generazione: fino a 1.400 token di output. I primi download dei modelli possono pesare centinaia di MB. La chat WebGPU e i requisiti di memoria del browser variano in base al dispositivo. L'output del modello è una bozza.
Origine di esempio
A useful tool makes everyday work easier. Review the results before sharing.
Domande frequenti
Why does the local AI chat say my browser needs WebGPU?
The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.
How big is the model download for local AI chat?
The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.
Does the local AI chat remember previous messages?
No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.
Dove viene elaborato il mio input?
La modalità locale scarica modelli e risorse di runtime pubblici e mantiene l'input in questo browser. I modelli possono rimanere nella cache di questo dispositivo.
Quali sono i limiti di input?
Origini per la chat: 8.000 caratteri; generazione: fino a 1.400 token di output. I primi download dei modelli possono pesare centinaia di MB. La chat WebGPU e i requisiti di memoria del browser variano in base al dispositivo. L'output del modello è una bozza.