ToolCabana

Discussion IA locale privée

Discutez avec un modèle WebGPU local ou un service IA configuré.

Favorites are saved in this browser. Find them in My favorites.

Discussion IA locale privée

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.
Load sample text to explore what this tool can do. This replaces your current input.
0 charactersClear the source text.

Comment utiliser Discussion IA locale privée

Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.

  1. Collez la source dans l'éditeur de saisie ou chargez l'exemple intégré.
  2. Définissez le traitement.
  3. Lancez la discussion IA locale privée, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.

Ce que cet outil prend en charge

Télécharge un modèle d'inférence au premier lancement. La discussion et la génération nécessitent WebGPU ; les modèles de reconnaissance plus légers utilisent le WebAssembly du navigateur. Le résultat de l'IA peut omettre ou inventer des détails. Vérifiez-le avant utilisation.

Traitement
Navigateur local

Limites et traitement

Sources de discussion : 8 000 caractères ; génération : jusqu'à 1 400 tokens en sortie. Les premiers téléchargements de modèles peuvent représenter plusieurs centaines de MB. Les besoins en mémoire pour la discussion WebGPU et le navigateur varient selon l'appareil. Le résultat du modèle est un brouillon.

Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.

Questions fréquentes

Why does the local AI chat say my browser needs WebGPU?

The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.

How big is the model download for local AI chat?

The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.

Does the local AI chat remember previous messages?

No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.

Où ma saisie est-elle traitée ?

Le mode local télécharge des ressources publiques de modèle et d'exécution et conserve la saisie dans ce navigateur. Les modèles peuvent rester en cache sur cet appareil.

Quelles sont les limites de saisie ?

Sources de discussion : 8 000 caractères ; génération : jusqu'à 1 400 tokens en sortie. Les premiers téléchargements de modèles peuvent représenter plusieurs centaines de MB. Les besoins en mémoire pour la discussion WebGPU et le navigateur varient selon l'appareil. Le résultat du modèle est un brouillon.