# Discussion IA locale privée

> Discutez avec un modèle WebGPU local ou un service IA configuré.

[Open tool](https://www.toolcabana.com/fr/local-ai-chat) · [IA et prompts](https://www.toolcabana.com/fr/category/ai-and-prompt-tools)

Tool ID: local-ai-chat. Requested language: fr. Description language: fr. Complete guide translation: yes.

## Overview (en)

Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.

## Supported tasks (fr)

Télécharge un modèle d'inférence au premier lancement. La discussion et la génération nécessitent WebGPU ; les modèles de reconnaissance plus légers utilisent le WebAssembly du navigateur. Le résultat de l'IA peut omettre ou inventer des détails. Vérifiez-le avant utilisation.

## Steps (fr)

1. Collez la source dans l'éditeur de saisie ou chargez l'exemple intégré.
2. Définissez le traitement.
3. Lancez la discussion IA locale privée, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.

## Settings

- Traitement (fr; key: inference; type: select): Navigateur local [fr]

## Limitations (fr)

Sources de discussion : 8 000 caractères ; génération : jusqu'à 1 400 tokens en sortie. Les premiers téléchargements de modèles peuvent représenter plusieurs centaines de MB. Les besoins en mémoire pour la discussion WebGPU et le navigateur varient selon l'appareil. Le résultat du modèle est un brouillon.

## Example input

```text
A useful tool makes everyday work easier. Review the results before sharing.
```

## Privacy and connections (fr)

Le mode local télécharge des ressources publiques de modèle et d'exécution et conserve la saisie dans ce navigateur. Les modèles peuvent rester en cache sur cet appareil.

## Questions (fr)

### Why does the local AI chat say my browser needs WebGPU?

The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.

### How big is the model download for local AI chat?

The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.

### Does the local AI chat remember previous messages?

No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.

### Où ma saisie est-elle traitée ?

Le mode local télécharge des ressources publiques de modèle et d'exécution et conserve la saisie dans ce navigateur. Les modèles peuvent rester en cache sur cet appareil.

### Quelles sont les limites de saisie ?

Sources de discussion : 8 000 caractères ; génération : jusqu'à 1 400 tokens en sortie. Les premiers téléchargements de modèles peuvent représenter plusieurs centaines de MB. Les besoins en mémoire pour la discussion WebGPU et le navigateur varient selon l'appareil. Le résultat du modèle est un brouillon.

## Related tools

- [Chat with document](https://www.toolcabana.com/fr/chat-document)
- [AI flashcard maker](https://www.toolcabana.com/fr/flashcard-maker)
- [AI quiz maker](https://www.toolcabana.com/fr/quiz-maker)
- [AI study guide](https://www.toolcabana.com/fr/study-guide)
