# Chat privado com IA local

> Converse com um modelo WebGPU local ou com um serviço de IA configurado.

[Open tool](https://www.toolcabana.com/pt-br/local-ai-chat) · [IA e ferramentas de prompts](https://www.toolcabana.com/pt-br/category/ai-and-prompt-tools)

Tool ID: local-ai-chat. Requested language: pt-BR. Description language: pt-BR. Complete guide translation: yes.

## Overview (en)

Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.

## Supported tasks (pt-BR)

Baixa um modelo de inferência na primeira execução. O chat e a geração exigem WebGPU; modelos menores de reconhecimento usam WebAssembly do navegador. A saída da IA pode omitir ou inventar detalhes. Revise antes de usar.

## Steps (pt-BR)

1. Cole a fonte no editor de entrada ou carregue o exemplo integrado.
2. Configure o processamento.
3. Execute o chat privado com IA local, revise a saída e use os controles disponíveis para copiar ou baixar.

## Settings

- Processamento (pt-BR; key: inference; type: select): Navegador local [pt-BR]

## Limitations (pt-BR)

Fontes de chat: 8,000 caracteres; geração: até 1,400 tokens de saída. Os primeiros downloads de modelos podem ter centenas de MB. Os requisitos de memória do chat com WebGPU e do navegador variam por dispositivo. A saída do modelo é um rascunho.

## Example input

```text
A useful tool makes everyday work easier. Review the results before sharing.
```

## Privacy and connections (pt-BR)

O modo local baixa recursos públicos do modelo e do ambiente de execução e mantém a entrada neste navegador. Os modelos podem ficar em cache neste dispositivo.

## Questions (pt-BR)

### Why does the local AI chat say my browser needs WebGPU?

The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.

### How big is the model download for local AI chat?

The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.

### Does the local AI chat remember previous messages?

No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.

### Onde minha entrada é processada?

O modo local baixa recursos públicos do modelo e do ambiente de execução e mantém a entrada neste navegador. Os modelos podem ficar em cache neste dispositivo.

### Quais são os limites de entrada?

Fontes de chat: 8,000 caracteres; geração: até 1,400 tokens de saída. Os primeiros downloads de modelos podem ter centenas de MB. Os requisitos de memória do chat com WebGPU e do navegador variam por dispositivo. A saída do modelo é um rascunho.

## Related tools

- [Chat with document](https://www.toolcabana.com/pt-br/chat-document)
- [AI flashcard maker](https://www.toolcabana.com/pt-br/flashcard-maker)
- [AI quiz maker](https://www.toolcabana.com/pt-br/quiz-maker)
- [AI study guide](https://www.toolcabana.com/pt-br/study-guide)
