ToolCabana

Chat privado com IA local

Converse com um modelo WebGPU local ou com um serviço de IA configurado.

Favorites are saved in this browser. Find them in My favorites.

Chat privado com IA local

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.
Load sample text to explore what this tool can do. This replaces your current input.
0 charactersClear the source text.

Como usar Chat privado com IA local

Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.

  1. Cole a fonte no editor de entrada ou carregue o exemplo integrado.
  2. Configure o processamento.
  3. Execute o chat privado com IA local, revise a saída e use os controles disponíveis para copiar ou baixar.

O que esta ferramenta suporta

Baixa um modelo de inferência na primeira execução. O chat e a geração exigem WebGPU; modelos menores de reconhecimento usam WebAssembly do navegador. A saída da IA pode omitir ou inventar detalhes. Revise antes de usar.

Processamento
Navegador local

Limites e processamento

Fontes de chat: 8,000 caracteres; geração: até 1,400 tokens de saída. Os primeiros downloads de modelos podem ter centenas de MB. Os requisitos de memória do chat com WebGPU e do navegador variam por dispositivo. A saída do modelo é um rascunho.

Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.

Perguntas frequentes

Why does the local AI chat say my browser needs WebGPU?

The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.

How big is the model download for local AI chat?

The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.

Does the local AI chat remember previous messages?

No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.

Onde minha entrada é processada?

O modo local baixa recursos públicos do modelo e do ambiente de execução e mantém a entrada neste navegador. Os modelos podem ficar em cache neste dispositivo.

Quais são os limites de entrada?

Fontes de chat: 8,000 caracteres; geração: até 1,400 tokens de saída. Os primeiros downloads de modelos podem ter centenas de MB. Os requisitos de memória do chat com WebGPU e do navegador variam por dispositivo. A saída do modelo é um rascunho.