# Chat privado con IA local

> Chatea con un modelo WebGPU local o con un servicio de IA configurado.

[Open tool](https://www.toolcabana.com/es/local-ai-chat) · [IA y herramientas de prompts](https://www.toolcabana.com/es/category/ai-and-prompt-tools)

Tool ID: local-ai-chat. Requested language: es. Description language: es. Complete guide translation: yes.

## Overview (en)

Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.

## Supported tasks (es)

Descarga un modelo de inferencia en la primera ejecución. El chat y la generación requieren WebGPU; los modelos de reconocimiento más pequeños usan WebAssembly del navegador. La salida de la IA puede omitir o inventar detalles. Revísala antes de usarla.

## Steps (es)

1. Pega la fuente en el editor de entrada o carga el ejemplo integrado.
2. Configura el procesamiento.
3. Ejecuta el chat privado con IA local, revisa la salida y usa los controles disponibles para copiar o descargar.

## Settings

- Procesamiento (es; key: inference; type: select): Navegador local [es]

## Limitations (es)

Fuentes de chat: 8,000 caracteres; generación: hasta 1,400 tokens de salida. Las primeras descargas de modelos pueden ser de cientos de MB. Los requisitos de memoria del chat con WebGPU y del navegador varían según el dispositivo. La salida del modelo es un borrador.

## Example input

```text
A useful tool makes everyday work easier. Review the results before sharing.
```

## Privacy and connections (es)

El modo local descarga recursos públicos del modelo y del entorno de ejecución y mantiene la entrada en este navegador. Los modelos pueden quedar en caché en este dispositivo.

## Questions (es)

### Why does the local AI chat say my browser needs WebGPU?

The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.

### How big is the model download for local AI chat?

The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.

### Does the local AI chat remember previous messages?

No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.

### ¿Dónde se procesa mi entrada?

El modo local descarga recursos públicos del modelo y del entorno de ejecución y mantiene la entrada en este navegador. Los modelos pueden quedar en caché en este dispositivo.

### ¿Cuáles son los límites de entrada?

Fuentes de chat: 8,000 caracteres; generación: hasta 1,400 tokens de salida. Las primeras descargas de modelos pueden ser de cientos de MB. Los requisitos de memoria del chat con WebGPU y del navegador varían según el dispositivo. La salida del modelo es un borrador.

## Related tools

- [Chat with document](https://www.toolcabana.com/es/chat-document)
- [AI flashcard maker](https://www.toolcabana.com/es/flashcard-maker)
- [AI quiz maker](https://www.toolcabana.com/es/quiz-maker)
- [AI study guide](https://www.toolcabana.com/es/study-guide)
