Chat privado con IA local
Chatea con un modelo WebGPU local o con un servicio de IA configurado.
Chat privado con IA local
Cómo usar Chat privado con IA local
Private local AI chat sends a single message to a small language model, Qwen2.5 0.5B Instruct, that runs in your browser through WebGPU, and returns one written answer. The model downloads on first use and may stay cached on the device. Messages are limited to 8,000 characters and answers to 1,400 output tokens, and replies can be wrong, so review them.
- Pega la fuente en el editor de entrada o carga el ejemplo integrado.
- Configura el procesamiento.
- Ejecuta el chat privado con IA local, revisa la salida y usa los controles disponibles para copiar o descargar.
Qué admite esta herramienta
Descarga un modelo de inferencia en la primera ejecución. El chat y la generación requieren WebGPU; los modelos de reconocimiento más pequeños usan WebAssembly del navegador. La salida de la IA puede omitir o inventar detalles. Revísala antes de usarla.
- Procesamiento
- Navegador local
Límites y procesamiento
Fuentes de chat: 8,000 caracteres; generación: hasta 1,400 tokens de salida. Las primeras descargas de modelos pueden ser de cientos de MB. Los requisitos de memoria del chat con WebGPU y del navegador varían según el dispositivo. La salida del modelo es un borrador.
Fuente de ejemplo
A useful tool makes everyday work easier. Review the results before sharing.
Preguntas frecuentes
Why does the local AI chat say my browser needs WebGPU?
The chat model runs on your device's graphics hardware through WebGPU. If the browser does not expose WebGPU, the tool stops with an error before downloading the model; switch to a browser and device that support it.
How big is the model download for local AI chat?
The first run downloads the model and runtime, which can be hundreds of MB, with progress shown while it loads. Later runs can reuse the copy cached by the browser unless that cache has been cleared.
Does the local AI chat remember previous messages?
No. Each run sends only the text currently in the input box, with a short instruction to answer accurately and state uncertainty. To continue a topic, include the earlier context in your new message, staying within 8,000 characters.
¿Dónde se procesa mi entrada?
El modo local descarga recursos públicos del modelo y del entorno de ejecución y mantiene la entrada en este navegador. Los modelos pueden quedar en caché en este dispositivo.
¿Cuáles son los límites de entrada?
Fuentes de chat: 8,000 caracteres; generación: hasta 1,400 tokens de salida. Las primeras descargas de modelos pueden ser de cientos de MB. Los requisitos de memoria del chat con WebGPU y del navegador varían según el dispositivo. La salida del modelo es un borrador.