Comparação semântica de textos
Compare dois textos com similaridade local de embeddings.
Comparação semântica de textos
Como usar Comparação semântica de textos
Semantic text comparison measures how close two texts are in meaning by embedding each with the all-MiniLM-L6-v2 model in your browser and reporting their cosine similarity to four decimal places. Paste the first text in the main box and the second in Comparison text, each up to 8,000 characters. The score is not a plagiarism, truth or equivalence verdict.
- Cole a fonte no editor de entrada ou carregue o exemplo integrado.
- Configure o texto de comparação.
- Execute a comparação semântica de textos, revise a saída e use os controles disponíveis para copiar ou baixar.
O que esta ferramenta suporta
Baixa um modelo de inferência na primeira execução. O chat e a geração exigem WebGPU; modelos menores de reconhecimento usam WebAssembly do navegador. A saída da IA pode omitir ou inventar detalhes. Revise antes de usar.
- Texto de comparação
- Set this value for your task.
Limites e processamento
As fontes de texto são limitadas a 8,000 caracteres; a busca de imagens aceita até 20 imagens e uma consulta de 500 caracteres. Os modelos podem truncar textos longos. Os primeiros downloads podem ter centenas de MB e exigem memória do navegador.
Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.
Perguntas frequentes
What does the cosine similarity score mean?
It measures how closely the two embedding vectors point in the same direction. Values near 1 mean very similar meaning according to the model, and lower values mean less related content. There is no fixed pass mark, so compare scores across several text pairs.
Can semantic text comparison detect plagiarism?
No. The tool states the score is not a plagiarism, truth or equivalence verdict. A high score only means the model sees related meaning; it does not show copying, agreement or that both texts are correct.
How long can the texts be for semantic comparison?
Each text can be up to 8,000 characters, but the embedding model may truncate long inputs, so later parts of a long text might not influence the score. Comparing paragraph-sized sections gives a more representative result.
Onde minha entrada é processada?
O modo local baixa recursos públicos do modelo e do ambiente de execução e mantém a entrada neste navegador. Os modelos podem ficar em cache neste dispositivo.
Quais são os limites de entrada?
As fontes de texto são limitadas a 8,000 caracteres; a busca de imagens aceita até 20 imagens e uma consulta de 500 caracteres. Os modelos podem truncar textos longos. Os primeiros downloads podem ter centenas de MB e exigem memória do navegador.