Correção com IA no Teclado

Modelos de IA on-device do Hugging Face para correção ortográfica e predição de palavras em tempo real — 100% offline, 100% privado.

1 Visão Geral

O Kwiq integra modelos de IA on-device via ONNX Runtime para melhorar o teclado com correção ortográfica e predição de palavras em tempo real. Toda a inferência roda localmente — sem necessidade de internet após baixar o modelo.

Nota A correção com IA é opcional. Quando desativada, o teclado volta ao motor clássico baseado em dicionários (distância de Levenshtein + Trie + bigramas). Você pode ativar/desativar independentemente para correção e predição.

Arquitetura

O motor de IA suporta três arquiteturas de modelo:

  • ONNX Runtime — Runtime de inferência. Roda em CPU com aceleração XNNPACK. Suporta quantização INT8 e FP16 para modelos menores e mais rápidos.
  • T5-SEQ2SEQ — Modelos encoder-decoder ajustados para correção de erros gramaticais (GEC). Já convertidos para ONNX com quantização INT8. Rápidos e leves (30-40 MB).
  • DECODER-SLM — Modelos de linguagem compactos decoder-only. Usam prompt engineering para predição contextual. Precisam de export ONNX via optimum-cli.
  • BYTE-LEVEL — Modelos byte-level que operam diretamente em bytes UTF-8 sem tokenizer. Extremamente robustos a erros de digitação.

2 Modelos Disponíveis

Os modelos são obtidos do Hugging Face Hub. O catálogo inclui várias categorias:

Correção Ortográfica (T5)

Modelos T5 ultra-leves ajustados para correção gramatical e ortográfica. Já em formato ONNX INT8, prontos para uso. 30-40 MB. Ideal para correção de erros de digitação em tempo real.

Predição de Palavras (SmolLM2)

Modelos de linguagem compactos state-of-the-art do Hugging Face. 135M-360M parâmetros. Melhor compreensão contextual. Requer export ONNX.

Byte-Level (ByT5)

Modelos ByT5 do Google que trabalham diretamente com bytes UTF-8. Sem tokenizer. Robusto a ruído e erros de encoding. Multilíngue.

Navegue e baixe modelos diretamente das Configurações do Kwiq → Teclado → Correção com IA. Cada modelo mostra tamanho, idioma suportado e se está pronto para uso.

3 Baixando Modelos

Os modelos são baixados sob demanda do Hugging Face Hub e armazenados em cache no armazenamento interno:

  1. Abra Configurações do Kwiq → Teclado → Correção com IA.
  2. Escolha um modelo do catálogo.
  3. Toque em Baixar. Você verá uma barra de progresso enquanto o modelo é obtido.
  4. Após o download, ative Correção ortográfica com IA e/ou Predição com IA.
Dica Os modelos ficam no cache interno do app. Desinstalar o Kwiq ou limpar dados do app removerá os modelos baixados. Você também pode excluir modelos individuais na tela de configurações.

4 Como Funciona

O pipeline de sugestões do teclado combina múltiplas fontes de dados em ordem progressiva:

Quando você digita, as sugestões são geradas nesta ordem:

  1. Bigramas — Pares de palavras aprendidos do seu histórico de digitação (banco Room). Mais rápido, sempre ativo.
  2. Prefixo — Correspondência por prefixo no dicionário (Trie + Hunspell). Encontra palavras que começam com o que você digitou.
  3. IA — Inferência do modelo de IA via ONNX Runtime. Fornece correções ortográficas inteligentes e predições contextuais. Score mais alto, então sugestões de IA aparecem primeiro quando ativadas.
  4. Levenshtein — Correções clássicas por distância de Levenshtein. Sempre disponível como fallback quando a IA está desativada ou falha.
Nota Se o modelo de IA não estiver carregado ou a inferência falhar, o teclado volta silenciosamente ao motor clássico. Sua experiência de digitação nunca é interrompida.

5 Controle via MCP

Modelos de IA também podem ser gerenciados remotamente através da interface MCP (Model Context Protocol). Isso permite que assistentes de IA naveguem, baixem, selecionem e excluam modelos no seu dispositivo via clientes MCP.

Ferramentas MCP disponíveis: ai_model_list, ai_model_download, ai_model_status, ai_model_select, ai_model_delete. Acesse-as pelo Dashboard Auto-Hospedado em /mcp.