O assistente envia minhas páginas para algum lugar?
Não. Ele roda no seu navegador. O único uso da rede é baixar o modelo uma vez, do host público dele, depois que você o ativa.
O assistente do Vellum fica desativado até você ativá-lo. Então um modelo de linguagem é baixado uma vez e roda no seu navegador. Ele responde a partir do que você escreveu, mostra onde encontrou e pode executar código para você, com sua aprovação.

Nada relacionado a IA é baixado até você ativar o assistente. Então o modelo é buscado uma vez no host público dele e guardado em cache pelo navegador; ele roda na GPU com WebGPU, ou como um modelo menor na CPU. Suas perguntas, as respostas e o índice de busca que ele cria ficam no armazenamento do navegador, neste dispositivo.
O modelo é um modelo pequeno de pesos abertos rodando localmente: ele é mais lento e menos capaz que os grandes modelos na nuvem, e pode errar. As citações mostram onde conferir.
Toda resposta cita as páginas que usou como chips numerados; um chip abre a página. Pergunte sobre todas as páginas, um caderno ou só a página aberta. Arquivos também contam: o texto dentro de PDFs, documentos do Word e apresentações é indexado página por página, então uma citação pode apontar para a página exata de um PDF.
Não. Ele roda no seu navegador. O único uso da rede é baixar o modelo uma vez, do host público dele, depois que você o ativa.
De um navegador atual. Ele é mais rápido com WebGPU (Chrome e Edge recentes); sem isso, um modelo menor roda na CPU.
Só quando você pede um resumo, um esquema ou uma continuação e decide mantê-lo. O código que ele quer executar espera sua aprovação.