Pular para o conteúdo
VellumAbrir o Vellum

Pergunte às suas páginas. Nada sai do dispositivo.

O assistente do Vellum fica desativado até você ativá-lo. Então um modelo de linguagem é baixado uma vez e roda no seu navegador. Ele responde a partir do que você escreveu, mostra onde encontrou e pode executar código para você, com sua aprovação.

O painel do assistente do Vellum, explicando que o modelo é baixado uma vez e roda neste dispositivo, com o botão para ativá-lo.
O painel do assistente do Vellum, explicando que o modelo é baixado uma vez e roda neste dispositivo, com o botão para ativá-lo.

No seu dispositivo, depois que você ativa

Nada relacionado a IA é baixado até você ativar o assistente. Então o modelo é buscado uma vez no host público dele e guardado em cache pelo navegador; ele roda na GPU com WebGPU, ou como um modelo menor na CPU. Suas perguntas, as respostas e o índice de busca que ele cria ficam no armazenamento do navegador, neste dispositivo.

O modelo é um modelo pequeno de pesos abertos rodando localmente: ele é mais lento e menos capaz que os grandes modelos na nuvem, e pode errar. As citações mostram onde conferir.

Respostas com fontes

Toda resposta cita as páginas que usou como chips numerados; um chip abre a página. Pergunte sobre todas as páginas, um caderno ou só a página aberta. Arquivos também contam: o texto dentro de PDFs, documentos do Word e apresentações é indexado página por página, então uma citação pode apontar para a página exata de um PDF.

Mais do que um chat

No app

Perguntas

O assistente envia minhas páginas para algum lugar?

Não. Ele roda no seu navegador. O único uso da rede é baixar o modelo uma vez, do host público dele, depois que você o ativa.

Do que ele precisa?

De um navegador atual. Ele é mais rápido com WebGPU (Chrome e Edge recentes); sem isso, um modelo menor roda na CPU.

Ele pode alterar minhas páginas?

Só quando você pede um resumo, um esquema ou uma continuação e decide mantê-lo. O código que ele quer executar espera sua aprovação.