L’assistant envoie-t-il mes pages quelque part ?
Non. Il tourne dans votre navigateur. Le seul usage du réseau est le téléchargement unique du modèle, depuis son hébergeur public, une fois que vous l’avez activé.
L’assistant de Vellum est désactivé tant que vous ne l’activez pas. Un modèle de langage se télécharge alors une fois et tourne dans votre navigateur. Il répond à partir de ce que vous avez écrit, montre où il l’a trouvé, et peut exécuter du code pour vous, avec votre accord.

Rien de lié à l’IA ne se télécharge tant que vous n’activez pas l’assistant. Son modèle est alors récupéré une fois depuis son hébergeur public et mis en cache par le navigateur ; il tourne sur le GPU avec WebGPU, ou sous forme de modèle plus petit sur le CPU. Vos questions, les réponses et l’index de recherche qu’il construit restent dans le stockage du navigateur, sur cet appareil.
Le modèle est un petit modèle à poids ouverts qui tourne en local : il est plus lent et moins performant que les grands modèles du cloud, et il peut se tromper. Ses citations vous montrent où vérifier.
Chaque réponse cite les pages utilisées sous forme de pastilles numérotées ; une pastille ouvre la page. Interrogez toutes les pages, un carnet ou seulement la page ouverte. Les fichiers comptent aussi : le texte des PDF, des documents Word et des présentations est indexé page par page, si bien qu’une citation peut pointer vers la page exacte d’un PDF.
Non. Il tourne dans votre navigateur. Le seul usage du réseau est le téléchargement unique du modèle, depuis son hébergeur public, une fois que vous l’avez activé.
D’un navigateur récent. Il est plus rapide avec WebGPU (versions récentes de Chrome et Edge) ; sans WebGPU, un modèle plus petit tourne sur le CPU.
Seulement quand vous demandez un résumé, un plan ou une suite et que vous le gardez. Le code qu’il veut exécuter attend votre accord.