Conversation

Clique-glisse la sphère pour la tourner · tape dessus pour parler
● DéconnectéMoteur —
Inactif
tape la sphère pour parler

Chat

Parle ou écris — même conversation

Pas encore de message — écris ci-dessous ou parle à Jarvis.

Spotify

En écoute en ce moment

Rien en cours de lecture, ou pas encore connecté.

Activité outils

vault_search / vault_read, en direct

En attente d'activité…
Préférences

Tes préférences

Identité, voix, proactivité, connexions — effet immédiat, rien à redémarrer

Identité

Comment Jarvis s'adresse à toi
Prénom
Injecté dans les instructions système de Jarvis à chaque nouvelle session
Profil
Rôle/contexte, ajouté entre parenthèses après ton prénom

Voix

Verrouillée — voir pourquoi ci-dessous
Voix Gemini
GEMINI_VOICE_NAME (server/.env) — changer casserait les clips "Mmh ?"/accusé de réception préenregistrés avec cette voix
Kore
Volume de sortie
Réglage propre à cet appareil (pas partagé) — n'affecte pas le volume système
100%

Proactivité

Météo par défaut · briefing
Ville météo par défaut
Utilisée si tu demandes la météo sans préciser de ville
Heure du briefingà venir
Aucun briefing programmé pour l'instant — pas encore de canal pour parler sans que tu aies lancé la conversation
08:00
Appareil Spotify par défaut
Nom (ou partie du nom) de l'appareil visé quand tu ne précises rien à l'oral — corrige le fait que Spotify reprenait presque toujours sur l'ampli du salon (souvent le seul allumé en permanence)

Expérimentaltest de latence

Passage vault systématique
Recherche vault systématique
Avant CHAQUE réponse, Jarvis évalue s'il doit consulter le vault (rien / recherche légère / memory.md / dossier projet, selon la question) au lieu de le faire seulement pour créer une page. Ralentit certaines réponses — c'est justement ce qu'on teste. Le chrono ci-contre affiche le temps réel de chaque réponse.
Contexte figé (comparatif modèles)
La première génération de page après activation capture son contexte vault sur disque — chaque essai suivant, quel que soit le modèle choisi dans "Recherches & Création", reçoit exactement ce même contexte. Utile pour comparer les modèles à conditions identiques. Désactiver efface la capture ; la prochaine activation en fait une nouvelle.

Activation vocale

Mot d'activation · sensibilité
Mot d'activation « Jarvis »
Écoute passive en arrière-plan — activé par défaut
Seuil VAD (barge-in)
VAD_THRESHOLD
—
Timeout d'inactivité
Ferme la session après ce délai de silence
15 s

Connexions

État des services et intégrations
Serveur
Session manager Node.js + WebSocket
déconnecté
—
Vault
vault_search / vault_read / vault_write (avec confirmation)
G:\Jarvis (dev) → /root/vault (prod)
Google Drive
drive_search / drive_read (lecture seule) + file_save (écriture, avec confirmation)
configuré — server/scripts/setup-google-drive.mjs
Spotify
Lecture en cours + contrôle (jouer/pause/suivant/rechercher)
configuré — server/scripts/setup-spotify.mjs
Carte 3D
Mapbox GL — jeton public côté client
VITE_MAPBOX_TOKEN dans client-desktop/.env
Modèles

Tes moteurs IA

Fournisseur par capacité — effet immédiat, pris en compte à la prochaine connexion pour la voix
Moteur vocal
Speech-to-speech temps réel — pris en compte à la prochaine connexion
Gemini Live
gemini-3.1-flash-live-preview · free tier
OpenAI Realtime
voir le choix de modèle ci-dessous
Pipeline (bêta)
VAD+STT+LLM+TTS séparés — Phase 2 : détection de la parole seulement, pas encore de vraie conversation
Modèle OpenAI Realtime
Actif seulement si le moteur vocal ci-dessus est réglé sur OpenAI — pris en compte à la prochaine connexion
Mini
gpt-realtime-2.1-mini · 3× moins cher
Complet
gpt-realtime-2.1 · plus cher, potentiellement mieux compris
Recherches & Création
Génération de pages web, diaporamas (create_page) — 2 choix retenus le 31/08/2026
DeepSeek
deepseek-v4-flash · le moins cher, défaut
Sol — medium
gpt-5.6-sol · même choix que Vision
Vision
Lecture d'images/PDF (extraction facture, nommage de photo...) — 2 choix retenus après comparatif réel du 30/08/2026
OpenAI (Sol, medium)
gpt-5.6-sol · effort medium · pas de PDF direct
DeepSeek Vision
deepseek-v4-flash-vision-exp · le moins cher · pas de PDF direct

Historique

Sessions passées
Aucune session enregistrée pour l'instant
La persistance des conversations n'est pas encore construite côté serveur.
Coûts

Ce que Jarvis dépense en IA

Recherches/Création (create_page) + Vision (factures) — hors voix, voir le résumé de périmètre plus bas
Total ce mois
—
—
Aujourd'hui
—
appels facturables du jour
Tokens mois
—
input + output, tous fournisseurs
Forecast fin de mois
—extrapolé
rythme observé, projeté sur le mois

Évolution

Coût USD / jour

Répartition par capacité

Où part l'argent, ce mois

Par fournisseur

Part du total, ce mois

Par modèle

Tokens consommés, ce mois

Historique mensuel

Coût facturable par mois, par fournisseur

Suivi Recherches/Création (create_page) + Vision (factures) Voix non suivie — Gemini en free tier, OpenAI Realtime pas encore utilisable
Rapports

Comptes rendus de l'agent

Vérification hebdomadaire du vault (notes orphelines, liens cassés, contexte périmé...) — lecture seule, rien n'est appliqué automatiquement
Aucun rapport pour l'instant
Le premier arrivera après le passage hebdomadaire de l'agent de maintenance du vault.
À propos

À propos de Jarvis

Ce que c'est, comment c'est construit
J
Jarvis v0.1.0
Assistant vocal personnel — voix temps réel, proactif
Auteur
Martin Ducatez
Statut
Projet personnel — développement actif, pas encore déployé
Démarré
11 août 2026
Dépôt
Privé — G:\Jarvis_App_v2, hors vault

Stack technique

Ce qui fait tourner Jarvis
Client desktop
Fenêtre native, capture micro sans restriction navigateur
Tauri (Rust) + TypeScript/Vite
Serveur
Sessions vocales, outils, clés API
Node.js + WebSocket
Voix
Speech-to-speech temps réel — pas de pipeline STT→LLM→TTS
Gemini Live API / OpenAI Realtime API
Outils
Ce que Jarvis peut consulter/afficher à la voix
Vault Obsidian · Google Drive · Spotify · Open-Meteo · Mapbox
Construit avec
Développé en pair-programming conversationnel
Claude Code (Anthropic)