Contextepilote la jauge et le seuil de compactagetok
Paramètres
Journal du moteur
Emplacements
Projets
Chaque projet a sa mémoire, ses discussions et ses trackers, séparés des autres. La description est donnée à l'IA au début de chaque discussion du projet : elle sait sur quoi elle travaille sans qu'on le lui réexplique.
Config active
…
Presets
Mode agent
Mémoire?
Sauvegarde chiffrée
Voir la mémoire
Trackers ?Données datées qui s'accumulent : compteurs, relevés, journaux d'événements (poids, abonnés, relevés de compteur…). L'IA y ajoute des points et les consulte par niveaux — jamais en entier, quelle que soit l'ancienneté. La dernière valeur de chaque tracker lui est donnée d'emblée : elle répond sans appeler d'outil.
Accès internet?Ajoute les outils web_search / web_open / web_read / web_grep. Le moteur intégré ne demande aucune installation. Le moteur Crawl4AI exige un serveur que tu héberges toi-même (ex. docker run -d -p 11235:11235 --shm-size=1g unclecode/crawl4ai:latest) mais exécute le JavaScript des pages. Actifs seulement si le mode agent est actif.
enregistré automatiquement en quittant le champ
Contrôle du navigateur?Donne à l'IA le contrôle d'un navigateur dans le conteneur (outils browser_open / browser_find / browser_click / browser_type / browser_key / browser_scroll). L'IA lit les éléments numérotés de la page et agit par numéro — aucune vision requise, ça marche avec de petits modèles. browser_screenshot s'ajoute si la vision est active. Utilise le Chromium de Playwright embarqué dans l'image ; à défaut, LOKI_CHROME=<chemin>. Actif seulement si le mode agent est actif.
Serveurs MCP?Connecte des serveurs MCP (Model Context Protocol) pour donner de nouveaux outils à l'IA : accès fichiers, bases de données, APIs métier… stdio = programme lancé localement (npx/uvx/binaire) · http = serveur distant. ⚠ un serveur stdio exécute du code sur cette machine, au même titre que le shell.
(aucun serveur — ajoute un serveur fichiers, une base de données, une API…)
Paramètres
Tâches planifiées
Le mode agent est désactivé : les tâches s'exécuteront mais l'IA n'aura aucun outil pour agir (envoyer un mail, lire des fichiers…). Active le mode agent ci-dessus.
(aucune tâche — ex. « toutes les 2 h, relève mes mails et prépare des brouillons de réponse »)
System prompt
Moteur
Moteur llama.cpp
Télécharge llama-server et ses bibliothèques depuis l'image officielle
(~170 Mo), sans reconstruire l'image de Loki. Le nouveau moteur est essayé
avant d'être adopté ; celui de l'image reste intact et récupérable en un clic.
llama.cpp précompilé conseillé
binaire officiel téléchargé tel quel, prêt en ~2 min
llama.cpp compilé conseillé
compilé ici pour votre machine — plus rapide, plus long à installer
llama.cpp personnalisé
un fork de llama.cpp pour modèles spéciaux (quant ternaire…)
▸ détails
Service du moteur?Démarre, redémarre ou arrête llama-server — le processus qui charge le modèle et répond. Un redémarrage recharge le modèle du preset actif (quelques secondes à quelques minutes selon sa taille). Libérer la VRAM arrête le moteur et la dictée, puis annonce la mémoire vidéo rendue : c'est ce qu'il faut quand une autre application réclame la carte. Le même bouton vit sur les jauges, en pied de barre latérale.
Dictée
Modèle?Transcription par Parakeet (NVIDIA), servie par sherpa-onnx. Le modèle n'est pas dans l'image : il est téléchargé à la demande dans /data/asr/ et survit aux recréations du conteneur. Il tourne dans un processus séparé, allumé au premier clic sur le micro et éteint après dix minutes sans dictée. Sur le processeur : la carte reste au moteur de chat, et un modèle de cette taille n'en a pas besoin sur des tranches de quelques secondes.
Reconnaissance?Il n'y a pas de réglage de langue : Parakeet la détecte lui-même, phrase par phrase. Le modèle v3 couvre 25 langues européennes dont le français ; le v2 ne comprend que l'anglais.
Vérifier
Identité
Ton prénomaffiché sur tes messages
Ton avatar
Avatar de Loki
Apparence
Affichage
Accès OpenAI
Endpoint compatible OpenAI?Branchez n'importe quel client compatible OpenAI (OpenCode, Continue, Cursor, Open WebUI…) sur cette adresse — le modèle s'y appelle loki. L'endpoint est servi par Loki sur le port de cette interface : aucun autre port à ouvrir. Si une clé est définie, le client doit envoyer Authorization: Bearer <clé>.
Adresse de l'endpoint — modèle loki
Adresse publique — facultative?Le nom de domaine ou l'IP par lesquels on atteint cette interface, par exemple ia.exemple.fr ou 192.168.1.20:8090. Laissez vide et l'adresse affichée suit celle de votre navigateur. Renseignez-la si vous passez par un reverse proxy ou un nom de domaine : Loki ne voit alors qu'un appel interne et ne peut pas la deviner. Sans https://, il est ajouté.
Clé API?Protège l'endpoint des complétions — vérifiée par Loki et par le moteur. Indispensable dès que l'adresse ci-dessus est joignable par d'autres. Modifier la clé redémarre le moteur.
Actions
Exporter la conversation
⤓
Rien à exporter
La conversation est vide.
Format
Portée
Contenu
Raisonnementsla réflexion du modèle, souvent plus longue que la réponse
Appels d'outilscommandes, lectures et écritures de fichiers
Sorties des outilsce que chaque outil a répondu
Tracker
Backends personnalisés
Compile un fork de llama.cpp depuis un dépôt Git — pour les modèles qui exigent un moteur spécial (quant ternaire, etc.). Un backend personnalisé ne remplace pas le moteur : vous le choisissez ensuite par modèle (bouton crayon → section Moteur → « backend détecté »).
Catalogue MCP
Serveurs connus, embarqués dans Loki — aucun appel réseau pour cette liste.
« Utiliser » remplit le formulaire d'ajout : la commande s'exécutera sur
cette machine, relis-la avant d'enregistrer.
Serveur MCP
Outils ?Décoche un outil pour le masquer à l'IA sans déconnecter le serveur. Utile pour ne garder que ce dont tu as besoin.
Tâche planifiée
Dernier résultat
Nom
Type
Consigne
Script
À exécuter
Preset
Modèle utilisé
Projet visé
Fréquence
Toutes les
À
minute heure jour mois jour-semaine
Accès
Accès à la mémoire
Accès au web
Tâche active
Preset
Nom
Modèle
Fichier
Quantizationauto si vide
Visionprojecteur mmproj
Chercher un modèlesur Hugging Face — dépôts GGUF uniquement
Télécharger un modèle ou un projecteur mmproj — lien direct vers un .gguf
Destination
Dossiers de modèleschercher les .gguf ailleurs (disque externe…)
Ces dossiers servent aussi de destination de téléchargement.
Modèles installésles .gguf présents sur le disque — et de quoi en effacer un
Jeton Hugging Facedépôts à accès restreint (« gated ») ou privés
Cartes graphiques
Réglages
Contextetok
Couches sur GPU999 ou auto = ce qui tient en VRAM · all = tout, quitte à saturer
Experts MoE sur CPUvide = non
Threads CPU0 = auto
Threads (batch)0 = auto
BATCH
UBATCH
Cache KVcompression du contexte
Décodage spéculatifanticipe des jetons pour accélérer
Jetons anticipéspar étape — défaut 3
Raisonnementréflexion étape par étape
Intensité du raisonnementdéfaut de ce preset — ajustable à la volée depuis la barre de saisie
Flash attentionplus rapide, moins de VRAM
Garder en RAMévite le swap (mlock)
Charger tout en mémoiredésactive le mmap
Échantillonnage
Températurevide = défaut du modèle
top_pnoyau de probabilité
top_k0 = désactivé
min_pseuil de probabilité
Pénalité de présencepousse vers de nouveaux mots (0 = off)
Pénalité de répétitionanti-répétition (1 = neutre)