From 2a643e496cbe4ede0185ad6a358f22a1aaaa0e89 Mon Sep 17 00:00:00 2001 From: Pierre Martin Date: Thu, 27 Aug 2026 08:25:45 +0200 Subject: [PATCH] =?UTF-8?q?chore(ai):=20ajout=20nouveaux=20mod=C3=A8les?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- programs/pi.nix | 44 ++++++++++++++++++++++++++++++++++++++++++++ 1 file changed, 44 insertions(+) diff --git a/programs/pi.nix b/programs/pi.nix index 7f782e9..6399390 100644 --- a/programs/pi.nix +++ b/programs/pi.nix @@ -61,6 +61,50 @@ let contextWindow = 262144; maxTokens = 64000; } + { + id = "qwen3.8-27b"; + name = "Qwen 3.8 27B (vision) — Lundi Matin"; + # reasoning = false : avec thinking.enabled la passerelle/vLLM supprime + # le bloc thinking (testé), donc on laisse pi ne pas envoyer le + # paramètre thinking. qwen raisonne alors nativement et emet des + # blocs thinking a signature vide (deja gere par + # compat.allowEmptySignature du provider). + reasoning = false; + # Modele vision : accepte les images (teste via l'endpoint anthropic + # /v1/messages, format image.source.base64). Reserve aux analyses + # d'image : basculer dessus via /model pour cet usage, ou via + # l'extension vision-proxy pour un routage automatique. + input = [ + "text" + "image" + ]; + # Limite reelle mesuree via la passerelle LiteLLM (HTTP 400 : + # "This model's maximum context length is 250000 tokens"). + contextWindow = 250000; + maxTokens = 64000; + } + { + id = "qwen3.8-flash-next"; + name = "Qwen 3.8 Flash Next (vision) — Lundi Matin"; + # Meme logique que qwen3.8-27b : thinking.enabled supprime le bloc + # thinking cote vLLM (teste), donc on laisse pi ne pas envoyer le + # parametre thinking. Le modele raisonne alors nativement et emet + # des blocs thinking a signature vide, deja geres par + # compat.allowEmptySignature du provider. + reasoning = false; + # Modele vision : 125B-A5B MoE multimodal (plus rapide et plus + # puissant que deepseek-v4-flash, qui reste 284B-A13B non multimodal). + # Bémol : contexte plafonne a 262k, comme deepseek-v4-flash, contre + # 500k pour glm-5.2 et kimi-k3. + input = [ + "text" + "image" + ]; + # Limite reelle mesuree via la passerelle LiteLLM (HTTP 400 + # ContextWindowExceededError a 262145 tokens). + contextWindow = 262144; + maxTokens = 64000; + } ]; }; };