Les réglages gratuits, après l'entraînement

ça tourne dans ton navigateur. Aucun appel au serveur : les figures sont calculées ici.

Si vous êtes pressé, commencez ici : les boutons qui ne coûtent pas une seconde de GPU. On les tourne à chaque question, sur des poids figés.

Un bouton gratuit, c'est quoi

Un modèle entraîné ne choisit pas un mot : il note chaque candidat. Ce qu'on fait ensuite de ces notes s'appelle le décodage, et rien de cela n'est dans les poids.

Effet immédiat, 0 €. C'est pour ça qu'on l'oublie — et qu'on paie longtemps un mauvais réglage.

1. La température, en direct

Elle divise les notes avant le tirage. Basse, elle écrase les outsiders. Haute, elle aplatit tout : les improbables reviennent.

température0,70

tiré : —

Fig. 34 — « Le chat dort sur le … ». Calculé dans votre navigateur.

Les huit notes de départ sont posées à la main : la figure montre l'arithmétique, pas une mesure. Les autres chiffres viennent d'un run.

2. Le curseur « sage ↔ fou »

Le robot qui dessine offre un curseur « sage ↔ fou » de 0,3 à 1,2, jamais expliqué. Sage, le modèle enchaîne ses coups de crayon préférés : propre, et toujours pareil. Fou, il tente l'improbable — parfois du style, souvent un raté.

Réglages sages (≤ 0,7 avec top-p) : environ 11 beaux chats sur 12. En mode fou (0,9), nettement plus de ratés — une grille deux fois plus fine pardonne moins les audaces.

run-004d · 2026-07-22 · P100 · 45 min · 0 € · ce qui a marché

Le même run affiche une justesse tombée de 25,7 % à 17,5 %. Le modèle n'a pas empiré : la grille est passée de 64 à 128 cases, deviner juste devient plus dur. Changer la règle du jeu rend les métriques d'avant incomparables.

run-004d · EXPERIENCES.md

3. Les règles et le top-p

Deux filtres avant le tirage

Les règles interdisent les coups impossibles : chez le robot dessinateur, après un « x » vient forcément un « y ». Le top-p garde les meilleurs candidats jusqu'à une masse de 0,9 et jette la queue. Effet : moins de dessins cassés, plus de variété.

4. La pénalité de répétition

Elle baisse la note d'un mot déjà employé. Posée contre un modèle qui radotait, puis recopiée vingt runs sans remesure.

En mathématiques, répéter est obligatoire : un raisonnement réécrit les mêmes nombres à chaque ligne. Pénaliser la répétition ne combat pas le radotage, ça taxe le calcul. La retirer : 60/100 → 65/100, sans toucher un poids.

run-048 · 2026-08-05 · Kaggle GPU · 50 min · 0 € · chapitre LLM

moteur1,051,00écart
STaR 1,5 B6065+5
raisonneur5660+4
programmeur5251−1
vote ×66971+2
urne ×68287+5

Aucun optimum caché : 1,10 → 52, 1,05 → 60, 1,02 → 63, 1,00 → 65. Le code du programmeur répète peu de nombres (0,24 contre 0,80 en français) : la taxe n'a rien à prélever chez lui. Garde-fou : 0 génération dégénérée.

run-048 · balayage et comptage sur 3 cerveaux

5. Le nombre de brouillons

Faire écrire plusieurs réponses aux dés, puis élire la majorité. Le nombre de brouillons K se paie en secondes.

0 50 100 K=12 48 1632 2738 4666 7989 2734 3744 45 tireté : la réponse est dans l'urne · plein : le vote l'élit · sur 100 problèmes
Fig. 35 — run-020, 32 brouillons aux dés à température 0,8.

Le vote casse un plafond que l'entraînement n'avait pas su casser : 37 → 45 sur 100, zéro poids modifié. L'écart entre les deux courbes est la vraie information : sur 89 problèmes sur 100, la réponse est déjà dans les brouillons. Le modèle sait trouver, il ne sait pas élire.

run-020 · 2026-07-31 · P100 · 35 min · 0 €

Même bouton sur l'agent qui écrit des programmes : K = 1 → 49, K = 3 → 52, K = 5 → 53, K = 7 → 57. Six points gratuits ; l'urne contient la réponse 82 fois sur 100.

run-040 · 2026-08-03 · P100 · 40 min · 0 €

32 brouillons, c'est 32 fois le calcul : le curseur « réflexion » des modèles modernes, à essayer dans le chat.

6. L'amorce

Les mots autour de la question ne changent pas les poids, mais le chemin qu'elle emprunte dedans.

Même examen de 100 problèmes, aucun entraînement, en ajoutant « réfléchissons étape par étape » : le petit cerveau passe de 15 à 33, le grand de 38 à 54. Le record obtenu à force d'entraînements valait 57.

run-027 · 2026-08-01 · P100 · 2 h 30 · 0 €

Le contre-essai, publié parce qu'il a échoué : faire reformuler la question par le modèle avant de la résoudre. Sur un cas isolé, ça réparait une lecture piégeuse. À l'examen complet, température 0 : direct 37, réécriture 5 — trois réparés, trente-cinq cassés.

run-023 · 2026-07-31 · P100 · 30 min · 0 €

7. La force de bruitage

En diffusion, le bouton gratuit s'appelle la force : le niveau de bruit ajouté à une photo décide de ce qui survit d'elle.

Portraits réels donnés au modèle qui ne connaît que le dessin animé : à t = 300 la photo résiste ; vers 600 à 700, l'équilibre — pose et lumière de la personne, yeux et aplats du manga ; à 900, un personnage d'animation.

run-009 · 2026-07-24 · P100 · 2 h 15 · 0 € · la machine à manga

Le témoin qui borne le curseur : à t ≤ 500, les six commandes de couleur donnent la même image — la photo avait déjà tout décidé.

run-008-img2img · 2026-07-24 · kernel CPU · DDIM déterministe, 40 pas · 0 € · la diffusion

8. Le seuil, contre-exemple

Le seuil qui coupe une probabilité en deux est gratuit, et tentant.

Une page « offres d'emploi » d'entreprise était classée offre, 0,501. Monter le seuil l'effaçait. Le vrai défaut : le corpus n'avait jamais vu une page carrières. Une troisième classe fait tomber les faux positifs de 18,6 % à 2,7 % sur 371 pages, sans perdre un point de rappel (98,6 %).

run-058 · 2026-08-25 · Kaggle GPU · 3 h 10 · 0 € · le détecteur

Un bouton gratuit déplace une erreur ; il ne la répare pas.

9. La quantification

Arrondir les poids à 8 bits, après coup : 531 Mo par modèle et environ 19 jetons par seconde sur les deux cœurs bridés du serveur. Sans lui, aucune démo du site ne serait en ligne.

run-015-gguf · 2026-07-30 · Kaggle CPU · 10 min par modèle · 0 € · EXPERIENCES.md

Déclaré non mesuré