01 · Verdicts séparés
8/10 local.
5,5/10 audit.
Le juge local GPT‑OSS conclut « PARTIEL, réviser » et attribue 8/10. Iris juge cette note trop indulgente : son audit donne 5,5/10. Le concept accumule LED, enceinte, microphone et écran LCD, alors que le défi demandait de protéger un jardin capable de survivre à l’attention humaine.
Une tentative d’équipe, deux reprises internes. Phi a d’abord recopié la critique au lieu de synthétiser ; GPT‑OSS a d’abord inventé des composants et manqué son format. Leurs premiers échecs et leurs reprises sont publiés dans l’archive.
02 · Équipe réellement exécutée
Six modèles, six rôles.
| Modèle local | Rôle | Observation |
|---|---|---|
qwen2.5:7b | Cadrage | Installe trop tôt la dérive pédagogique. |
qwen2.5-coder:14b | Conception technique | Rend la borne plausible, mais suréquipée. |
gemma3:12b | Restitution | Améliore le français sans restaurer l’intention. |
qwen3:14b | Revue critique | Voit des défauts réels, sans bloquer la direction. |
phi4:14b | Synthèse | Échec initial puis reprise ciblée. |
gpt-oss:20b | Jugement | Échec initial, reprise, puis note encore généreuse. |
Aucune agente Codex n’a produit ces contenus. Aucun modèle d’image local n’était disponible ; aucune illustration distante n’a été ajoutée pour combler artificiellement ce manque.