• # Encore en train de lire

    Posté par  . Évalué à 2 (+0/-0).

    Comme quoi c’est intéressant. Pas une critique générale des LLMs, mais de la manière dont sont gérées les interactions avec eux.

    Y en a une qui m’intrigue : le reproche qu’on soit obligé de passer par du langage naturel. L’auteur exprime sa frustration qu’il y ait obligatoirement une couche d’interprétation entre ce qu’il veut faire et ce que le LLM va faire - via MCP.

    En gros il veut un IDE donc. Je trouve ça rigolo, mais pas nécessairement con. Je continue ma lecture…

    • [^] # Re: Encore en train de lire

      Posté par  (site web personnel) . Évalué à 3 (+0/-0).

      Les agents ne sont pas qu'un moyen pour découper le contexte comme le prétend l'article. Le fait de pouvoir utiliser des outils permet de faire des grep plus ou moins sensé évite d'avaler tout les fichiers du projet, c'est déjà pas mal. Il permet aussi à l'IA de se corriger dans une boucle de retroaction.

      D'expérience, une IA n'est pas vraiment capable de suivre plusieurs directive à la fois. Genre faire un code qui passe de bon teste et suivant une liste de règle. Claude est plus pénible que Codex de ce point de vue. Il "triche" plus. Bref, l'IA est un peu trop humaine de ce point de vue là.

      Le moyen de contrôler cela est de faire une session, un objectif. Par exemple, une session d'écriture de spec, une session d'écriture de test depuis la spec, puis une session de code qui suit la spec, doit faire passer les tests sans les modifier, et enfin une passe final pour faire une revue pour voir l'adéquation du tout à la spec ou de norme, et on reboucle en cas d'erreur.

      Comme c'est très chiant de faire cela à la main, les skills le font. J'utilise le projet "superpower" pour faire ça. Il force l'IA à faire du TDD. Je n'ai pas eu de mauvaise surprise pour l'instant.

      Il faudrait que je travail encore plus le coté de "le code fait réellement ce que l'on pense qu'il fait". On peux forcer les méthodologies aéronautique (code et test indépendant, revue de code et revue de test, puis traçabilité spec<->code et spec<-> test, puis couverture de code par les tests), on peut lancer les tests à la main. On peut multiplier le revue avec "normes", par exemple : est-ce que telle code n'a aucun code smell qui ressemble au TOP 10 des CVE.

      Quentin adam a été interviewé sur le sujet, c'est le PDG de clever-cloud https://www.youtube.com/watch?v=AiytemqB_F0 . Il parle de comment cadrer les IA pour faire le boulot. Il leur fait faire des taches "inhumaines" : comme créer des interfaces MOC que l'on n'aurait jamais le temps de faire à la main.

      "La première sécurité est la liberté"

Envoyer un commentaire

Suivre le flux des commentaires

Note : les commentaires appartiennent à celles et ceux qui les ont postés. Nous n’en sommes pas responsables.