Mais de toute façon, ça n'est pas une question d'expertise juridique, car les juristes et la loi française utilisent le terme "propriété intellectuelle".
Par contre, c'est une question de militantisme, car dire que le terme propriété intellectuelle est un problème est la position de RMS depuis des années. Et par problème, il faut comprendre que son usage ne s'aligne pas avec les idées cyberlibertarianistes défendues par RMS comme l'abolition total des restrictions sur les œuvres de l'esprit. Et donc, en incitant à faire changer les termes (sans aucun succès, il faut bien le reconnaître), on vise à obtenir 2 choses.
Primo, ça donne un ice breaker dans la discussion en donnant une raison d'intervenir car "quelqu'un n'utilise pas les bons mots". C'est très adapté aux modalités de communications des années 2000 et au web 2.0 ou les producteurs de textes sont partout. Donc ça donne quasiment un moyen clé en main de faire du bruit sur un sujet. Ici, c'est un peu inutile parce qu'on connait le sujet, mais bon, ç'est peut être un réflexe pavlovien.
Secundo, ça permet avant tout de signaler son appartenance à la mouvance qui s'aligne sur les positions de RMS. C'est comme dire GNU/Linux, mais ça n'a pas été autant tourné en ridicule. Le but n'est pas de faire changer les choses car ça n'a aucun effet matériel, mais de se distinguer et de créer une identité (encore une fois, un échec). Ce phénomène militant est largement plus visible dans les milieux queers/LGBT sur le web qui arrivent à faire changer les termes sur des échelles qui se sont comptes en années (exemple GLBT -> LGBT -> LGBTQ -> LGBTQIA+ -> queer, SOGIESC, SGM, GSRM, etc). Et la différence principale est qu'une partie de la communauté investit son temps sur ce travail pour définir les frontières des identités et parce que l'identité et ses conséquences sont au cœur des mouvements (ensuite, est ce que ça donne quelque chose d'utile, je ne crois pas, en tout cas pas directement à mon sens). Ce n'est pas le cas du mouvement du logiciel libre ou la production de logiciel est au cœur du mouvement, donc venir définir son identité n'a que peu d'importance pour une grande majorité de gens.
Et c'est parce que c'est une façon de se signaler que le commentaire commence par une attaque ad hominem, car le but est de faire réagir et d'attirer l'attention.
Mais quand on regarde le commentaire en détail, on voit quand même que la conclusion ne suit pas la prémisse. La prémisse "je ne suis pas "spécialiste juridique" car j’écris des choses fausses sur la propriété intellectuelle car le terme en français est contrefaçon" suivi de "le terme propriété intellectuelle est trompeur". Le raisonnement du premier point est faux comme dit ailleurs, mais surtout le second est une opinion et une position politique n'a rien à voir avec le raisonnement du début du commentaire, c'est de l'enfumage.
Ça se voit aussi parce qu'il n'y a aucune citation ou justification, et surtout parce qu'il y a tentative de masquer d’où vient l'opinion politique. Citer RMS en 2026, ç'est risquer de faire revenir tout les débats des années passés. Mais c'est surtout pousser le risque que quelqu'un note que le cyberlibertarianisme a été coopté par des grands noms qu'on déteste, comme Musk, etc.
Mais bon, que je sois spécialiste juridique ou pas ne change rien, je mets mon texte avec l'idée qu'il se suffise à lui même. Si d'autres personnes s'attachent de façon disproportionné au titre de la personne plus qu'à ce qui est dit, c'est triste, mais on est dans un pays libre.
Non, le droit d'auteur ne dérive pas du droit de propriété pour tout un tas de raisons juridiques et pratiques.
Alors peut être que "dériver" est pas le meilleur terme à utiliser (vu que bien sur, il y a eu des droits bien avant le concept de droit fondamental européen, vu qu'il y a eu des droits avant le concept de l'Union Européenne), peut être que j'aurais du dire "se rattache". Mais la directive qui régit le droit d'auteur en Europe (2001/29/CE, dite directive InfoSoc) dit au point 3 de son préambule:
(3) L'harmonisation envisagée contribuera à l'application des quatre libertés du marché intérieur et porte sur le respect des principes fondamentaux du droit et notamment de la propriété, dont la propriété intellectuelle, et de la liberté d'expression et de l'intérêt général.
Les titulaires de droits d’auteur bénéficient de la protection de l’article 1 du Protocole no 1 (Neij et Sunde Kolmisoppi c. Suède (déc.), 2013, et SIA AKKA/LAA c. Lettonie, 2016, § 41).
Le lien avec le principe de propriété et donc le droit à la propriété me semble assez clairement articulé aux échelons les plus haut du juridique en Europe.
Le terme «propriété intellectuelle» n'est destiné qu'à faire croire que c'est le cas pour prétendre que «la copie c'est du vol» alors que ça relève de la contrefaçon et pas du vol, justement.
Tu as le droit de suivre l'opinion de RMS sur le sujet, mais c'est pas ce qui est écrit dans les textes que j'ai cité. Et certes, la traduction en français et la transposition en droit français rendent les choses plus compliqués et changent parfois des trucs subtiles. Mais comme j'ai cité majoritairement le droit européen (la CEDH, le TFEU, l'AIA et le CRA), il m'a semblé clair que le contexte était le droit européen avant tout.
Ensuite, je suppose que c'est une référence à RMS parce qu'on est sur Linuxfr et que je connais mes classiques, mais c'est aussi la position qu'on peut dériver des actes de l'industrie de l'IA.
Il serait plus intéressant pour le débat de détailler un peu plus ta position autrement qu'en claquant une remarque rapide sur un point de vocabulaire pour défendre une position assez clairement minoritaire dans le monde. On est pas sur X/Twitter, c'est pas le royaume de la posture et du pinaillage sur le vocabulaire.
On a, mais si tu commences à dire qu'il y a ce genre de loi, ça va quand même rendre l'histoire moins viral.
Tout comme le fait que la liste des livres en question n'est pas publié, et qu'il faut aller tout en bas de l'article de igen.fr pour comprendre que "rare" dans ce contexte veut dire "imprimé en peu d'exemplaire". Par exemple, des livres en auto édition, mais aussi des livres en langue étrangère. Mais tout ça, ça n'a pas la force émotionnel de comparer ça à la bibliothèque d’Alexandrie, ça fait pas cliquer sur des liens.
Saviez vous qu'il y avait un autre candidat avec des soucis avec la justice dans cette éléction ?
Alors non, je ne parle pas de Laurence Fox, mais de Daniel Pocock, ancien développeur Debian déchu, tristement connu pour la campagne de harcèlement qu'il a commencé il y a bientôt 10 ans. C'est la deuxième fois qu'il tente de se faire élire à un mandat, la première fois étant en 2024. Ce fut l'occasion pour lui de battre un record, celui d'avoir le moins de voix toutes élections confondues sur cette circonscription (524 votants sur 1.3 millions d’électeurs, donc 0.04%). Ce coup ci, il n'a pas fini dernier, mais en ayant 16 votes sur les 79785 personnes inscrites sur les listes, il passe à 0.02%, c'est un peu la déchéance de faire un score moitié moins bon.
Pourquoi est ce qu'il se présente, je ne sais pas, mais je suppose que quand on a des dettes (50 000€ pour la compagnie d’électricité d’après son propre blog) et sans doute d'autres soucis, l'immunité parlementaire doit avoir un peu plus d'importance.
Saracroche maintient à jour une BdD des numéros repérés comme spammeurs par les usagers. Et donc en dehors des numéros obligatoires. Et il peut aussi agir sur les SMS.
Alors j'ai pas Saracroche, mon tel est trop vieux, mais sur yet another call blocker (l'appli que j'utilise), je vois bien que la majorité des appels bloqués le sont parce qu'ils sont dans la liste noire que j'ai rentré sous le nom "bloc arcep" (avec les indicatifs que l'arcep documente). Sur la liste des appels depuis le début de l'année, il y a eu entre 90 et 100 appels bloqués, et je pense qu'il y a moins de 5 numéros qui sont peut être du spam et qui n'ont pas été bloqué. Je ne suis pas sur parce que je regarde juste les appels hors du carnet d'adresse de moins d'une minute, et c'est pas parce que c'est court que c'était un spam. Donc ça fait entre 0 et 5% qui passent entre les filets, je pense que ça pointe en direction d'un impact indéniable de la loi, et un respect des obligations par une vaste majorité des acteurs de la chaîne.
Le problème de xmpp, c'est que personne ne sponsorise un ou plusieurs serveurs pour fournir un service pour le monde entier. Whatsapp, 3 milliard d'usager par mois, c'est 2000 fois plus que le fediverse. Et déjà là, c'est concentré sur quelques gros serveurs et il y a régulièrement des serveurs qui ferment. C'est comme le mail, ou les forges. On arrive à faire des trucs à une échelle assez petite, mais assez clairement, pas à l'échelle du monde.
Heu juste pour dire que je ne fais pas référence au PIB dans ce que je disais, mais je parlais de la croissance d'une économie dans son ensemble.
Oui, et de toute façon, réduire un système complexe à un chiffre est une très grosse simplification et une erreur (tout comme réduire une position politique à un angle dans une assemblé, angle lui même réduit à 4/5 positions).
A mon avis vu l'ampleur, tant qu'un paquet d'amendes ne sera pas tombé, ça ne changera rien.
En même temps, personne ne semble se plaindre, ou pas assez de monde.
Alors laissez vos bloqueurs (type Saracroche et Cie) actifs car sinon ça va s'engouffrer chez vous!
Saracroche s'appuie aussi sur le fait qu'il y a une obligation d'utiliser des ranges spécifiques de numéros, donc je vois pas pourquoi une certaine obligation marche (celle qui permet d'avoir saracroche), et pourquoi une autre ne marcherais pas.
Je pense que c'est pas tant la religion en tant que pratique, mais la religion en tant que vecteur de pouvoir (d'autant que la religion a du succès, pas grand monde va raler sur le culte de Zeus comme oppression de nos jours). On pourrait dire pareil des idéologies diverses et variées comme par exemple le communisme (exemple typique), mais aussi le nationalisme qui a commencé surtout comme idée de libération contre la royauté avant de prendre les connotations qu'on connaît. Et c'est inextricable car faire changer les choses (ce qui est le but de pas mal d'idéologies ou de mouvements), c'est avant tout essayer (et réussir) d'exercer un pouvoir dans un sens qu'on estime juste. Mais estimer ce qui est "juste" est assez casse gueule, car ce qui parait juste pour un groupe ne va pas l'être pour un autre.
Franchement, c'est petit joueur par rapport à nous.
(quoi, ma remarque est sarcastique et commente sur la nature humaine et l'incapacité à s'entendre à 100% quand il y a assez de monde, non, pas mon genre…)
Pareil, j'ai pas accroché. J'ai tenté sur un projet solo pour voir la syntaxe (donc git push sur main en direct), mais ça m'a vachement perturbé au final. Je retenterais sans doute dans 6 mois parce que je suis pas immunisé à la propagande, mais j'ai pas trop vu d'avantage dans le workflow d'un projet solo, voir c'était même plus chiant de devoir faire 2 commandes au lieu d'une pour pousser dans main. Et j'arrive déjà à faire des git rebase -i donc même si c'est plus simple avec jj, je n'en bénéficie pas trop.
Ah oui, parce que le capitalisme existe en dehors de la société.
Si AWS fait un DC, c'est pas juste pour polluer pour le fun parce que c'est pas un super vilain de Captain Planet. Le DC reflète une demande, et la demande vient bien de quelque part. Bien sur que les efforts d'une personne ne vont rien changer face au compte d'une infrastructure qui reflète la demande de plusieurs millions d'autres personnes.
À part chercher à se dédouaner d'un probléme collectif parce qu'on ne veut rien changer, ce genre de commentaire sert à rien.
En supposant une erreur dans les temps (passage de kwh en kw par an), ça fait une différence de 8000 sur les chiffres, ce qui change bien sur totalement ma conclusion.
Maintenant, le souci aussi, c est l'usage de gaz que je suppose naturel, car c'est un facteur 30 à 100 par rapport à du nucléaire, et 4 à 8 fois plus que du biomethane (vu la population de bovins au Texas, même si ça produit du co²).
Enfin bref, si vous êtes client AWS, il est sans doute temps de contacter votre attaché commercial pour foutre un peu de pression (sauf si je me suis planté encore sur les calculs, mon estomac est toujours vide).
Bon, malgré mes recalculs, je me demande si je me suis pas planté sur les unités de temps. Si quelqu'un sans l'estomac vide peut revérifier la concordance des unités, ça serait sympa.
On estime à 9 tonnes par personne et par an les émissions de CO² de la population française. On devrait ramener ça à 2 tonnes pour limiter le changement climatique (principalement via la viande rouge, le fait de prendre drastiquement moins l'avion, et moins d'achat de trucs neufs, je vous laisse jouer avec le graphique).
La, on a une centrale qui a un permis de consommer jusqu'à 30 millions de tonnes par an soit l'équivalent grosso modo des émissions de la population de Paris intramuros (2.1 millions d'habitant) et celle de Marseille (800 000) combinés, en supposant une conso moyenne de 9 tonnes.
En pratique, c'est une limite maximum et le permis parle de production de 7.65 GWh. Si on estime que le gaz produit 490 g de CO² par KWh (cf ce document qui cite le GIEC), la production de 7 650 000 KWh via du gaz va produire 3.7 milliards de gramme de CO², soit 3700 t de CO² (7 650 000 * 490, 1 tonne = 1 milliard de gramme), si je ne me suis pas trompé dans les calculs bien sur (si je me suis planté, le reste de mon commentaire serait bien sur incorrect et je me rétracterais devant des chiffres corrigés).
On est très loin de la limite du permis, et j'ai l'impression que le discours présente la limite comme étant la conso en pratique (exemple ici), ce qui me semble factuellement incorrect et manipulatoire, même si je trouve le permis beaucoup trop permissif à ce niveau (mais bon, le Texas, etc).
3700 tonnes de CO² par an, c'est pas rien, mais à 1.2 tonnes par personne et par vol transatlantique (A/R), avec 200 personnes par vol, c'est l'équivalent de la production d'une quinzaine d'avion qui font un Paris-New York (240 tonnes par vol), soit grosso modo le trafic sur cette ligne depuis CDG par jour (j'ai compté 15 vols dans une semaine, avec JFK et Newark).
Donc, si je ne me suis pas trompé dans les calculs, je pense qu'il ne faut pas oublier les leviers les plus impactants vis à vis du changement climatique (à savoir l'avion, la viande rouge, et remplacer trop souvent son matos électronique ou pas). Par refus du complotisme, je n'irais pas jusqu'à dire que certaines industries bénéficient de la distraction qu'entraîne le focus sur le CO² des datacenters, mais ça tomberais quand même à point nommé si ç’était le cas.
Alors si il y a une mauvaise utilisation de l'IA c'est bien ça. Wikipedia te le dis de manière certaine et surtout à jour (ça bouge les capitales !).
Bien sur, mais si je tape la demande sur Google ou DDG, et qu'une vignette s'affiche avec le résultat, et est ce que j'ai demandé à une IA si je ne vais pas sur Wikipedia ?
Et je suis d'accord que pour mon exemple qui marche parfaitement, c'est aussi un cas trivial ou ça marche sans LLM (et quand je déploie des modéles, j'envoie toujours 2/3 questions qui semblent trivial mais qui ne le sont pas, comme la durée de train Paris vers New York…). Mais je pense qu'il y a sans doute des demandes plus complexes qui ne vont pas sur WP directement pour illustrer le pouvoir du pattern matching.
Tu demandes un contenu éditorialisé
Certes, mais quand je demande ça sur un moteur de recherche, j'ai plus de choix, par fonctionnement d'un moteur de recherche. Et ce point sur le contenu éditorialisé est en fait important.
donc c'est difficile de reprocher à chacune de pas être celle que tu attendais
Nan, c'est pas difficile du tout, je viens de le faire :P
Mais mon point, c'était surtout qu'on peut pas faire confiance assez rapidement, donc prendre 3h pour un truc qui semble prendre 5 minutes me semble une simplification.
Pour le code (la question c'était "au quotidien", moi c'est le code) les hallucinations il n'y en a quasiment pas dès lors que tu utilises un agent (et pas 3 copier/coller sur le web).
Mais ça pose la question des biais. Un agent, c'est juste l'automatisation de la vérification des résultats. On va battre les hallucinations par le pouvoir des stats et une boucle (boucle qui au passage devrait être en logiciel libre, mais curieusement un point absent des discussions en général), en gros, ça bruteforce (une approche valable, je précise).
Mais si il y a des biais dans une demande que tu qualifie d'éditorial comment ça se manifeste dans le code ?
Je précise que je dit "qualifie d'éditorial" parce je suis d'accord avec toi, mais je ne trouve pas de meilleur mot, et j'ai le sentiment qu'il y en a un.
On force la forme que prends le code via l'usage des linters, on force le code à être correct via des tests et un compilo (quand c'est possible), et ça n'est pas un processus créatif ou éditorial, mais est ce qu'il y a plus que ça qui rentrerait dans la catégorie "editorial", et est ce que c'est important ?
Pour répondre à la seconde question, je pense que c'est important.
Vu que la protection via les droits d'auteurs du code dépend du fait qu'il y a un élément créatif (cf cette article), si on estime que le code produit n'est pas comparable au résultat d'une demande "éditorial", alors même si un humain sélectionne le code, on peut argumenter qu'il n'y rien de créatif, donc rien de protégeable (avec tout ce que ça implique).
Si au contraire, on estime que l'humain qui va examiner ce que produit le LLM est capable de faire un choix éditorial, alors ça veut dire que le code produit par les LLMs souffre de biais comme le programme des cinés clubs produit par un LLM.
Et donc, si on estime qu'il y a des biais, comment ça se manifeste dans le code en pratique ?
(question ouverte, j'ai pas assez réfléchi pour avoir un avis, et on m'a filé un angine ce weekend)
la révolution elle est déjà là. pas pour les défis de l'humanité (j'y crois pas une seule seconde), mais pour énormément de métiers. pas forcément une bonne révolution (seul le temps nous le dira), mais dès aujourd'hui, passer 3h à chercher ce qu'une IA peux te pointer du doigt en 5mn, c'est très mal vu en général.
Le souci, c'est que toutes les recherches ne sont pas égales (premier souci), et que les réponses ne sont pas toujours exhaustives (second souci), et que ça dérive (troisieme souci). Quand il s'agit d'un fait facile à vérifier, je pense que ça va. Par exemple, quelle est la capitale de la Mongolie, ça devrait aller.
Quand c'est sur un sujet moins présent dans le corpus (soit parce que c'est trop neuf, soit parce que c'est un sujet peu exploré), les risques d'halluciner augmentent. Par exemple, je suis sur que demander un résumé sur les lois autour du droit d'auteur en Afrique du Sud va donner un truc qui semble correct, mais qui va pas rentrer trop dans les détails, car les autres pays dominent sans doute le corpus, et les lois se ressemblent beaucoup. Mais peut être qu'il y a des documents et je suis pas tombé dessus.
Pour la dérive et les hallucinations, c'est facile à voir.
Par exemple, j'ai demandé une liste de films en abusant de Gemini de mon employeur (littéralement "j'ai besoin d'un liste de 10 films parlant de la GPA en vue d'organiser une rétrospective pour un club ciné."). Au début, je me suis planté, j'ai mis "PMA" au lieu de "GPA" et "Pro" au lieu de "Flash", et ça tourne encore.
J'ai pris ça parce que j'ai une idée assez précise des films sur le sujet sorti en France. J'avais en tête La Petite, il est pas dans la liste (ou La Fête des pères. Par contre, la réponse contient Gestación qui ne parle pas de GPA.
Donc hop, 10% d'hallucination.
J'ai refait une demande de ciné club sur un autre sujet (la bisexualité masculine au cinéma), la réponse est un chouia plus correct car il y a moins de films dans ma demande (6 au lieu de 10) et il y a plus de listes sur le web.
Par contre, j'ai aussi demandé des films en français, et dans la liste, il y a Cabaret (1972) qui est non dispo en streaming d'après allociné, et dont le dvd n'a pas de doublage français (vu que c'est une comédie musicale, c'est sans doute trop cher à doubler).
Encore une fois, j'ai du vérifier pour trouver ce qui va pas.
Et ça, c'est sans parler des autres soucis. Par exemple, la recherche est partie sans demander plus de détails (contrairement à un humain). J'ai eu plus qu'une liste à chaque fois (avec des explications, le titre du ciné club, les sujets à aborder, etc). J'ai eu des refs sans rapport avec les affirmations auquel elles sont attachés (vu que j'ai eu 6 fois le même article sur medium, qui ne parle que de la moitié des films de la liste…). Et à la fin, le système m'incite à continuer à utiliser Gemini en proposant d'autres requêtes, comme "faire les fiches du ciné club" ou "trouver des trucs plus expérimentaux ou plus anciens" (comprendre, avant les années 80…).
Pour le fun, j'ai cliqué sur le second, et la, le modèle s'éloigne en proposant Un chant d'amour, de Genet, qui est en effet ancien et plus expérimental, mais qui dérive du sujet de la bisexualité masculine.
Et même si j'ai pas les chiffres pour le vérifier, j'ai le sentiment que les résultats du modèle soit "culturellement aplatis". Vu que le LLM stocke tout sans trop de considération de langue (eg les tokens pour "chien" sont grosso modo au même endroit dans la matrice du LLM que "dog" ou "hund"), il me semble logique (et visiblement, d'autres personnes aussi, vu que quelqu'un a écrit sur le concept avant que je me pose la question) que si tu as peu de textes dans une langue sur un sujet (genre le français), mais beaucoup dans une autre (anglais), le modèle va tout prendre la ou un moteur de recherche ne va pas traverser la barrière de la langue. Et je me suis poser la question car sur les films sur la GPA de mon exemple, il y en avait 5 des USA, et 2 venant de l'Inde, 2 pays anglophones. Une fois que j'ai demandé spécifiquement en français, ça a pris plus de films français (et pas juste traduit).
Donc ouais, ça prends 5 minutes et pas 3h, mais le résultat est parfois subtilement faux, parfois à coté de la plaque, et sans doute subtilement biaisé
perso moi ce que je vois c'est que Claude génère du code meilleur que 90% que ce que je vois autour (et je suis gentil).
sans doute parce que le code qui a servi pour claude est du code libre (vu que c'est le code publique) qui est sans doute moins moche que les trucs horribles en internes fait par l'industrie au sens large. Ça me semble être un cas assez particulier car je ne suis pas sur qu'on retrouve une tel dichotomie dans d'autres secteurs de la société/partie du corpus (cad ou la majorité des données publiques sont de meilleurs qualités que les données privés).
Alors je veux bien faire preuve de bonne foi, mais mon premier lien pointe vers la page Wikipedia "Russian propaganda in educational system" (c'est de l'anglais, ça veut dire "Propagande dans le système educatif de la Russie", je voudrais bien dire que je fait ça au cas ou ça coince, mais je suis juste vexé donc je me défoule en étant sarcastique)
Et je sais pas ce qui est le plus vexant, que quelqu'un me réponde avec un lien qui va dans le sens exact de ce que j'ai donné comme source sans avoir cliqué sur le premier lien que j'ai donné, ou que 4 personnes estiment que ç'est pertinent de venir répéter ce qui est dit dans le lien que j'ai donné sans avoir cliqué sur celui ci.
Mais je vais supposer que je me suis mal expliqué.
Mon point est que Poutine est au pouvoir depuis 1999, et qu'à part des trucs nationalistes pas si fondamentalement différent de chez nous ou ailleurs (et non surprenant dans le contexte de l'aprés Perestroïka), il n'y a pas eu l'air d'avoir grand chose avant 2014 (d’après WP), et donc qu'une réforme des programmes en vue de faire de la propagande n'a pas été la priorité.
Et si il y a plus de la moitié de la page WP qui parle de ce qui est arrivé après 2022/2023 lors de la suite de l'invasion de l'Ukraine, c'est aussi signe qu'il y a eu plus d'efforts après 2022, donc beaucoup moins avant.
D'ailleurs, le lien d'Amnesty International (car j'ai cliqué dessus) ne semble parler que de l’après 2023 (ou en tout cas, ne donne pas d'autres dates sauf si j'ai mal lu), ce qui va dans le sens de ce que j'ai dit.
Car la formule "n'a pas été la priorité", c'est exactement ça. Je veux pas dire "ça n'a pas été fait", ou "ça n'arrive pas" mais ça n'a pas été fait tout de suite. Il y a eu 15 ans entre la prise de pouvoir et les premiers efforts (si on compte 2014), et plus que 15 si on ne garde que 2023.
Et je mets ça en comparaison avec le régime nazi où les Hitlerjugend sont devenus l'unique groupe pour jeunes garçons 3 ans après l'arrivée des Nazis au pouvoir.
On peut comparer avec la Hongrie de Orbán ou j'ai trouvé un article qui parle de propagande pro-russe en 2020, soit 10 ans après sa 2nde arrivée au pouvoir, et 6 ans après son virage illibéral.
Dernier exemple, l'Italie fasciste ou visiblement, c'est arrivé tout de suite, et donc ou c'était une priorité.
je réponds à "refourguer leur camelote proprio" du commentaire d'en haut, car c'est pas exactement le cas ici. En tout cas, rien qui pointe dans ce sens au contraire du fait que ça soit le CNLL qui râle.
Alors l'environnement est un vrai probléme, mais ce qui me dérange, c'est que c'est assez clairement détourné.
Les feux de forêts à coté de Bordeaux sont une bonne illustration de ce que je pense. De ce que je vois sur les réseaux sociaux, ça sert surtout pour se défouler sur le gouvernement. Je comprends que les gens soient émues, et il y a des gens qui ont tout perdus, etc.
Et bien sur, on peut critiquer le gouvernement et je ne doute pas que ça soit plus que critiquable, mais fondamentalement, le probléme est que personne ne veut payer plus d’impôt pour qu'on puisse dépenser plus d'argent pour l'adaptation, et qu'on s’attend tous à ce que rien ne change en moins bien malgré des chocs économiques non prévisibles.
Par exemple, le coût de la crise du COVID est loin d'être négligeable. Si on regarde juste le cout du bouclier tarifaire sur le gaz et l'elec, ça se chiffre à quelques dizaines de milliards. Le cout de ce bouclier, c'est de l'ordre de 10% du déficit (qui est de 150 milliards d’après l'INSEE).
Je juge pas si on devait le faire ou pas, mais on peut dire que l'argent qui est parti dans le bouclier est celui qui n'est pas parti dans les canadairs au même moment. Et je ne dit pas qu'on aurait pas du faire le bouclier tarifaire, mais qu'à un moment, on sort de l'argent qu'on a pas, et franchement, ça me fait chier de le dire parce que c'est quand même une idée de droitard, mais c'est quand même un souci dont on discute pas assez. À la place, on a les parties politiques qui s'accusent mutuellement au lieu de chercher le consensus et d'essayer d'unir le pays. On devrais se poser plus souvent la question de "pourquoi y a pas plus de thunes" et "que faire pour en avoir plus", ou "comment limiter le changement climatique en pratique" que "qui est responsable".
J'ai vu 0 personne dire "pour éviter les feux de forêts, il faut lutter contre le réchauffement climatique, donc changer notre mode de vie, par exemple devenir végétarien". C'est normal, c'est pas un bon message, c'est condescendant, c'est culpabilisant, ça touche à des trucs qu'on aime comme manger. Et c'est peut être contre productif vu comment certains partis capitalisent sur la grogne. Et en même temps, bah, c'est sans doute vrai.
Le fait qu'on se préoccupe de l'écologie que quand ça permet de pourrir le gouvernement en place, ou quand ça s'aligne avec des idées qu'on a déjà (genre "la silicon valley, c'est mal", mais aussi "les pollueurs, c'est surtout les autres pays", voir directement des idées écofascistes), ça me semble un souci.
Et pour corriger un message, soit on crie plus fort, et clairement, c'est pas ma voix qui va porter, soit on essaye de donner des billes aux autres pour le faire. Moi, je pense que je suis meilleur à donner des billes aux autres, ce que je fais.
Ensuite, oui, tu as raison de dire que je devrais être moins dans la réaction.
Et sur les LLMs, je pense que déjà, se former est un bon plan. Arrêter de croire que c'est magique, mais aussi arrêter de croire que les gens qui utilisent n'ont pas de raisons valables de le faire. C'est très centriste et mou comme vision, mais je pense que la techno est la et contrairement à la blockchain, elle a un usage. Donc j'ai tendance à dire que comme disent les anglais, le génie ne va pas revenir dans la bouteille.
Ensuite, est ce que ça va rester comme ça sans rien changer, sans doute pas (ne serais que pour des questions économiques). Mais je pense qu'il faut aussi arrêter les hyperboles non justifiés, arrêter d'amplifier les hyperboles (mais encore une fois, peut être que je vois juste les mauvais trucs, peut être que j'ai mal dormi).
Juste un truc en passant : non, maintenant c'est l'utilisation qui crame plus d'énergie sauf évolution récente, une seule requête peut cramer énormément de token.
L'utilisation d'un modèle complexe pour faire n'imp est une aberration, oui. Mais prendre le pire cas possible comme argument me parait discutable. Je n'ai aucun doute sur le fait que ça va vite changer le jour ou les tokens vont être correctement facturés, donc ça me semble moins une priorité parce que ça va venir tôt ou tard.
Et si je regarde ce papier de janvier 2026, les auteurs disent bien qu'il y a une grande variante entre les modèles (point 2.3.3), genre un facteur de 140, et effectivement, le papier va dans ton sens sur avec le point 3 ("GPT 3.3 a pris 1GWh pour le training, la conso en inférence est 564MWh par jour pour 10 millions d'utilisateurs". Ensuite, comparer l’entraînement du modèle GPT 3.3 (de 2020) avec l'inférence de GPT 5.x me semble assez incorrect, mais même avec un facteur 10 de différence, ça pointe en faveur de l'inférence.
Maintenant, la conso de us-east-1, j'ai lu que ç'est 2.2GWh (j'ai pas noté la source, j'ai supposé par jour). À titre de comparaison, l'usine de Tobata Seisakusho consomme 1 à 5 MWh pour traiter 1 tonne de minérai dans un four, et traite 1500 tonnes de minerais par jour, donc consomme entre 1.5 GWh à 7.5GWh par jour (encore une fois, j'ai pris des notes mais j'ai pas noté la source, j'ai du chercher "consommation d'une usine" sur le web une nuit). Donc je pense qu'on peut relativiser un peu l'exceptionnalisme des llms. C'est pas rien et je dit pas qu'il faut rien faire, mais c'est pas non plus exceptionnel par rapport à la sidérurgie, loin de la.
Sauf que tout le monde se fout de l'impact de la sidérurgie, car tout le monde comprends bien que si on veut des rails ou des voitures, faut le faire.
Passer son temps à réagir aux critiques des autres est-ce bien constructif ?
Ah bah moi, je suis la pour passer le temps et gagner du karma. Si on changeais le monde sur Linuxfr, on le saurait.
[^] # Re: IANAL
Posté par Misc (site web personnel) . En réponse au journal NVIDIA, l'OSI et la licence OpenMDW. Évalué à 8 (+5/-0).
Mais de toute façon, ça n'est pas une question d'expertise juridique, car les juristes et la loi française utilisent le terme "propriété intellectuelle".
Par contre, c'est une question de militantisme, car dire que le terme propriété intellectuelle est un problème est la position de RMS depuis des années. Et par problème, il faut comprendre que son usage ne s'aligne pas avec les idées cyberlibertarianistes défendues par RMS comme l'abolition total des restrictions sur les œuvres de l'esprit. Et donc, en incitant à faire changer les termes (sans aucun succès, il faut bien le reconnaître), on vise à obtenir 2 choses.
Primo, ça donne un ice breaker dans la discussion en donnant une raison d'intervenir car "quelqu'un n'utilise pas les bons mots". C'est très adapté aux modalités de communications des années 2000 et au web 2.0 ou les producteurs de textes sont partout. Donc ça donne quasiment un moyen clé en main de faire du bruit sur un sujet. Ici, c'est un peu inutile parce qu'on connait le sujet, mais bon, ç'est peut être un réflexe pavlovien.
Secundo, ça permet avant tout de signaler son appartenance à la mouvance qui s'aligne sur les positions de RMS. C'est comme dire GNU/Linux, mais ça n'a pas été autant tourné en ridicule. Le but n'est pas de faire changer les choses car ça n'a aucun effet matériel, mais de se distinguer et de créer une identité (encore une fois, un échec). Ce phénomène militant est largement plus visible dans les milieux queers/LGBT sur le web qui arrivent à faire changer les termes sur des échelles qui se sont comptes en années (exemple GLBT -> LGBT -> LGBTQ -> LGBTQIA+ -> queer, SOGIESC, SGM, GSRM, etc). Et la différence principale est qu'une partie de la communauté investit son temps sur ce travail pour définir les frontières des identités et parce que l'identité et ses conséquences sont au cœur des mouvements (ensuite, est ce que ça donne quelque chose d'utile, je ne crois pas, en tout cas pas directement à mon sens). Ce n'est pas le cas du mouvement du logiciel libre ou la production de logiciel est au cœur du mouvement, donc venir définir son identité n'a que peu d'importance pour une grande majorité de gens.
Et c'est parce que c'est une façon de se signaler que le commentaire commence par une attaque ad hominem, car le but est de faire réagir et d'attirer l'attention.
Mais quand on regarde le commentaire en détail, on voit quand même que la conclusion ne suit pas la prémisse. La prémisse "je ne suis pas "spécialiste juridique" car j’écris des choses fausses sur la propriété intellectuelle car le terme en français est contrefaçon" suivi de "le terme propriété intellectuelle est trompeur". Le raisonnement du premier point est faux comme dit ailleurs, mais surtout le second est une opinion et une position politique n'a rien à voir avec le raisonnement du début du commentaire, c'est de l'enfumage.
Ça se voit aussi parce qu'il n'y a aucune citation ou justification, et surtout parce qu'il y a tentative de masquer d’où vient l'opinion politique. Citer RMS en 2026, ç'est risquer de faire revenir tout les débats des années passés. Mais c'est surtout pousser le risque que quelqu'un note que le cyberlibertarianisme a été coopté par des grands noms qu'on déteste, comme Musk, etc.
Mais bon, que je sois spécialiste juridique ou pas ne change rien, je mets mon texte avec l'idée qu'il se suffise à lui même. Si d'autres personnes s'attachent de façon disproportionné au titre de la personne plus qu'à ce qui est dit, c'est triste, mais on est dans un pays libre.
[^] # Re: IANAL
Posté par Misc (site web personnel) . En réponse au journal NVIDIA, l'OSI et la licence OpenMDW. Évalué à 7 (+4/-0).
Alors peut être que "dériver" est pas le meilleur terme à utiliser (vu que bien sur, il y a eu des droits bien avant le concept de droit fondamental européen, vu qu'il y a eu des droits avant le concept de l'Union Européenne), peut être que j'aurais du dire "se rattache". Mais la directive qui régit le droit d'auteur en Europe (2001/29/CE, dite directive InfoSoc) dit au point 3 de son préambule:
De même, le résumé de jurisprudence de la CEDH sur l'article 1 du protocole 1, point 56 aux pages 16/17 dit:
Le lien avec le principe de propriété et donc le droit à la propriété me semble assez clairement articulé aux échelons les plus haut du juridique en Europe.
Tu as le droit de suivre l'opinion de RMS sur le sujet, mais c'est pas ce qui est écrit dans les textes que j'ai cité. Et certes, la traduction en français et la transposition en droit français rendent les choses plus compliqués et changent parfois des trucs subtiles. Mais comme j'ai cité majoritairement le droit européen (la CEDH, le TFEU, l'AIA et le CRA), il m'a semblé clair que le contexte était le droit européen avant tout.
Ensuite, je suppose que c'est une référence à RMS parce qu'on est sur Linuxfr et que je connais mes classiques, mais c'est aussi la position qu'on peut dériver des actes de l'industrie de l'IA.
Il serait plus intéressant pour le débat de détailler un peu plus ta position autrement qu'en claquant une remarque rapide sur un point de vocabulaire pour défendre une position assez clairement minoritaire dans le monde. On est pas sur X/Twitter, c'est pas le royaume de la posture et du pinaillage sur le vocabulaire.
# Parfait pour le futur
Posté par Misc (site web personnel) . En réponse au lien Linux 6.18 pour l'ESP32-S31 (RISC-V à 320 MHz et 16 MB de RAM). Évalué à 6 (+3/-0).
Vu que le prix de la ram décolle, on va bientôt pouvoir tout juste avoir 16M au lieu de 16G.
[^] # Re: mouais?
Posté par Misc (site web personnel) . En réponse au lien Google commence à déployer son mécanisme de restriction des APK tiers. Évalué à 5 (+2/-0).
Hier, j'ai reçu une notif pour un update sur mon galaxy s8. J'ai rien eu depuis 5 ans. La mise à jour est en attente pour le moment.
[^] # Re: Bureau des complots
Posté par Misc (site web personnel) . En réponse au journal Série d’été 2026 de France-Culture sur les rumeurs. Évalué à 6 (+3/-0).
Sion, y a https://www.franceinfo.fr/replay-radio/complorama/ (en pause pour l'été)
[^] # Re: C'est pas un problème d'IA, c'est un problème de loi
Posté par Misc (site web personnel) . En réponse au lien Un AirTag a permis de démontrer qu'une filiale d'Amazon achète des livres pour les détruire et entraîner une IA. Évalué à 10 (+7/-0).
On a, mais si tu commences à dire qu'il y a ce genre de loi, ça va quand même rendre l'histoire moins viral.
Tout comme le fait que la liste des livres en question n'est pas publié, et qu'il faut aller tout en bas de l'article de igen.fr pour comprendre que "rare" dans ce contexte veut dire "imprimé en peu d'exemplaire". Par exemple, des livres en auto édition, mais aussi des livres en langue étrangère. Mais tout ça, ça n'a pas la force émotionnel de comparer ça à la bibliothèque d’Alexandrie, ça fait pas cliquer sur des liens.
[^] # Re: Calculs de coin de table
Posté par Misc (site web personnel) . En réponse au lien Agriculture et nappes phréatiques - En moyenne 1 300m3 d'eau s'évapore de la bassine de Sainte Soline chaque jour, consommation journalière d'une ville de.... Évalué à 3 (+0/-0).
Je pense qu'on devrait aller inspecter sur place et constater le niveau de l'eau en planque dans la piscine.
# En parlant de Clacton-on-Sea et de Linuxfr
Posté par Misc (site web personnel) . En réponse au journal Non, Netanyahou, la BD "Panique à Londres" n'est pas un documentaire sur l'érection de la République Islamique de Grande-Bretagne 🙄. Évalué à 6 (+3/-0).
Saviez vous qu'il y avait un autre candidat avec des soucis avec la justice dans cette éléction ?
Alors non, je ne parle pas de Laurence Fox, mais de Daniel Pocock, ancien développeur Debian déchu, tristement connu pour la campagne de harcèlement qu'il a commencé il y a bientôt 10 ans. C'est la deuxième fois qu'il tente de se faire élire à un mandat, la première fois étant en 2024. Ce fut l'occasion pour lui de battre un record, celui d'avoir le moins de voix toutes élections confondues sur cette circonscription (524 votants sur 1.3 millions d’électeurs, donc 0.04%). Ce coup ci, il n'a pas fini dernier, mais en ayant 16 votes sur les 79785 personnes inscrites sur les listes, il passe à 0.02%, c'est un peu la déchéance de faire un score moitié moins bon.
Pourquoi est ce qu'il se présente, je ne sais pas, mais je suppose que quand on a des dettes (50 000€ pour la compagnie d’électricité d’après son propre blog) et sans doute d'autres soucis, l'immunité parlementaire doit avoir un peu plus d'importance.
[^] # Re: Dissuasif⁉️ 🤣
Posté par Misc (site web personnel) . En réponse au lien Démarchage téléphonique : à partir du 11 août, les entreprises devront obtenir le consentement des consommateurs. Évalué à 3 (+0/-0).
Alors j'ai pas Saracroche, mon tel est trop vieux, mais sur yet another call blocker (l'appli que j'utilise), je vois bien que la majorité des appels bloqués le sont parce qu'ils sont dans la liste noire que j'ai rentré sous le nom "bloc arcep" (avec les indicatifs que l'arcep documente). Sur la liste des appels depuis le début de l'année, il y a eu entre 90 et 100 appels bloqués, et je pense qu'il y a moins de 5 numéros qui sont peut être du spam et qui n'ont pas été bloqué. Je ne suis pas sur parce que je regarde juste les appels hors du carnet d'adresse de moins d'une minute, et c'est pas parce que c'est court que c'était un spam. Donc ça fait entre 0 et 5% qui passent entre les filets, je pense que ça pointe en direction d'un impact indéniable de la loi, et un respect des obligations par une vaste majorité des acteurs de la chaîne.
[^] # Re: Signal
Posté par Misc (site web personnel) . En réponse au lien Résolution de la rentrée : quitter WhatsApp. Évalué à 9 (+6/-0).
Le problème de xmpp, c'est que personne ne sponsorise un ou plusieurs serveurs pour fournir un service pour le monde entier. Whatsapp, 3 milliard d'usager par mois, c'est 2000 fois plus que le fediverse. Et déjà là, c'est concentré sur quelques gros serveurs et il y a régulièrement des serveurs qui ferment. C'est comme le mail, ou les forges. On arrive à faire des trucs à une échelle assez petite, mais assez clairement, pas à l'échelle du monde.
[^] # Re: Pensée systémique.
Posté par Misc (site web personnel) . En réponse au lien L’arnaque du bilan carbone. Évalué à 5 (+2/-0).
Oui, et de toute façon, réduire un système complexe à un chiffre est une très grosse simplification et une erreur (tout comme réduire une position politique à un angle dans une assemblé, angle lui même réduit à 4/5 positions).
[^] # Re: Dissuasif⁉️ 🤣
Posté par Misc (site web personnel) . En réponse au lien Démarchage téléphonique : à partir du 11 août, les entreprises devront obtenir le consentement des consommateurs. Évalué à 4 (+1/-0).
En même temps, personne ne semble se plaindre, ou pas assez de monde.
Saracroche s'appuie aussi sur le fait qu'il y a une obligation d'utiliser des ranges spécifiques de numéros, donc je vois pas pourquoi une certaine obligation marche (celle qui permet d'avoir saracroche), et pourquoi une autre ne marcherais pas.
[^] # Re: Modération
Posté par Misc (site web personnel) . En réponse au journal Rachat d'Electronic Arts finalisé. Évalué à 3 (+0/-0).
Je pense que c'est pas tant la religion en tant que pratique, mais la religion en tant que vecteur de pouvoir (d'autant que la religion a du succès, pas grand monde va raler sur le culte de Zeus comme oppression de nos jours). On pourrait dire pareil des idéologies diverses et variées comme par exemple le communisme (exemple typique), mais aussi le nationalisme qui a commencé surtout comme idée de libération contre la royauté avant de prendre les connotations qu'on connaît. Et c'est inextricable car faire changer les choses (ce qui est le but de pas mal d'idéologies ou de mouvements), c'est avant tout essayer (et réussir) d'exercer un pouvoir dans un sens qu'on estime juste. Mais estimer ce qui est "juste" est assez casse gueule, car ce qui parait juste pour un groupe ne va pas l'être pour un autre.
[^] # Re: Modération
Posté par Misc (site web personnel) . En réponse au journal Rachat d'Electronic Arts finalisé. Évalué à 3 (+0/-0).
Franchement, c'est petit joueur par rapport à nous.
(quoi, ma remarque est sarcastique et commente sur la nature humaine et l'incapacité à s'entendre à 100% quand il y a assez de monde, non, pas mon genre…)
[^] # Re: Je n'ai pas accroché
Posté par Misc (site web personnel) . En réponse au journal Jujutsu v0.44.0. Évalué à 5 (+2/-0).
Pareil, j'ai pas accroché. J'ai tenté sur un projet solo pour voir la syntaxe (donc git push sur main en direct), mais ça m'a vachement perturbé au final. Je retenterais sans doute dans 6 mois parce que je suis pas immunisé à la propagande, mais j'ai pas trop vu d'avantage dans le workflow d'un projet solo, voir c'était même plus chiant de devoir faire 2 commandes au lieu d'une pour pousser dans main. Et j'arrive déjà à faire des git rebase -i donc même si c'est plus simple avec jj, je n'en bénéficie pas trop.
[^] # Re: Pour rappel
Posté par Misc (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 1 (+0/-2).
Ah oui, parce que le capitalisme existe en dehors de la société.
Si AWS fait un DC, c'est pas juste pour polluer pour le fun parce que c'est pas un super vilain de Captain Planet. Le DC reflète une demande, et la demande vient bien de quelque part. Bien sur que les efforts d'une personne ne vont rien changer face au compte d'une infrastructure qui reflète la demande de plusieurs millions d'autres personnes.
À part chercher à se dédouaner d'un probléme collectif parce qu'on ne veut rien changer, ce genre de commentaire sert à rien.
[^] # Re: Pour rappel
Posté par Misc (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 5 (+2/-0).
En supposant une erreur dans les temps (passage de kwh en kw par an), ça fait une différence de 8000 sur les chiffres, ce qui change bien sur totalement ma conclusion.
Maintenant, le souci aussi, c est l'usage de gaz que je suppose naturel, car c'est un facteur 30 à 100 par rapport à du nucléaire, et 4 à 8 fois plus que du biomethane (vu la population de bovins au Texas, même si ça produit du co²).
Enfin bref, si vous êtes client AWS, il est sans doute temps de contacter votre attaché commercial pour foutre un peu de pression (sauf si je me suis planté encore sur les calculs, mon estomac est toujours vide).
[^] # Re: Pour rappel
Posté par Misc (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 2 (+0/-1).
Bon, malgré mes recalculs, je me demande si je me suis pas planté sur les unités de temps. Si quelqu'un sans l'estomac vide peut revérifier la concordance des unités, ça serait sympa.
# Pour rappel
Posté par Misc (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 5 (+3/-1).
On estime à 9 tonnes par personne et par an les émissions de CO² de la population française. On devrait ramener ça à 2 tonnes pour limiter le changement climatique (principalement via la viande rouge, le fait de prendre drastiquement moins l'avion, et moins d'achat de trucs neufs, je vous laisse jouer avec le graphique).
La, on a une centrale qui a un permis de consommer jusqu'à 30 millions de tonnes par an soit l'équivalent grosso modo des émissions de la population de Paris intramuros (2.1 millions d'habitant) et celle de Marseille (800 000) combinés, en supposant une conso moyenne de 9 tonnes.
En pratique, c'est une limite maximum et le permis parle de production de 7.65 GWh. Si on estime que le gaz produit 490 g de CO² par KWh (cf ce document qui cite le GIEC), la production de 7 650 000 KWh via du gaz va produire 3.7 milliards de gramme de CO², soit 3700 t de CO² (7 650 000 * 490, 1 tonne = 1 milliard de gramme), si je ne me suis pas trompé dans les calculs bien sur (si je me suis planté, le reste de mon commentaire serait bien sur incorrect et je me rétracterais devant des chiffres corrigés).
On est très loin de la limite du permis, et j'ai l'impression que le discours présente la limite comme étant la conso en pratique (exemple ici), ce qui me semble factuellement incorrect et manipulatoire, même si je trouve le permis beaucoup trop permissif à ce niveau (mais bon, le Texas, etc).
3700 tonnes de CO² par an, c'est pas rien, mais à 1.2 tonnes par personne et par vol transatlantique (A/R), avec 200 personnes par vol, c'est l'équivalent de la production d'une quinzaine d'avion qui font un Paris-New York (240 tonnes par vol), soit grosso modo le trafic sur cette ligne depuis CDG par jour (j'ai compté 15 vols dans une semaine, avec JFK et Newark).
Donc, si je ne me suis pas trompé dans les calculs, je pense qu'il ne faut pas oublier les leviers les plus impactants vis à vis du changement climatique (à savoir l'avion, la viande rouge, et remplacer trop souvent son matos électronique ou pas). Par refus du complotisme, je n'irais pas jusqu'à dire que certaines industries bénéficient de la distraction qu'entraîne le focus sur le CO² des datacenters, mais ça tomberais quand même à point nommé si ç’était le cas.
[^] # Re: Ça vous sert à quoi au quotidien ?
Posté par Misc (site web personnel) . En réponse au journal Auto-héberger ses LLM (IA) : Débordement CPU+RAM, Mixture-of-Experts et Benchmarks. Évalué à 4 (+1/-0).
Bien sur, mais si je tape la demande sur Google ou DDG, et qu'une vignette s'affiche avec le résultat, et est ce que j'ai demandé à une IA si je ne vais pas sur Wikipedia ?
Et je suis d'accord que pour mon exemple qui marche parfaitement, c'est aussi un cas trivial ou ça marche sans LLM (et quand je déploie des modéles, j'envoie toujours 2/3 questions qui semblent trivial mais qui ne le sont pas, comme la durée de train Paris vers New York…). Mais je pense qu'il y a sans doute des demandes plus complexes qui ne vont pas sur WP directement pour illustrer le pouvoir du pattern matching.
Certes, mais quand je demande ça sur un moteur de recherche, j'ai plus de choix, par fonctionnement d'un moteur de recherche. Et ce point sur le contenu éditorialisé est en fait important.
Nan, c'est pas difficile du tout, je viens de le faire :P
Mais mon point, c'était surtout qu'on peut pas faire confiance assez rapidement, donc prendre 3h pour un truc qui semble prendre 5 minutes me semble une simplification.
Mais ça pose la question des biais. Un agent, c'est juste l'automatisation de la vérification des résultats. On va battre les hallucinations par le pouvoir des stats et une boucle (boucle qui au passage devrait être en logiciel libre, mais curieusement un point absent des discussions en général), en gros, ça bruteforce (une approche valable, je précise).
Mais si il y a des biais dans une demande que tu qualifie d'éditorial comment ça se manifeste dans le code ?
Je précise que je dit "qualifie d'éditorial" parce je suis d'accord avec toi, mais je ne trouve pas de meilleur mot, et j'ai le sentiment qu'il y en a un.
On force la forme que prends le code via l'usage des linters, on force le code à être correct via des tests et un compilo (quand c'est possible), et ça n'est pas un processus créatif ou éditorial, mais est ce qu'il y a plus que ça qui rentrerait dans la catégorie "editorial", et est ce que c'est important ?
Pour répondre à la seconde question, je pense que c'est important.
Vu que la protection via les droits d'auteurs du code dépend du fait qu'il y a un élément créatif (cf cette article), si on estime que le code produit n'est pas comparable au résultat d'une demande "éditorial", alors même si un humain sélectionne le code, on peut argumenter qu'il n'y rien de créatif, donc rien de protégeable (avec tout ce que ça implique).
Si au contraire, on estime que l'humain qui va examiner ce que produit le LLM est capable de faire un choix éditorial, alors ça veut dire que le code produit par les LLMs souffre de biais comme le programme des cinés clubs produit par un LLM.
Et donc, si on estime qu'il y a des biais, comment ça se manifeste dans le code en pratique ?
(question ouverte, j'ai pas assez réfléchi pour avoir un avis, et on m'a filé un angine ce weekend)
[^] # Re: Ça vous sert à quoi au quotidien ?
Posté par Misc (site web personnel) . En réponse au journal Auto-héberger ses LLM (IA) : Débordement CPU+RAM, Mixture-of-Experts et Benchmarks. Évalué à 4 (+2/-1).
Le souci, c'est que toutes les recherches ne sont pas égales (premier souci), et que les réponses ne sont pas toujours exhaustives (second souci), et que ça dérive (troisieme souci). Quand il s'agit d'un fait facile à vérifier, je pense que ça va. Par exemple, quelle est la capitale de la Mongolie, ça devrait aller.
Quand c'est sur un sujet moins présent dans le corpus (soit parce que c'est trop neuf, soit parce que c'est un sujet peu exploré), les risques d'halluciner augmentent. Par exemple, je suis sur que demander un résumé sur les lois autour du droit d'auteur en Afrique du Sud va donner un truc qui semble correct, mais qui va pas rentrer trop dans les détails, car les autres pays dominent sans doute le corpus, et les lois se ressemblent beaucoup. Mais peut être qu'il y a des documents et je suis pas tombé dessus.
Pour la dérive et les hallucinations, c'est facile à voir.
Par exemple, j'ai demandé une liste de films en abusant de Gemini de mon employeur (littéralement "j'ai besoin d'un liste de 10 films parlant de la GPA en vue d'organiser une rétrospective pour un club ciné."). Au début, je me suis planté, j'ai mis "PMA" au lieu de "GPA" et "Pro" au lieu de "Flash", et ça tourne encore.
J'ai pris ça parce que j'ai une idée assez précise des films sur le sujet sorti en France. J'avais en tête La Petite, il est pas dans la liste (ou La Fête des pères. Par contre, la réponse contient Gestación qui ne parle pas de GPA.
Donc hop, 10% d'hallucination.
J'ai refait une demande de ciné club sur un autre sujet (la bisexualité masculine au cinéma), la réponse est un chouia plus correct car il y a moins de films dans ma demande (6 au lieu de 10) et il y a plus de listes sur le web.
Par contre, j'ai aussi demandé des films en français, et dans la liste, il y a Cabaret (1972) qui est non dispo en streaming d'après allociné, et dont le dvd n'a pas de doublage français (vu que c'est une comédie musicale, c'est sans doute trop cher à doubler).
Encore une fois, j'ai du vérifier pour trouver ce qui va pas.
Et ça, c'est sans parler des autres soucis. Par exemple, la recherche est partie sans demander plus de détails (contrairement à un humain). J'ai eu plus qu'une liste à chaque fois (avec des explications, le titre du ciné club, les sujets à aborder, etc). J'ai eu des refs sans rapport avec les affirmations auquel elles sont attachés (vu que j'ai eu 6 fois le même article sur medium, qui ne parle que de la moitié des films de la liste…). Et à la fin, le système m'incite à continuer à utiliser Gemini en proposant d'autres requêtes, comme "faire les fiches du ciné club" ou "trouver des trucs plus expérimentaux ou plus anciens" (comprendre, avant les années 80…).
Pour le fun, j'ai cliqué sur le second, et la, le modèle s'éloigne en proposant Un chant d'amour, de Genet, qui est en effet ancien et plus expérimental, mais qui dérive du sujet de la bisexualité masculine.
Et même si j'ai pas les chiffres pour le vérifier, j'ai le sentiment que les résultats du modèle soit "culturellement aplatis". Vu que le LLM stocke tout sans trop de considération de langue (eg les tokens pour "chien" sont grosso modo au même endroit dans la matrice du LLM que "dog" ou "hund"), il me semble logique (et visiblement, d'autres personnes aussi, vu que quelqu'un a écrit sur le concept avant que je me pose la question) que si tu as peu de textes dans une langue sur un sujet (genre le français), mais beaucoup dans une autre (anglais), le modèle va tout prendre la ou un moteur de recherche ne va pas traverser la barrière de la langue. Et je me suis poser la question car sur les films sur la GPA de mon exemple, il y en avait 5 des USA, et 2 venant de l'Inde, 2 pays anglophones. Une fois que j'ai demandé spécifiquement en français, ça a pris plus de films français (et pas juste traduit).
Donc ouais, ça prends 5 minutes et pas 3h, mais le résultat est parfois subtilement faux, parfois à coté de la plaque, et sans doute subtilement biaisé
sans doute parce que le code qui a servi pour claude est du code libre (vu que c'est le code publique) qui est sans doute moins moche que les trucs horribles en internes fait par l'industrie au sens large. Ça me semble être un cas assez particulier car je ne suis pas sur qu'on retrouve une tel dichotomie dans d'autres secteurs de la société/partie du corpus (cad ou la majorité des données publiques sont de meilleurs qualités que les données privés).
# Y a pas "reconnaitre les syndicats internes" ?
Posté par Misc (site web personnel) . En réponse au lien Wiki-news : six recommandations pour une société des communs; Wikimania à Paris. Évalué à 6 (+3/-0).
Je fais référence à ça:
https://www.404media.co/wikimedia-waits-until-after-its-massive-conference-to-say-it-wont-voluntarily-recognize-union/
[^] # Re: Risque de dérives
Posté par Misc (site web personnel) . En réponse au journal Le Droit d'Instruire, par l'incroyable N. B.. Évalué à 4 (+1/-0).
Alors je veux bien faire preuve de bonne foi, mais mon premier lien pointe vers la page Wikipedia "Russian propaganda in educational system" (c'est de l'anglais, ça veut dire "Propagande dans le système educatif de la Russie", je voudrais bien dire que je fait ça au cas ou ça coince, mais je suis juste vexé donc je me défoule en étant sarcastique)
Et je sais pas ce qui est le plus vexant, que quelqu'un me réponde avec un lien qui va dans le sens exact de ce que j'ai donné comme source sans avoir cliqué sur le premier lien que j'ai donné, ou que 4 personnes estiment que ç'est pertinent de venir répéter ce qui est dit dans le lien que j'ai donné sans avoir cliqué sur celui ci.
Mais je vais supposer que je me suis mal expliqué.
Mon point est que Poutine est au pouvoir depuis 1999, et qu'à part des trucs nationalistes pas si fondamentalement différent de chez nous ou ailleurs (et non surprenant dans le contexte de l'aprés Perestroïka), il n'y a pas eu l'air d'avoir grand chose avant 2014 (d’après WP), et donc qu'une réforme des programmes en vue de faire de la propagande n'a pas été la priorité.
Et si il y a plus de la moitié de la page WP qui parle de ce qui est arrivé après 2022/2023 lors de la suite de l'invasion de l'Ukraine, c'est aussi signe qu'il y a eu plus d'efforts après 2022, donc beaucoup moins avant.
D'ailleurs, le lien d'Amnesty International (car j'ai cliqué dessus) ne semble parler que de l’après 2023 (ou en tout cas, ne donne pas d'autres dates sauf si j'ai mal lu), ce qui va dans le sens de ce que j'ai dit.
Car la formule "n'a pas été la priorité", c'est exactement ça. Je veux pas dire "ça n'a pas été fait", ou "ça n'arrive pas" mais ça n'a pas été fait tout de suite. Il y a eu 15 ans entre la prise de pouvoir et les premiers efforts (si on compte 2014), et plus que 15 si on ne garde que 2023.
Et je mets ça en comparaison avec le régime nazi où les Hitlerjugend sont devenus l'unique groupe pour jeunes garçons 3 ans après l'arrivée des Nazis au pouvoir.
On peut comparer avec la Hongrie de Orbán ou j'ai trouvé un article qui parle de propagande pro-russe en 2020, soit 10 ans après sa 2nde arrivée au pouvoir, et 6 ans après son virage illibéral.
Dernier exemple, l'Italie fasciste ou visiblement, c'est arrivé tout de suite, et donc ou c'était une priorité.
[^] # Re: Résumé
Posté par Misc (site web personnel) . En réponse au lien La « tech » française contre le logiciel libre. Évalué à 4 (+2/-1).
je réponds à "refourguer leur camelote proprio" du commentaire d'en haut, car c'est pas exactement le cas ici. En tout cas, rien qui pointe dans ce sens au contraire du fait que ça soit le CNLL qui râle.
[^] # Re: résumé
Posté par Misc (site web personnel) . En réponse au lien xfwl4 et l'utilisation des LLMs dans la réécriture en Rust du Window Manager de Xfce. Évalué à 6 (+6/-3).
Alors l'environnement est un vrai probléme, mais ce qui me dérange, c'est que c'est assez clairement détourné.
Les feux de forêts à coté de Bordeaux sont une bonne illustration de ce que je pense. De ce que je vois sur les réseaux sociaux, ça sert surtout pour se défouler sur le gouvernement. Je comprends que les gens soient émues, et il y a des gens qui ont tout perdus, etc.
Et bien sur, on peut critiquer le gouvernement et je ne doute pas que ça soit plus que critiquable, mais fondamentalement, le probléme est que personne ne veut payer plus d’impôt pour qu'on puisse dépenser plus d'argent pour l'adaptation, et qu'on s’attend tous à ce que rien ne change en moins bien malgré des chocs économiques non prévisibles.
Par exemple, le coût de la crise du COVID est loin d'être négligeable. Si on regarde juste le cout du bouclier tarifaire sur le gaz et l'elec, ça se chiffre à quelques dizaines de milliards. Le cout de ce bouclier, c'est de l'ordre de 10% du déficit (qui est de 150 milliards d’après l'INSEE).
Je juge pas si on devait le faire ou pas, mais on peut dire que l'argent qui est parti dans le bouclier est celui qui n'est pas parti dans les canadairs au même moment. Et je ne dit pas qu'on aurait pas du faire le bouclier tarifaire, mais qu'à un moment, on sort de l'argent qu'on a pas, et franchement, ça me fait chier de le dire parce que c'est quand même une idée de droitard, mais c'est quand même un souci dont on discute pas assez. À la place, on a les parties politiques qui s'accusent mutuellement au lieu de chercher le consensus et d'essayer d'unir le pays. On devrais se poser plus souvent la question de "pourquoi y a pas plus de thunes" et "que faire pour en avoir plus", ou "comment limiter le changement climatique en pratique" que "qui est responsable".
J'ai vu 0 personne dire "pour éviter les feux de forêts, il faut lutter contre le réchauffement climatique, donc changer notre mode de vie, par exemple devenir végétarien". C'est normal, c'est pas un bon message, c'est condescendant, c'est culpabilisant, ça touche à des trucs qu'on aime comme manger. Et c'est peut être contre productif vu comment certains partis capitalisent sur la grogne. Et en même temps, bah, c'est sans doute vrai.
Le fait qu'on se préoccupe de l'écologie que quand ça permet de pourrir le gouvernement en place, ou quand ça s'aligne avec des idées qu'on a déjà (genre "la silicon valley, c'est mal", mais aussi "les pollueurs, c'est surtout les autres pays", voir directement des idées écofascistes), ça me semble un souci.
Et pour corriger un message, soit on crie plus fort, et clairement, c'est pas ma voix qui va porter, soit on essaye de donner des billes aux autres pour le faire. Moi, je pense que je suis meilleur à donner des billes aux autres, ce que je fais.
Ensuite, oui, tu as raison de dire que je devrais être moins dans la réaction.
Et sur les LLMs, je pense que déjà, se former est un bon plan. Arrêter de croire que c'est magique, mais aussi arrêter de croire que les gens qui utilisent n'ont pas de raisons valables de le faire. C'est très centriste et mou comme vision, mais je pense que la techno est la et contrairement à la blockchain, elle a un usage. Donc j'ai tendance à dire que comme disent les anglais, le génie ne va pas revenir dans la bouteille.
Ensuite, est ce que ça va rester comme ça sans rien changer, sans doute pas (ne serais que pour des questions économiques). Mais je pense qu'il faut aussi arrêter les hyperboles non justifiés, arrêter d'amplifier les hyperboles (mais encore une fois, peut être que je vois juste les mauvais trucs, peut être que j'ai mal dormi).
L'utilisation d'un modèle complexe pour faire n'imp est une aberration, oui. Mais prendre le pire cas possible comme argument me parait discutable. Je n'ai aucun doute sur le fait que ça va vite changer le jour ou les tokens vont être correctement facturés, donc ça me semble moins une priorité parce que ça va venir tôt ou tard.
Et si je regarde ce papier de janvier 2026, les auteurs disent bien qu'il y a une grande variante entre les modèles (point 2.3.3), genre un facteur de 140, et effectivement, le papier va dans ton sens sur avec le point 3 ("GPT 3.3 a pris 1GWh pour le training, la conso en inférence est 564MWh par jour pour 10 millions d'utilisateurs". Ensuite, comparer l’entraînement du modèle GPT 3.3 (de 2020) avec l'inférence de GPT 5.x me semble assez incorrect, mais même avec un facteur 10 de différence, ça pointe en faveur de l'inférence.
Maintenant, la conso de us-east-1, j'ai lu que ç'est 2.2GWh (j'ai pas noté la source, j'ai supposé par jour). À titre de comparaison, l'usine de Tobata Seisakusho consomme 1 à 5 MWh pour traiter 1 tonne de minérai dans un four, et traite 1500 tonnes de minerais par jour, donc consomme entre 1.5 GWh à 7.5GWh par jour (encore une fois, j'ai pris des notes mais j'ai pas noté la source, j'ai du chercher "consommation d'une usine" sur le web une nuit). Donc je pense qu'on peut relativiser un peu l'exceptionnalisme des llms. C'est pas rien et je dit pas qu'il faut rien faire, mais c'est pas non plus exceptionnel par rapport à la sidérurgie, loin de la.
Sauf que tout le monde se fout de l'impact de la sidérurgie, car tout le monde comprends bien que si on veut des rails ou des voitures, faut le faire.
Ah bah moi, je suis la pour passer le temps et gagner du karma. Si on changeais le monde sur Linuxfr, on le saurait.