J'ai l'impression qu'on est pratiquement sur la blague de la compression :
Soit 10 fichiers numéroté de 0 à 9
L'encodeur reconnaît le fichier et lui assigné un numéro de 0 à 9
Le numéro est envoyé
Le décodeur a les 10 chansons, et peut reconnaître le numéro.
J'ai une super idée : on pourrait coder la musique avec des symboles qui diraient ce que chaque instrument doit faire, la façon dont ils doivent jouer, qui doit chanter quoi, et comme ça serait juste des symboles sur du papier, ça prendrait très peu de place et on pourrait ne pas coder/décoder du son, mais juste une information textuelle, laissant le lectorat se charger de la conversion en audio par lui-même. D'ailleurs on pourrait faire un peu pareil pour les œuvres cinématographiques en disant qui doit jouer quoi et où et quand et comment, et charge au lectorat de se représenter la scène. Le taux de compression par rapport à l'audio/vidéo serait terrible, et en plus la qualité audio ou vidéo pourrait même être meilleure (en tout cas plus adaptée au lectorat concerné).
Mmmm, si ça c'est déja fait, je veux bien en savoir plus :)
Mais sinon, pour une autre forme d'écriture de la musique, j'ai joué il y a bien longtemps avec ABC, une notation assez lisible pour un cerveau biologique, et qui peut être "compilée" en commandes MIDI pour votre TX81Z ou en LaTeX pour imprimer une partition pour votre guitariste préférée. C'est aussi assez facile à générer par programmatique, et d'ailleurs d'écrire ça, j'ai envie de m'y remettre…
Posté par Luc-Skywalker .
Évalué à 2 (+0/-0).
Dernière modification le 01 septembre 2026 à 11:44.
cette histoire de découpe c'est parce qu'il faut faire rentrer l'info dans des QRcodes, ça n'a rien à voir avec le codec.
On doit scanner plusieurs QRcode pour reconstituer l'intégralité des "données latentes" qu'on envoie ensuite au codec pour la reconstruction de l'audio.
Si le but c'est d'être efficace, pourquoi ne pas utiliser le Datamatrix qui est plus dense ?
À première vue, il semblerait qu'on peut mettre plus de caractère dans un seul QRCode, et donc il faudrait scanner plusieurs DataMatrix, mais ce choix n'est pas expliqué dans l'article il me semble.
parce que tous les ordiphones lisent les QRcodes ?
On peut aussi se demander pourquoi tant d'over engineering: streamer via LoRa (avec 2 ESP32 + modules LoRA) plutôt que via le BlueTooth qu'embarquent ordiphone et PC.
"Si tous les cons volaient, il ferait nuit" F. Dard
# illustration
Posté par Luc-Skywalker . Évalué à 2 (+0/-0).
c'est bien le plus impressionnant (un MP3 de 2,9 Mo qui tient dans 24 Ko) et c'est possible en utilisant https://github.com/facebookresearch/encodec
"Si tous les cons volaient, il ferait nuit" F. Dard
[^] # Re: illustration
Posté par BAud (site web personnel) . Évalué à 4 (+2/-0).
enfin un début d'implémentation de i2bp ?
[^] # Re: illustration
Posté par Luc-Skywalker . Évalué à 2 (+0/-0).
C'est un peu comme le MP3 mais à la mode IA => un encodeur/decodeur + format de représentation qui est dans le "latent space"
"Si tous les cons volaient, il ferait nuit" F. Dard
[^] # Re: illustration
Posté par Earered . Évalué à 3 (+2/-0).
J'ai l'impression qu'on est pratiquement sur la blague de la compression :
[^] # Re: illustration
Posté par Benoît Sibaud (site web personnel) . Évalué à 6 (+3/-0).
J'ai une super idée : on pourrait coder la musique avec des symboles qui diraient ce que chaque instrument doit faire, la façon dont ils doivent jouer, qui doit chanter quoi, et comme ça serait juste des symboles sur du papier, ça prendrait très peu de place et on pourrait ne pas coder/décoder du son, mais juste une information textuelle, laissant le lectorat se charger de la conversion en audio par lui-même. D'ailleurs on pourrait faire un peu pareil pour les œuvres cinématographiques en disant qui doit jouer quoi et où et quand et comment, et charge au lectorat de se représenter la scène. Le taux de compression par rapport à l'audio/vidéo serait terrible, et en plus la qualité audio ou vidéo pourrait même être meilleure (en tout cas plus adaptée au lectorat concerné).
[^] # Re: illustration
Posté par Luc-Skywalker . Évalué à 3 (+1/-0).
Tu penses à une partition ou à un fichier MIDI imprimés sur papier ?
"Si tous les cons volaient, il ferait nuit" F. Dard
[^] # Re: illustration
Posté par Tonton Th (site web personnel, Mastodon) . Évalué à 4 (+2/-0). Dernière modification le 01 septembre 2026 à 13:03.
Mmmm, si ça c'est déja fait, je veux bien en savoir plus :)
Mais sinon, pour une autre forme d'écriture de la musique, j'ai joué il y a bien longtemps avec ABC, une notation assez lisible pour un cerveau biologique, et qui peut être "compilée" en commandes MIDI pour votre TX81Z ou en LaTeX pour imprimer une partition pour votre guitariste préférée. C'est aussi assez facile à générer par programmatique, et d'ailleurs d'écrire ça, j'ai envie de m'y remettre…
[^] # Re: illustration
Posté par Luc-Skywalker . Évalué à 3 (+1/-0).
ben oui, c'est rien d'autre qu'un binaire de quelques Ko comme les "latent data" utilisées ici (qui représentent le son)
ce qui permet, avec le MIDI, qu'à la place d'un quatuor à cordes, on va entendre des bombardes ;)
"Si tous les cons volaient, il ferait nuit" F. Dard
[^] # Re: illustration
Posté par jihele . Évalué à 3 (+1/-0). Dernière modification le 01 septembre 2026 à 11:27.
Oui, je suis pas sûr de comprendre.
Est-ce que c'est la phase d'encodage qui entraîne le décodeur ?
Si j'encode, je suis le seul à posséder le décodeur ?
Et plus j'encode, plus le décodeur grossit ?
[^] # Re: illustration
Posté par Luc-Skywalker . Évalué à 2 (+0/-0). Dernière modification le 01 septembre 2026 à 11:44.
cette histoire de découpe c'est parce qu'il faut faire rentrer l'info dans des QRcodes, ça n'a rien à voir avec le codec.
On doit scanner plusieurs QRcode pour reconstituer l'intégralité des "données latentes" qu'on envoie ensuite au codec pour la reconstruction de l'audio.
ceci fait, on peut écouter le résultat.
"Si tous les cons volaient, il ferait nuit" F. Dard
[^] # Re: illustration
Posté par jihele . Évalué à 2 (+0/-0).
Ça j'ai bien compris mais c'est pas ce dont je parlais.
C'est ma question qui doit pas être claire.
# Datamatrix ?
Posté par Glandos . Évalué à 3 (+1/-0).
Si le but c'est d'être efficace, pourquoi ne pas utiliser le Datamatrix qui est plus dense ?
À première vue, il semblerait qu'on peut mettre plus de caractère dans un seul QRCode, et donc il faudrait scanner plusieurs DataMatrix, mais ce choix n'est pas expliqué dans l'article il me semble.
[^] # Re: Datamatrix ?
Posté par Luc-Skywalker . Évalué à 4 (+2/-0).
parce que tous les ordiphones lisent les QRcodes ?
On peut aussi se demander pourquoi tant d'over engineering: streamer via LoRa (avec 2 ESP32 + modules LoRA) plutôt que via le BlueTooth qu'embarquent ordiphone et PC.
"Si tous les cons volaient, il ferait nuit" F. Dard
Envoyer un commentaire
Suivre le flux des commentaires
Note : les commentaires appartiennent à celles et ceux qui les ont postés. Nous n’en sommes pas responsables.