Page 1 sur 1

Codage des noms de fichiers

Posté : lun. 19 mai 2025 17:10
par clpda
Bonjour,
Après avoir migré le PC1 sur Linux, j'ai transféré mes anciens fichiers préalablement créés sous Windows et que j'avais sauvegardés sur un disque externe, et cela dans deux espaces/partitions:
  1. une partie dans les dossiers proposés par défaut (Dossier personnel, subdivisé en Bureau, Documents etc.), sur la partition système sda2 ext4
  2. les archives dans la partition sdb1 fat32
Dans un premier temps, tout s'est bien passé. Depuis quelques jours cependant, les dossiers et fichiers de la partition sdb1 présentent des anomalies dans leur nom:
  • les caractères acentués (et probabalement tous les caractères du groupe Latin-1) ont été remplacés par un point d'interrogation blanc dans un losange noir ("replacement character", FFFD); le nom du dossier ou fichier concerné est suivi de la mention "codage non valide"
  • les caractères au-delà de hexFF ont été remplacés par des points d'interrogation simples (3F); le nom du fichier concerné n'est suivi d'aucune mention particulière
En complément:
  • les noms des dossiers et fichiers placés dans mon dossier personnel (sur sda2) affichent correctement tous les caractères
  • si l'on copie un des fichiers de la partition sdb1 dans un espace où les caractères originaux seraient affichés correctement, les caractères de remplacement restent inchangés lorsqu'ils atterrissent mon dossier personnel mais deviennent des soulignés ("underscore", 5F) s'ils atterrissent dans une clé USB (dev/sdc fat32) qui par ailleurs affiche correctement tous les caractères des fichiers que j'y avais déjà mis
  • le contenu des fichiers dont le nom a été modifié n'est pas affecté
  • ce n'est pas un problème de police, les polices définies dans l'option "Choix des polices" possèdent tous les caractères originaux
J'ai évidemment toujours la sauvegarde initiale mais ça ne sert à rien de la recharger si un paramètre quelconque de la partition devant l'héberger est erroné et entraîne "l'élagage" de tout ce qui n'est pas ASCII!
Merci d'avance pour toute aide!

Re: Codage des noms de fichiers

Posté : ven. 23 mai 2025 15:38
par clpda
Bonjour,
L'absence de réaction après plus de 1100 visionnements signifie-t-elle que...
  1. il s'agit d'une instabilité minime, déjà vue, et que la seule solution évidente est de reformater la partition et recharger les données
  2. jamais vu un truc pareil, la cause en est inconnue mais peu importe car la solution sous a s'applique également
  3. le post manquait de certaines informations essentielles pour comprendre le problème et fournir un conseil pertinent
Merci de m'éclairer.

Entre temps, je suis tombé sur une série de posts (t=10582, à propos de laquelle j'aurai une question que je poserai dans un autre post) qui m'ont convaincu de déplacer toutes les données (et pas seulement mes archives) dans une partition séparée, qui sera donc reformatée en espérant que son jeu de caractères soit d'emblée UTF-16.

Re: Codage des noms de fichiers

Posté : ven. 23 mai 2025 18:23
par arghlub
salut,
Pour t'avouer, j'ai lu ton post en diagonale, mais tu parles de partitions W$ (sûrement au format NTFS, Linux est en EXT ou en BTFS), cela ne viendrait pas t'il de cela ?
je dis ça j'en sais rien je suis pas expert W$ :l

sinon va voir tes locale : viewtopic.php?p=114093#p114093

attention, c'est juste une piste, je vois pas trop ce qui peux clocher ;)

Re: Codage des noms de fichiers

Posté : ven. 23 mai 2025 18:37
par clpda
Salut,
Merci de ta réponse et de ta question!
Non, les partitions ont été créées sous Linux à partir de la clé bootable car j'ai reformaté le tout après avoir décidé de "lourder" Windows.
Cordialement

Re: Codage des noms de fichiers

Posté : ven. 23 mai 2025 22:14
par arghlub
T'as un window$ sous la main ???
Si oui, comment apparaissent les noms de tes fichiers en etant sous w$ ?

Re: Codage des noms de fichiers

Posté : ven. 23 mai 2025 22:29
par arghlub
dernire p'tite chose ...
sache que les caractères sous Linux sont souvent codés en «unicode» des milliers de caractères contrairement à l'ascii de w$ avec juste quelque centaines ....pour te faire une idée, envoie l'appli «table de carctères» et par exemple (j'ai mis une table au haasrd avec un caractère au hasard ... (en bas à gauche tu vois le code hexadécimal du caractère «u+****» : tu peux reproduire au clavier n'importe quel caractère, il y en a des millies ...
Image

Re: Codage des noms de fichiers

Posté : ven. 23 mai 2025 23:57
par clpda
Salut arghlub,
Merci de ta réponse.
Question Unicode, c'est bon, c'est presque mon seul domaine de compétence en informatique :lol:
Unicode, c'est déjà générique en quelque sorte, puisqu'on a
  • UTF-32, codage sur 4 octets, essentiellement pour les idéogrammes chinois (plus peut-être quelques autres cas, je ne sais plus)
  • UTF-16, codage sur 2 octets, pour la grande majorité des écritures, avec la conséquence que pour ASCII et Latin-1, un caractère sur deux est vide et apparaît généralement sous la forme d'un ÿ si le fichier est lu et affiché octet par octet
  • UTF-8, codage sur 1 à 3 octets, le codage préféré du web (latino-centrique ;)) puisque les lettres latines emploient 1 octet, les caractères accentués des langues occidentales 2 octets et le reste 3 octets
  • UTF-7, en cours de dépréciation si ce n'est pas déjà le cas (et je ne souviens plus de ses caractéristiques)
C'est d'ailleurs justement à cause de ces connaissances préalables que la dégradation du codage de mes fichiers et dossiers m'a le plus surpris, d'où mon post: un gestionnaire de fichiers "rétrogradé" en ASCII, je n'avais jamais vu!
Mais, apparemment, cela n'a choqué personne :?
Bonne fin de soirée, cordialement

Re: Codage des noms de fichiers

Posté : sam. 24 mai 2025 12:50
par arghlub
Compliqué ...

Ce que j'en pense (pas sûr du tout) ...
si t'a un W$ , tu y montes cette patitions et tu renommes les répertoires avec des noms “génériques” (sans accent, espace ou autres caractères spéciaux).
après je dis ça j'en sais rien ....
;)

Re: Codage des noms de fichiers

Posté : sam. 24 mai 2025 15:43
par clpda
Salut arghlub,
En parcourant de nombreux échanges de ce forum, je crois avoir trouvé la cause du problème et par conséquent la solution:
fat32 serait un format de partition fourni par linux à fins de compatibilité, un peu comme un pis-aller. Mon hypothèse est que
  1. fat32 reconnaît les noms de fichiers en Unicode si la partition a été formatée par windows.
  2. Par contre, si une partition est formatée en fat32 par linux, les noms des fichiers ne peuvent être qu'en ASCII.
Mon disque USB de sauvegarde avait été formaté sous windows mais la partition de données sur l'ordi avait été formatée en fat32 par linux, vu que j'avais éliminé windows. J'avais pensé en installant linux que la partition cible devait avoir le même format que la partition source, d'où ce choix de fat32 pour la partition de données de l'ordi. J'ai lu ensuite des posts qui disaient que fat32 était presque exotique pour linux et même inutile si l'on n'avait plus besoin de windows. Alors, j'ai reformaté les partitions d'archivage sur les ordis en ext4 et rechargé les fichiers, qui ont conservé tous leurs noms au propre.
Je vais donc m'attaquer au problème suivant! :lol:
Bon week-end et merci encore pour ton aide!