Par contre pour l'utf-8, je
. Ce n'est certes pas un outil magique qui fait que tout peut passer à l'unicode sans avoir a se soucier de rien, mais il a de très nombreux avantages.Parmi ceux qui me viennent en premier à l'esprit il y a :
* taille réduite pour la majorité des langues. (Et même dans les langues à idéogrammes, les fichiers avec balisage comme xml, json,... et les fichiers de scripts sont majoritairement composés de caractères ascii standards. Je pense qu'en général, un programme a davantage à traiter ce genre de texte que le langage naturel.)
* pas de 0 dans le flux
* pas de problème de big/little endian
* compatibilité ascii standard -> utf-8
Le point ou je ne rejoint pas vraiment Kevin, c'est que le fait de ne pas connaitre directement l’emplacement des lettres est un vrai inconvénient, ça complexifie le traitement du texte. Cela est cependant mitigé par le fait que l'on a les bibliothèques pour faire ça ce n'est généralement pas ce qu'il y a de plus couteux en temps d’exécution.
l'UTF-16 est en effet désormais vraiment bâtard. C'était une bonne solution à l'époque ou unicode faisait seulement 16 bit. Maintenant, il cumule les défauts de l'UTF-8 et de l'UTF-32, sans aucun des avantages (sauf à considérer que l'unicode > 16bit n'existe pas).
Bref UTF-8 me semble une très bonne solution à la plupart des cas.

)
> nan mais arrêtez avec vos caractères à la con, vous prenez toute la place !
