Nom, la ligne

#-* encoding: utf-8 ?

Serais plutôt une directive de préprocesseur,  bien que cela ne doivent pas
s’apeler comme cela pour du python…

En faite, cette ligne indique comment traiter les chaine litérale dans le
code, de la même manière que l’attribut encoding dans le XML

 

Le BOM est une séquence qui se situe en début d’un fichier, contenant du
texte, pour indiquer l’encodage.

Ton éditeur de texte l’interprète mais ne l’affiche pas.

 

Dans ton cas, soit tu uniformise tous les intervenant pour qu’il utilise le
même encodage,soit tu as recours à de la conversion d’encodage.

Il me semble quela fonction API Windows « MultiByteToWideChar » fait cela

Cherche l’équivalent  en python

 

 

 

  _____  

De : [email protected] [mailto:[email protected]] De la
part de yannick
Envoyé : vendredi 20 décembre 2013 12:22
À : [email protected]
Objet : [progliste] Re: cherche cours encodage 

 

salut Lavachri,

c'est la dernière proposition qui m'interresse!

je bute  toujours  sur les même problèmes :

je souhaite utiliser un module pour executer du code xquery .

la méthode du module renvoie de l'unicode .

bon, je sais qu'en principe pour éviter tous les problèmes, je dois vérifier
que l'encodage de la sortie / entrée doit être le même .

je suis  dans la console python, qui est en ascii.

j'execute mon fichier xquery  ,

le code qui y est écrit doit m'envoyer du texte,

ce code, contient une fonction  qui lie une page html qui lui est en utf-8.

petite  question :

un bom en python est ce que c'est la ligne :

#-* encoding: utf-8 ?

 

 

 

 

 

 

 

 

 

 

----- Original Message ----- 

From: LavaChri <mailto:[email protected]>  

To: [email protected] 

Sent: Friday, December 20, 2013 11:49 AM

Subject: [progliste] Re: cherche cours encodage 

 

Slt,

Que veux tu savoir ?

 

La façon dont les fichiers sont écrit sur le support de stockage ?

 c’est à dire les TOC et autre MBR des formats FAT32, NTFS, EXT3, …

 

Ou la façon d’organiser les informations dans un fichier ?

C'est-à-dire comment est stocké le texte dans un fichier Txt par exemple.

Dans ce cas il n’y a pas de généralité, et les spécification doivent être
récupérer chez l’auteur.

 

Si cela peut t’aider à te faire une idée.

Un fichier est un espace défini sur un support de stockage.

Ce fichier est constitué d’élément indivisible qui est l’octet.

C'est-à-dire que le plus petit élément que tu pourras lire ou écrire dans un
fichier est un octet.

 

Si, comme je le présume, tu veux parler d’encodage de texte.

Pour écrire la lettre A en ASCII il te faudra utiliser 1 octet

Pour écrire la lettre A en Unicode il te faudra utiliser 2 octets

 

Donc un fichier TXT ayant une taille de 2 octets pourra contenir soit :

-   un caractère unicode

-   2 caractères ASCII

 

Comment savoir si c’est du ASCII ou du Unicode ?

Ya pas de solution universelle, il faut bricoler …

Cependant il existe la possiblité d’utiliser un BOM en début de fichier pour
indiquer l’encodage. 

 


  _____  


De : [email protected] [mailto:[email protected]] De la
part de yannick
Envoyé : vendredi 20 décembre 2013 08:24
À : [email protected]
Objet : [progliste] cherche cours encodage 

 

bonjour,y aurait t'il une personne qui aurait un bon lien pour bien
comprendre l'encodage des fichiers ?

merci !

Répondre à