Toutes mes réponses sur les forums
-
AuteurMessages
-
Re: pourquoi 2^31?
Je m’y essaye.
2 puissance 31 = 2,147,483,648.
Si on codait brutalement sur 4 octets comme UTF-32 (Abgech, est-ce la même chose qu’UCS4?), on aurait les caractères de 0 à 2^32-1, soit deux fois plus. En UTF-8, on a perdu de la capacité de coder des très grands nombres. Ỏu est l’intérêt? C’est la capacité de coder simplement et légèrement les fichiers les plus courants.
Quand on code en UTF-8, on peut employer un seul octet pour les 128 premiers caractères, de 0 à 127, et le bit de poids fort de l’octet est à 0. Quand ce bit est à zéro, l’application sait dire que c’est un octet seul, et interpréter 65dec (décimal), soit 01000001bin (binaire) comme la lettre A.
Pour les caractères de numéro supérieur à 127, pour deux octets, le premier octet commence par 110, suivi de 5 bits significatifs (les bits de poids fort du numéro unicode), puis un deuxième octet qui commence par 10 suivi de 6 bits significatifs. On encore donc 2^(5+6) = 2^11 = 2048 caractères.
Pour plus de caractères, on emploie 3 octets: 1110xxxx 10yyyyyy 10zzzzzz, soit 2^16 = 65536 caractères. Juste assez pour tous les caractères existants. Sur 4 octets, on code sur 4 octets: 11110www 10xxxxxx 10yyyyyy 10zzzzzz, donc 3w, et 6 x, y et z, donc 2^21. Je n’ai jamais vu de caractère encodé sur 4 octets. Ca doit exister. UTF-8 peut encoder par définition jusqu’à 6 octets: le premier 1111110x et 5 octets de la forme 10yyyyyy, soit 2^ (6 * 5 = 30 + 1 = 31) (le dernier bit du premier octet, qui est significatif).
Bingo.
On perd donc une part importante de la capacité de coder des grands nombres. (sur 6 octets, on peut coder en brut 6^36 caractères, soit 32 fois plus.
L’intérêt de ca, à part que peu de périphériques sont en 32 bits, c’est aussi que l’immense majorité des fichiers et des données sont essentiellement de l’ASCII –même si sur Linux on peut tout-à-fait écrire un source en UTF-8 avec du viet dans le texte et ca sera compilé sans souci, le programme lui-même, par exemple, est en ASCII, donc codé sur 7 bits.
De plus, cet encodage est « auto-synchronisé », c’est-à-dire que si on capte un flux de données, on peut toujours savoir à partir de quel octet on doit décoder pour avoir un texte clair.
Si la norme ISO 10646 ne définit d’encodage que sur 6 octets et non 7 (on pourrait imaginer 11111110 et 6 fois 10xxxxxx pour encoder 2^36 caractères), ca doit être que ca permet de se synchroniser même si on capte un flux de bits sans synchro, donc même si on ne sait pas òu commencent et òu finissent les octets. La classe.
C’est beau, l’info, quand c’est bien fait.
En tout cas, UTF-8 n’est pas près de se faire supplanter par un autre encodage, c’est son immense force. (Jusqu’à ce que le Chinois ou le Bengali supplante l’anglais pour l’info!)
Il n’y a vraiment que Windows pour ne pas vouloir implémenter ca proprement: comme ils ont une grosse part de marché, ca leur permet de garder une clientèle captive. Sur le web, le standard impose de savoir au moins reconnaitre UTF-8.
Ou alors tu oublies tous les conforts qu’on t’a appris, la tuture, l’appart’ à papa maman et tu plonges.
Ca marche aussi, mais tu fais une croix sur la sécu, l’assurance vieillesse, l’assurance chômage, le RMI,…
Et tu viens te plonger dans le vrai monde, aussi dérangeant qu’il soit parfois.
T’inquiète pas trop, si la tripe te lâche, tu pourras rester à Saigon, òu il y a plein de gens qui se font leur Vietnam entre eux, la petite touche d’exotisme entre deux restaus francais, et vivent une vie de privilégiés dans des ghettos dorés.
Mais si tu plonges, il y a une vie à vivre. C’est cool: plus de sécu, mais une vie à vivre vraiment, qui s’en doutait encore?
Et puis ne t’accroche pas trop à ta peau d’âne*: ca n’a plus grande valeur, sauf bien sur si tu veux t’asservir à la grande industrie. Tu es ingénieur quand tu quittes l’école, diplômé la belle affaire. Vois ce que ca pèse. 10 ans après, espérons que tu te seras redéfini autrement.
* ton diplôme, ignare!

Dédé: le billet de 100 đồng non plus n’a pas l’effigie de l’oncle Hồ.
Je vous rappelle que Trúc est plutôt un nom de fille!
(ca a de plus l’avantage d’éviter à leur amant d’un soir d’oublier leur nom au réveil: hé, Truc, fais-moi le café)
CEla dit, celui-là a respecté les cloisons fermées sur les côtés.
Rien de pire que de percer une fenêtre pour se la voir combler de briques un beau matin (surtout que le macon n’ayant pas accès à ton côté de son mur fait souvent un mur bien moche).
15 décembre 2007 à 2h54 en réponse à : [PDA-Pocket PC..] dictionnaire electronique portable vietnamien #51326Ca a l’air étonnament pas mal du tout, avec une palette sémantique développée et tout.
(une fois de plus, ce n’est pas parce que c’est gratuit que c’est nécessairement moins bon)
Les IDE comptabilisés ici sont encore des promesses d’apport de capital. Or historiquement sur ces 15 dernières années, le Vietnam a vu se matérialiser seulement une fraction de ces promesses.
Qui vivra verra.
Ce que disait un Joseph, Africain de Cần Thơ il y a de ca quelques années: « petit, je courais nu entre les cases du village comme tout le monde, mais je ne suis vraiment devenu miséreux que quand quelqu’un est arrivé au village avec des dollars ».
Il le disait en anglais, mais l’idée était bien celle-là.
Pierre, il y a un fil ici òu les penseurs se grattent le ventre en se demandant qui a le plus d’humour. Tu devrais concourrir. Et apporte tes cartes.
Si on attend que tous les membres soient là… Je propose Février 2009?
Si on attend que tous les membres soient là…
12 décembre 2007 à 6h17 en réponse à : [Photos transports-marchandises] Bon les gars,aujourdhui qui transporte quoi et quoi transporte qui? #51105lẩu dê, c’est de la chèvre. (Paul, tu dois connaitre con dê 35, non?)
L’agneau, c’est cừu non. Ca se mange aussi, mais c’est plus rare.
Et, Paul, ton cochon, on dirait bien un Mong Cai. Faudrait demander à Olivier, c’est par chez lui qu’on en voit beaucoup.
12 décembre 2007 à 6h12 en réponse à : [PDA-Pocket PC..] dictionnaire electronique portable vietnamien #51104Le problème avec les dicos électroniques, c’est que ca donne un mot pour un mot et l’impression que c’est correct, mais dès que tu as besoin de dire autre-chose que « aller à la gare » ou « combien la cuisse de chien? », tu vas droit au mur, avec ton truc électronique.
Les palettes sémantiques francaise et vietnamienne ne se recouvrent que peu, même si, c’est vrai, dans quelques cas assez amusants ca colle très bien.
Alors les dicos électroniques, en réalité, c’est un handicap pour apprendre la langue. Ca te donne une impression de sécurité, mais ca te réserve des frustrations majeures.
En affaires, prend un interprète et forme-le;
En amour, passe-toi du langage à défaut de te passer de la langue. :p ;
Et si c’est pour péter la classe, trouve-toi un dico électronique.
Bon, cela dit, si c’est pour demander ou est la gare, et si ca doit tenir dans la poche, rien n’interdit d’avoir la classe.
Pour ma part, je reste dans les parages. Entre 17 et 21, ce serait cool.
Photo truquée. L’ilôt du petit lac a été grossièrement rajouté. Est-ce bien le petit lac? Plus de 4 millions de touristes au Vietnam, et pas moyen de trouver une photo de touristes à Hanoi? La honte à cette feuille de chou bancale!
Le secteur de l’accueil et de l’hébergement est malheureusement bien en peine de trouver des vocations: si l’hospitalité tient une part dans l’héritage culturel, servir est encore bien souvent regardé de haut.
Pourtant, que de talents!
10 décembre 2007 à 3h42 en réponse à : C’est quand meme plus juste de dire Saigon qu’Ho Chi Minh City/Ville/HCMC… #50952J’ai tendance à écrire TP. Hồ Chí Minh (et pas TPHCM), et à prononcer Sài Gòn, sauf effectivement s’il y a uniforme ou contexte formel.
Mais un courrier adressé à saigon n’arrive pas. Et à TP.HCM pas sur.
-
AuteurMessages