Re: Codes de langue pour occitan

"Nicolas Krebs" <[email protected]>
Newsgroups gmane.comp.web.spip.devel
Message-ID <[email protected]>
Super.

Bon, j'ai lu les quatre articles 
https://blog.smellup.net/spip.php?article104
Chapitre 1 : des normes et des langues

https://blog.smellup.net/spip.php?article105
Chapitre 2 : règles de construction des étiquettes de langue

https://blog.smellup.net/spip.php?article106
Chapitre 3 : étiquettes SPIP alpha-2 et alpha-3

https://blog.smellup.net/spip.php?article107
Chapitre 4 : étiquettes SPIP à multiples sous-étiquettes et nom de langue

D'autres sont-ils prévus ?

Quelques remarques :

1 dans https://blog.smellup.net/spip.php?article104#ISO-639-indicatifs-de-langues

Remplacer « ISO 639-6 (projet) » par « ISO 639-6 (projet abandonné) ». 
Cf. https://www.iso.org/standard/43380.html


2 dans https://blog.smellup.net/spip.php?article104#RFC-5646-etiquettes-de-langue

Il faut mentionner le nom «BCP 47».


3 dans https://blog.smellup.net/spip.php?article105#La-region

Mentionner que le «code numérique de 3 chiffres» correspond à la norme M.49, 
cf. https://en.wikipedia.org/wiki/UN_M.49


4 dans https://blog.smellup.net/spip.php?article106#Etiquettes-de-macro-langage-regle-R2

Je ne comprend pas cette volonté de supprimer les langues avec un code de type «macrolangue». 
Cf. https://www.w3.org/International/questions/qa-choosing-language-tags#langsubtag 
section «Use macrolanguages with care.» et RFC 5646 section 4.1 
https://tools.ietf.org/html/rfc5646#section-4.1 
(traduction d'une ancienne version dans http://abcdrfc.free.fr/rfc-vf/rfc4646.htm#rfc4646-4-1 ).

Si une personne veut étiquetter un texte en «norvégien» ou en «albanais», elle doit 
pouvoir le faire àmha. Dans l'autre sens, si une personne demande avec l'en-tête 
HTTP «Accept-Language» d'avoir du norvégien, il faut pouvoir lui répondre en norvégien, 
nynorsk ou bokmål.

Si c'est juste pour les traductions de SPIP, alors ce n'est pas un gros problème.


5 dans https://blog.smellup.net/spip.php?article106#Etiquettes-de-macro-langage-regle-R2

La phrase «l’étiquette « sh » est à revoir absolument car elle ne correspond à rien de 
compréhensible aujourd’hui.» n'est pas sourcée et me semble fausse. Il y a une 
Wikipédia en serbo-croate, vous savez ?


6 dans https://blog.smellup.net/spip.php?article107#Les-etiquettes-d-occitan

Les codes avec le tiret bas (« _ ») comme séparateur ne sont pas des codes de langue 
conformes à la BCP 47, qui utilise des tirets simples -. Il faut soit convertir les codes de SPIP, 
soit faire deux listes distinctes.


7 dans https://blog.smellup.net/spip.php?article107#Les-etiquettes-d-occitan

Remplacer « oc_grmistr » par « oc_nicard_grmistr »


8 dans https://blog.smellup.net/spip.php?article107#Les-etiquettes-regionales

Il y a aussi
https://tools.ietf.org/html/rfc6067
https://www.bortzmeyer.org/6067.html
https://en.wikipedia.org/wiki/IETF_language_tag#Extension_U_(Unicode_Locale)
https://unicode.org/reports/tr35/#Locale_Extension_Key_and_Type_Data
https://www.unicode.org/reports/tr35/tr35-53/tr35.html#Locale_Extension_Key_and_Type_Data

dont des identifiants géographiques « Regional Subdivision » -u-rg-* permettent d'indiquer 
des provinces de pays, comme la Californie des États-unis (c'est l'exemple donné dans 
http://unicode.org/reports/tr35/#unicode_subdivision_subtag_validity )


9 dans https://blog.smellup.net/spip.php?article107#Les-etiquettes-regionales

Il y a de fortes chances que « zh_tw » désigne le mandarin en écriture traditionelle, cmn_Hant.


10 dans https://blog.smellup.net/spip.php?article107#Les-etiquettes-avec-ecriture

Dans la BCP47, « depreciated » implique que le code est déconseillé, par invalide. 
Le code « sh » est valide. Comme je l'ai écrit + haut, il existe une Wikipédia en serbo-croate, 
et si vous criez sur les toits que le serbo-croate n'existe pas, alors vous aurez des retours 
négatifs (pour ne pas dire des ennuis, car ce serait exagéré).


11 dans https://blog.smellup.net/spip.php?article107#Les-etiquettes-avec-ecriture

Il n'y a pas d'écriture par défaut pour le code sh, dans https://www.iana.org/assignments/language-subtag-registry/language-subtag-registry#sh il n'y a pas de ligne « Suppress-Script: », le serbo-croate s'écrit tant en alphabet latin qu'en alphabet cyrilique.

Nicolas Krebs


De : Eric Lupinacci <[email protected]>
À : [email protected]
Sujet : Re: [spip-dev] Codes de langue pour occitan
Date : 28/10/2018 09:46:11 CET
Copie à : SPIP-Dev <[email protected]>

Hello,


Oui on a eu l'information.

Je suis en train de préparer un article sur les étiquettes de langue SPIP pour voir si on 
peut pas les modifier pour être plus "standard".

++
Eric


Le sam. 27 oct. 2018 à 15:14, Nicolas Krebs <[email protected]> a écrit :

> Codes de langue pour occitan
> Au cas où ce serait passé inaperçu, de nouveaux codes de langue IETF on été standardisés 
> 
> pour des dialectes de l'occitan :
> - aranais      oc-aranes
> - auvergnat    oc-auvern
> - gascon       oc-gascon
> - limousin     oc-lemosin
> - languedocien oc-lengadoc
> - niçois       oc-nicard
> - provençal    oc-provenc
> - vivaroalpin  oc-vivaraup
> (liste non exhaustive)
> 
> Voir aussi :
> 
> https://www.spip.net/fr_article5723.html
> Les versions occitanes de SPIP : pourquoi autant d’« òc » ?
> 
> https://www.ietf.org/mail-archive/web/ietf-languages/current/msg00312.html
> Final records and registration forms for Occitan variants
> 
> https://www.iana.org/assignments/language-subtag-registry/language-subtag-registry
> la liste complète des composants valides, séparés par «%%» (chercher «Occitan»)
> 
> NK
> 
> 
> 


_______________________________________________
liste: https://listes.rezo.net/mailman/listinfo/spip-dev
doc: http://www.spip.net/
dev: http://trac.rezo.net/trac/spip/
irc://irc.freenode.net/spip
lmpx.com only provides a reader for public news (NNTP) servers. It is not affiliated with the servers or forums shown here and is not responsible for the content of articles, which is written by their respective authors.