22. juli 2004 - 22:59Der er
8 kommentarer og 1 løsning
Encoding og/eller entities
Er man sikker på at ens specialtegn (f.eks. dansk æ,ø,å) ses korrekt overalt med en korrekt encoding (ISO-8859-1)? Eller er man nødt til at bruge html-entities eller talkoder for at være 100% sikker?
Med andre ord: hvor sikkert er man dækket ind med encoding?
Støv, fibre og metalliske partikler kan påvirke både uptime, levetid og driftssikkerhed. Derfor arbejder flere datacentre systematisk med contamination control.
Fordi den computer brugeren bruger skal kunne forstå præcis den encoding du angiver, så principielt bør du få det samme volapyk ud, hvis du angiver et tegn med entities, talkoder og klartekst, hvis maskinen ikke forstår den pågældende encoding ...
Systemet burde nemlig oversætte et givet tegn til unicode-ækvivalenten (eller en anden standard), så det er selvfølgelig afhængig af, om den del af unicode forstås af din computer ...
Hvis du ikke har installeret understøttelse af koreansk på din computer hjælper det ikke meget, at en webdesigner korrekt har angivet ISO-2022-kr ...
roenving> "Hvis du ikke har installeret understøttelse af koreansk på din computer hjælper det ikke meget, at en webdesigner korrekt har angivet ISO-2022-kr ..."
ok, og det var lige præcis den situation jeg tænkte på. for så gælder det også at hvis ikke koreanerne har installeret understøttelse af dansk nytter min ISO-8859-1 ikke meget. Ikke fordi jeg regner med at koreanerne forstår dansk, men fordi jeg måske laver nogle internationale sider på engelsk (med enkelte danske karakterer, f.eks. i navne).
Så det du siger er vel faktisk: ja, både livrem og seler, det er det sikreste.
Men hvis du bruger sprog-afhængige special-tegn, vil de jo under alle omstændigheder falde udenfor, for det vil for en inder give nogenlunde samme mening at se rønving, som r¢nving ...
-- og så skal du ikke regne med at alle html-entities er understøttet alle steder, f.eks. understøtter min IE ikke alle de html-entities, som msdn omtaler på deres liste (men jeg har selvfølgelig heller ikke opdateret den de sidste 24 timer !-)
jo, men som forfatter til siden har jeg alligevel en interesse i at den indiske læser ser Rønving (korrekt) og ikke R¢nving (ukorrekt).
Ok, html-entities er ikke nødvendigvis understøttet, men hvad med talkoder. Det kan være at Rønving ikke dur, men hvad med Rønving? Er det sikkert?
Faktisk burde ø være sikrere end ø da den er afhængig af en konkret tegntabel, mens den rene html-entity af browseren skal oversættes til et tegn, uanset hvilken tegntabel, som anvendes !-)
"den computer brugeren bruger skal kunne forstå præcis den encoding du angiver, så principielt bør du få det samme volapyk ud, hvis du angiver et tegn med entities, talkoder og klartekst, hvis maskinen ikke forstår den pågældende encoding"
Det forstår jeg sådan her:
1) Hvis maskinen forstår den angivne encoding, er der ikke noget vundet ved også at bruge entities for tegn omfattet af den angivne encoding (f.eks. er ø unødvendig hvis maskinen forstår ISO-8859-1). Det er kun relevant for tegn uden for denne.
2) Hvis maskinen ikke forstår denne encoding kan det være en idé at bruge html-entities, for selv om nogle af tegnene måske slet ikke er understøttet så kan andre godt være det. Måske kan den ikke forstå eller gengive ø men det går sikker bedre med é Så i det tilfælde får man faktisk noget for at bruge html-entities.
3) Man kan ikke vide hvad folks maskiner kan klare (slet ikke i Korea ;-) Så alt i alt opnås den største sikkerhed ved både at angive encoding og ved at bruge html-entities. Er det der vi ender?
fino! det kræver et svar ;-) Og så er der jo lige den krølle at titlen på mit sp. egentlig ikke er helt OK, for det bliver aldrig et sp. om ELLER, kun om OG. I hvert fald hvis man godt vil validere, for W3C kræver at encoding er angivet. Tak for diskussionen...!
Tilladte BB-code-tags: [b]fed[/b] [i]kursiv[/i] [u]understreget[/u] Web- og emailadresser omdannes automatisk til links. Der sættes "nofollow" på alle links.