Moin, Wenn ich in C mittels der Funktion iconv() Strings von UTF-8 nach irgendeinem ollen ISO-8859-X wandeln will, kann ich dann davon ausgehen, dass der ISO String keinesfalls laenger als der UTF-8 String ist - oder kennt da wer gleich ein Gegenbeispiel? Gruss WK
Gast
#5942533
Solange du kein //TRANSLIT benutzt, sollte die Annahme passen.
Gast
#5942537
Dergute W. schrieb: > kann ich dann davon ausgehen, > dass der ISO String keinesfalls laenger als der UTF-8 String ist Ja, passt so. leo
foobar schrieb: > Solange du kein //TRANSLIT benutzt, sollte die Annahme passen. Wassndasfuernapparat? Gruss WK
Gast
#5942572
Du musst dir erstmal darüber Gedanken machen das es in deinen utf-8 String Zeichen geben kann, die es in deiner iso Codierung nicht gibt. Ferner gibt es alternative Zeichenversionen. Wird in deinem utf-8 String z.B. ein Minus mit dem Zeichen für Minus dargestellt, dann hast du ein Problem. In den iso Codierungen gibt es kein Zeichen für Minus. Es gibt nur ein Zeichen welches als Bindestrich und Minus gemeinsam genutzt wird. Das ist aber ein komplett anderes Zeichen. Du solltest dich erstmal grundsätzlich mit Unicode beschäftigen. Sonnst tappst du da zwangsläufig früher oder später in Fallen
Moin, test schrieb: > Du musst dir erstmal darüber Gedanken machen das es in deinen utf-8 > String Zeichen geben kann, die es in deiner iso Codierung nicht gibt. Nein, das muss ich nicht. Wenn da Zeichen drinnen sind, die's nicht in meinem ISO gibt, dann wird iconv() hoffentlich -1 zurueckgeben und errno auf EILSEQ oder EINVAL oder sowas setzen. test schrieb: > Ferner gibt es alternative Zeichenversionen. Wird in deinem utf-8 String > z.B. ein Minus mit dem Zeichen für Minus dargestellt, dann hast du ein > Problem. In den iso Codierungen gibt es kein Zeichen für Minus. Es gibt > nur ein Zeichen welches als Bindestrich und Minus gemeinsam genutzt > wird. Das ist aber ein komplett anderes Zeichen. Mag sein, ist mir aber auch ziemlich egal. Wenn da einer irgendwelche komischen Strings eingibt, kanns schon sein, dass da nix vernueftiges dabei rauskommt. Das ist nicht tragisch. Tragisch waere, wenn einer Strings eingibt, die dann durch die Konversion laenger werden als das Original... Gruss WK
Gast
#5942593
>> Solange du kein //TRANSLIT benutzt, sollte die Annahme passen. > > Wassndasfuernapparat? man iconv_open:
1 | |
2 | |
3 | |
4 | |
5 | |
6 | |
7 | |
8 | |
9 | |
10 | |
11 | |
12 | |
13 | |
14 | |
15 | |
16 | |
17 | |
18 | |
19 | |
20 | |
21 | |
22 | |
23 | |
24 | |
25 | |
26 | |
27 | |
28 | |
29 | |
30 | |
31 | |
32 | |
33 | |
34 | |
35 | |
36 | |
37 | |
Moin, Heissen Dank. Genau so Zeugs vom Kaliber //TRANSLIT such' ich. OK, in dem Fall ist's nicht schlimm, weil ich selbst den tocode angeb'. Wenns aber sowas als Anweisung in utf-8 strings gaebe, das zu machen, wenn dieser String nach ISO-Gedoens gewandelt werden wuerde... Gruss WK
Antwort schreiben
Bitte melde dich an, um einen Beitrag zu schreiben.