przez Cyfrowy Baron » poniedziałek, 5 stycznia 2009, 12:51
Znaki: "Ą","Ć","Ę","Ł","Ń","Ó","Ś","Ź","Ż","ą","ć","ę","ł","ń","ó","ś","ź","ż" nie wymagają stosowania kodowania UTF, gdyż zmienna typu AnsiString bez problemu je obsługuje.
Nie rozumiem Twojego problemu, jeżeli wczytam źródło pliku HTML do zmiennej AnsiString to otrzymam właściwe źródło strony, z prawidłowo wyświetlonymi wierszami, czyli dla ciągu znaków:
"Ą","Ć","Ę","Ł","Ń","Ó","Ś","Ź","Ż","ą","ć","ę","ł","ń","ó","ś","ź","ż"
otrzymam:
"Ą","Ć","Ę","Ł","Ń","Ó","Ś","Ź","Ż","ą","ć","ę","ł","ń","ó","ś","ź","ż"
Jak widać poszczególne litery są wyświetlane bez zmiany, ale dla kodowania Windows-1250, natomiast przy zestawie znaków ISO-8859-1 otrzymam:
"Ą","Ć","Ę","Ł","Ń","Ó","Ś","Ź","Ż","ą","ć","ę","ł","ń","ó","ś","ź","ż"
Dużo więc zależy od tego w jakim zestawie znaków jest kodowana strona i powinieneś opracować kod dekodujący w zależności od użytego systemu kodowania.