Har byggt en applikation där csv filer laddas upp och parsas. Eftersom listorna innehåller många "konstiga" namn, t.ex. med ryska och kinesiska tecken, måste man alltid UTF-8 koda filerna som laddas upp.
Går det att känna igen i valideringen om filen är av rätt typ? Det som händer är att laddar man upp en UNICODE fil så sparas filen, men sen blir det generalpaj då datan ska sparas i databasen.
Har Googlat lite på det här, men hittar inget bra.
... Checking is possible because UTF-8 has a very specific byte-pattern not seen in any other encoding. If non-UTF-8 data is received, an error message should be sent back.