webForumDet fria alternativet

Hämtar sidkod 2ggr efter varandra, datumet..

1 svar · 386 visningar · startad av ps

psMedlem sedan juni 2000841 inlägg
#1

Har skrivit ett program i Python som delvis hämtar och plockar ut relevant information.

Nu till ett aningen konstigt problem.
Om jag hämtar samma sida 2ggr(ca 30 sekunder mellan hämtningarna) så får jag inte riktigt samma text.

Första gången ser det ut så här:
....den 26 april 2001 17:25....

Och den andra gången så här:
....26 April 2001 17:25....

Det är exakt detta som ändras (jag har inte missat att ta med "den" i andra textsnutten)

Datumet skrivs alltså ut på olika sätt. Hur är det möjligt(!)?

Ännu ett exempel:

Första gången:
....26 April 2001 14:15....

Andra gången:
....April 26, 2001 2:15 PM....

Hela strängen förutom just det här med datumet blir exakt likadan.

Verkar ju som den skrivet datumet lite som den vill.

Kanske har jag glömt att skicka med nån header om vilket land, eller tidszon som jag hämtar ifrån. ??

Har du svar eller bara en gissning om vad det kan vara för skumt; skriv!

redigerat

Kan tillägga att jag skickar dessa headers:

("Accept-Language", "sv")
("Host", host)
("Accept", "text/html")
("Accept", "text/plain")
("User-agent", "Mozilla/4.0 (compatible; MSIE 5.01; Windows NT 5.0)")

------------------
ps » Email » URL

[Redigerat av ps den 26 apr 2001]

[Redigerat av ps den 26 apr 2001]

psMedlem sedan juni 2000841 inlägg
#2

IE visar på ett sätt och Mozilla visar på ett annat.
Men dom är konsekventa..

Konstigt att inte mitt program är konsekvent i hämtningen.

Jag hämtar från: http://cnn.passagen.se --> ekonomilänkarna (ca 7 st) på framsidan längst ner.

------------------
ps » Email » URL

[Redigerat av ps den 27 apr 2001]

136 ms totalt · 3 externa anrop · v20260731065814-full.cf67ef55
0 ms — hämta forumlista (cache)
0 ms — hämta statistik (cache)
133 ms — hämta tråd, inlägg och bilagor (db)