webForumDet fria alternativet

Sökmotorindexering

Webbutveckling

3 svar · 537 visningar · startad av standard sparty

Medlem sedan sep. 201041 inlägg
Frågan#1

Jag byggde först min hemsida baserad på XML+XSLT. Nästan klar insåg jag att den inte skulle bli indexerad som en HTML-sida fastän outputen var HTML 4.01. Jag byggde om men nu är sidan istället beroende av att DOM-trädet manipuleras en hel del efter nedladdning. Tror ni att google Yahoo och bing fixar det?

Medlem sedan mars 20007 896 inlägg
#2

Nej, sökspindlarna brukar strunta i element som har tillkommit efter sidans laddning. Jag har däremot hört att Google försöker indexera manipulerade DOM-träd (egentligen ajaxlösningar, men det borde inte spela någon roll).

Anledningen till att XML+XSLT-sidor inte blir indexerade som sin output är att spindlarna inte kan processa XSLT:n, och enbart indexerar XML-filen. Du kan dock använda den här varianten vid utvecklingen ändå, och parsa XML genom XSLT på serversidan. Då får klienten nämligen ut ren [i ditt fall] HTML 4.01, och den är indexeringsbar för spindlarna.

Medlem sedan sep. 201041 inlägg
#3

Hej Spin.

Ja, som jag förstod det så gick det att lösa på serversidan med hjälp av ASP eller PHP. Tyvärr finns det ingen ledig plats i min skalle för de språken. Men jag måste säga att det är konstigt att inte spindlarna kan lugna sig lite tills dokumentträdet är färdigbyggt, med tanke på hela Ajax och web 2.0-hypen. Tough shit. Nåväl en lösning får du tillgodoräkna dig.

Medlem sedan juli 2003555 inlägg
#4

Problemet är att du gör antagandet att spindeln bygger på en webbläsare. En webbläsare är en fantastiskt komplicerad produkt, både att bygga, och att använda. Om du jämför vilka resurser som går åt för att bara ladda ner en textfil mot att köra den genom en webbläsare, exekvera en massa script, undersöka vilka lager som överlappar vilka, vilken text är synlig, vilken är dold, ladda en massa ajax osv. så ser du att det är mycket stor skillnad.

Det krävs helt enkelt väldigt, väldigt stora resurser för att spindla en viss mängd information jämfört med om de fullkomligt struntar i allt utom det rena innehållet.

Så nej, det finns med all sannolikhet inget DOM-träd att vänta på :)

281 ms totalt · 4 externa anrop · v20260731065814-full.a51de22e
142 ms — deklarationer (db)
0 ms — hämta statistik (cache)
135 ms — hämta tråd, inlägg och bilagor (db)
143 ms — ändringar (db)