I en databaskurs jag nu gar ska vi söka igenom källkoden till Ebay DVD och plocka ut relevant information, för att sedan skapa en förenklad version av deras databas.
Sökningen sker med hjälp av reguljära uttryck. Praktiskt nog ligger all nödvändig information lagrad i en JavaScript-array med rader som ser ut som följer (radbrytningar inlagda manuellt för att öka läsbarheten):
dSI(1,1,1,1,0,0,9,1,1,1,0,0,0,2,4180215961,"Ed Wood Special Edition DVD Brand New **RECALLED**","BRAND NEW FACTORY SEALED (not a copy or import)",
"/ws/eBayISAPI.dll?ViewItem&category=617&item=4180215961&rd=1",'','$69.94',
'','',0,0,"","3h 30m","","Apr-13","06:34","Apr-03","05:34",{},"0,0,0,0,0,0,0,0,0,0,0,0");
De intressanta delarna är:
- De första 14 kommaterade attributen som en sträng ("1,1,1,1,0,0,9,1,1,1,0,0,0,2" i detta fall; sista talet kan vara tvasiffrigt)
- Film-id (det tiosiffriga tal som kommer efter ovan nämnda attribut; 4180215961 i exemplet)
- Filmtitel (ex: "Ed Wood Special Edition DVD Brand New **RECALLED**")
- Pris ("$69.94")
- Slut- och starttid ("Apr-13","06:34","Apr-03","05:34")
Resten är helt ointressant och ska "bort".
Jag har lyckats läsa mig till de absoluta grunderna i reguljära uttryck, men här gar jag fet-bet. Tips?