Regular expressions er en ret udbredt tekst-sammenlignings-/-søgnings- og -udskiftning-metode, som bruges i en hel række scripting-sprog, med i praksis samme syntaks for selve det regulære udtryk !-)
-- selv har jeg faktisk kun een ressource liggende til eksempler på koder:
http://www.regexlib.com/Default.aspx-- og een ressource til at se opbygning i forhold til java script:
http://devedge.netscape.com/library/manuals/2000/javascript/1.3/reference/regexp.html-- men skal man dissekere ovenstående udtryk (det korte !-) bliver det til:
/ og / er start og slut på et regulært udtryk (til forskel fra en tekststrengs "")
^ og $ er henholdsvis fra det allerførste tegn og til det allersidste
\ betyder at det efterfølgende skal tages bogstaveligt selv om det måske har en speciel regExp-betydning (og det er også standard 'escape-tegn' i mange andre sprog)
\d matcher kun på tal -- og er et af en hel del forskellige special-sekvenser
{1,3} og {3} betyder henholdsvis 1-3 tegn og 3 tegn af den forudgående
() betyder at det indenfor skal tænkes som en gruppe (og kan bruges til avancerede udskiftninger, da den matchede værdi indenfor kan fyldes tilbage i en ny streng !-)
* betyder at det foregående kan forekomme 0 eller flere gange -- her præcis et punktum plus 3 cifre (\.\d{3}) ...
? betyder at det foregående kan forekomme højst een gang -- her præcis et komma plus nøjagtig 2 cifre (\,\d{2})
-- endnu et par af de rigtig nyttige kunne være:
+ som betyder at det skal forekomme en eller flere gange
\w som matcher bogstaver, tal og underscore
{4,} som er en afart af de tidligere nævnte antals-ting, her 4 eller flere af det foregående
[] som bruges til at angive flere tegn/koder som gerne må være det ene eller det andet
| som betyder eller (logisk eller -- ofte brugt sammen med grupperinger i paranteser !-)
[l-s] som betyder at noget skal falde indenfor det angivne interval
[^l-s] som betyder at noget skal falde _udenfor_ det angivne interval
-- endelig er der to modifiers som kan gøre livet lettere overfor søgninger i større strenge:
EFTER det sidste /
g som betyder global søgning og
i som betyder case Insensitive, altså match på både store og små bogstaver -- der skal det nævnes at det er den lokale sprogindstilling, som sætter grænserne, så du på en dansk pc vil genkende Æ som æ, men den vil ikke du udenfor skandinavien !-)
Det blev til en lille roman og en ultrakort indføring i regExp, men du kan jo bare spørge noget mere i
http://www.eksperten.dk/kat/105 hvis du har specialiteter, du kunne tænke dig at finde ...
-- og velbekomme '-)