[dk-tug] [OT] elisp find dupletter
Lars Madsen <[email protected]>
| Newsgroups | gmane.comp.tex.danish |
|---|---|
| Message-ID | <[email protected]> |
Hej
Nogen der kender en regexp eller en anden smart metode til at finde
dupletter i tekstfiler?
Det vil sige 'ord ord' hvor mellemrummet er generelt whitespace og hvor
ord kan indeholde æøå (i passende encoding, i dette tilfælde latin1)
reftex har en rar feature med reftex-search-document som skal fodres med
en passende regexp
Synes bare ikke lige jeg kan finde den rette regexp
I Perl (uden krav om æøå) virker denne nogenlunde
while ( $s =~ /(\b([[:word:]]+)\s+\2\b)/msg ) { .. }
hvor jeg har hele filen indlæst i $s
nogen ideer?
(det var sq godt en bruger kom og spurgte om dette, fandt lige en del
dupletter i et manus)
--
/Lars Madsen
DK-TUG formand, tug.dk