[dk-tug] [OT] elisp find dupletter

Lars Madsen <[email protected]>
Newsgroups gmane.comp.tex.danish
Message-ID <[email protected]>
Hej

Nogen der kender en regexp eller en anden smart metode til at finde 
dupletter i tekstfiler?

Det vil sige 'ord ord' hvor mellemrummet er generelt whitespace og hvor 
ord kan indeholde æøå (i passende encoding, i dette tilfælde latin1)

reftex har en rar feature med reftex-search-document som skal fodres med 
en passende regexp

Synes bare ikke lige jeg kan finde den rette regexp

I Perl (uden krav om æøå) virker denne nogenlunde


   while ( $s =~ /(\b([[:word:]]+)\s+\2\b)/msg ) { .. }

hvor jeg har hele filen indlæst i $s

nogen ideer?

(det var sq godt en bruger kom og spurgte om dette, fandt lige en del 
dupletter i et manus)



-- 

/Lars Madsen
DK-TUG formand, tug.dk
lmpx.com only provides a reader for public news (NNTP) servers. It is not affiliated with the servers or forums shown here and is not responsible for the content of articles, which is written by their respective authors.