Man kann diskutieren, was ein valides Maß ist.

„ALL“ ist eine Wiederholung. Doch genauer gesagt sind es zwei
Wiederholungen. „AL“ ist die eine, „LL“ die andere.

Sieht man es aus diesem Winkel, kann man eine Textdatei nach zweifachem
Vorkommen eines Buchstaben einer Gruppe abgrasen. Die Regexp sieht dann
so aus:

[khsnbm]{2}

Abgrasen kann man mit Grep.

Erstelle ich nun zwei Dateien, grep.txt mit diesem Inhalt:

[xuü]\{2\}
[viö]\{2\}
[laä]\{2\}
[cepwoz]\{2\}
[ksbhnm]\{2\}
[hnm]\{2\}
[gr]\{2\}
[ft]\{2\}
[qdj]\{2\}
[ßy]\{2\}

und grep1.txt mit diesem Inhalt:

[üa]\{2}
[öoq]\{2\}
[äej]\{2\}
[äpyuikx]\{2\}
[fgdhbm]\{2\}
[ctw]\{2\}
[rnv]\{2\}
[lsz]\{2\}

Dann kann man die Häufigkeit von Wiederholungen mit diesem Befehl
anzeigen lassen:

grep -iof grep.txt Test.txt | tr [:upper:] [:lower:] | sort | uniq -c |
sort -rn > Neo.txt

grep -iof grep1.txt Test.txt | tr [:upper:] [:lower:] | sort | uniq -c |
sort -rn > Dvorak.txt

Für den, der dazu keine Lust hat, hier die Ergebnisse bei Neo:

   1000 we
    958 al
    912 nn
    617 tt
    545 la
    539 ns
    512 ll
    472 ze
    446 hn
    400 mm
    369 ss
    367 wo
    306 hm
    297 oc
    285 rg
    275 rr
    263 nk
    255 ew
    252 ft
    231 ec
    179 gr
    147 bs
    145 ff
    121 ee
    107 hs
    101 vi
     97 zw
     84 pe
     84 nb
     73 nh
     45 nm
     44 po
     40 hk
     38 ez
     35 op
     32 aa
     28 sh
     28 ep
     27 pp
     27 ms
     25 tf
     25 ow
     24 ks
     22 zo
     22 eo
     19 uu
     18 sm
     16 sk
     16 mk
     12 kn
     10 bh
      9 bn
      8 hh
      7 hb
      6 sb
      5 mh
      5 gg
      4 sn
      4 iv
      4 bk
      3 mn
      3 kk
      3 kh
      3 kb
      2 zc
      2 oz
      2 bb
      1 ux
      1 oo
      1 mb
      1 co
      1 ce

und hier die Ergebnisse von Dvorak (der Treiber von meiner Homepage):

    912 nn
    814 ll
    617 tt
    400 mm
    379 rn
    371 ss
    306 hm
    291 ls
    275 rr
    209 je
    145 ff
    142 tw
    121 ee
    103 ki
     89 pi
     60 up
     52 lz
     45 zl
     43 ku
     41 ik
     36 rv
     35 bg
     30 nr
     27 uk
     27 nv
     26 fg
     23 sz
     23 pu
     23 md
     22 hd
     21 pp
     20 ip
     19 uu
     18 sl
     17 hg
     12 mg
     11 mf
     10 bh
      9 fb
      8 hh
      7 hb
      7 dh
      6 hf
      6 ej
      6 db
      5 ui
      5 mh
      5 iu
      5 gg
      4 gh
      3 kk
      3 gf
      3 fm
      3 fh
      3 bf
      2 gb
      2 dg
      2 df
      2 bb
      1 zs
      1 yp
      1 ux
      1 oo
      1 mb
      1 ix
      1 gm
      1 dm
      1 bd

Der getestete Text ist der gleiche wie letztes Mal, der Roman.


Die Ergebnisse brauchen kaum kommentiert werden, denke ich.

Der Neo-Tipper tippt in der Mitte und wiederholt die Finger. Der
Dvorak-Tipper tippt weiter am Rand.

Entweder so oder so. Beides gleichzeitig geht wohl nicht.


Antwort per Email an