Aufstellen eines statistischen Modells
摘要
In diesem Kapitel wird ein statistisches Modell zur Bestimmung der Schwierigkeit lateinischer Texte erstellt. Dazu werden die Schwierigkeitseinschätzungen der 67 Texte (abhängige Variable) in Beziehung gesetzt mit den jeweils 191 sprachlichen Variablen pro Text (unabhängige Variable). Es zeigt sich, dass ein lineares Regressionsmodell die Schwierigkeit mit R^2=.38 [*wanted to insert as formula, but was not possible*] bei 10-facher Kreuzvalidierung am besten vorhersagen kann.