Laufzeiten von PP 0.6.4-1 vor dem Umbau
30 Durchläufe je Szenario · Intel Core i5-1335U · R 4.6.1 · ein Thread
Iterationen1
Laufzeit in Sekunden
Streuung
Mittelwert SD Median IQR Min–Max VK2 Verteilung3
PP_4pl() · 1PL, 5.000 Personen × 40 Items
MLE 6 0,399 0,0106 0,397 0,00850 0,389–0,433 2,6%
-2.0 %-1.2 %+0.0 %+0.9 %+3.0 %
WLE 6 0,461 0,0130 0,457 0,0138 0,447–0,497 2,8%
-2.3 %-1.4 %+0.0 %+1.6 %+4.0 %
MAP 5 0,338 0,00857 0,337 0,00775 0,326–0,365 2,5%
-3.1 %-1.3 %+0.0 %+1.0 %+3.1 %
EAP – 0,829 0,0226 0,826 0,0213 0,805–0,900 2,7%
-2.5 %-1.5 %+0.0 %+1.0 %+4.1 %
PP_4pl() · 2PL, 5.000 Personen × 40 Items
MLE 7 0,461 0,0147 0,455 0,00800 0,440–0,499 3,2%
-1.9 %-0.5 %+0.0 %+1.2 %+1.6 %
WLE 7 0,532 0,0125 0,528 0,00750 0,519–0,571 2,3%
-1.7 %-0.5 %+0.0 %+0.9 %+2.8 %
MAP 5 0,341 0,0129 0,337 0,00875 0,327–0,375 3,8%
-3.1 %-1.6 %+0.0 %+1.0 %+2.2 %
EAP – 0,831 0,0203 0,828 0,0217 0,805–0,885 2,4%
-2.7 %-1.1 %+0.0 %+1.5 %+4.9 %
PP_4pl() · 3PL, 5.000 Personen × 40 Items
MLE 40 2,53 0,0543 2,53 0,0517 2,47–2,75 2,1%
-2.6 %-1.4 %+0.0 %+0.6 %+1.6 %
WLE 40 2,94 0,0909 2,93 0,0312 2,88–3,34 3,1%
-1.8 %-0.7 %+0.0 %+0.4 %+1.3 %
MAP 9 0,587 0,0121 0,583 0,0110 0,567–0,618 2,1%
-2.7 %-0.7 %+0.0 %+1.2 %+2.9 %
EAP – 0,837 0,0274 0,827 0,0320 0,806–0,921 3,3%
-2.5 %-1.0 %+0.0 %+2.9 %+7.1 %
PP_gpcm() · GPCM, 2.000 Personen × 20 Items, 5 Kategorien
MLE 7 0,198 0,00790 0,196 0,00350 0,189–0,228 4,0%
-2.8 %-0.3 %+0.0 %+1.5 %+2.3 %
WLE 7 0,971 0,0212 0,967 0,0192 0,948–1,06 2,2%
-2.0 %-0.7 %+0.0 %+1.3 %+3.9 %
EAP – 1,30 0,0419 1,29 0,0265 1,26–1,42 3,2%
-2.2 %-0.6 %+0.0 %+1.5 %+2.8 %
JKpp() · 3PL, 500 Personen × 40 Items, WLE-Objekt
Jackknife (40 Teilstichproben)4 40 × 500 142 2,27 142 1,94 140–152 1,6%
-1.6 %-1.2 %+0.0 %+0.2 %+0.6 %
PV() · 3PL, 300 Personen × 40 Items, EAP-Objekt
10 Plausible Values (MH) – 0,452 0,0113 0,450 0,0150 0,435–0,480 2,5%
-3.4 %-1.7 %+0.0 %+1.7 %+6.5 %
sim_gpcm() · GPCM, 2.000 Personen × 20 Items, 5 Kategorien
Simulation – 0,833 0,0195 0,828 0,0212 0,807–0,899 2,3%
-2.5 %-0.7 %+0.0 %+1.8 %+4.3 %
1 Newton-Raphson-Durchläufe. Der alte Code rechnet für alle Personen weiter, bis die letzte konvergiert ist oder maxsteps erreicht ist (40 bei PP_4pl(), 500 bei JKpp()). EAP, Plausible Values und Simulation iterieren nicht. Gezählt sind die ausgeführten Durchläufe; PP_gpcm() meldet in nsteps einen weniger.
2 Variationskoeffizient: Standardabweichung geteilt durch den Mittelwert.
3 Boxplot der Einzelläufe als Abweichung vom Median der Zeile in Prozent, alle Zeilen auf derselben Skala.
4 Eine einzige Person pendelt im Newton-Verfahren. Weil der alte Code erst abbricht, wenn alle Personen konvergiert sind, rechnen alle 40 Teilstichproben bis maxsteps = 500.
Messung: bench/bench.R, PP 0.6.4.1.9000, Commit a833907, 05.10.2026 · Daten: in R simuliert (bench/scenarios.R) · Verstrichene Zeit nach einem Aufwärmlauf, die Durchläufe verschränkt in zufälliger Reihenfolge.