So arbeitet der Pflegegeld-Prüfer
Kurz
Eine KI ordnet Ihre Erzählung den Regeln zu. Stunden, Stufe und Geld rechnet ein Programm. Das Ergebnis kann falsch sein.
So funktioniert es
- Sie
Erzählen
Sie beschreiben Ihren Alltag in eigenen Worten.
- KI
Zuordnen
Die KI ordnet Ihre Sätze Regeln zu, mit wörtlichem Zitat.
- Programm
Rechnen
Das Programm rechnet nach der Verordnung.
- Sie
Prüfen
Sie prüfen jede Zeile und entscheiden selbst.
Wie gut ist das?
Darauf können Sie bauen
- Mit feststehenden Angaben trifft das Programm 22 von 22 Fälle, ohne KI.
- Mit einer Rückfrage löste der Pflegegeld-Prüfer 13 von 15 Übungsfälle. Das Ziel von 13 ist erreicht.
- Lag er daneben, dann meist zu niedrig. Er verspricht also eher zu wenig als zu viel.
Hier liegen die Grenzen
- Im ersten Durchgang vom 26.09.2026 traf er bei 10 von 14 Übungsfällen die Referenzstufe. Auf 100 ähnliche Fälle wären wohl etwa 45 bis 88 richtig. Das Ziel von 12 hat er verfehlt.
- Weitere Gerichtsfälle, schon gesehen (X16 bis X30): 5 von 15, auf 100 ähnliche wohl 15 bis 58. Der Bescheid traf öfter: 8 von 14, ohne Kinderfall.
Der Pflegegeld-Prüfer bereitet vor. Die Stufe legt die Behörde oder das Gericht fest. Lassen Sie sich trotzdem beraten.
Alle Fälle ansehenGrenzen
- Wenige Fälle machen das Ergebnis ungenau.
- Die Übungsfälle halfen beim Verbessern. Im Alltag trifft er wohl seltener.
- Gemessen wird mit nacherzählten Urteilen, noch nicht mit Erzählungen echter Familien.
- Beispielfälle sind aufgezeichnet, Ihren Text liest die KI neu.
- Gezielt veränderte Geschichten sind erst an wenigen Fällen geprüft.
Was der Pflegegeld-Prüfer nicht tut
- Er entscheidet nicht über Ihr Pflegegeld.
- Er berät und vertritt Sie nicht.
- Die KI rechnet nicht. Häufigkeiten übernimmt sie nur aus Ihren Worten.
- Er speichert Ihre Erzählung nicht dauerhaft.
Genauer
Die Gerichtsfälle stammen aus veröffentlichten Urteilen österreichischer Gerichte.
KI-Agenten haben diese Urteile gesucht, gelesen und nacherzählt. Aus jedem Urteil haben sie abgeleitet, welche Stufe nach den Regeln passt. Diese Stufe heißt hier Referenzstufe.
Bei einigen Fällen weicht sie von der Stufe im Urteil ab. Die Gründe stehen in der ausführlichen Fassung.
Dazu kommen sieben erfundene Beispielfälle. Ihre Stufe ist aus den Regeln abgeleitet, nicht aus einem Urteil. Sie zählen deshalb nicht in die Zahl oben.
Ich habe den Pflegegeld-Prüfer mit KI-Agenten gebaut. Die strittigen Fragen habe ich selbst entschieden.
Übungsfälle sind Gerichtsfälle, an denen ich den Pflegegeld-Prüfer verbessert habe. Die Zahl oben stammt aus diesen Fällen.
Getroffen heißt: Die Mehrheit von 3 Läufen trifft die Referenzstufe.
Prüfungsfälle sind die weiteren Gerichtsfälle. Diese Fälle kenne ich schon, verbessere an ihnen aber nichts mehr. Ich werte sie einmal zum Schluss und zeige das Ergebnis, auch wenn es schlecht ist. (Fachwort: Holdout)
Was als Treffer zählt und welches Ziel gilt, habe ich aufgeschrieben, bevor ich gemessen habe. Seit dem Endlauf ändere ich die Regeln und die Anweisung an die KI nicht mehr. (Fachwort: Vorregistrierung)
Das Programm prüfe ich auch ohne KI: Bekommt es die richtigen Stunden, trifft es in allen Übungsfällen und erfundenen Fällen die Referenzstufe.
Die Zahlen oben habe ich mit Claude Opus 5.5 gemessen. Die Online-Demo liest eigenen Text mit einem günstigeren Modell, Gemini 3.8 Flash. Auf denselben Übungsfällen traf es in einem eigenen Lauf vom 26.09.2026 bei 11 von 14 die Referenzstufe. Auf 100 ähnliche wären wohl 52 bis 92 richtig. Dieser Lauf ging über eine lokale Schnittstelle im Abo und war vorab nicht als Hauptzahl festgelegt. Deshalb verrechne ich ihn nicht mit der Zahl oben. (Bericht zu den Zweitmodellen)
Die ausführliche Methodik liegt dem Quellcode bei.