Cum verificăm
O inteligență artificială (IA) pune relatarea dumneavoastră în legătură cu regulile din regulament. Orele, treapta și banii sunt recalculate de un program fix, fără IA. Rezultatul poate fi greșit. De aceea, la final dumneavoastră verificați și decideți.
Cum funcționează
- Dumneavoastră
Relatare
Descrieți viața de zi cu zi cu propriile cuvinte.
- IA
Potrivire
IA pune propozițiile dumneavoastră în legătură cu reguli, cu un citat cuvânt cu cuvânt.
- Program
Calcul
Un program fix calculează după regulament.
- Dumneavoastră
Decizie
Verificați fiecare rând și decideți ce faceți cu el.
Cât de des are dreptate
Cel mai de încredere până acum: cazuri din instanță neatinse
5 din 15
Cazuri din instanță, neatinse de noi după construirea verificatorului, pe care le-a încadrat corect din prima încercare; pe celelalte le-a încadrat de cele mai multe ori prea jos.
Situația de azi: cazuri de exercițiu
10 din 14
Cazuri de exercițiu din hotărâri judecătorești publicate, folosite de noi pentru reglare, pe care le-a încadrat corect din prima încercare.
Pflegegeld-Prüfer vă ajută să vă pregătiți. Treapta o stabilește autoritatea sau instanța. Cereți consiliere.
Pregătire
Am adunat 29 hotărâri judecătorești publicate despre Pflegegeld (indemnizație de îngrijire). Încă de la început, în 13 dintre aceste cazuri Bescheid-ul (decizie oficială) nu era la treapta stabilită în final de instanță.
Reguli stabilite dinainte
Înainte de prima măsurare, era stabilit ce contează drept rezultat corect și ce obiectiv se aplică: 12 din 14 cazuri de exercițiu.
Primele măsurări
Prima rulare a nimerit 9 din 14. Am făcut o singură îmbunătățire, apoi am înghețat regulile și instrucțiunile pentru IA. Ultima rulare a nimerit 10 din 14, deci obiectivul nu a fost atins.
La 4 dintre aceste rezultate corecte, răspunsul corect nu era o treaptă: niciun drept sau un copil, pentru care verificatorul nu calculează. La cazurile cu o treaptă reală a nimerit 6 din 9.
Proba pe cazuri neatinse
O singură dată, la final, pe alte 15 hotărâri: 5 corecte. După aceea nu am mai schimbat nimic. La cazurile cu o treaptă reală au fost 4 din 13.
De atunci
Pagina este publică. Am îmbunătățit întrebările suplimentare și interfața. La 28.09.2026 am comparat 10 modele de IA pe aceleași cazuri. Gemini 3.8 Flash, modelul pentru textul dumneavoastră, a nimerit cazurile de exercițiu la fel de des ca modelul pe care îl folosim ca etalon de calitate. La 29.09.2026 am măsurat din nou. Rezultatul apare mai sus ca situația de azi.
Măsurăm pe hotărâri judecătorești publicate, la care treapta corectă este deja cunoscută. O parte o folosim pentru exercițiu și îmbunătățire. O altă parte nu o atingem și o verificăm doar la final.
Ce contează drept rezultat corect stabilim dinainte și notăm în scris. Modificările ulterioare sunt notate acolo cu dată. Fiecare măsurare este adăugată și niciuna nu este ștearsă, nici cele proaste.
Punem mereu la îndoială chiar metoda. O verificare automată fără IA rulează la fiecare modificare. Ea recalculează rapoartele, verifică numitorii și caută urme ale cazurilor neatinse în reguli. Nu poate măsura din nou. Ce găsim apare mai jos, la limite.
Măsurat la 29.09.2026 cu Gemini 3.8 Flash, modelul care citește și textul dumneavoastră. Pe aceste cazuri l-am reglat, de aceea cifra este probabil prea mare.
Măsurat o singură dată, la 26.09.2026. Această cifră spune cel mai mult despre cum se descurcă la cazuri noi.
Pentru comparație: dacă la aceste cazuri s-ar fi preluat pur și simplu treapta din Bescheid, rezultatul ar fi fost corect în 8 din 14 cazuri, deci mai des. Așadar, verificatorul nu recunoaște în mod sigur dacă un Bescheid este corect.
Dacă programul primește orele din hotărâre, treapta este corectă în toate cele 22 cazuri de exercițiu și fictive. La cazurile neatinse, în 12 din 15. Celelalte hotărâri nu indică ore pentru fiecare sarcină de îngrijire, așa că programului îi lipsesc datele de intrare.
Când a greșit, treapta a fost de cele mai multe ori prea jos: prea jos de zece ori, prea sus de două ori.
Ce înseamnă asta pentru dumneavoastră?
Dacă arată mai mult decât Bescheid-ul dumneavoastră, merită să priviți atent și să cereți consiliere.
Dacă nu arată mai mult, asta nu înseamnă că Bescheid-ul dumneavoastră este corect. Mai degrabă scapă ceva din vedere decât să promită prea mult.
Limite
Unde poate greși
- S-a măsurat pe puține cazuri. De aceea fiecare cifră este imprecisă.
- Cazurile din instanță sunt hotărâri repovestite, încă nu relatări ale unor familii reale.
- Treapta corectă pentru fiecare hotărâre a fost dedusă de o IA din hotărâre. Un specialist în drept nu a verificat încă acest lucru.
- Unele reguli ale verificatorului au fost deduse din cazuri care au servit mai târziu drept cazuri neatinse. Acest lucru poate favoriza puțin rezultatul acolo.
- Textul dumneavoastră este citit de Gemini 3.8 Flash, același model ca la situația de azi. Pe cazurile neatinse nu a fost încă măsurat.
Ce nu face
- Nu decide asupra Pflegegeld-ului dumneavoastră (indemnizație de îngrijire).
- Nu vă oferă consiliere și nu vă reprezintă.
- IA nu calculează. Preia frecvențele doar din cuvintele dumneavoastră.
- Nu vă păstrează relatarea pe termen lung.
Este corectă treapta dumneavoastră?
Descrieți o zi obișnuită. Verificatorul pune propozițiile în legătură cu regulile și recalculează dacă treapta din Bescheid (decizie oficială) se potrivește.
Verificați Bescheid-ul meuPentru specialiști
Ultima rundă de măsurare: 29.09.2026.
Toate rundele de măsurare
Fiecare rundă evaluată în care IA citește relatarea, în ordine cronologică. Nimic nu este suprascris.
- 26.09.2026 · Cazuri de exercițiu: 9 din 14Interval 39 până la 84 % · Model Claude Opus 5.5Erster Lauf aus freiem Text, vor der einen Änderung an der Anweisung an die KI.
- 26.09.2026 · Cazuri de exercițiu: 10 din 14Interval 45 până la 88 % · Model Claude Opus 5.5Endlauf nach dem Einfrieren von Regeln und Anweisung. Das ist die vorher festgelegte Hauptzahl.
- 26.09.2026 · Cazuri fictive: 7 din 7Interval 65 până la 100 % · Model Claude Opus 5.5Erfundene Fälle mit Antworten auf die Rückfragen, darum eine Obergrenze.
- 26.09.2026 · Cazuri neatinse: 5 din 15Interval 15 până la 58 % · Model Claude Opus 5.5Unberührte Fälle, einmal gemessen, danach nichts verändert.
- 26.09.2026 · Hotărâri noi, pilot: 6 din 6Interval 61 până la 100 % · Model Claude Opus 5.5Pilot mit neuen Urteilen, nicht vorher festgelegt. Fast alle Fälle ohne Anspruch, sagt über Stufen darum wenig.
- 28.09.2026 · Cazuri de exercițiu: 10 din 14Interval 45 până la 88 % · Model Claude Opus 5.5 · Orele diferă în medie cu 17,7Modellvergleich, Bezugsarm für die Qualität. Verfehlt dieselben Übungsfälle wie das Modell, das eigenen Text liest.
- 28.09.2026 · Cazuri fictive: 7 din 7Interval 65 până la 100 % · Model Claude Opus 5.5 · Orele diferă în medie cu 0,6Modellvergleich. Erfundene Fälle mit Antworten auf die Rückfragen, darum eine Obergrenze.
- 28.09.2026 · Cazuri-limită: 2 din 2Interval 34 până la 100 % · Model Claude Opus 5.5 · Orele diferă în medie cu 0Modellvergleich, Randfälle.
- 28.09.2026 · Hotărâri noi, pilot: 6 din 6Interval 61 până la 100 % · Model Claude Opus 5.5 · Orele diferă în medie cu 5Modellvergleich. Fast alle Fälle ohne Anspruch, sagt über Stufen darum wenig.
- 28.09.2026 · Cazuri de exercițiu: 10 din 14Interval 45 până la 88 % · Model Claude Sonnet 5 · Orele diferă în medie cu 17,3Modellvergleich, bestes weiteres Modell aus der Sichtung.
- 28.09.2026 · Cazuri fictive: 6 din 7Interval 49 până la 97 % · Model Claude Sonnet 5 · Orele diferă în medie cu 0,7Modellvergleich. Erfundene Fälle mit Antworten auf die Rückfragen, darum eine Obergrenze.
- 28.09.2026 · Cazuri-limită: 2 din 2Interval 34 până la 100 % · Model Claude Sonnet 5 · Orele diferă în medie cu 0Modellvergleich, Randfälle.
- 28.09.2026 · Hotărâri noi, pilot: 6 din 6Interval 61 până la 100 % · Model Claude Sonnet 5 · Orele diferă în medie cu 0,8Modellvergleich. Fast alle Fälle ohne Anspruch, sagt über Stufen darum wenig.
- 28.09.2026 · Cazuri de exercițiu: 10 din 14Interval 45 până la 88 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 19,4Modellvergleich mit dem Modell, das eigenen Text liest, gleichauf mit Claude Opus. Gemessen über das lokale Abo-Gateway, nicht über den Weg der gehosteten Prüfung.
- 28.09.2026 · Cazuri fictive: 7 din 7Interval 65 până la 100 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 0,6Modellvergleich. Erfundene Fälle mit Antworten auf die Rückfragen, darum eine Obergrenze.
- 28.09.2026 · Cazuri-limită: 1 din 2Interval 10 până la 91 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 0Modellvergleich, Randfälle. Ein Randfall blieb ohne Wertung, weil das Gateway zweimal keine Antwort lieferte; er zählt hier als nicht getroffen.
- 28.09.2026 · Hotărâri noi, pilot: 5 din 6Interval 44 până la 97 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 4,2Modellvergleich. Fast alle Fälle ohne Anspruch, sagt über Stufen darum wenig.
- 29.09.2026 · Cazuri de exercițiu: 10 din 14Interval 45 până la 88 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 17,8Zweite Messrunde, neu gemessen nach der Änderung der Regel zur Bindung an den Bescheid bei einer Klage (Link und Wortlaut); die Anweisung an die KI blieb gleich. Wie im Modellvergleich über das lokale Abo-Gateway gemessen, nicht über den Weg der gehosteten Prüfung.
- 29.09.2026 · Cazuri fictive: 7 din 7Interval 65 până la 100 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 0,9Zweite Messrunde. Erfundene Fälle mit Antworten auf die Rückfragen, darum eine Obergrenze.
- 29.09.2026 · Cazuri-limită: 1 din 2Interval 10 până la 91 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 0Zweite Messrunde, Randfälle. Ein Randfall blieb ohne Wertung, weil das Gateway zweimal keine Antwort lieferte; er zählt hier als nicht getroffen.
- 29.09.2026 · Hotărâri noi, pilot: 5 din 6Interval 44 până la 97 % · Model Gemini 3.8 Flash · Orele diferă în medie cu 3,3Zweite Messrunde. Fast alle Fälle ohne Anspruch, sagt über Stufen darum wenig.
Cazuri neatinse
Prima trecere: 5 din 15 cazuri cu treapta de referință nimerită. Din 100 de cazuri asemănătoare, probabil 15 până la 58 ar fi corecte.
Dintre acestea, cu treaptă reală 4 din 13, fără drept 1 din 1, copil în afara domeniului 0 din 1.
Greșite: 10. Dintre acestea, 7 prea jos, 2 prea sus, o dată un copil nerecunoscut.
Corect în fiecare rulare: 3 din 15.
Cu o întrebare suplimentară: 7 din 15.
Aceste cazuri au fost evaluate o singură dată, la final, și după aceea nu s-a îmbunătățit nimic pe ele. Rezultatul apare aici, chiar dacă este prost.
Înainte de construire, aceste cazuri au fost deja folosite în comparații de modele. 22 reguli numesc unul dintre ele ca origine, 10 dintre acestea se află în textul pentru IA. Este vorba de X16, X19, X21, X22, X24, X25, X28, X29, X30. Codurile cazurilor nu apar în textul pentru IA. De aceea spunem despre aceste cazuri că sunt „neatinse de la construire”, nu „noi”.
Preluarea treptei din Bescheid
Cazuri neatinse: pe cele 14 cazuri cu treaptă de referință, Bescheid-ul inițial a nimerit de 8 ori, deci mai des decât Pflegegeld-Prüfer.
Cazuri de exercițiu: pe cele 14 cazuri cu treaptă de referință, Bescheid-ul a nimerit de 5 ori, deci mai rar decât Pflegegeld-Prüfer.
În toate cele 29 hotărâri adunate care au un Bescheid, Bescheid-ul a fost de 16 ori la treapta din hotărâre.
Dacă rezultatul lui diferă de Bescheid, asta nu dovedește că Bescheid-ul este greșit. Este un motiv să priviți mai atent și să cereți consiliere.
Arată mai mult când Bescheid-ul era prea jos?
Numărat ulterior, nu stabilit dinainte. Pentru următoarea măsurare vom stabili dinainte această mărime.
Cazuri neatinse: Când Bescheid-ul era sub treapta de referință, a arătat mai mult decât Bescheid-ul în 4 din 6 cazuri. Când Bescheid-ul era corect, a arătat totuși mai mult în 1 din 8 cazuri.
Cazuri de exercițiu: Când Bescheid-ul era sub treapta de referință, a arătat mai mult decât Bescheid-ul în 3 din 3 cazuri. Când Bescheid-ul era corect, a arătat totuși mai mult în 0 din 5 cazuri.
Cazuri de exercițiu
Prima trecere: 10 din 14 cazuri cu treapta de referință nimerită. Din 100 de cazuri asemănătoare, probabil 45 până la 88 ar fi corecte. Obiectiv stabilit dinainte: 12, ratat.
Dintre acestea, cu treaptă reală 6 din 9, fără drept 1 din 1, copil în afara domeniului 3 din 4.
Corect în fiecare rulare: 10 din 14.
Nimerit înseamnă: majoritatea celor 3 rulări nimeresc treapta de referință. În plus există un caz special, la care se evaluează comportamentul. El se numără separat; împreună sunt 15 cazuri de exercițiu.
Cu o întrebare suplimentară: 13 din 15. Se numără dacă a nimerit treapta sau a pus întrebarea care conta. Obiectiv stabilit dinainte: 13, atins.
Greșite: 4. Dintre acestea, 3 prea jos, niciunul prea sus. O dată nu a recunoscut un caz cu copil.
Calcul fără IA
Cu orele din hotărâre, programul nimerește 22 din 22 cazuri, cazuri de exercițiu și cazuri fictive la un loc. Obiectiv stabilit dinainte: 22, atins.
Cazuri neatinse: 12 din 15. Ratate: X18, X25 și X30. Aceste hotărâri indică doar treapta, nu și ore pentru fiecare sarcină de îngrijire, de aceea programul nu primește date de intrare.
Cazuri fictive
Măsurarea folosește 7 cazuri fictive. IA citește relatarea, programul calculează: 7 din 7 cu treapta așteptată. Obiectiv stabilit dinainte: 6, atins. Pe 5 dintre ele le puteți încerca chiar dumneavoastră pe pagina de verificare.
Povestit altfel: treapta s-a schimbat la niciuna din 35 reformulări. Această măsurare nu a fost stabilită dinainte.
Modelul verificării dumneavoastră
Verificarea cu textul dumneavoastră folosește Gemini 3.8 Flash. Situația de azi provine de la acest model. Detaliile despre cazurile de exercițiu și cazurile neatinse din această parte provin din rulări cu Claude Opus 5.5.
O primă rulare separată cu Gemini 3.8 Flash la 26.09.2026 a nimerit 11 din 14 cazuri de exercițiu. Din 100 de cazuri asemănătoare, probabil 52 până la 92 ar fi corecte. Pe cazurile neatinse acest model nu a fost încă măsurat.
Comparația modelelor
La 28.09.2026 am comparat 10 modele de IA pe aceleași cazuri: cazuri de exercițiu, cazuri fictive, cazuri-limită și cazuri suplimentare. Cazurile neatinse nu au fost incluse. Pe cazurile de exercițiu, Gemini 3.8 Flash a nimerit 10 din 14, iar Claude Opus 5.5 10 din 14, de fiecare dată după majoritatea rulărilor.
Ambele au ratat aceleași cazuri: X5, X6, X12 și X15. Așadar, cauza ține mai degrabă de reguli și de modul de lucru decât de model. De aceea Gemini 3.8 Flash rămâne modelul pentru textul dumneavoastră. Claude Opus 5.5 verifică în plus cazurile ratate, ca a doua opinie, iar fiecare îmbunătățire o măsurăm din nou cu Gemini 3.8 Flash pe aceleași cazuri.
Sunt puține cazuri, iar pe cazurile de exercițiu am făcut reglaje. Așadar, o diferență între modele nu este dovedită, în nicio direcție.
De unde vine treapta de referință
Cazurile din instanță provin din hotărâri publicate ale instanțelor austriece.
Agenți de IA au căutat, au citit și au repovestit aceste hotărâri. Din fiecare hotărâre s-a dedus ce treaptă se potrivește după reguli. Această treaptă se numește aici treaptă de referință.
La unele cazuri ea diferă de treapta din hotărâre, de exemplu când un copil este în afara domeniului.
Întrebările disputate le-a decis operatorul, de fiecare dată așa cum au recomandat agenții. Un specialist în drept nu a verificat încă treptele de referință.
Cum rămânem cinstiți
- Cazurile de exercițiu și cazurile neatinse rămân separate. Pe cazurile neatinse nu se îmbunătățește nimic.
- Ce contează drept rezultat corect este stabilit dinainte. Modificările se adaugă ca completări cu dată.
- Fiecare măsurare este adăugată, niciuna nu este suprascrisă. Fiecare poartă o amprentă a regulilor și a instrucțiunilor pentru IA.
- Pentru rulările de măsurare nu plătim pe fiecare apel, de aceea putem măsura cât de des este nevoie.
- Ce am numărat ulterior este marcat ca atare.
- O verificare fără IA rulează la fiecare modificare. Ea recalculează rapoartele și numitorii, caută urme ale cazurilor neatinse în reguli și relatări și compară cazurile de exercițiu cu cele neatinse. Nu măsoară din nou.
Termeni de specialitate
- Cazuri de exercițiu
- calibrare
- Cazuri neatinse
- holdout, văzute deja înainte de construire
- Stabilit dinainte
- preînregistrare
- Interval
- interval de 95 % după Wilson
Caz cu caz
Cazurile de exercițiu, unul câte unul. Atingeți un caz ca să vedeți detaliile.
Cazurile neatinse, unul câte unul.
Aceasta nu este consultanță juridică. Arbeiterkammer (Camera Muncii) și asociațiile persoanelor cu dizabilități își consiliază membrii în privința Bescheid-ului (decizie oficială) și a acțiunii în instanță (Klage).