Rapport antwurdkwaliteit
Antwurdkwaliteit: Gem 1.0 fergelike mei Gem 2.0
Pilot · dielferzameling fan fragen
Wy leine de âldere dialoochagint (Gem 1.0) neist de nije GenAI-agint (Gem 2.0): deselde gemeente, deselde fragen, allinne de motor derûnder ferskilt.
| Kritearium | Gem 1.0 | Gem 2.0 |
|---|---|---|
| Krektens | ||
| Helpfeardigens | ||
| Ienfâld | ||
| Stavering & grammatika | ||
| Toan | ||
| Woegen totaal | 0,872 | 0,888 |
Skoarebannen
- 0,90–1,00
- 0,80–0,89
- 0,70–0,79
- 0,60–0,69
- < 0,60
Wat betsjut dit?
De wichtichste ferskillen tusken dizze ferzjes binne:
- Gem 2.0 is better yn komplekse fragen, bygelyks as it giet om ko-âlderskip.
- Gem 1.0 is better by rûsfragen en ynformele bewurdingen (lykas “blabla…”, “hoi, ik wol…”).
Oer dizze mjitting
- Testset
- 100 fragen út 12 kategoryen fan de faak stelde fragen. Elke skoare is it gemiddelde oer dy fragen.
- Kritearia
- Kritearia en ferwachte antwurden binne noch net optimalisearre nei maksimale oerienkomst mei minsklike beoardielers. It kritearium “krektens” is no algemien en ienfâldich hâlden.
Lytse letterkes: metoade & foarbehâlden
Pilot op in dielferzameling: dizze run is net sûnder mear represintatyf foar alle ûnderwerpen of alle gemeenten.