heise+ | Large Language Models testen mit EVALs – Qualität messbar machen

heise+ | Large Language Models testen mit EVALs – Qualität messbar machen

Shutterstock 2220987525 C05bfa71da10dce5

Warum das Testen von LLMs schwer ist: Sie sind nicht deterministisch. Gleicher Input kann unterschiedliche, teils faktisch falsche Outputs erzeugen.

Ähnliche Beiträge

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert