Stanford-Studie

Sprachmodelle halluzinieren „alarmierend“ viel bei rechtlichen Anfragen

Bekannte Sprachmodelle wie ChatGPT, Claude, LLama oder PaLM teilen ein entscheidendes Problem: Viele ihrer Ergebnisse sind schlicht falsch. Forscherinnen und Forscher der Stanford University haben nun untersucht, wie verbreitet dieses als ‚Halluzinieren‘ bezeichnete Verhalten bei rechtlichen Anfragen ist.

Teilen Sie unseren Beitrag

Weiterlesen mit Juve Plus

4 Wochen gratis testen

  • Zugang zu allen digitalen JUVE Inhalten inklusive E-Paper aller Magazine
  • Exklusiver Zugang zu allen Rankings, Datenanalysen und Hintergrundartikeln
  • Inhouse-Teams erhalten kostenfreien Zugriff
  • Themennewsletter JUVE Business Weekly und JUVE Tech Weekly

Ihre Firma hat bereits ein JUVE+-Abo?

Für die Studie werteten sie mehr als 200.000 Abfragen der Large Language Modelle (LLM) GPT 3.5, Llama 2 und PaLM 2 aus. Diese reichten von einfachen Fragen – wie etwa nach dem Verfasser eines bestimmten Gutachtens – bis hin zu komplexeren Aufgaben, zum Beispiel, ob zwei Fälle in einem Spannungsverhältnis zueinander stehen. Das Ergebnis: Je nach Modell lagen die Halluzinationsraten bei 69 bis 88 Prozent.

Artikel teilen

Gerne dürfen Sie unseren Artikel auf Ihrer Website und/oder auf Social Media zitieren und mit unserem Originaltext verlinken. Der Teaser auf Ihrer Seite darf die Überschrift und einen Absatz des Haupttextes enthalten. Weitere Rahmenbedingungen der Nutzung unserer Inhalte auf Ihrer Website entnehmen Sie bitte unseren Bedingungen für Nachdrucke und Lizenzierung.

Für die Übernahme von Artikeln in Pressespiegel erhalten Sie die erforderlichen Nutzungsrechte über die PMG Presse-Monitor GmbH, Berlin.
www.pressemonitor.de

Lesen sie mehr zum Thema