Technologie
GPT-6 kann sich per „Sandbagging“ in Tests schlechter machen als es ist
Bei einem Menschen würde man wohl Tiefstapler sagen, bei einem KI-Modell heißt es „Sandbagging“: Ein Nebensatz in der kürzlich veröffentlichten System Card zu OpenAIs neuem Modell GPT-6 Astra beschreibt ein Problem, das die gesamte Prüfpraxis der KI-Branche betrifft.
Schlagzeilen quer durchs Spektrum
- «GPT-6 kann sich per „Sandbagging“ in Tests schlechter machen als es ist» — Trending Topics (mitte)