Detektory AI wykrywają 93,5% bezpośredniego tekstu LLM, lecz tylko 15,1% tekstu człowieka po poprawkach LLM. 🤖

Zbudowano Authorship-Rewriting Benchmark (ARB): 1800 ludzkich tekstów z XSum, WritingPrompts i OpenWebText, każdy w czterech wariantach - tekst człowieka, generacja od zera, tekst człowieka przekształcony przez LLM oraz tekst LLM przekształcony tym samym modelem; użyto czterech otwartych generatorów. Przy progu 1% fałszywie pozytywnych FastDetectGPT i Binoculars-falcon-7b wykryły 91,2% oraz 93,5% bezpośredniego tekstu LLM, ale tylko 30,8% i
uzior - Detektory AI wykrywają 93,5% bezpośredniego tekstu LLM, lecz tylko 15,1% teks...

źródło: card

Pobierz
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach