Genauigkeit

Kann ich diesem Tool vertrauen?

Entscheiden Sie selbst!

Der genaueste KI-Detektor laut MGTD-Benchmark

MGTD-Benchmark (ICAIE, 2025)– the biggest and most robust benchmark for AI checkers, consisting of 15 different datasets. Authors collected over 2M samples and measured quality or popular AI detectors. It's AI took the first place mit über 92 % Roc-Auc-Score.

MGTD benchmark ROC-AUC
MGTD-Benchmark, Quelle

RAID

RAID (ACL-Papier, 2024) ist ein weiterer wichtiger Maßstab für die Bewertung von KI-Detektoren, wenn auch schon etwas veraltet, da er im August 2024 veröffentlicht wurde. Er enthält über 600.000 Textbeispiele, die von 11 verschiedenen Modellen in 8 Domänen in seiner Testaufteilung generiert wurden.

RAID benchmark
RAID-Benchmark-Parameter

Wir haben It's AI in ihre offizielle Quelle eingereicht Bestenliste und erreichte 98,3 % Genauigkeit.

99 % Genauigkeit bei GRiD, HC3, GhostBuster

GRiD

GPT Reddit-Datensatz (GRiD) besteht aus Kontext-Prompt-Paaren, die von Reddit stammen und Antworten enthalten, die von Menschen generiert und von ChatGPT generiert wurden.

HC3

Der HC3 (Menschlicher ChatGPT-Vergleichskorpus) Der Datensatz besteht aus fast 40.000 Fragen und den entsprechenden menschlichen/ChatGPT-Antworten.

GhostBusters

Der GhostBusters Der Datensatz nutzt das GPT-3.5-Turbo-Modell zur Generierung von Texten in den Bereichen kreatives Schreiben, Nachrichten und studentische Aufsätze.

Im Durchschnitt erzielte It's AI bei diesen 3 Datensätzen 99,1 % Genauigkeit und 96 % f1-Scoreund übertraf damit alle in den Papieren berücksichtigten Detektoren (kommerzielle Detektoren wurden dort nicht bewertet).

0,8 % Falsch-Positiv-Rate bei ASAP 2,0

Falsch-Positiv-Rate (FPR) ist eine weitere wichtige Kennzahl, die wir berücksichtigen sollten, wenn wir über KI-Erkennung sprechen. Es gibt an, wie viele Texte, die tatsächlich von Menschen geschrieben wurden, versehentlich als KI gekennzeichnet werden.

Ein niedriger FPR ist besonders kritisch für die Bildung, wenn es besser ist, ein paar KI-generierte Werke zu übersehen, anstatt Schülern falsche Vorwürfe zu machen, die selbst Texte geschrieben haben. Aus diesem Grund haben wir uns entschieden, zusätzlich zu früheren Benchmarks auch die bildungsbezogenen Aspekte zu messen ASAP 2.0-Datensatz.

Das ASAP 2.0-Korpus umfasst 25.000 überzeugende Aufsätze von Studenten, die aus standardisierten Schreibtests stammen. Die Aufsätze wurden ausgewählt, um die Menge an demografischen Informationen zu maximieren, die für jeden Autor verfügbar sind, einschließlich des Status beim Erlernen der englischen Sprache (ELL), des wirtschaftlichen Hintergrunds (benachteiligt oder nicht), des Behinderungsstatus, der Rasse/ethnischen Zugehörigkeit, des Geschlechts und der Klassenstufe.

It's AI schien diese Texte in weniger als 1 % der Fälle falsch zu klassifizieren FPR entspricht 0,8 %.

0,8 % FPR
auf ASAP 2.0 Datensatz

Bewertung der arabischen Sprache

It's AI unterstützt die KI-Erkennung in arabischer Sprache vollständig. Wir haben es an mehreren arabischen Benchmarks gemessen und Sie können die Ergebnisse unten finden:

98.7%
Genauigkeit
0.5%
FPR

ASJP – wissenschaftliche Arbeiten. Dieser Datensatz enthält maschinengenerierten arabischen Text über mehrere Generierungsmethoden und Large Language Model (LLMs). Es wurde im Rahmen der Forschungsarbeit „The Arabic AI Fingerprint: Stylometrische Analyse und Erkennung von Texten großer Sprachmodelle“ erstellt.

It's AI erreichte 98,7 % Genauigkeit mit 0,5 % FPR auf ASJP.

XL-SUMME– Arabische Nachrichten. XLSum ist ein umfassender und vielfältiger Datensatz, der 1,35 Millionen professionell kommentierte Artikel-Zusammenfassungspaare der BBC umfasst und mithilfe einer Reihe sorgfältig entwickelter Heuristiken extrahiert wurde. Der Datensatz deckt 45 Sprachen ab, darunter Arabisch, von ressourcenarm bis ressourcenintensiv, für viele davon ist derzeit kein öffentlicher Datensatz verfügbar. XL-Sum ist hochabstrakt, prägnant und von hoher Qualität, wie die menschliche und intrinsische Bewertung zeigt.

It's AI klassifizierte XL-SUM perfekt als vollständig von Menschen geschriebenes Korpus, also das FPR beträgt 0 % drauf.

It's AI – Unübertroffene Genauigkeit, der Sie vertrauen können

Gesamt, It's AI wurde ein neues SOTA-Modell (State-of-the-Art). beim MGTD-Benchmark, übertraf andere KI-Detektoren und zeigte eine signifikante Leistung bei den Datensätzen RAID, GRiD, HC3, GhostBuster, ASAP 2.0, ASJP und XL-SUM, was dies beweist Konstanz und Zuverlässigkeit.

Probieren Sie es selbst aus

Stellen Sie die Originalität Ihrer Arbeit sicher

Erkennen Sie KI
Plagiate finden
Texte verbessern
originality