Erkennen — SlopTotal
23 independent detectors.
Bewerbungsprüfung Detektor
Prüfen Sie Bewerbungsprüfung mit 23 Detektoren. Kostenlos.
Blogartikel Detektor
Prüfen Sie Blogartikel mit 23 Detektoren. Kostenlos.
ChatGPT Detektor
Prüfen Sie ChatGPT mit 23 Detektoren. Kostenlos.
Claude Detektor
Prüfen Sie Claude mit 23 Detektoren. Kostenlos.
DeepSeek Detektor
Prüfen Sie DeepSeek mit 23 Detektoren. Kostenlos.
Detektor-Benchmarks Detektor
Prüfen Sie Detektor-Benchmarks mit 23 Detektoren. Kostenlos.
E-Mails Detektor
Prüfen Sie E-Mails mit 23 Detektoren. Kostenlos.
Einsatz im Unterricht Detektor
Prüfen Sie Einsatz im Unterricht mit 23 Detektoren. Kostenlos.
Ensemble-Erkennung Detektor
Prüfen Sie Ensemble-Erkennung mit 23 Detektoren. Kostenlos.
Erkennung ohne Konto Detektor
Prüfen Sie Erkennung ohne Konto mit 23 Detektoren. Kostenlos.
Erkennung pro Absatz Detektor
Prüfen Sie Erkennung pro Absatz mit 23 Detektoren. Kostenlos.
Erkennung über Perplexität Detektor
Prüfen Sie Erkennung über Perplexität mit 23 Detektoren. Kostenlos.
Erkennungs-API Detektor
Prüfen Sie Erkennungs-API mit 23 Detektoren. Kostenlos.
falsch positive Treffer Detektor
Prüfen Sie falsch positive Treffer mit 23 Detektoren. Kostenlos.
Gemini 2 Detektor
Prüfen Sie Gemini 2 mit 23 Detektoren. Kostenlos.
Gemini Detektor
Prüfen Sie Gemini mit 23 Detektoren. Kostenlos.
Genauigkeit von Detektoren Detektor
Prüfen Sie Genauigkeit von Detektoren mit 23 Detektoren. Kostenlos.
humanisierte oder umformulierte KI Detektor
Prüfen Sie humanisierte oder umformulierte KI mit 23 Detektoren. Kostenlos.
kostenlose Erkennung Detektor
Prüfen Sie kostenlose Erkennung mit 23 Detektoren. Kostenlos.
Lebensläufe und Anschreiben Detektor
Prüfen Sie Lebensläufe und Anschreiben mit 23 Detektoren. Kostenlos.
Llama Detektor
Prüfen Sie Llama mit 23 Detektoren. Kostenlos.
Marketingtexte Detektor
Prüfen Sie Marketingtexte mit 23 Detektoren. Kostenlos.
Mistral Detektor
Prüfen Sie Mistral mit 23 Detektoren. Kostenlos.
Nachrichtenartikel Detektor
Prüfen Sie Nachrichtenartikel mit 23 Detektoren. Kostenlos.
ob Erkennung funktioniert Detektor
Prüfen Sie ob Erkennung funktioniert mit 23 Detektoren. Kostenlos.
Offline-Erkennung Detektor
Prüfen Sie Offline-Erkennung mit 23 Detektoren. Kostenlos.
ohne Wortlimit Detektor
Prüfen Sie ohne Wortlimit mit 23 Detektoren. Kostenlos.
Open-Source-Erkennung Detektor
Prüfen Sie Open-Source-Erkennung mit 23 Detektoren. Kostenlos.
Plagiatsprüfung Detektor
Prüfen Sie Plagiatsprüfung mit 23 Detektoren. Kostenlos.
Produktbewertungen Detektor
Prüfen Sie Produktbewertungen mit 23 Detektoren. Kostenlos.
Prüfung einer URL Detektor
Prüfen Sie Prüfung einer URL mit 23 Detektoren. Kostenlos.
Prüfung in der Redaktion Detektor
Prüfen Sie Prüfung in der Redaktion mit 23 Detektoren. Kostenlos.
Quellcode Detektor
Prüfen Sie Quellcode mit 23 Detektoren. Kostenlos.
reiner Text Detektor
Prüfen Sie reiner Text mit 23 Detektoren. Kostenlos.
selbst gehostete Erkennung Detektor
Prüfen Sie selbst gehostete Erkennung mit 23 Detektoren. Kostenlos.
Social-Media-Posts Detektor
Prüfen Sie Social-Media-Posts mit 23 Detektoren. Kostenlos.
spanischsprachiger Text Detektor
Prüfen Sie spanischsprachiger Text mit 23 Detektoren. Kostenlos.
Studierendenarbeiten Detektor
Prüfen Sie Studierendenarbeiten mit 23 Detektoren. Kostenlos.
Texte von Nicht-Muttersprachlern Detektor
Prüfen Sie Texte von Nicht-Muttersprachlern mit 23 Detektoren. Kostenlos.
Wie die 23 Motoren zu einem Urteil kommen
SlopTotal fragt nicht ein einzelnes Modell nach seiner Meinung. Es lässt 23 unabhängige Detektoren laufen und zeigt alle 23 Zeilen, denn interessant ist meist die Uneinigkeit. Neun sind neuronale Klassifikatoren, die darauf trainiert wurden, menschlichen von maschinellem Text zu trennen, darunter DeBERTa-v3-large, drei RoBERTa-Varianten und ein BERT-tiny mit 4,4 Millionen Parametern, das in Millisekunden antwortet. Sieben sind statistische Tests, die überhaupt kein Detektortraining brauchen: Sie messen, wie vorhersagbar Ihr Text für GPT-2 Medium wirkt, über Perplexität, Token-Rangverteilung, Log-Rank und Kreuzentropie-Verhältnisse zwischen zwei verschiedenen Sprachmodellen. Die restlichen sieben lesen die Prosa selbst: Kurzformen, Gedankenstrich-Gewohnheiten, Varianz der Satzlänge, Abschwächungen und Standardeinstiege.
Der Endwert ist kein Mittelwert. Ein Mittelwert erlaubt es einem einzelnen selbstsicheren Motor, das Ergebnis zu ziehen, und Detektoren irren korreliert: Die neuronalen Klassifikatoren wurden auf ähnlichen Daten trainiert, liegen also gemeinsam falsch, wenn sie falsch liegen. Die Berechnung stützt sich auf jene Klassifikatoren, die in unserer eigenen Auswertung genau und verzerrungsfrei waren, verrechnet sie mit dem vollständig gewichteten Satz und behandelt Übereinstimmung zwischen unabhängigen Motorfamilien als das eigentliche Vertrauenssignal.
Jede Gewichtung stammt aus einer Messung, nicht aus einer Vermutung. Der Beitrag jedes Detektors richtet sich danach, wie gut er bekannten menschlichen von bekanntem maschinellem Text getrennt hat, und wird gesenkt, wenn er eine Schlagseite gegen eine bestimmte Art des Schreibens zeigte. Detektoren, die auf demselben Benchmark trainiert wurden, gegen den wir testen, werden gedämpft: Ein Modell, das auf seiner eigenen Trainingsverteilung geprüft wird, schmeichelt sich immer selbst.
Gegen zwei Korpora geprüft, nicht gegen eines
Angaben zur Genauigkeit sagen wenig, solange offenbleibt, was geprüft wurde. SlopTotal wird gegen maschinellen Text aus sechs Modellfamilien geprüft — GPT-4, ChatGPT, Llama, Mistral, Cohere und GPT-3 — in vier Textsorten: Nachrichten, literarische Prosa, Lyrik und wissenschaftliche Kurzfassungen. Nur eine Textsorte zu messen ist der kurze Weg zu eindrucksvollen Zahlen, die in der Praxis zusammenbrechen: Einer unserer eigenen Motoren traf Kurzfassungen fast perfekt und lag bei allem anderen fast genau verkehrt.
Das zweite Korpus lassen die meisten Detektoren aus. Es besteht aus Prosa, die zwischen 1532 und 1915 erschien — Machiavelli, Austen, Melville, Kafka — wo ein hoher Wert nur ein Fehler sein kann, weil der Text den Sprachmodellen um mindestens ein Jahrhundert vorausgeht. Jeder Detektor, der ältere oder formellere Sprache still bestraft, fällt an diesem Satz auf, und mehrere unserer Motoren fielen auf. Die Ergebnisse liegen im Repository offen, samt der Fehlschläge.
Wo Erkennung aufhört zu funktionieren
Kurze Texte sind unzuverlässig, und kein ehrlicher Detektor behauptet etwas anderes. Unter etwa 80 Wörtern kippt der Wert schon bei einer einzelnen Wortwahl; ab rund 200 Wörtern beruhigt sich das Ergebnis. Wenn Sie einen Kurzbeitrag einfügen und eine entschiedene Antwort erhalten, misstrauen Sie der Antwort, nicht dem Beitrag.
Leicht überarbeitete KI ist der schwierige Fall. Ein Text, den ein Mensch Satz für Satz umgeschrieben hat, verliert mit jedem Durchgang maschinelle Spuren, und es gibt keine Schwelle, ab der Überarbeiten keine Rolle mehr spielt. Quellcode ist eine echte Lücke: Diese Motoren sind auf natürliche Sprache trainiert, und in unseren Tests beschuldigen sie menschlichen Code nicht zu Unrecht, erkennen maschinellen Code aber auch nicht verlässlich. Deshalb behaupten wir es nicht.
Ein Wert ist ein Hinweis, kein Urteil. Nutzen Sie die 23 Zeilen, um zu entscheiden, wo Sie hinsehen und was Sie fragen — und fragen Sie dann. Kein Detektorergebnis sollte allein über eine Note, eine Einstellung oder eine Veröffentlichung entscheiden, und jedes Werkzeug, das dazu einlädt, verkauft eine Sicherheit, die es nicht besitzt.