Assessment-Netzwerk
Aktuelle Arbeitsbereiche
- AI-Operations-Kontrolle
- Executive-Assistant-Präzision
- Recherche & Verifikation
- Support-Triage & Urteilsvermögen
- Datenqualitätskontrolle
- Kundenkommunikation
- Projektsteuerung
- E-Commerce Operations
- Sales Operations
- Finance Operations
- Recruiting Operations
- Security & Access Operations
- Marketing Operations
- Redaktion & Content-Qualität
- Customer Success Operations
- Einkauf & Lieferantenkontrolle
- People Operations
- Compliance & Richtlinien
- Logistik & Fulfillment
- Automation & No-Code Operations
Auswahl pro Sitzung
Jede Sitzung erhält fünf Aufgaben aus dem acht Aufgaben umfassenden Pool des gewählten Bereichs. Aufgabenreihenfolge, Antwortreihenfolge und öffentliche IDs werden pro Sitzung randomisiert.
Der Browser erhält nur den Text und die undurchsichtigen Antwort-IDs, die für die Bearbeitung nötig sind. Die maßgeblichen Lösungsschlüssel bleiben serverseitig.
Score-Dimensionen
Genauigkeit — 30
Erkennt wesentliche Fehler, Widersprüche und unsichere Ergebnisse.
Urteilsvermögen — 25
Misst Priorisierung und Entscheidungsqualität bei konkurrierenden Signalen.
Anweisungsbefolgung — 20
Misst, ob ausdrückliche Vorgaben bei der Ausführung erhalten bleiben.
Verifikation — 15
Misst, ob durch Evidenz nicht gedeckte Behauptungen zurückgewiesen werden.
Kommunikation — 10
Misst klare, begrenzte Kommunikation ohne erfundene Zusagen.
Verbindliche Bewertung
Die Bewertung ist deterministisch und serverseitig. Single-Choice-Aufgaben verlangen die richtige Auswahl. Multi-Select vergibt begrenzte Teilpunkte für richtige Markierungen und bestraft Fehlmarkierungen.
Dieselbe gespeicherte Sitzungsvariante mit demselben Antwortsatz erzeugt denselben Score. Wesentliche Änderungen an Aufgaben oder Bewertungslogik erhalten eine neue Assessment-Version, statt historische WorkProofs umzuschreiben.
Integritätskontrollen
- Cloudflare Turnstile vor geschützter Sitzungszuteilung und finaler Abgabe
- einmalige, kurzlebige Serversitzungen
- Bindung von Client und Sitzung über pseudonymen Fingerprint
- serverseitige Rate Limits und tägliche Wiederholungslimits
- Lösungsschlüssel nur auf dem Server und undurchsichtige Antwort-IDs pro Sitzung
- eindeutige Sitzung-zu-Versuch-Beziehung gegen Replay
Score-Bereiche
- 90–100 — Außergewöhnliche Kontrolle
- 80–89 — Starker Operator
- 70–79 — Arbeitsfähig
- 60–69 — In Entwicklung
- Unter 60 — Urteilsvermögen muss stärker werden
Keine erfundenen Perzentile. Keine erfundene Prognosekraft.
Mandorka veröffentlicht keine Perzentilwerte, bevor eine aussagekräftige Vergleichsgruppe existiert, und behauptet keine Vorhersage künftiger Jobleistung, bevor Validierungsevidenz dies rechtfertigt.
Öffentlicher Standard und Validierung
Der WorkProof Standard veröffentlicht Anforderungen und Grenzen der verantwortungsvollen Nutzung. Das Validierungsprogramm prüft das Signal gegen reale arbeitsbezogene Ergebnisse. WorkProof Standard · Validation Program
Grenzen
Ein WorkProof dokumentiert beobachtete Leistung in einer definierten Simulation. Er bestätigt weder Identität noch Hintergrund, langfristige Zuverlässigkeit, sämtliche Fachkenntnisse oder garantierte künftige Arbeitsleistung. Er ist Evidenz für eine Entscheidung, nicht die Entscheidung selbst.