Wer die Prüfer bezahlt: was „unabhängig geprüft“ jetzt heißt
Anthropic holt Accenture mit Mitarbeiterzugang ins Haus und bezahlt die Prüfarbeit selbst, OpenAI sagt Prüfern Zugang über Wochen bis Monate zu, und ein offener Brief legt Mindestbedingungen fest. Mit dem Zugang wächst die Frage, woran man die Unabhängigkeit eines Prüfers erkennt. Vier Fragen, die sich an jedem veröffentlichten Befund stellen lassen.
Was eine Prüfung von außen auf einer Systemkarte wert ist, fragt Beurteilen und Einordnen, Kapitel 07: Das Haus wählt die Prüfer aus und räumt ihnen den Zugang ein, und bei GPT-6 Astra hatte Apollo Research dafür drei Tage. Zwischen dem 18. und dem 22. September 2026 sind drei Texte erschienen, die an diesem Bild ansetzen. Anthropic holt Accenture als eingebetteten Prüfer ins Haus, über 200 Unterzeichner legen in einem offenen Brief Mindestbedingungen für solche Prüfer fest, und OpenAI veröffentlicht eigene Grundsätze für Prüfungen von außen.
Alle drei versprechen oder verlangen deutlich mehr Zugang als die drei Tage bei Astra. Umgesetzt ist davon bisher wenig: Anthropic beschreibt eine Partnerschaft, deren Einzelheiten nach eigener Angabe noch ausgearbeitet werden, OpenAI sagt Unterstützung zu, und der Brief stellt Forderungen. Mit dem Zugang ändert sich auch der Gegenstand. Apollo hat ein Modell getestet; eingebettete Prüfer sollen das Training verfolgen, Entscheidungen im Haus nachvollziehen und Vorfälle melden. Damit rückt eine Frage nach vorn, die bei drei Tagen Zugang zweitrangig war: Woran erkennt man, dass ein Prüfer unabhängig ist, wenn er über Monate im Haus sitzt und das Haus seine Arbeit bezahlt?
Was bisher galt
Das genaueste Beispiel ist die Astra-Karte, die Beurteilen und Einordnen, Kapitel 07 auf seiner zweiten Ebene ausführlich zitiert. Apollo hatte drei Tage, zwei davon mit Zugriff auf einen Zwischenstand samt sichtbarem Denkprotokoll (Beleg (externe Seite, deploymentsafety.openai.com)). Über die eigenen Befunde schreibt Apollo in der Karte:
Zwei Gründe also: Das Modell bemerkte die Prüfung häufig, und das Prüffenster war knapp. Beide hat der Prüfer selbst benannt.
Anthropic und Accenture: Zugang wie ein Mitarbeiter
Am 18.09.2026 hat Anthropic eine Partnerschaft mit Accenture angekündigt. Geführt wird sie von Faculty, nach Anthropics Angabe die KI-Einheit von Accenture, und sie umfasst Bewertung und Red-Teaming der Modelle, Prüfungen der Ausrichtung und Tests der Schutzschichten (Beleg (externe Seite, anthropic.com)). Die eingebetteten Prüfer bekommen einen Zugang, den Anthropic mit dem eines Mitarbeiters vergleicht. Sie sollen damit watch models take shape in training, follow the decisions that govern how those models are built and deployed, and speak directly to employees (externe Seite, anthropic.com). Vorfälle melden und der Öffentlichkeit ein genaueres Bild von Nutzen und Risiken geben sollen sie ebenfalls.
Wer die Prüfarbeit bezahlt, sagt Anthropic offen: das eigene Haus, direkt, begründet mit Bedeutung und Dringlichkeit der Arbeit. Eine Summe dafür nennt die Ankündigung nicht. Die Milliarde, die darin steht, gilt dem Aufbau: Anthropic und Accenture wollen über die nächsten fünf Jahre je mindestens eine Milliarde Dollar in Kapazität auf diesem Gebiet investieren (Beleg (externe Seite, anthropic.com)). Was eine einzelne Prüfung kostet und zu welchen Bedingungen Accenture arbeitet, bleibt offen.
Daneben spricht Anthropic mit METR und anderen gemeinnützigen Prüfstellen über Pilotversuche, die diese aus eigenen Mitteln finanzieren. Auf lange Sicht soll das Geld aus gemeinsamen oder staatlichen Töpfen kommen, wie Anthropic es im Juni in seinem Advanced AI Framework gefordert hat (Beleg (externe Seite, anthropic.com)).
Die Partnerschaft ist nicht exklusiv: Anthropic will in den kommenden Wochen weitere Prüfer nennen, und Accenture soll in ähnlicher Rolle für andere KI-Entwickler arbeiten. Wie weit das Vorhaben ist, sagt die Ankündigung selbst. Eingebettete Prüfung sei neu, viele Einzelheiten würden noch ausgearbeitet, und es gebe as yet, no standards for what information embedded evaluators should have access to, or how they should report what they find (externe Seite, anthropic.com).
Der Brief: was Unabhängigkeit mindestens verlangt
Am selben Tag hat das AI Evaluator Forum einen offenen Brief mit dem Titel „Minimum Conditions for Embedding Evaluators“ veröffentlicht, nach eigener Angabe mit über 200 Unterzeichnern (Beleg (externe Seite, aievaluatorforum.org)). Er nennt kein Unternehmen beim Namen und richtet sich an die großen KI-Häuser insgesamt. Beim Zugang geht er so weit wie Anthropic:
Dazu stellt er Bedingungen an die Prüfstelle. Sie soll die volle redaktionelle Kontrolle über ihre Befunde behalten, Interessenkonflikte offenlegen und mindern, und sie
Eine Bezahlung oder Belohnung, die vom Ergebnis der Prüfung abhängt, soll sie ablehnen. Kommt ein Prüfer zu Schlüssen, die dem Haus unangenehm sind, soll er vor Vergeltung geschützt sein, gegen Klagen und durch
Der Brief verlangt außerdem mehrere Prüfstellen mit je eigenem Fachgebiet, einen direkten Draht zu Vorstand und Aufsichtsgremien, eng gefasste Verschwiegenheitsvereinbarungen und das Recht, Befunde samt Belegen zu veröffentlichen. Schwärzen darf das Haus nur befristet und nur zum Schutz bestimmter Interessen:
Wer bezahlt, legt der Brief nicht fest. Seine Bedingungen gelten der Art der Finanzierung: Sie darf nicht am Befund hängen, und sie muss einen unbequemen Befund überstehen.
OpenAI: tiefer Zugang nach Grundsätzen
Am 22.09.2026 hat OpenAI beschrieben, wie es Prüfungen von außen unterstützen will (Beleg (externe Seite, openai.com)). Es sagt Prüfern deep levels of access across training, evaluation, and deployment (externe Seite, openai.com) zu. Die Dauer richtet sich nach der Frage: Manche Prüfungen sollen Wochen dauern, andere mehrere Monate, und mehrere dürfen parallel laufen. Die Grundsätze gelten für Prüfstellen aus der Privatwirtschaft und dem gemeinnützigen Bereich; für die Arbeit mit Regierungen behält sich OpenAI andere Wege vor. Die Grenze des Zugangs zieht das Haus: verhältnismäßig, auf die vereinbarten Aussagen bezogen und within the bounds of legal, security, and IP constraints (externe Seite, openai.com).
Zur Unabhängigkeit wird der Text ausführlich. Prüfer sollen Interessenkonflikte erkennen, offenlegen und angehen, ausdrücklich auch financial incentives, relationships with developers, and prior involvement in the work being assessed (externe Seite, openai.com). Schutzvorkehrungen sollen sicherstellen, dass commercial pressures and compensation arrangements do not influence findings (externe Seite, openai.com), etwa durch Befangenheitsregeln oder Sperrfristen. Die Prüfer sollen redaktionell unabhängig bleiben, bei gewahrter Vertraulichkeit. Das Haus darf Schwärzungen verlangen, und der Prüfer darf vermerken, wo wesentlich geschwärzt wurde und was das für seinen Bericht bedeutet. Wo eine vollständige Veröffentlichung nicht möglich ist, sieht OpenAI vertrauliche Berichte an Aufsichtsgremien vor, etwa an den Vorstand (Beleg (externe Seite, openai.com)).
Geregelt ist damit, dass die Vergütung die Befunde nicht beeinflussen soll. Woher das Geld kommt, legt der Text nicht fest.
Wo die drei auseinanderliegen
Beim Zugang liegen die drei Texte nah beieinander, beim Geld auseinander.
| Anthropic mit Accenture | Offener Brief | OpenAI | |
|---|---|---|---|
| Stand | Partnerschaft angekündigt, Einzelheiten offen | Forderung an alle großen Häuser | Grundsätze und Zusage, ohne benannten Prüfer |
| Zugang | vergleichbar einem Mitarbeiter | wie hoch privilegierte Mitarbeiter | tief, verhältnismäßig, in den Grenzen von Recht, Sicherheit und geistigem Eigentum |
| Dauer einer Prüfung | ohne Angabe | ohne Angabe | Wochen bis Monate |
| Wer bezahlt | Anthropic direkt, später gemeinsame oder staatliche Mittel | ohne Festlegung, unabhängig vom Befund, gesichert auch nach unbequemem Befund | ohne Festlegung, Vergütung soll Befunde nicht beeinflussen |
| Geschäft mit dem Haus | siehe unten | soll keines von Gewicht bestehen | offenzulegen |
| Veröffentlichung | Vorfälle melden, Öffentlichkeit genauer informieren | volle redaktionelle Kontrolle, befristete Schwärzungen | redaktionelle Unabhängigkeit, markierte Schwärzungen, auch vertraulich an Aufsichtsgremien |
Die Zeile zum Geschäft verlangt einen Blick ins Vorjahr. Am 09.12.2025 haben Anthropic und Accenture die Accenture Anthropic Business Group angekündigt, eine eigene Praxis rund um Claude, mit der Anthropic zu den ausgewählten strategischen Partnern von Accenture zählt (Beleg (externe Seite, anthropic.com)). Dazu gehört eine Schulung in großem Umfang:
Nach dem Maßstab des Briefs ist das Geschäft mit dem geprüften Haus von Gewicht, und nach OpenAIs Grundsätzen wäre es als Beziehung zum Entwickler offenzulegen. Die Ankündigung vom 18.09. geht auf die Business Group nicht ein und beschreibt keine Trennung zwischen Prüfarbeit und Beratungsgeschäft. Geführt wird die Prüfarbeit von Faculty; ob diese Einheit im Sinne des Briefs als eigene Prüfstelle zählt, sagt keine der Quellen.
Für Anthropics Weg spricht, was die beiden anderen Texte nicht haben: einen benannten Prüfer, einen zugesagten Zugang und eine offen genannte Geldquelle. Dass das geprüfte Haus bezahlt, verbietet auch keiner der beiden anderen Texte. Sie setzen an der Abhängigkeit vom Befund an und an der Offenlegung. Ein gemeinsamer oder staatlicher Topf, wie ihn Anthropic für später vorschlägt, hat ebenfalls Geldgeber mit eigenen Interessen, und für ihn gelten dieselben Bedingungen: Er muss einen unbequemen Befund überstehen.
Was das für die Systemkarte heißt
Wo die Befunde eingebetteter Prüfer erscheinen werden, ist offen. Keiner der drei Texte sagt sie für die Systemkarte zu: Anthropic spricht von Vorfallsmeldungen und besserer Information der Öffentlichkeit, der Brief von der Veröffentlichung durch den Prüfer, OpenAI auch von vertraulichen Berichten an Aufsichtsgremien. Die dritte der fünf Fragen aus Beurteilen und Einordnen, Kapitel 07, wer von außen geprüft hat, wie lange und mit welchem Zugang, genügt dafür allein nicht mehr. Ob ein Befund in der Karte steht, in einem eigenen Bericht des Prüfers oder in einer Ankündigung, vier Fragen lassen sich von außen beantworten:
- Wer hat die Prüfung bezahlt, und hängt die Bezahlung am Ergebnis?
- Hat die Prüfstelle sonst Geschäft mit dem Haus, und wo ist das offengelegt?
- Wer entscheidet über die Veröffentlichung? Steht der Befund nur beim Haus, oder hat der Prüfer selbst veröffentlicht?
- Sind Schwärzungen markiert und befristet, und sagt der Prüfer, was sie für sein Ergebnis bedeuten?
Hinreichend sind die vier Fragen nicht. Ob der Prüfer seine Methoden selbst wählt, ob er neuen Risiken nachgehen darf, ob er den Vorstand direkt erreicht und ob das Haus den Zugang beenden kann, lässt sich von außen nur prüfen, wo Haus oder Prüfer es offenlegen. Einen Teil davon verlangt der Brief ausdrücklich.
Die Antworten stehen selten an einer Stelle. Die Karte nennt den Prüfer, die Ankündigung der Partnerschaft das Geld, und die Geschäftsbeziehung steht in einer Meldung vom Vorjahr. Für eine Beschaffung ist das Arbeit, die man einmal je Prüfer macht und für jede weitere Karte wiederverwendet.
Apollo hat für die geringe Aussagekraft seiner Befunde zwei Gründe genannt, das häufige Bemerken der Prüfung und das knappe Fenster. Ein Prüfer, der das Training über Monate verfolgt, nimmt die Zeitgrenze weg. Das Bemerken der Prüfung bleibt, und ob längerer Zugang auch den ausgelieferten Stand, genug Rechenzeit und passende Tests mitbringt, sagen die Ankündigungen nicht. Wer monatelang im Haus sitzt, kommt ihm außerdem näher. Ob sein Befund unabhängig ist, entscheidet sich an Fragen wie den vier oben, und für deren Antworten gibt es nach Anthropics eigenem Satz noch keinen Standard.
Quellen
5 Einträgealle erreichbar
Erreichbarkeit automatisch geprüft
Dokumentationerreichbar
OpenAI, GPT-6 Astra System Card (externe Seite, deploymentsafety.openai.com)
deploymentsafety.openai.comgeprüft 24.09.2026
OpenAIs jüngste System Card, veröffentlicht am 03.09.2026. Sie führt eigene Abschnitte zu Umgehungsversuchen, biologischen und chemischen Fähigkeiten, Cybersicherheit und der Einstufung nach dem Preparedness-Rahmen und benennt zwei externe Prüfer. Zur Herkunft der Trainingsdaten sagt sie nichts Nachprüfbares mehr: Der zuständige Abschnitt spricht von vielfältigen Datensätzen und einer Filterung, ohne eine Quelle zu nennen. Die GPT-5 System Card nannte an derselben Stelle noch drei.
Ankündigung des Herstellerserreichbar
Partnering with Accenture on embedded evaluation (externe Seite, anthropic.com)
anthropic.comgeprüft 24.09.2026
Anthropics eigene Ankündigung der Partnerschaft mit Accenture, Beleg für Umfang, Zugang der Prüfer und Investitionssumme.
Originalarbeiterreichbar
aievaluatorforum.orggeprüft 24.09.2026
Offener Brief des AI Evaluator Forum vom 18.09.2026, nach eigener Angabe mit über 200 Unterzeichnern. Er nennt kein Unternehmen und legt Mindestbedingungen für Prüfer fest, die in KI-Unternehmen eingebettet arbeiten: Zugang wie hoch privilegierte Mitarbeiter, Unabhängigkeit von den Häusern, keine vom Befund abhängige Bezahlung, Veröffentlichung der Befunde mit befristeten Schwärzungen und Schutz vor Vergeltung. Abgerufen am 24.09.2026.
Ankündigung des Herstellerserreichbar
Priorities and principles for effective third party assessments (externe Seite, openai.com)
openai.comgeprüft 24.09.2026
OpenAI-Blogbeitrag zu Zugangsrechten, Schwerpunktbereichen und Grundsätzen für unabhängige Sicherheitsprüfungen seiner Modelle.
Ankündigung des Herstellerserreichbar
Anthropic und Accenture, Ausbau der Partnerschaft vom 09.12.2025 (externe Seite, anthropic.com)
anthropic.comgeprüft 24.09.2026
Anthropics Ankündigung vom 09.12.2025: Accenture und Anthropic gründen die Accenture Anthropic Business Group, eine eigene Praxis rund um Claude, und rund 30.000 Accenture-Beschäftigte werden auf Claude geschult. Beleg für die Geschäftsbeziehung, die neben der Prüfpartnerschaft vom 18.09.2026 besteht. Abgerufen am 24.09.2026.