AI Evaluator Forum: 100 Forscher fordern unabhängige KI-Prüfung
Veröffentlicht am: 23.09.2026 um 05:13 Uhr | Redaktion boerse-global.de
Die Informatikprofessorin an der Stanford University sowie Mitgründerin und Leiterin des Start-ups World Labs, Fei-Fei Li, verlangt grundlegend neue Strukturen bei der Überprüfung fortgeschrittener künstlicher Intelligenz.
Sicherheitsbewertungen dürften künftig nicht mehr allein den entwickelnden Technologiekonzernen überlassen werden, da unternehmensinterne Prüfungen für eine verlässliche Risikoanalyse nicht ausreichten. Stattdessen müssten Wissenschaft, staatliche Stellen und die Industrie gemeinsam verbindliche und breiter angelegte Bewertungsstandards etablieren.
Interne Testreihen der Hersteller könnten lediglich isolierte Modellfähigkeiten und spezifische Merkmale erfassen, böten jedoch keinen Ersatz für standardisierte externe Verfahren. Li sprach sich vor diesem Hintergrund für unabhängige Agenturen und öffentliche Institutionen aus, die eine stärkere Aufsicht über hochkomplexe Systeme übernehmen sollten.
Die tatsächlichen Risiken der Technologie hingen maßgeblich davon ab, wie Menschen sie entwickelten, regierten und einsetzten. Die menschliche Kontrolle müsse daher zwingend gewährleistet bleiben.
Li äußerte sich im Rahmen eines Auftritts bei Bloomberg Tech, bei dem sie zudem über Atlas sprach, das jüngste Modell von World Labs. Das System zielt darauf ab, dreidimensionale Umgebungen zu verstehen sowie zu generieren, und soll Anwendungsmöglichkeiten von der Robotik bis hin zu wissenschaftlichen Simulationen erschließen.
Während Experten über die künftige Aufsicht von KI-Systemen debattieren, müssen Unternehmen bereits heute konkrete gesetzliche Anforderungen an die Risikodokumentation erfüllen. Dieser kostenlose Umsetzungsleitfaden bietet einen kompakten Überblick über alle Fristen und Pflichten, die der EU AI Act für den Einsatz von KI vorschreibt. EU AI Act in 5 Schritten verstehen
Räumliche Intelligenz abseits reiner Sprachmodelle gewinne zunehmend an Bedeutung und könne auch für Trainings- sowie Evaluationsszenarien genutzt werden. Li hatte sich bereits 2025 als Mitautorin eines Berichts der kalifornischen Joint Policy Working Group zu Grenzwertmodellen dafür eingesetzt, Risikobewertungen systematisch mit externen Audits zu verknüpfen.
Wachsender Druck auf Entwickler und Politik
Mit ihren Forderungen bewegt sich Li in einer breiteren Debatte über die Glaubwürdigkeit bestehender Kontrollmechanismen. Am 18. September 2026 veröffentlichte das AI Evaluator Forum einen offenen Brief, den mehr als 100 Forscher und Evaluatoren unterzeichneten.
Das Bündnis fordert strukturelle Garantien für unabhängige Prüfer, darunter vollständige Urteils- und Redaktionsfreiheit, weitreichenden Systemzugang, ausreichende Prüfzeiträume sowie wirksame Schutzmechanismen gegen wirtschaftliche Vergeltungsmaßnahmen durch die Modellentwickler.
Die rechtssichere Einordnung von KI-Systemen in Risikoklassen stellt viele Organisationen vor große Herausforderungen. Erfahren Sie in diesem kostenlosen Report, welche Systeme als Hochrisiko gelten und wie Sie die Einhaltung der EU-KI-Verordnung in Ihrem Verantwortungsbereich sicherstellen. Kostenlosen Umsetzungsleitfaden zum EU AI Act anfordern
Anlass für diese Initiative waren Zusagen von Anthropic-Chef Dario Amodei und OpenAI-Chef Sam Altman aus der Mitte des Monats. Beide Führungskräfte hatten angekündigt, externen Gutachtern künftig einen mitarbeiterähnlichen Zugang zu ihren Systemen zu gewähren. Der Expertenkoalition genügt diese Zusage nicht, da sie keine echte strukturelle Unabhängigkeit sichere.
Bereits 2025 hatte das AI Evaluator Forum Prinzipien definiert, wonach die Hoheit über Prüfmethoden, das Veröffentlichen von Ergebnissen und die Offenlegung möglicher Interessenkonflikte als Grundvoraussetzungen gelten müssen. Bislang ist jedoch ungeklärt, ob diese Vorgaben auf vertraglicher Basis oder per Gesetz verankert werden.
Auch andere Branchenvertreter mahnen Reformen an. Aidan Gomez, Chef des KI-Unternehmens Cohere, kritisierte, dass nicht eine kleine Gruppe von Unternehmen mit klaren kommerziellen Absichten die Standards festlegen dürfe.
Elham Tabassi, Forscherin an der Brookings Institution, unterstrich ebenfalls, dass freiwillige Selbstverpflichtungen der Industrie nicht genügten und durch wissenschaftlich nachprüfbare Messmethoden abgelöst werden müssten. Ob die Politik letztlich eine eigenständige Aufsichtsbehörde schafft oder ein gesetzlich verbindliches Regulierungssystem einführt, ist bislang nicht entschieden.
