← Alle Leistungen

Leistungen / KI-Validierung und Ermittlungen

Modelle bewerten.
Aktionen rekonstruieren.

Für Softwareunternehmen und Organisationen in der Schweiz und im Ausland: LLM-Validierung für Entwicklungsteams und nachträgliche Analyse von KI-Systemen und -Agenten. Fernarbeit richtet sich nach vereinbartem Zugang und Umfang.

01 / AI Validator

Das Modell wird besser.
Was belegen die Daten?

Für Teams im Pre-Training, Fine-Tuning oder bei der Domänenanpassung. Ziele, Modellzugang und Prüfungstiefe werden gemeinsam festgelegt.

Benchmarks und Domänenkompetenz

Eine Evaluationssuite mit geeigneten Benchmarks und repräsentativen Aufgaben: Verständnis, Extraktion, Schlussfolgern oder Generierung, je nach Projekt.

Sie erhalten
Ergebnisse nach Aufgabe, Sprache und Schwierigkeitsgrad, mit vereinbarten Metriken und Fehleranalyse. Fachliche Bewertungen benötigen von Domänenexpertinnen und -experten geprüfte Referenzantworten.

Modell- und Checkpoint-Vergleiche

Vergleich des Basismodells, angepasster Versionen und Release-Kandidaten unter ausdrücklich festgelegten, vergleichbaren Testbedingungen.

Sie erhalten
Eine Gegenüberstellung von Verbesserungen und Regressionen. Neben Gesamtwerten stehen Ergebnisse je Kategorie, damit Zielkonflikte sichtbar werden.

Genauigkeit und Halluzinationen

Tests mit überprüfbaren Antworten zu Richtigkeit, Konsistenz, Befolgung von Anweisungen und Verhalten bei unzureichender Informationslage.

Sie erhalten
Klassifizierte Fehler, dokumentierte Beispiele und Testergebnisse. Automatische Bewerter werden mit einer menschlich geprüften Stichprobe verglichen.

Robustheit und Sicherheit des Modells

Vereinbarte Tests mit Eingabevariationen, adversarialen Anweisungen, unangemessenen Antworten und möglicher Offenlegung sensibler Informationen.

Sie erhalten
Testszenarien, Bedingungen und Ergebnisse mit Schwachstellen und Prioritäten. Zugang zu Gewichten und Angaben zu Trainingsdaten bestimmen die möglichen Prüfungen.

Qualität des Evaluationsprotokolls

Prüfung der Trennung von Trainings- und Testdaten, der Repräsentativität von Stichproben und möglicher Überschneidungen anhand verfügbarer Materialien.

Sie erhalten
Erkenntnisse zu Risiken, die Messungen verzerren können. Ohne Zugriff auf relevante Trainingsdaten lässt sich Kontaminationsfreiheit nicht feststellen.

Regressionstests vor dem Release

Wiederholung der Tests mit neuen Versionen und Vergleich mit vereinbarten Akzeptanzschwellen. Modell, Prompts, Generierungsparameter und Umgebung werden dokumentiert.

Sie erhalten
Ein Validierungsbericht mit Ergebnissen, beobachteter Variabilität, Grenzen und offenen Punkten für die Release-Entscheidung des Teams.

Beispielszenario

Fine-Tuning verbessert die Domänenleistung.
Und die übrigen Fähigkeiten?

Ein Evaluationsbeispiel, kein Kundenfall.

Ein Softwareunternehmen passt ein LLM an ein Fachgebiet an. Vor dem Release möchte es den Vergleich zum Ausgangsmodell: bessere Fachantworten? Erhaltene allgemeine Fähigkeiten? Befolgung von Anweisungen? Neue Fehler?

Eine vereinbarte Testsuite misst diese Aspekte getrennt. Der Bericht zeigt Verbesserungen, Regressionen und Ergebnisse mit weiterem Prüfbedarf.

Methode und Ergebnisse

Eine nachvollziehbare Validierung.

Umfang festlegen

Modell, Version, Domäne, Sprachen, Ziele und Zugangsart: Endpunkt oder vereinbarte Umgebung.

Protokoll vorbereiten

Testdatensätze, Baseline, Metriken, Akzeptanzkriterien und Ausführungsbedingungen.

Prüfen und analysieren

Geeignete Tests und Wiederholungen, Fehlerklassifikation und menschliche Prüfung relevanter Fälle.

Nachweise bereitstellen

Vergleichsbericht, detaillierte Ergebnisse, Protokoll und die im Auftrag vereinbarten reproduzierbaren Materialien.

Ergebnisse für das geprüfte Modell
Die Validierung betrifft den dokumentierten Checkpoint, die Aufgaben und Bedingungen. Sie ist keine regulatorische Zertifizierung und keine Garantie für jeden Einsatz. Anwendungen, RAG-Systeme und Agenten benötigen einen eigenen Sicherheitsprüfungsumfang.

Für den Erstkontakt: Basismodell, Trainingsverfahren, Domäne, Sprachen und Evaluationsziel. Proprietäre Gewichte, Datensätze und Zugangsdaten werden nur unter vereinbarten Bedingungen und auf vereinbarten Wegen geteilt.

02 / Forensische Analyse von KI-Vorfällen

Vom Prompt zur Aktion.
Was ist passiert?

Nachträgliche Analyse für Unternehmen, Softwareanbieter und Kanzleien zur Klärung problematischer Antworten, offengelegter Informationen oder unerwarteter KI-Aktionen.

Anweisungen und Kontext

Untersuchung verfügbarer Prompts, Systemanweisungen, Gespräche und verwendeter externer Inhalte. Suche nach möglichen manipulativen Anweisungen oder widersprüchlichen Vorgaben.

Vorgeschlagene, versuchte und ausgeführte Aktionen

Abgleich von Antworten, Werkzeugaufrufen, Operationsergebnissen und Protokollen der beteiligten Systeme. Eine Aussage der KI allein belegt keine tatsächlich ausgeführte Aktion.

Berechtigungen und Konfiguration

Rekonstruktion von Modellversion, Einstellungen, Zugriffen, Berechtigungen und menschlichen Freigaben, soweit dokumentiert. Analyse der Bedingungen, die das beobachtete Verhalten ermöglicht haben.

Zeitablauf und Nachweise

Zeitliche Ordnung verfügbarer Informationen, Quellenangaben und Trennung von beobachteten Fakten, Hypothesen und Lücken. Reproduktionen werden in einer kontrollierten Umgebung vereinbart.

Das Auftragsergebnis
Ein Bericht mit Zeitablauf, untersuchten Materialien, belegten Vorgängen, möglichen Einflussfaktoren und Empfehlungen. Ein einzelner Prompt belegt keine Ursache; die Analysetiefe hängt von Qualität und Verfügbarkeit der Spuren ab.

Ein Agent verändert unerwartete Dateien.

Beispielszenario, kein Kundenfall.

Welche Anfrage erhielt er? Welche Inhalte nutzte er? Schlug er eine Änderung vor oder führte er sie aus? Mit welchen Berechtigungen und Freigaben? Die Untersuchung sucht nach Belegen in den vorhandenen Protokollen.

So beginnen wir

Beschreiben Sie Ereignis, Zeitraum und betroffenes System. Geben Sie an, welche Gespräche und Protokolle vorliegen. Vor der Übermittlung vertraulicher Daten oder Zugangsdaten vereinbaren wir Materialien, Zugänge und Übermittlungswege.