zoon / engineering lab

KI-Zugänge im Praxistest

Wie greifen Zugriffsrechte, Datenschutzregeln und Kostenlimits wirklich? Ein Zwischenstand aus dem zoon-Labor.

Vier Kandidaten, unterschiedlich weit geprüft

Die Statuszahlen beschreiben den Teststand, kein Produktranking. „Offen“ bedeutet nicht „kann das nicht“.

KandidatPrüfstandBeobachtungNächste Gegenprobe

Was wir bisher gelernt haben

01

Ein Budget kann überschritten werden

Bei beiden ausführlicher getesteten Gateways erlaubte ein Limit von 0,02 USD seriell 0,03 USD Verbrauch vor der Sperre. Im parallelen agentgateway-Lauf waren es 0,06 USD.

Künstliche Preise und Token. Beobachtete Läufe, keine garantierten Obergrenzen.

02

Eine Sperre braucht einen nachvollziehbaren Beleg

Ein gültiger Schlüssel darf nicht jedes Modell oder Werkzeug aufrufen. Wir haben verbotene Aufrufe tatsächlich ausgeführt und geprüft, ob sie das Backend erreichen.

Bei agentgateway und LiteLLM geprüft. Vollständige Mandantenisolation bleibt eine weitere Aufgabe.

03

Maskierung ist ein Teil des Arbeitsablaufs

Die konfigurierte E-Mail-Regel ersetzt die Testadresse vor dem Mock. In der Antwort bleibt der Platzhalter stehen. Die tatsächliche Klartext-App ist noch nicht angebunden.

Das schützt nicht automatisch vertrauliche Fachinhalte oder Werkzeugargumente.

Warum zoon das untersucht

Klartext kann eine Funktion eines größeren Produkts sein. Das Labor prüft, wie Schutz im Arbeitsablauf, Modellzugang und Betrieb zusammenspielen. Die Produktfrage lautet: Welche Arbeit bleibt beim zweiten vergleichbaren Kunden übrig? Wiederholbare Einrichtung und Fehlerdiagnose sind mögliche Ansatzpunkte. Kundennutzen und Zahlungsbereitschaft sind noch nicht belegt.

Was wurde vom MacBook aus ausprobiert?

Der Nutzer hat über einen SSH-Tunnel Anfragen gesendet: ohne Schlüssel abgelehnt, mit gültigem Schlüssel beantwortet, verbotenes Modell gesperrt, Streaming vollständig, E-Mail vor dem Backend ersetzt und Budgetfolge 200 / 200 / 429 beobachtet. Das ergänzt die automatisierten Läufe. Ein direkt eingebundener Klartext-Client und ein echter Modellprovider fehlen noch.

Testbelege und offene Punkte

Die Übersicht oben bezieht sich auf festgelegte Läufe vom 7. September. Hier lassen sich auch andere vorhandene Läufe auswählen.

Ergebnisse werden geladen …

Kandidat / LaufSzenarioStatusErwartung / EinordnungEvidenz