Angewandte Forschung in künstlicher Intelligenz
Die Frage die uns erreicht lautet fast nie "baut mir dieses Werkzeug", sondern "kann ein Modell das, auf unseren Daten, zu tragbaren Kosten". Sie zu beantworten ist Forschung, keine Entwicklung.
Zuerst der Prüfsatz
Ein- bis dreihundert reale Fälle aus Ihren eigenen Dokumenten, mit von Hand geschriebener erwarteter Antwort. Das dauert, es ist undankbar, und es ist das Einzige was das Weitere diskutierbar macht. Ohne diesen Satz schrumpft jeder Vergleich zweier Ansätze auf einen Eindruck und auf das Vertrauen in den der ihn äussert.
Der Satz bleibt bei Ihnen. Er dient dem ersten Entscheid, danach jeder Modelländerung, und er erlaubt Ihnen einen künftigen Anbieter zu prüfen ohne von vorne zu beginnen.
- Reale Fälle aus Ihren Dokumenten, keine erfundenen Beispiele
- Erwartete Antworten mit Ihren Fachleuten verfasst
- Schwierige Fälle und Fallen bewusst aufgenommen
- Der Satz wird übergeben und ist ohne uns nutzbar
Ansätze vergleichen, nicht den eigenen verteidigen
Wir stellen einfache Kontextübergabe, dokumentgestützte Suche, Spezialisierung eines offenen Modells und den Aufruf eines proprietären Modells gegeneinander. Für jeden messen wir die Treffsicherheit auf dem Prüfsatz, die Kosten je Aufruf, die Latenz und die Quote teurer Fehler.
Das Ergebnis passt in eine Tabelle und eine Empfehlung. Manchmal lautet es dass kein Ansatz das Vorhaben rechtfertigt, und wir sagen es bevor eine Entwicklung begonnen wurde.
- Vier Familien von Ansätzen im Wettbewerb
- Treffsicherheit, Kosten je Aufruf, Latenz, Quote teurer Fehler
- Offene Modelle auf unserer eigenen Infrastruktur, in der Schweiz
- Schriftlicher, bezifferter Bericht, unabhängig vom Ergebnis
Vom Urteil zum System
Fällt das Ergebnis günstig aus, verwendet der Betrieb den Prüfsatz als Regressionstest weiter. Jede Änderung von Modell, Anbieter oder Anweisung wird vor der Auslieferung gemessen. Das verhindert das stille Abdriften, jenen Moment in dem ein System weiterläuft und dabei leise schlechtere Ergebnisse liefert.
- Der Prüfsatz wird zum Regressionstest
- Messung vor jedem Modell- oder Anbieterwechsel
- Abdriften über die Zeit verfolgt
- Umkehrbarkeit eingeplant: der Rückweg bleibt offen
Angewandte Forschung in künstlicher Intelligenz
Wie lange dauert eine Machbarkeitsstudie?
In den meisten Fällen drei bis sechs Wochen, gut die Hälfte davon für den Prüfsatz. Das Ergebnis ist ein schriftlicher Bericht mit den Zahlen, den festgestellten Grenzen und einer Empfehlung, auch wenn sie negativ ausfällt.
Müssen wir alle unsere Daten übergeben?
Nein. Eine Studie läuft auf einer repräsentativen Stichprobe, und diese kann pseudonymisiert sein. Die Verarbeitung kann vollständig auf unserer Schweizer Infrastruktur stattfinden, wenn Ihre Pflichten das verlangen.
Was, wenn das Urteil negativ ist?
Sie behalten den Bericht, den Prüfsatz und das schriftliche Argument mit dem sich das Thema intern schliessen lässt. Das ist weniger spektakulär als ein gestartetes Projekt, und viel günstiger als ein nach einem Jahr abgebrochenes.
KI-Anwendungen
Sprachmodelle im Einsatz für klar begrenzte, messbare und umkehrbare Aufgaben.
In der Division KI-Anwendungen
Sprechen wir über das, was Sie bauen wollen.
Beschreiben Sie Ihre Lage in wenigen Zeilen. Liegt das Thema ausserhalb unserer Stärken, sagen wir es sofort.
Kontakt aufnehmen