Jev versteht Sprache, schreibt aber keinen Satz. Warum gerade dieses KI-Modell Entwickler begeistert
Das neue KI-Modell Jev trifft nur Entscheidungen, etwa auf welches Konto eine Rechnung gehört, und war in Tests des Herstellers fast 200-mal schneller und über 400-mal günstiger als die stärksten Modelle, die Texte schreiben. Für den Mittelstand zählt das, weil in seinen Vorgängen vor allem entschieden wird.
Diogo Almeida hat bei OpenAI das Verfahren mitentwickelt, mit dem ChatGPT gelernt hat zu antworten. Ausgerechnet er hat jetzt mit seiner Firma TypeSafe AI ein Modell vorgestellt, das schweigt. Es heißt Jev (heise online).
Für eine Geschäftsführerin im Mittelstand ist das spannender als das nächste Chatprogramm. In ihren Vorgängen wird vor allem entschieden, und genau dafür ist Jev gebaut.
Jev stammt aus derselben Familie wie ChatGPT, er liest und versteht Sprache. Nur antwortet er nicht mit Text, sondern mit einer Entscheidung und der Angabe, wie sicher er ist. Der Hersteller nennt das ein System-1-Modell. Wer Daniel Kahnemans Schnelles Denken, langsames Denken kennt, erkennt darin das schnelle, intuitive Denken wieder.
In wiederkehrenden Vorgängen stecken viele Entscheidungen. Gehört diese Rechnung auf Konto A oder B? Passt diese Bewerbung auf die Stelle? An welche Abteilung geht diese Mail? Dafür wird heute oft ein Modell benutzt, das auch Texte schreibt. Seine Antwort ist ein Text, den die Software erst auslesen und prüfen muss.
Jev dagegen kann man sich als neuen Kollegen vorstellen, der nur Ja oder Nein sagt, das aber sehr schnell.

Dass er deshalb nichts erfinden kann, ist eine Aussage des Herstellers. Zwei weitere Unterschiede spürt man im Betrieb:
-
Er ist fast 200-mal schneller. In eigenen Tests des Herstellers lieferte Jev seine Entscheidungen bis zu 194-mal schneller als die stärksten Modelle von OpenAI und Anthropic. TypeSafe schreibt selbst dazu, im Alltag komme eher weniger an. Ein großer US-Anbieter, über den viele Webseiten und Online-Shops laufen, hat für eine eigene Prüfaufgabe fünf- bis achtzehnmal schnellere Ergebnisse gemessen.
-
Er ist über 400-mal günstiger. Im selben Test kostete eine Entscheidung bis zu 445-mal weniger. Das liegt auch daran, dass die Antwort selbst nichts kostet: bezahlt wird nur das Lesen der Anfrage.
Wer den neuen Kollegen einarbeitet
Mehrere große Entwicklerplattformen hatten ihn binnen drei Tagen eingebunden. Kein Betrieb mit 200 Leuten kann jedes neue Modell selbst finden, prüfen und einbauen.
Und Jev wird nicht der letzte neue Kollege bleiben. Jedes solche Modell kann für genau einen Schritt in einem Vorgang das bessere Werkzeug sein, und für den nächsten Schritt schon nicht mehr. Die spannende Frage für einen Betrieb ist deshalb weniger, ob er Jev einsetzt, als wer ein Auge darauf hat, wann sich ein Wechsel lohnt, und ihn dann auch verantwortet.
Wer einen Vorgang an einen betriebenen Agenten abgegeben hat, gibt genau diese Aufgabe gleich mit ab.
Ein ehrlicher Vorbehalt
Jev begründet seine Entscheidung nicht in Worten. Wo jemand eine Begründung erwartet, etwa bei der Absage an einen Bewerber oder einer Feststellung für einen Prüfer, ist er das falsche Werkzeug. Und alle Zahlen oben stammen bisher vom Hersteller und von einzelnen Anwendern, nicht aus einem unabhängigen Test.
Und jetzt?
Ob ein Vorgang besser selbst gebaut oder betrieben wird, ordnet Managed Agents oder selbst bauen ein. Welche Schritte in euren Vorgängen Entscheidungen sind und welche Texte, zeigt die Probe-Analyse.