Jev kostenlos im Vercel AI Gateway bis 25. September
JevVercel AI Gatewayмаршрутизация моделей
Was Vercel konkret freigeschaltet hat
Der zentrale Punkt ist einfach: Jev ist derzeit kostenlos über das Vercel AI Gateway verfügbar, und das Aktionsfenster wurde bis zum 25. September 2026 angekündigt. Stand 21. September ist das kein neuer dauerhafter Preis, sondern eine kurze Gelegenheit, das Modell ohne Tokenkosten zu testen.
Die wichtigste Referenz ist die Seite „Jev API, Pricing & Playground“ im Katalog des Vercel AI Gateway. Die Vercel-Dokumentation weist außerdem darauf hin, dass verfügbare Modelle auf der Modellseite oder über den JSON-Endpunkt für Modelle gefunden werden können. Jev ist also in den regulären Gateway-Ablauf eingebunden und nicht in einer separaten Demo versteckt.
Jev ist nicht als weiteres universelles LLM interessant, sondern als schnelle Bewertungs- und Routing-Schicht zwischen Modellen. In den Integrationsmaterialien wird die Kennung typesafe-ai/jev genannt; weitere Leitfäden verknüpfen sie mit dem Ablauf experimental_evaluate in AI SDK 7 oder neuer. Das ist ein konkreter Anwendungsfall: schnell entscheiden, welcher nächste Schritt oder welches Modell ein Workflow braucht.
Nach der Aktion verändert sich die Wirtschaftlichkeit. TypeSafe nannte zum Zeitpunkt der Ankündigung einen Basistarif von 0,042 US-Dollar pro Million Input-Tokens, während Output-Tokens nicht berechnet wurden. Diese Werte sollten in jeder Kalkulation getrennt betrachtet werden: Der Nullpreis bei Vercel ist temporär, der TypeSafe-Tarif ist für ein langlebiges System aussagekräftiger.
Warum das mehr als ein kostenloses Spielzeug ist
Die wichtigste Veränderung besteht darin, dass sich ein Router-Experiment vom Budget für den Router selbst trennen lässt. Ein Team kann prüfen, ob eine dedizierte Bewertungsschicht die Latenz senkt und Zweige vorhersehbarer auswählt, ohne das Ergebnis während der Aktion mit Jev-Kosten zu vermischen.
Kostenloser Zugang beweist jedoch nichts über die Qualität der Entscheidungen. Ich würde zuerst Routing-Fehler, die Robustheit bei mehrdeutigen Anfragen und die Zahl tatsächlich vermeidbarer teurer Aufrufe untersuchen. Berichte zum Start nennen eine Latenz von etwa 70–500 ms, doch das ist ein angegebener Bereich und keine Garantie für einen bestimmten Workflow.
Am meisten profitieren Systeme mit häufigen kurzen Bewertungen: Agenten, verzweigte Pipelines und Multi-Modell-Orchestrierung. Die Annahme, dass „der Router alles selbst optimiert“, trägt nicht: Ohne eigene Traces und Metriken fügt er nur einen weiteren Entscheidungspunkt hinzu. Nach dem 25. September ist nicht der Preis die spannendste Frage, sondern ob der Vorteil bei der realen Anfrageverteilung erhalten bleibt.