knowledge-base/raw/blog/2026-09-16_vercel-jev-ai-gateway.md

48 lines
4.9 KiB
Markdown
Raw Normal View History

---
type: blog
source_url: https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway
retrieved: 2026-09-18
title: "TypeSafe AI's Jev now available on AI Gateway"
author: "Rohan Taneja, Zachary Chen, Jerilyn Zheng (Vercel)"
tags: [jev, typesafe-ai, vercel, ai-gateway, ai-sdk, structured-outputs, zdr, evaluation-models]
---
# Vercel: Jev auf dem AI Gateway (Changelog 16.09.2026)
Primärartefakt der Anbieter-Seite Vercel (nicht TypeSafe). Zwei Seiten lokal abgerufen und ausgewertet (18.09.2026):
- Changelog: https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway — „Blog Changelog", datiert **16 Sep 2026**, Autoren **Rohan Taneja, Zachary Chen, Jerilyn Zheng**, „2 min read"
- Modellseite: https://vercel.com/ai-gateway/models/jev — Titel „Jev API, Pricing & Playground | Vercel AI Gateway"
## Fakten der Modellseite
- **Modell-ID des Gateways:** `typesafe-ai/jev`
- **Einordnung (Wortlaut):** „Jev is TypeSafe AI's System One evaluation model for fast, structured decisions in software. It evaluates shared state against typed questions and returns choices, scores, and boolean probabilities, supporting classification, routing, rubric-based assessment, and automated verification. Multiple questions can be evaluated in parallel within a single request."
- **Preis (Modellseite):** „Input $0.04, Per 1M tokens" — **$0,04 pro 1 Mio. Input-Token**, gerundete Anzeige. Keine Output-Preiszeile (entspricht „Output kostenlos").
- **Provider-Tabelle:** ein Anbieter (TypeSafe AI), 7 Spalten; Zeile „TypeSafe AI", Input **$0.04/M**, **Release Date 09/15/2026**; Rechtshinweis „Legal: Terms • Privacy"; Hinweis „Your use is subject to TypeSafe AI's Terms & Privacy Policies."
- **Beispielcode der Seite:** `import { experimental_evaluate as evaluate } from 'ai';` mit `model: 'typesafe-ai/jev'`, `state` (String) und `questions: { refunded: { type: 'boolean', instructions: 'Was a refund issued?' } }`.
## Fakten des Changelog-Eintrags
- Jev ist ab dem 16.09.2026 über das AI Gateway nutzbar (Modell-Release laut Provider-Zeile: 15.09.2026).
- Beschreibung: „state goes in, typed **Choice, Score, and Boolean** answers come out" — im Gegensatz zu LLMs, die „generate text one token at a time, which the application then parses and validates". Jev werte „all declared questions in parallel" aus und liefere typisierte Antworten plus Wahrscheinlichkeiten direkt.
- Zweckformulierung: „makes it straightforward to automate clear cases while routing uncertain ones to review."
- **Leistungszahlen:** „TypeSafe reports Jev was up to **193.6x faster** and **444.6x cheaper** than LLMs on its workflow evaluations." (explizit als TypeSafe-Angabe gekennzeichnet, übernommen aus der TypeSafe-Primärquelle)
- **Genannte Anwendungsfälle:** nächsten Tool- oder Subagenten im Agent-Loop wählen; entscheiden, ob fortgesetzt, erneut versucht, der Nutzer gefragt oder abgebrochen wird; Dringlichkeit/Risiko vor einer Aktion bewerten; Modell-Ausgaben verifizieren und Guardrails durchsetzen.
- **Zugriffsweg:** AI SDK **7.0.105 oder neuer**, `experimental evaluate` API (`pnpm add ai@latest`). Parameter je Auswertung: `model`, `state` (String, Objekt oder Array), `questions` (Map benannter Entscheidungen).
- **Antwortform:** Ergebnis behält Question-IDs und Choice-Keys; „TypeSafe reports separate Choice and Score confidence in `result.providerMetadata.typesafe.confidence`." Empfehlung der Seite: Kalibrierung an gelabelten Beispielen des eigenen Workflows prüfen.
- **Datenschutz/Kosten:** Jev unterstützt **Zero Data Retention** und **No Training**, pro Request aktivierbar über `providerOptions.gateway.zeroDataRetention` (Beispielcode setzt `zeroDataRetention: true`). Auswertungen erscheinen in Logs und Custom Reporting, zählen gegen Budgets des Gateways.
- Beispiel im Changelog: ein Support-Fall wird in **Queue, Priority und Refund-Review**-Entscheidung übersetzt, unsichere Fälle gehen ins manuelle Review.
## Lokale Verifikation
- Beide Seiten lieferten HTTP 200 mit auswertbarem Text (669.985 bzw. 445.689 Byte HTML; Text 3.444 bzw. 4.704 Zeichen nach Skript-/Markup-Entfernung).
- Der Preis erscheint auf der Modellseite als `$0.04` (zwei Nachkommastellen), die TypeSafe-Primärquelle nennt `$0,042`. Die Gateway-Seite rundet die Anzeige; kein Widerspruch, aber auch kein Gateway-eigener Nachweis der vierstelligen Genauigkeit.
- Ein **Soft-404-Test** auf `vercel.com`-Pfade war nicht Teil dieser Prüfung; der Test auf `typesafe.ai` ergab differenzierte Antworten (nicht identische Byte-Größe), daher kein SPA-Hull-Befund.
## Offene Punkte
- Keine unabhängige Messung der Gateway-Latenz; die 193,6×/444,6×-Angaben sind als TypeSafe-Zahlen gekennzeichnet und werden nur weitergegeben.
- Ob der Gateway-Preis identisch mit dem Direkt-API-Preis ist (und ob Vercel einen Aufschlag nimmt), ist auf beiden Seiten nicht ausgewiesen.
- Ob es ein SLA, Rate Limits oder Region-Beschränkungen für Jev auf dem Gateway gibt, ist auf den beiden Seiten nicht dokumentiert.