knowledge-base/wiki/concepts/llm/jev-vercel-ai-gateway.md

93 lines
8.9 KiB
Markdown
Raw Normal View History

---
created: 2026-09-18
updated: 2026-09-18
sources: [xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md, blog/2026-09-16_vercel-jev-ai-gateway.md]
tags: [concept, llm, jev, typesafe-ai, vercel, ai-gateway, ai-sdk, distribution, system-one-models, evaluation-models, structured-outputs]
---
# Jev auf dem Vercel AI Gateway — Verteilung statt Waitlist
> **Quelle:** Greg Isenberg ([[../../people/greg-isenberg.md|@gregisenberg]]), X-Post vom 18.09.2026 (`raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`) + Vercel-Changelog und -Modellseite vom 16.09.2026, lokal gelesen (`raw/blog/2026-09-16_vercel-jev-ai-gateway.md`). Anlass: geteilt von Pit Weber in OME Topic „JEV", 18.09.2026. Modell und Testlage selbst: [[system-one-models-jev.md]].
## Kernidee
Jev ist nicht mehr nur über TypeSafes eigene Waitlist erreichbar. Seit 16.09.2026 läuft das Modell im **[[../../institutions/vercel.md|Vercel]] AI Gateway** — also in der Routing- und Abrechnungsschicht eines Fremdanbieters. Damit ist die Ankündigungsphase des Modells beendet und die **Verteilungsphase** beginnt: nicht „wie gut ist Jev", sondern „wie kommt es in Code".
Das ist der eigentliche Neuigkeitswert des Isenberg-Posts. Seine Beschreibung des Modells („it sorts, it doesn't write back") ist korrekt, aber die substanzielle Information steckt in zwei Nebensätzen: *live on the Vercel AI Gateway* und *skip the waitlist*.
## Technischer Zugang (lokal verifiziert, 18.09.2026)
| Feld | Wert |
|------|------|
| Modell-ID | `typesafe-ai/jev` |
| Zugang | Vercel AI Gateway, AI SDK **7.0.105+** (`experimental evaluate` API) |
| Frage-Typen | **Choice** (Option wählen), **Score** (Rubrik bewerten), **Boolean** (Wahrscheinlichkeit für „true") |
| Eingabe | ein gemeinsames `state` (String, Objekt oder Array) + Map benannter `questions` |
| Ausgabe | typisierte Antworten mit Wahrscheinlichkeiten; Question-IDs und Choice-Keys bleiben erhalten; getrennte Confidence für Choice und Score unter `result.providerMetadata.typesafe.confidence` |
| Latenz-/Kostenangaben | 70500 ms, $0,042/MTok Input, Output $0 (TypeSafe-Angabe, siehe [[system-one-models-jev.md]]) |
| Preis auf der Gateway-Seite | **$0,04 / 1 Mio. Input-Token** — gerundete Anzeige, zwei Nachkommastellen |
| Datenschutz-Optionen | **Zero Data Retention** und **No Training**, pro Request über `providerOptions.gateway` |
| Abrechnung | Auswertungen erscheinen in Logs/Custom Reporting und zählen gegen Gateway-Budgets |
Beispiel der Anbieterseite: ein Support-Fall wird in drei Fragen zerlegt — Queue, Priority, Refund-Review; unsichere Fälle gehen ins manuelle Review. Der Satz, der die ganze Produktkategorie zusammenfasst, steht im Vercel-Changelog: „automate clear cases while routing uncertain ones to review".
Der Gateway-Auftritt kostet TypeSafe nichts an Kontrolle, aber er verschiebt die Bezahl- und Log-Schicht zu Vercel. Wer Jev über den Gateway ruft, hat Vercel im Datenpfad — mit ZDR als Option, nicht als Default.
## Die sieben Geschäftsideen des Posts — was daran Jev ist
Isenberg listet Anwendungen, die sich alle als Frage an ein Entscheidungsmodell formulieren lassen. Die Grenze verläuft nicht zwischen den Ideen, sondern innerhalb jeder Idee: Jev **sortiert**, es **arbeitet nicht**.
| # | Idee des Posts | Einordnung |
|---|----------------|------------|
| 1 | „Instant Quotes" unter einer Sekunde (Dachdecker, Umzüge, Versicherung, Legal Intake) | Entspricht einer Score-/Choice-Frage über Formulardaten; der eigentliche Aufwand bleibt das Preiswerk und die Haftung, nicht die Klassifikation |
| 2 | Lead Scoring als Produkt — echte Anfragen aufs Handy des Inhabers | Klassischer Fall, deckt sich mit TypeSafes eigenem Muster |
| 3 | Support-Triage ohne Support-Team | Deckt sich mit dem dokumentierten **Intent-Routing**-Muster von TypeSafe (`docs.typesafe.ai/patterns/intent-routing`) |
| 4 | Clipping: bester Moment aus einem Transcript in Sekunden bewertet | Als **Score**-Frage plausibel; „bester Moment" ist eine Rubrik, kein Text |
| 5 | Bewerbungs-/Antragsstapel (Grants, Permits, Claims, Kredite) | Reichweitenstärkster Fall und der mit dem größten Fehlerpreis — hier zählt Kalibrierung, nicht Tempo |
| 6 | Marketplace-Matching statt Rückruf | Plausibel als Klassifikation gegen ein Verzeichnis |
| 7 | „Browser agents that actually move FAST" | **Teilweise am Produkt vorbei:** Jev beschleunigt die Entscheidung, nicht das Browsen. Der Flaschenhals dieser Idee liegt in der Browser-Schicht, nicht im Entscheidungsmodell |
Die Formel des Posts — „find an expensive queue and put Jev at the front of it" — ist eine brauchbare Heuristik, aber sie beschreibt nur die halbe Arbeit. Vor jede Warteschlange gehört ein Gate, hinter jede Entscheidung eine Eskalation. Genau dafür liefert das Gateway die Confidence-Werte, und genau deshalb ist die Kalibrierung die entscheidende Eigenschaft (siehe [[system-one-models-jev.md|Merksatz: Type-Safety ist keine Wahrheitsgarantie]]).
## Einordnung: Distribution als eigene Produktphase
- **Gateway statt SDK-Wettbewerb.** TypeSafe verkauft kein Harness, sondern ein Modell — und verteilt es über die Schicht, die andere Harnesses ohnehin schon benutzen. Das ist der schnellste Weg in fremden Code, ohne eigene Developer-Relations-Maschine.
- **Wiederverwendung einer bestehenden Bezahlgrenze.** Budgets, Logs, ZDR-Schalter: Der Gateway bringt Kostenkontrolle und Compliance-Rahmen mit. Für die Freigrenze „Checks sind so billig, dass man sie laufend macht" (siehe [[../agents/agent-budget-breaker.md|Kostendeckel]]) ist das die passende Infrastruktur.
- **Der Influencer-Post als Verteilkanal.** Ein Startup-Ideen-Kanal mit 712.496 Followern erklärt ein Infrastrukturprodukt über Geschäftsideen. Das ist wirksamer als jede Benchmark-Tabelle, verschiebt aber die Wahrnehmung: Jev wird als Baukasten für Firmen gelesen, nicht als Entscheidungsschicht für Software.
- **Zweiter Zugangsweg, zweite Preisangabe.** Die Waitlist-Story stammt aus der Ankündigung, der Gateway-Zugang ist jünger. Beide Preise ($0,042 bzw. $0,04) bezeichnen dasselbe, nur mit unterschiedlicher Rundung — ein Detail, das bei Kostenrechnung über Milliarden Tokens dann doch zählt.
## Quellenkritik
- ⚠️ **„1.700 E-Mails für 18 Cent"** steht im Post ohne Token-Aufschlüsselung, Datensatz oder Messung. Die Größenordnung passt zur TypeSafe-Preislogik ($0,042/MTok), die Zahl selbst ist aber zweit- bis dritthändig (externe Angabe: 4,2 Mio. Input- + 500k Output-Token).
- ⚠️ **„94 % sicher"** ist ein Illustrationswert für Kalibrierung, kein Messergebnis.
- ⚠️ **193,6×/444,6×** übernimmt Vercel ausdrücklich als TypeSafe-Angabe („TypeSafe reports"), nicht als eigene Messung.
- ⚠️ **Interessenlage des Posts:** Isenberg verdient an Startups und Aufmerksamkeit; der Post hat Funnel-Struktur („at the end I'll tell you how") und endet in einem Podcast-Verweis. Er ist Verteilung, nicht Prüfung — die einzige unabhängige Messung bleibt der Every-Einzeltest.
-**Lokal verifiziert:** Gateway-Modellseite und Changelog liefern beide HTTP 200 mit auswertbarem Inhalt; Modell-ID, Preisangabe, Frage-Typen, ZDR-Optionen und SDK-Mindestversion stehen wörtlich dort.
## Offene Punkte
- Kein Nachweis, dass der Gateway-Preis dem Direkt-API-Preis entspricht (oder ob Vercel einen Aufschlag nimmt) — auf beiden Seiten nicht ausgewiesen.
- Keine Angaben zu Rate Limits, SLA und Regionen für Jev auf dem Gateway.
- Ob die Episode ([[../../people/ryan-vogel.md|Ryan Vogel]] als Gast) eigene Messungen enthält, ist nicht geprüft; das Video-Transkript wurde nicht ausgewertet.
- Offen, wie viele Fragen pro Request praktisch parallel möglich sind — die Kostenrechnung hängt daran.
## Verwandte Wiki-Seiten
- [[system-one-models-jev.md]] — Modell, RLCD, Testlage, Zahlenkritik
- [[../../institutions/typesafe-ai.md]] — Anbieter, Team, Manifesto
- [[../../institutions/vercel.md]] — Gateway-Betreiber
- [[../../people/greg-isenberg.md]] — Autor des Posts
- [[../../people/ryan-vogel.md]] — Gast der Episode
- [[llm-model-catalog.md]] — Modellkatalog
- [[harness-vs-standalone-chat-llm.md]] — Gate vs. Generierung
- [[../agents/agent-budget-breaker.md]] — Kostendeckel für unbewachte Schleifen
- [[../agents/ai-agents-2026.md]] — Agent-Use-Cases
## Quellen
- [X-Post @gregisenberg](https://x.com/gregisenberg/status/2101018750916948237) (18.09.2026, 18:41 UTC; 29.661 Views / 415 Likes bei Abruf 21:31 UTC)
- [YouTube: „Jev is HERE. How to use it"](https://www.youtube.com/watch?v=4mTLpuQpB80) (Kanal Greg Isenberg; Beschreibung lokal nicht auswertbar)
- [Vercel AI Gateway — Jev](https://vercel.com/ai-gateway/models/jev) (modell-ID, Preis, Beispielcode)
- [Vercel Changelog: TypeSafe AI's Jev now available on AI Gateway](https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway) (16.09.2026, Taneja/Chen/Zheng)
- Raw: `raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`, `raw/blog/2026-09-16_vercel-jev-ai-gateway.md`