knowledge-base/wiki/institutions/vercel.md

69 lines
5.3 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
created: 2026-09-18
updated: 2026-09-20
sources: [blog/2026-09-16_vercel-jev-ai-gateway.md, xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md]
tags: [institution, vercel, ai-gateway, ai-sdk, infrastructure, model-routing, hosting]
---
# Vercel (AI Gateway)
US-amerikanisches Infrastruktur-Unternehmen (Hosting, Edge/Fluid Compute, CI/CD, Next.js) mit einer **Agent-Stack-Schicht**: AI SDK, AI Gateway, Sandbox, Workflows, Connect, Passport, eve.
Im Wiki bisher nur am Rand aufgetaucht (als Bauplatz für die „Grok Bot Galaxy"-Firma, siehe [[../tools/grok-bot-spacexai.md]]). Eigenständige Relevanz bekommt Vercel am **16.09.2026**, als das Gateway das TypeSafe-Modell **Jev** aufnimmt.
- Gateway-Modellseite: https://vercel.com/ai-gateway/models/jev
- Changelog: https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway
## AI Gateway — was beobachtbar ist
Der AI Gateway ist eine **Routing-, Abrechnungs- und Logging-Schicht für Modellaufrufe**. Für Jev dokumentieren die Seiten konkret:
| Aspekt | Ausprägung |
|--------|-----------|
| Modell-ID-Schema | `{anbieter}/{modell}`, hier `typesafe-ai/jev` |
| Zugang | über das AI SDK (hier 7.0.105+ mit `experimental evaluate`) |
| Abrechnung | Auswertungen erscheinen in Logs und Custom Reporting und zählen gegen Gateway-**Budgets** |
| Compliance-Schalter | **Zero Data Retention** und **No Training**, pro Request über `providerOptions.gateway` |
| Provider-Wahl | Gateway führt Anbieter-Slugs; bei Jev genau ein Anbieter (TypeSafe AI), Release-Datum 15.09.2026, Rechtshinweis auf die Anbieter-AGB |
**Das ist die eigentliche Funktion:** Der Gateway bündelt für fremde Modelle genau die Fragen, die sonst jedes Team selbst lösen müsste — Kostenkontrolle, Logs, Datenschutzschalter, Anbieterauswahl. Ein Modell dort zu listen ist ein Verteilungsentscheid, kein Modellentscheid.
Für die Kostendiskussion im Wiki ist das die passende Infrastruktur zur Freigrenzen-Logik in [[../concepts/agents/agent-budget-breaker.md]]: Checks werden erst dann dauerhaft laufengelassen, wenn Kostenkontrolle und Datenschutz nicht mehr pro Aufruf verhandelt werden müssen.
## Leaderboards — offene Nutzungsdaten (abgerufen 20.09.2026)
Der Gateway veröffentlicht **eigene Nutzungsstatistiken** unter [vercel.com/ai-gateway/leaderboards/models](https://vercel.com/ai-gateway/leaderboards/models): anonymisiert, täglich aktualisiert, als CSV/Chart und über einen authentifizierungsfreien JSON-Export beziehbar, lizenziert **CC BY 4.0**. Sechs Abschnitte: Token Volume, Open vs. Closed Token Volume, Requests, Spend, Reach, Preference — Zeiträume `Jun 21/22, 2026` bis `Sep 18/19, 2026`.
Damit liefert Vercel erstmals **Nachfrage-Seitenzahlen zu fremden Modellen** — ein Gateway-Betreiber sieht, was durch sein Routing läuft, und veröffentlicht es. Beobachtungen:
| Abschnitt | Wert (Text der Seite) |
|---|---|
| Open vs. Closed (Token-Volumen) | Prozentwerte nur als Screenshot belegt (78,4 % / 21,6 %, Post vom 19.09.2026) — im ausgelieferten Text nicht enthalten |
| Token Volume | „Other" 14,3 % |
| Requests | „Other" 33,6 % |
| Spend | „Other" 22,5 % |
| Reach | **Jev 15,6 %** vor Claude Haiku 4.5 (14,6 %) und GPT 5.6 Luna (13,0 %) |
| Preference | **Jev 13,3 %** vor Luna/Sonnet 5 (je 6,9 %) |
⚠️ Die Zahlen der gestapelten Charts werden clientseitig gerendert und waren per Textabruf nicht auslesbar; nur Listen-Abschnitte (Reach/Preference) und „Other"-Werte stehen im Text. Vollständige Tabellen: `raw/other/2026-09-20_vercel-ai-gateway-leaderboards.md`.
Auswertung des Open-Weights-Anteils und der Kartell-These, die daran gehängt wurde: [[../concepts/llm/open-weights-share-vercel-gateway.md]]. Die Reach-Führung von Jev: [[../concepts/llm/system-one-models-jev.md]].
## Beobachtungsstand
- ✅ Lokal verifiziert (20.09.2026): Leaderboard-Seite HTTP 200; Abschnittstitel, Untertitel, Zeiträume, Reach-/Preference-Listen und der Hinweis auf CC-BY-4.0-Export stehen wörtlich im abgerufenen Text.
- ⚠️ Leaderboard-Prozente der Charts sind clientseitig gerendert — nicht per Textabruf reproduzierbar.
- ✅ Lokal verifiziert (18.09.2026): Modellseite und Changelog liefern HTTP 200 mit auswertbarem Text; Modell-ID, Preisangabe `$0.04/1M`, Frage-Typen, ZDR-Optionen und SDK-Mindestversion stehen wörtlich dort.
- ⚠️ Die Leistungszahlen (193,6× schneller / 444,6× günstiger) gibt Vercel ausdrücklich als **TypeSafe-Angabe** weiter („TypeSafe reports"), nicht als eigene Messung.
- ⚠️ Ob Gateway-Preis = Direkt-API-Preis, ist nicht ausgewiesen. Rate Limits, SLA und Regionen für Jev sind auf beiden Seiten nicht dokumentiert.
- Kein Eintrag zu Vercels Preismodell, Unternehmensdaten oder Wettbewerbern (OpenRouter, Netlify) erfasst — bei Bedarf nachziehen.
## Verwandte Wiki-Seiten
- [[../concepts/llm/jev-vercel-ai-gateway.md]] — Verteilung von Jev über den Gateway
- [[../concepts/llm/open-weights-share-vercel-gateway.md]] — Open-Weights-Anteil, Reach/Preference, Kartell-These
- [[../people/guillermo-rauch.md]] — CEO, postete die Gateway-Zahlen
- [[../concepts/llm/system-one-models-jev.md]] — das Modell
- [[typesafe-ai.md]] — Anbieter des Modells
- [[../tools/plur1bus-memory.md]] — Hermes/OpenClaw-Stack (Vergleichsfolie: Gateway als Fremd-Routing)
- [[../concepts/llm/llm-model-catalog.md]] — Modellkatalog