Decision Models · Jev-kompatible API

Inferenz für Open‑Weights-
Entscheidungsmodelle.

Kleine, schnelle Modelle, die eine typisierte Frage mit Wahrscheinlichkeiten beantworten: Ticket zuordnen, Aktion freigeben, Entwurf bewerten. Bis zu ~40× günstiger und ~18× schneller als ein 27B-Reasoning-LLM bei denselben Entscheidungsaufgaben.¹

1 JevBench-Schätzungen für dieselben Entscheidungsaufgaben im Vergleich zu einem 27B-Reasoning-LLM; keine Messung des gehosteten Dienstes. Methode und Einordnung →

Anfrage → AntwortBeispiel-Anfragen
ANFRAGE / Auswahl

Zustand: Mia besitzt ein rotes Fahrrad.

Frage: Welche Farbe hat das Fahrrad?

ANTWORT / Wahrscheinlichkeiten
rot0.91
blau0.09
ANFRAGE / Auswahl

Zustand: Ein Geschäftskunde möchte die Rechnungsadresse ändern.

Frage: Welche Support-Warteschlange passt?

ANTWORT / Wahrscheinlichkeiten
billing0.87
technical0.09
account0.04
ANFRAGE / Ja-Nein

Zustand: Ein Nutzer mit Leserolle löscht einen Arbeitsbereich.

Frage: Ist diese Aktion erlaubt?

ANTWORT / P(wahr)
true0.04
Illustrative Vertragsformen, keine gemessene Ausgabe — alle Beispiele und Code stehen im Schnellstart (EN).

Zwei Tarife, eine API

Wähle, wo deine Entscheidungen laufen.

GLOBAL · PEER-TO-PEER

Rechenleistung von allen, für alle.

Unser niedrigster Preis pro Entscheidung, auf Kapazität, die mit dem Bedarf wächst.

Heute: freie EU-Kapazität und GPUs nach Bedarf für Schlüssel mit erlaubter weltweiter Verarbeitung.

Als Nächstes: das REAX-Netzwerk – ein Bittensor-Subnetz, in dem alle mit einer starken GPU offene Modelle bereitstellen und variable Subnetz-Belohnungen erhalten können – mit den damit verbundenen Risiken.

DemnächstSo funktioniert Peer-to-Peer →

EU-TARIF

Hosting in der EU.

DSGVO-konform gebaut – AVV bei der Registrierung, Eingaben und Antworten werden nicht gespeichert.

Ausgerichtet am EU AI Act – Modellkarten, Benchmarks und vorgesehener Einsatzzweck dokumentiert.

EU-Anfragen bleiben immer in der EU und haben Vorrang.

Mehr zum EU-Tarif →

Über unsere API hinaus

Nutze jedes offene Entscheidungsmodell.

Wähle ein Modell aus der JevBench-Open-Weights-Rangliste und betreibe es so, wie du es brauchst.

Dediziertes Hosting

Dein eigener privater Endpunkt für ein Modell, in der EU oder weltweit.

Mehr erfahren →

Lokal betreiben

Ein Installer prüft deine Hardware und lädt das Modell herunter. Kostenlos für Einzelpersonen und kleine Teams.

Mehr erfahren →

Alle Modelle ansehen →

Anwendungsfälle

Kleine Entscheidungen in deinen Abläufen.

Sende Kontext und eine benannte Frage; nutze die typisierte Antwort in deinem Ablauf.

Support

Tickets passend zuordnen

Ordne Anfragen der richtigen Warteschlange zu.

Rechnungsadresse ändern → Abrechnung | Technik | Konto

Support

Eskalationen erkennen

Markiere sensible Fälle anhand deiner Eskalationsregeln.

Zahlung anfechten → eskalieren?

Produkt / Sicherheit

Aktionen anhand einer Richtlinie prüfen

Prüfe geplante Aktionen. Behalte feste Zugriffskontrollen in deiner Anwendung.

Leser löscht Arbeitsbereich → erlaubt?

Qualität

Entwürfe nach Kriterien bewerten

Bewerte Antworten oder Zusammenfassungen und eskaliere unsichere Fälle.

Entwurf + Kriterien → Bewertung

Vertrieb

Leads priorisieren

Ordne eingehende Nachrichten nach deinen Kriterien ein.

Rollout möglich? → heiß | warm | kalt

Betrieb / Dokumente

Dokumente richtig weiterleiten

Ordne Dokumenttext dem passenden Ablauf zu.

Dokument → Rechnung | Vertrag | Sonstiges

Agents

Den nächsten Schritt wählen

Wähle zwischen Suche, Rückfrage, Antwort oder Stopp.

Kontext + Tools → nächster Schritt?

LLM-Kosten

Anfragen zum passenden Modell routen

Klassifiziere Schwierigkeit und Risiko, bevor du ein LLM auswählst.

Anfrage → Kategorie · Schwierigkeit · Risiko

Beispiele zur Orientierung. Prüfe repräsentative Fälle mit deinen eigenen Daten, bevor du Entscheidungen automatisierst.

Zahlen mit Einordnung

Schneller und günstiger – mit Grenzen bei der Genauigkeit.

Für klar umrissene Entscheidungen kann ein kleineres Modell ausreichen. Für offene Texte oder schwierige Schlussfolgerungen bleibt ein LLM die bessere Wahl.

JE 1.000 ENTSCHEIDUNGEN

~40× niedrigere geschätzte Kosten

Rund 0,05 $ gegenüber 2,18 $ für ein 27B-Reasoning-LLM.

DIESELBEN AUFGABEN

~18× schnellerer angepasster Median

Rund 0,35 s gegenüber 6,49 s.

BENCHMARK-ERGEBNISSE

Geringere Spitzen-Genauigkeit

Das verglichene Entscheidungsmodell liegt bei der Genauigkeit unter Frontier-LLMs.

JevBench-Kosten- und Medianzeitwerte sind Schätzungen aus Modellimplementierungen, keine Messungen des gehosteten Decision-Models-Dienstes. Die Benchmark wird vom Gründer von Decision Models betrieben. Für freies Schreiben und schwierige Schlussfolgerungen eignet sich ein Frontier-LLM besser. Methode und Quellen → · Quelldaten

Presse-Einordnung

Was TechCrunch über Jev schrieb

“…LLMs as we know them aren't the right solution for a lot of software because they are comparatively slow and expensive.”
— TechCrunch; der Artikel handelt von Jev, nicht von Decision Models.

Modellprogramm

s1-fast

Plumb-4B · kurzer Text

Kurzer Text, niedrige Latenz. Läuft auf einer gebündelten Engine; Wahrscheinlichkeiten identischer Anfragen können sich geringfügig unterscheiden.

s1-vision

Rune · EU · ein Bild

Entscheidungen mit einem Bild.

s1-llm-auto-router

CPU

Klassifiziert Kategorie, Schwierigkeit und Tragweite für Ihren LLM-Router.

Wenn Rune nicht verfügbar ist, greift s1-pro-Text auf Winnow-12B Q8 zurück; in der EU-Stufe und bei Peer-to-Peer ohne Opt-in zur weltweiten Verarbeitung hat s1-vision kein Ausweichmodell und liefert eine wiederholbare 503-Antwort; Peer-to-Peer-Schlüssel mit Opt-in zur weltweiten Verarbeitung können bei ausgelasteter Kapazität von weltweiten On-Demand-GPUs mit der Gemma-4-12B-Bildimplementierung bedient werden. Auf Peer-to-Peer läuft Rune, wenn freie Queue-/Admission-Kapazität es erlaubt, mit kompatiblem Einzelfragen-Fallback; Bundles sind Best-Effort und können wiederholbare HTTP-503-Antworten liefern. Gesamte Modellliste: /models · Lizenz.

Fähigkeit, Preis und Geschwindigkeit

Rune liegt bei beiden öffentlichen Referenzbenchmarks nahe an Jev. Unsere EU-Eingabepreise liegen unter Jevs Listenpreis. Vergleiche die gemessene Latenz im Diagramm unten. Surogate Rune 26B-A4B v3 ist das Hauptmodell in der EU und dient als s1-pro für kalibrierte Textentscheidungen. Die folgenden Indizes sind öffentliche Referenzergebnisse — keine gehosteten Decision-Models-Scores — und JevBench wird vom Gründer von Decision Models betrieben. Methode und Rohdaten: /benchmarks · Artefakt (JSON) herunterladen.

Decision Index

Balanced, chance-corrected index / 100 ↑ · v0.2.1

Stand: Decision Index v0.2.1, 2. Oktober 2026 · aktuelles Ranking ansehen

  1. #1Jev 1.13.057.91
  2. #2Ours – s1-pro (Surogate Rune 26B-A4B v3)57.44
  3. #3Decider chat · Gemma-4-31B57.33
  4. #4pplx-decider-v1-27b56.40
  5. #5simple-jev · Qwen3.8-27B (featherless)55.74
  6. #6frontier-infra Jebadiah 27B54.67
  7. #7Eikos-27B-FP8 Qwen3.8-27B LoRA53.13
  8. #8reflex Qwen3.8-27B-FP8 (wide choice)52.16
  9. #9Decider chat · Qwen3.6-27B51.35
  10. #10Winnow-12B50.02

Ours – s1-pro · reference modelJev 1.13.0 (Referenz-API)Andere getestete Modelle

Skala 0–100

Quelle: Decision Index · Daten · abgerufen 2 October 2026

Anmerkungen (EN)

Public default balanced index; equal weight across five areas. Rows retain the source order and use sequential display ranks, including tied scores. Jev is the reference API; other entries are tested model implementations. Reference results are not a hosted System1 measurement.

JevBench Capability Score

Mean of Intelligence and Calibration / 100 ↑ · v1.5.5 · gerankt innerhalb der Caps

Stand: JevBench Capability Score v1.5.5, 2. Oktober 2026 · aktuelles Ranking ansehen

  1. #1Jev 1.13.080.01
  2. #2Winnow-12B Q879.25
  3. #3Cygnet79.05
  4. #4Ours – s1-pro (Surogate Rune 26B-A4B v3)79.02
  5. #5Jev-Omni76.54
  6. #6djev76.37
  7. #7JevK5 v0.372.31
  8. #8Plumb-4B71.65
  9. #9Decision 4B v1.271.11
  10. #10Imajev-4B70.80

Ours – s1-pro · reference modelJev 1.13.0 (Referenz-API)Andere getestete Modelle

Skala 0–100

Quelle: JevBench Capability Score · Daten · abgerufen 2 October 2026

Anmerkungen (EN)

Only models inside the cost and median latency caps (each 2× Jev 1.13.0) are ranked. Benchmark run by the founder of System1 Models. Tested reference engines; the hosted System1 engine has not been scored in this release.

Median-Latenz, niedriger ist besser

Medium text · one question · warm HTTP/2 · median ms ↓

  1. s1-pro · EUp95 749.4 ms30/30 erfolgreich199.6 ms
  2. s1-fast · EUp95 286.7 ms30/30 erfolgreich155.1 ms
  3. Jev 1.13.0p95 340.2 ms30/30 erfolgreich233.6 ms

Decision ModelsJev 1.13.0

Skala 0–300 ms

Measured from Nuremberg, Germany, 2 October 2026. 33 rotated rounds on identical medium synthetic support tickets, one question, HTTP/2 persistent clients; first 3 rounds excluded as warm-up; 30 measured calls per target. p50=sample median; p95=nearest rank ceil(0.95*n). End-to-end successful-response latency; every failure retained. s1-pro has a lower median but a higher p95 than Jev. Small sample; results vary with workload and network.

Quelle: Artefakt (JSON) · abgerufen 2 October 2026

Der gemessene Latenzvergleich steht im Geschwindigkeitsdiagramm oben — Mediane, p95 und Erfolgszahlen aus dem verlinkten Messartefakt. Öffentliche Index-Ergebnisse sind nur Referenz — keine gehosteten Decision-Models-Scores.

Methodennotizen (EN)

Public synthetic text; real customer API end-to-end latency, successful-response quantiles; failures tracked separately; no retained customer payloads. p95 uses the nearest sample percentile.

Eingabepreis pro Million Tokens (USD)

$0–0,05 pro M Eingabe-Tokens

  1. s1-fast · Peer-to-Peer$0.032
  2. s1-fast · EU$0.034
  3. s1-pro · Peer-to-Peer$0.038
  4. s1-pro · EU$0.040
  5. Jev 1.13.0$0.042

Decision ModelsJev 1.13.0

$0–0,05 pro M Eingabe-Tokens

Einführungspreise · Ausgabe kostenlos · ohne Steuern.

Quelle: Decision-Models-Preise · Jev-1.13.0-Preis · abgerufen 2 October 2026

Kosten pro 1.000 Entscheidungen (USD)

$0–0,012 pro 1.000 Entscheidungen

  1. s1-pro · Peer-to-Peer$0.0087
  2. s1-pro · EU$0.0093
  3. Jev 1.13.0$0.0109

Decision ModelsJev 1.13.0

$0–0,012 pro 1.000 Entscheidungen

Gemessene Kostenschätzung bei 3 Fragen pro Anruf. EU und Jev: 30/30 erfolgreich. Peer-to-Peer: 14/30 aus Finnland, 12/30 aus Virginia; Kosten nur für erfolgreiche Aufrufe; Peer-to-Peer-Bundles sind Best-Effort und können wiederholbare HTTP-503-Antworten liefern.

Quelle: Artefakt (JSON) · abgerufen 2 October 2026

Anmerkungen (EN)

2 October 2026. Medium text, 3 questions per call, from Finland. Mean billable input tokens × USD list rate / 3 decisions × 1,000. EU/Jev 10/10 successful medium calls; Peer-to-Peer 5/10, estimates cover successful calls only. Internal trial requests were not paid debits. Across all S/M/L cells: EU/Jev 30/30, Peer-to-Peer 14/30 in Finland and 12/30 in Virginia. Peer-to-Peer bundles are best-effort and may return retryable HTTP 503. Shared state billing reduces cost; large bundles can be slower than Jev.

Die Schnittstelle

Eine API für wiederkehrende Entscheidungen

Sende Kontext und typisierte Fragen: bis zu drei mit s1-pro, eine mit s1-fast oder s1-vision. Du erhältst eine gewählte Antwort mit Wahrscheinlichkeiten, wenn das Modell sie unterstützt.

01 / INTEGRIEREN

Eine Anfrageform

Nutze einen benannten Zustand und Fragen vom Typ noul, choice oder score pro Anfrage.

02 / PRÜFEN

Eine nützliche Antwort

Lies Antwort, Konfidenz oder Wahrscheinlichkeitsverteilung, Nutzungsbeleg und die verwendete Stufe.

03 / STEUERN

Deine Stufe

Wähle Peer-to-Peer oder EU pro API-Schlüssel oder pro Anfrage mit dem Header S1-Region.

Zwei Ansätze

Wähle den Ansatz, der zu deinen Daten passt.

Dieselben Modellprofile und dieselbe API-Anfrageform. Die Implementierung hängt von verfügbarer Kapazität ab. Wähle pro API-Schlüssel oder pro Anfrage mit einem Header.

PEER-TO-PEERElastische Kapazität

Peer-to-Peer – Kapazität, die mit deinem Bedarf wächst

Gebaut für weltweite Skalierung. Peer-to-Peer startet auf freier EU-Kapazität. Ist sie ausgelastet, können Schlüssel mit deiner Zustimmung nach Bedarf angemietete GPU-Kapazität von Lium nutzen, betrieben von unabhängigen Drittanbietern in verschiedenen Ländern, auch außerhalb der EU/des EWR.

Heute

EU-Anfragen haben Vorrang. Aktiviere „Allow worldwide processing“ (weltweite Verarbeitung erlauben) für jeden Schlüssel, der die EU verlassen darf. Ohne Zustimmung bleibt Peer-to-Peer auf EU-Kapazität und kann bei Auslastung warten oder abgelehnt werden. Bestandskunden behalten die Verarbeitung ausschließlich in der EU, sofern sie nicht zustimmen. Anfrage- und Antwortinhalte werden auf keinem Knoten gespeichert.

  • s1-fast 0,032 $ · s1-pro 0,038 $ je 1 Mio. Eingabe-Tokens
  • Ausgabe-Tokens kostenlos
  • Ideal für hohes Volumen und nicht sensible Daten
Peer-to-Peer-Preise →
EUFlagge der Europäischen UnionHöchster Datenschutz

EU – für die strengsten Datenschutzanforderungen

Für Teams mit höchsten Datenschutzansprüchen oder strengen EU-Regulierungsanforderungen. EU-Anfragen laufen ausschließlich bei vertraglich gebundenen Betreibern in der EU, und Inferenzdaten verlassen die EU nie. EU-Anfragen haben Vorrang, auch wenn ein Schlüssel weltweite Peer-to-Peer-Verarbeitung erlaubt.

  • s1-fast 0,034 $ · s1-pro 0,040 $ je 1 Mio. Eingabe-Tokens
  • Inferenzdaten bleiben in der EU
  • Nur vertraglich gebundene EU-Betreiber – EU-Anfragen haben Vorrang
  • AVV bei der Registrierung, veröffentlichte Liste der Unterauftragsverarbeiter
  • Prompts und Ausgaben werden nie gespeichert oder zum Training genutzt
Zur EU-Seite →

Anmeldung (Google) und Zahlungen (Stripe) übernehmen die Unterauftragsverarbeiter auf unserer Unterauftragsverarbeiter-Seite; sie erhalten nie deine Prompts.

Für Teams

Alles, was du zum Integrieren brauchst.

FAQ

Häufige Fragen

Ist Decision Models der Jev-Dienst?

Nein. Decision Models ist ein eigenständiger Dienst für offene Entscheidungsmodelle mit einer Jev-kompatiblen API. Jev ist eine Marke von TypeSafe AI; Decision Models ist nicht mit TypeSafe verbunden.

Wie bekomme ich API-Zugang?

Mit Google anmelden, im Dashboard einen API-Schlüssel erstellen und die erste Anfrage senden. Kostenloses Kontingent auf Einladung. Aufladen ab 1 EUR. Privatpersonen und Unternehmen weltweit können sich registrieren und Guthaben aufladen. Steuern werden im Checkout angezeigt, bevor du bezahlst.

Werden Prompts oder Antworten gespeichert?

Nein. Prompts und Ausgaben werden nie gespeichert oder zum Training genutzt. Für die Abrechnung speichern wir nur Nutzungsdaten wie Token-Zahlen.

Worin unterscheiden sich Peer-to-Peer und EU?

Peer-to-Peer startet auf freier EU-Kapazität; EU-Anfragen haben Vorrang. Bei Auslastung kann Peer-to-Peer nach Bedarf angemietete GPU-Kapazität von Lium (lium.io) nutzen. Unabhängige Drittanbieter betreiben die Hardware in verschiedenen Ländern, einschließlich außerhalb der EU/des EWR. Das erfolgt nur für Schlüssel mit aktiviertem „Allow worldwide processing“ (weltweite Verarbeitung erlauben). Ohne Zustimmung bleibt Peer-to-Peer auf EU-Kapazität und kann bei Auslastung warten oder abgelehnt werden. Bestandskunden behalten die Verarbeitung ausschließlich in der EU, sofern sie nicht zustimmen. Anfrage- und Antwortinhalte werden auf keinem Knoten gespeichert. Anfragen des EU-Tiers bleiben immer in der EU. Verarbeitungsorte und Übermittlungsbedingungen →

Was erlaubt weltweite Verarbeitung?

Nur Peer-to-Peer-Anfragen von Schlüsseln mit deiner Zustimmung können Lium-GPU-Kapazität außerhalb der EU/des EWR nutzen, wenn freie EU-Kapazität ausgelastet ist. Anfragen des EU-Tiers bleiben immer in der EU. Der Schalter schafft keine Rechtsgrundlage für die Übermittlung personenbezogener Daten: Sende solche Daten auf Schlüsseln mit Zustimmung nur, wenn für deine Nutzung eine geeignete Übermittlungsgrundlage besteht. Lies den AVV und die Liste der Unterauftragsverarbeiter.

Kann ich Bilder senden?

Ja, mit s1-vision: ein Bild pro Anfrage (PNG, JPEG oder WebP). Reine Text-Anfragen kosten wie s1-pro; eine Anfrage mit Bild wird für alle Eingabe-Tokens (Text und Bildpositionen) zum Bildpreis abgerechnet, weil Bildverarbeitung pro Token etwa 3× so viel GPU-Zeit braucht. Ein Bild zählt als die Eingabe-Tokens, die das Modell tatsächlich liest.

Ist ein Entscheidungsmodell so genau wie ein Frontier-LLM?

Nein. Im Benchmark erzielt das verglichene Entscheidungsmodell eine geringere Genauigkeit als Frontier-LLMs. Prüfe eigene Beispieldaten; für offene Texte und schwierige Aufgaben nutze ein Frontier-LLM oder eine menschliche Prüfung. Methode und Ergebnisse →