Kundenservice
Tickets passend zuordnen
Ordne eine Anfrage einer Warteschlange zu.
Rechnungsadresse ändern → Abrechnung | Technik | Konto
EU-Tarif · DSGVO-Datenverarbeitung · EU
Ordne Anfragen zu, klassifiziere Inhalte und bewerte Entwürfe per API. EU-Anfragen laufen bei vertraglich gebundenen Betreibern in der EU; den AVV akzeptierst du bei der Registrierung, Eingaben und Antworten werden nicht gespeichert.
1 JevBench-Schätzungen für dieselben Entscheidungsaufgaben im Vergleich zu einem 27B-Reasoning-LLM; keine Messung des gehosteten Dienstes. Methode und Einordnung →
Zustand: Mia besitzt ein rotes Fahrrad.
Frage: Welche Farbe hat das Fahrrad?
Zustand: Ein Geschäftskunde möchte die Rechnungsadresse ändern.
Frage: Welche Support-Warteschlange passt?
Zustand: Ein Nutzer mit Leserolle löscht einen Arbeitsbereich.
Frage: Ist diese Aktion erlaubt?
ISO/IEC-27001-Zertifizierungen halten unsere Hosting-Anbieter.
Konkrete Anwendungen
Sende Kontext und eine benannte Frage; nutze die typisierte Antwort in deinem Ablauf.
Kundenservice
Ordne eine Anfrage einer Warteschlange zu.
Rechnungsadresse ändern → Abrechnung | Technik | Konto
Produkt / Sicherheit
Vergleiche die Aktion mit einer Richtlinie. Behalte feste Zugriffskontrollen in deiner Anwendung.
Leser löscht Arbeitsbereich → erlaubt?
Qualität
Bewerte Antworten oder Zusammenfassungen und eskaliere unsichere Fälle.
Entwurf + Kriterien → Bewertung
Betrieb / Dokumente
Ordne Dokumenttext dem passenden Ablauf zu.
Dokument → Rechnung | Vertrag | Sonstiges
Beispiele zur Orientierung. Prüfe repräsentative Fälle mit deinen eigenen Daten, bevor du Entscheidungen automatisierst.
Datenfluss
Jede EU-Anfrage bleibt vom ersten bis zum letzten Byte in der EU.
Antwort zurück über denselben verschlüsselten Weg
Zwei Ansätze
Anfragen des EU-Tiers bleiben immer in der EU und haben Vorrang. Der Schalter für weltweite Peer-to-Peer-Verarbeitung ändert daran nichts.
Peer-to-Peer startet auf freier EU-Kapazität. Bei Auslastung kann Peer-to-Peer nach Bedarf angemietete GPU-Kapazität von Lium (lium.io) nutzen. Unabhängige Drittanbieter betreiben die GPU-Hardware in verschiedenen Ländern, einschließlich außerhalb der EU/des EWR. Das erfolgt nur für Schlüssel mit ausdrücklich aktiviertem „Allow worldwide processing“ (weltweite Verarbeitung erlauben). Ohne Zustimmung bleibt Peer-to-Peer in der EU und kann bei Auslastung warten oder abgelehnt werden. Bestandskunden behalten die Verarbeitung ausschließlich in der EU, sofern sie nicht für den jeweiligen Schlüssel zustimmen. Anfrage- und Antwortinhalte werden auf keinem Knoten gespeichert.
Verträge
Auftragsverarbeitungsvertrag nach Art. 28 DSGVO, bei der Registrierung angenommen.
AVV lesen →Jeder Anbieter mit Zweck und Standort.
Liste ansehen →Welche Kontodaten wir verarbeiten und warum.
Datenschutz lesen →Deutsches Unternehmen, erreichbare Ansprechpartner.
Impressum öffnen →Verschlüsselung, Zugriffe und Betrieb im Überblick.
Sicherheit ansehen →Zahlen mit Einordnung
Für klar umrissene Entscheidungen kann ein kleineres Modell ausreichen. Für offene Texte oder schwierige Schlussfolgerungen bleibt ein LLM die bessere Wahl.
JE 1.000 ENTSCHEIDUNGEN
Rund 0,05 $ gegenüber 2,18 $ für ein 27B-Reasoning-LLM.
DIESELBEN AUFGABEN
Rund 0,35 s gegenüber 6,49 s.
BENCHMARK-ERGEBNISSE
Das verglichene Entscheidungsmodell liegt bei der Genauigkeit unter Frontier-LLMs.
JevBench-Kosten- und Medianzeitwerte sind Schätzungen aus Modellimplementierungen, keine Messungen des gehosteten Decision-Models-Dienstes. Die Benchmark wird vom Gründer von Decision Models betrieben. Für freies Schreiben und schwierige Schlussfolgerungen eignet sich ein Frontier-LLM besser. Methode und Quellen → · Quelldaten
Presse-Einordnung
“…LLMs as we know them aren't the right solution for a lot of software because they are comparatively slow and expensive.”
EU AI Act
Decision Models hostet offene Allzweckmodelle für eng umrissene Entscheidungsaufgaben. Wir veröffentlichen Modellkarten und Benchmark-Ergebnisse, kennzeichnen unsere Modelle klar und dokumentieren den vorgesehenen Einsatzzweck. Wer die API für Hochrisiko-Zwecke im Sinne der KI-Verordnung nutzt, braucht eine eigene Bewertung.
Rune · EU
Kalibrierte Textentscheidungen mit bis zu drei Fragen pro Aufruf. Rune ist das EU-Hauptmodell.
Plumb-4B · kurzer Text
Kurzer Text, niedrige Latenz. Läuft auf einer gebündelten Engine; Wahrscheinlichkeiten identischer Anfragen können sich geringfügig unterscheiden.
Rune · EU · ein Bild
Entscheidungen mit einem Bild.
CPU
Klassifiziert Kategorie, Schwierigkeit und Tragweite für Ihren LLM-Router.
Wenn Rune nicht verfügbar ist, greift s1-pro-Text auf Winnow-12B Q8 zurück; in der EU-Stufe und bei Peer-to-Peer ohne Opt-in zur weltweiten Verarbeitung hat s1-vision kein Ausweichmodell und liefert eine wiederholbare 503-Antwort; Peer-to-Peer-Schlüssel mit Opt-in zur weltweiten Verarbeitung können bei ausgelasteter Kapazität von weltweiten On-Demand-GPUs mit der Gemma-4-12B-Bildimplementierung bedient werden. Auf Peer-to-Peer läuft Rune, wenn freie Queue-/Admission-Kapazität es erlaubt, mit kompatiblem Einzelfragen-Fallback; Bundles sind Best-Effort und können wiederholbare HTTP-503-Antworten liefern. Gesamte Modellliste: /models · Lizenz.
Rune liegt bei beiden öffentlichen Referenzbenchmarks nahe an Jev. Unsere EU-Eingabepreise liegen unter Jevs Listenpreis. Vergleiche die gemessene Latenz im Diagramm unten. Surogate Rune 26B-A4B v3 ist das Hauptmodell in der EU und dient als s1-pro für kalibrierte Textentscheidungen. Die folgenden Indizes sind öffentliche Referenzergebnisse — keine gehosteten Decision-Models-Scores — und JevBench wird vom Gründer von Decision Models betrieben. Methode und Rohdaten: /benchmarks · Artefakt (JSON) herunterladen.
Balanced, chance-corrected index / 100 ↑ · v0.2.1
Stand: Decision Index v0.2.1, 2. Oktober 2026 · aktuelles Ranking ansehen
Ours – s1-pro · reference modelJev 1.13.0 (Referenz-API)Andere getestete Modelle
Skala 0–100
Quelle: Decision Index · Daten · abgerufen 2 October 2026
Public default balanced index; equal weight across five areas. Rows retain the source order and use sequential display ranks, including tied scores. Jev is the reference API; other entries are tested model implementations. Reference results are not a hosted System1 measurement.
Mean of Intelligence and Calibration / 100 ↑ · v1.5.5 · gerankt innerhalb der Caps
Stand: JevBench Capability Score v1.5.5, 2. Oktober 2026 · aktuelles Ranking ansehen
Ours – s1-pro · reference modelJev 1.13.0 (Referenz-API)Andere getestete Modelle
Skala 0–100
Quelle: JevBench Capability Score · Daten · abgerufen 2 October 2026
Only models inside the cost and median latency caps (each 2× Jev 1.13.0) are ranked. Benchmark run by the founder of System1 Models. Tested reference engines; the hosted System1 engine has not been scored in this release.
Medium text · one question · warm HTTP/2 · median ms ↓
Decision ModelsJev 1.13.0
Skala 0–300 ms
Measured from Nuremberg, Germany, 2 October 2026. 33 rotated rounds on identical medium synthetic support tickets, one question, HTTP/2 persistent clients; first 3 rounds excluded as warm-up; 30 measured calls per target. p50=sample median; p95=nearest rank ceil(0.95*n). End-to-end successful-response latency; every failure retained. s1-pro has a lower median but a higher p95 than Jev. Small sample; results vary with workload and network.
Quelle: Artefakt (JSON) · abgerufen 2 October 2026
Der gemessene Latenzvergleich steht im Geschwindigkeitsdiagramm oben — Mediane, p95 und Erfolgszahlen aus dem verlinkten Messartefakt. Öffentliche Index-Ergebnisse sind nur Referenz — keine gehosteten Decision-Models-Scores.
Public synthetic text; real customer API end-to-end latency, successful-response quantiles; failures tracked separately; no retained customer payloads. p95 uses the nearest sample percentile.
$0–0,05 pro M Eingabe-Tokens
Decision ModelsJev 1.13.0
$0–0,05 pro M Eingabe-Tokens
Einführungspreise · Ausgabe kostenlos · ohne Steuern.
Quelle: Decision-Models-Preise · Jev-1.13.0-Preis · abgerufen 2 October 2026
$0–0,012 pro 1.000 Entscheidungen
Decision ModelsJev 1.13.0
$0–0,012 pro 1.000 Entscheidungen
Gemessene Kostenschätzung bei 3 Fragen pro Anruf. EU und Jev: 30/30 erfolgreich. Peer-to-Peer: 14/30 aus Finnland, 12/30 aus Virginia; Kosten nur für erfolgreiche Aufrufe; Peer-to-Peer-Bundles sind Best-Effort und können wiederholbare HTTP-503-Antworten liefern.
Quelle: Artefakt (JSON) · abgerufen 2 October 2026
2 October 2026. Medium text, 3 questions per call, from Finland. Mean billable input tokens × USD list rate / 3 decisions × 1,000. EU/Jev 10/10 successful medium calls; Peer-to-Peer 5/10, estimates cover successful calls only. Internal trial requests were not paid debits. Across all S/M/L cells: EU/Jev 30/30, Peer-to-Peer 14/30 in Finland and 12/30 in Virginia. Peer-to-Peer bundles are best-effort and may return retryable HTTP 503. Shared state billing reduces cost; large bundles can be slower than Jev.
EU-Preise
Je 1 Million Eingabe-Tokens. Ausgabe-Tokens sind kostenlos. Kostenloses Kontingent auf Einladung. Aufladen ab 1 EUR.
| Modell | USD | EUR |
|---|---|---|
s1-fastPlumb-4B · Text | $0.034 | 0,030 € |
s1-proSurogate Rune 26B-A4B v3 · Text | $0.040 | 0,035 € |
Zzgl. anwendbarer Steuern. Privatpersonen und Unternehmen weltweit können sich registrieren und Guthaben aufladen. Steuern werden im Checkout angezeigt, bevor du bezahlst. Alle Preise und Rechner →
Häufige Fragen
Nein. Anfragen des EU-Tarifs laufen bei vertraglich gebundenen Betreibern in der EU. Eingaben und Antworten werden nicht gespeichert, protokolliert oder zum Training verwendet. Lies den AVV und die Liste der Unterauftragsverarbeiter.
Weltweite Peer-to-Peer-Verarbeitung muss pro Schlüssel ausdrücklich aktiviert werden. Anfragen des EU-Tarifs bleiben immer in der EU.
Nein. Wir geben keine pauschale Konformitätszusage für deine Anwendung. Du bleibst für deine Anwendung, die übermittelten Daten und deren rechtmäßige Nutzung verantwortlich.
Die Benchmark-Schätzung zeigt einen deutlichen Genauigkeitsabstand zu Frontier-LLMs. Prüfe repräsentative Fälle und nutze für schwierige Aufgaben ein Frontier-LLM oder eine menschliche Prüfung. Methode und Ergebnisse →