Startpreise je 1 Million Eingabe-Tokens. Ausgabe-Tokens sind kostenlos. s1-pro und s1-vision laufen auf Surogate Rune 26B-A4B v3. Winnow-12B Q8 ist das Ausweichmodell für s1-pro (Text); für s1-vision gibt es in der EU-Stufe und bei Peer-to-Peer ohne Opt-in zur weltweiten Verarbeitung kein Ausweichmodell: Ist Rune nicht verfügbar, erhalten s1-vision-Anfragen eine wiederholbare Antwort 503. Peer-to-Peer-Schlüssel mit Opt-in zur weltweiten Verarbeitung können bei ausgelasteter Kapazität von weltweiten On-Demand-GPUs mit der Gemma-4-12B-Bildimplementierung bedient werden. Peer-to-Peer-Anfragen können Rune bei freier Kapazität nutzen. s1-fast nutzt in beiden Stufen Plumb-4B. Peer-to-Peer für flexible Kapazität, EU für gezielte EU-Verarbeitung. Kostenloses Kontingent auf Einladung. Aufladen ab 1 EUR.
Kostenlos starten
Mit Google anmelden, API-Schlüssel erstellen, loslegen. Privatpersonen und Unternehmen weltweit können sich registrieren und Guthaben aufladen. Steuern werden im Checkout angezeigt, bevor du bezahlst. Rechnungen stellt die productivity-boost.com Betriebs UG (haftungsbeschränkt) & Co. KG aus.
USD-Startpreise
Modell
Peer-to-Peer Flexible Kapazität · Zustimmung je Schlüssel
EU Inferenz nur in der EU · AVV
s1-fast Plumb-4B · Text
$0.032
$0.034
s1-pro Rune (EU main) · Winnow-12B Q8 fallback · Text
$0.038
$0.040
s1-vision · nur Text Rune · Text ohne Bild
$0.038
$0.040
s1-vision · mit Bild Rune · Anfrage enthält ein Bild; alle Eingabe-Tokens (Text und Bildpositionen) zum Bildpreis
$0.217
$0.228
s1-llm-auto-router Routing-Klassifikator · CPU · 7 feste Fragen
$0.001
$0.001
EUR-Startpreise
Modell
Peer-to-Peer Flexible Kapazität · Zustimmung je Schlüssel
EU Inferenz nur in der EU · AVV
s1-fast Plumb-4B · Text
0,028 €
0,030 €
s1-pro Rune (EU main) · Winnow-12B Q8 fallback · Text
0,033 €
0,035 €
s1-vision · nur Text Rune · Text ohne Bild
0,033 €
0,035 €
s1-vision · mit Bild Rune · Anfrage enthält ein Bild; alle Eingabe-Tokens (Text und Bildpositionen) zum Bildpreis
0,190 €
0,200 €
s1-llm-auto-router Routing-Klassifikator · CPU · 7 feste Fragen
0,001 €
0,001 €
Anfragen mit Bild werden für alle Eingabe-Tokens (Text und Bildpositionen) zum Bildpreis abgerechnet, weil Bildverarbeitung pro Token etwa 3× so viel GPU-Zeit braucht. Reine Text-Anfragen an s1-vision kosten wie s1-pro.
Dieselben Modellprofile und dieselbe API-Anfrageform. Die Implementierung hängt von verfügbarer Kapazität ab. Wähle pro API-Schlüssel oder pro Anfrage mit einem Header.
PEER-TO-PEERElastische Kapazität
Peer-to-Peer – Kapazität, die mit deinem Bedarf wächst
Gebaut für weltweite Skalierung. Peer-to-Peer startet auf freier EU-Kapazität. Ist sie ausgelastet, können Schlüssel mit deiner Zustimmung nach Bedarf angemietete GPU-Kapazität von Lium nutzen, betrieben von unabhängigen Drittanbietern in verschiedenen Ländern, auch außerhalb der EU/des EWR.
Heute
EU-Anfragen haben Vorrang. Aktiviere „Allow worldwide processing“ (weltweite Verarbeitung erlauben) für jeden Schlüssel, der die EU verlassen darf. Ohne Zustimmung bleibt Peer-to-Peer auf EU-Kapazität und kann bei Auslastung warten oder abgelehnt werden. Bestandskunden behalten die Verarbeitung ausschließlich in der EU, sofern sie nicht zustimmen. Anfrage- und Antwortinhalte werden auf keinem Knoten gespeichert.
Für Teams mit höchsten Datenschutzansprüchen oder strengen EU-Regulierungsanforderungen. EU-Anfragen laufen ausschließlich bei vertraglich gebundenen Betreibern in der EU, und Inferenzdaten verlassen die EU nie. EU-Anfragen haben Vorrang, auch wenn ein Schlüssel weltweite Peer-to-Peer-Verarbeitung erlaubt.
Anmeldung (Google) und Zahlungen (Stripe) übernehmen die Unterauftragsverarbeiter auf unserer Unterauftragsverarbeiter-Seite; sie erhalten nie deine Prompts.
Nutzung
Bezahle nach dem tatsächlichen Eingabetoken-Zähler
TATSÄCHLICHE MODELLNUTZUNG
Eingabetokens
s1-pro erlaubt bis zu drei Textfragen pro Anfrage; s1-fast und s1-vision erlauben eine. Tokenizer zählen denselben Text je Modell unterschiedlich. Bei s1-vision zählt ein Bild als die Eingabe-Tokens, die das Modell tatsächlich liest (typisch ~300–450). Anfragen mit Bild werden für alle Eingabe-Tokens (Text und Bildpositionen) zum Bildpreis abgerechnet, reine Text-Anfragen zum s1-pro-Preis.
KOSTENLOS
Ausgabetokens
Die API liefert strukturierte Entscheidungen statt generierter Absätze.