Schütze deine AI-Keys
vor Kostenexplosion und Missbrauch
Das LLM-Gateway für alle Provider — ein AI-Gateway mit hartem Budget-Limit vor jedem Aufruf, Abrechnung je Mandant und lückenlosem Audit. OpenAI-kompatibel, betrieben in Deutschland, in Minuten eingerichtet.
Betrieb & Datenschutz
LLM-Gateway aus Deutschland: Kostenkontrolle mit Budget-Limit, Audit-Trail und Mandanten-Trennung
PROMPTOPOLY wird in Deutschland betrieben — Server in Deutschland, Entwicklung in Deutschland. Das Gateway ist für den DSGVO-Alltag gebaut: Response-Payloads werden nach sieben Tagen automatisch gelöscht, die Löschfristen sind fest, und der Audit-Trail macht jede Antwort nachvollziehbar. Ehrlich gesagt gehört zur DSGVO immer auch dein eigener Prozess — das Gateway liefert die technische Seite dafür.
Das harte Budget-Limit gilt vor jedem Aufruf: Tages-, Wochen- und Monatsdeckel, race-sicher reserviert. Die Kostenkontrolle sitzt damit vor der Rechnung, nicht danach — ein Agent in der Endlosschleife stoppt, bevor er Geld kostet. LLM-Kostenkontrolle heißt hier: nicht monatlich zur Kenntnis nehmen, sondern vor jedem Call entscheiden. Das ist auch der Unterschied, der im DSGVO- oder Kundenaudit zählt: nachweisen können, was passiert ist.
Jeder Mandant läuft über eigene Keys mit eigener Trennung: eigenes Budget, eigener Audit-Trail, eigene Verbuchung. Die Mandanten-Trennung wird so zur Grundlage deiner Kundenabrechnung — aus dem Protokoll wird die Position auf der Rechnung. Kostenkontrolle, die du je Kunde ausweisen kannst, statt einer Sammelposition für alle.
Integration
Tausche nur die Base-URL aus
// Vorher: Direkt zu OpenAI
const openai = new OpenAI({ apiKey: 'sk-...' });
// Nachher: Über PROMPTOPOLY Proxy
const openai = new OpenAI({
apiKey: 'pk_xxxxxxxxxxxxxxxxxxxx',
baseURL: 'https://promptopoly.com/api/v1/proxy/v1'
});
Keine Code-Änderungen nötig. Alle OpenAI-kompatiblen SDKs funktionieren sofort.
Sicherheit
Harte Sperren VOR der Weiterleitung
Authentifizierung
Jeder Request wird per X-Proxy-Key authentifiziert. Inaktive oder abgelaufene Keys werden sofort abgelehnt.
Firewall
IP-Allowlist, Modell-Whitelist und Blocklist-Regex prüfen den Request. Verbotene Calls blockieren vor Budget-Reservierung.
Budget & Wallet
Race-sicheres Budget-Limit und Prepaid-Wallet-Debit. Kein Call verlässt das Gateway ohne ausreichend Guthaben.
Provider-Call
Verschlüsselte Credentials werden entschlüsselt, der Provider-Call ausgeführt und die Antwort zurückgegeben.
Audit & Abrechnung
Jeder Call wird in einer Hash-Chain protokolliert. Marge und Kosten werden transparent abgerechnet.
Features
Leistungsumfang
Harte Limits
Tages-, Wochen- oder Monatsbudgets. Race-sichere Reservierung verhindert Kostenexplosionen.
KeyVault
AES-256-GCM Verschlüsselung. Klartext nur transient im RAM. Key-Rotation inklusive.
Marge & Abrechnung
Prozentual, fix oder pro 1k Tokens. Prepaid oder Postpaid. Transparent in Cent — mit echten Zahlen gerechnet auf der Beispielrechnung in den Preisen.
Audit-Trail
HMAC-verkettete Hash-Chain. Export als CSV/JSON. Feste Löschfristen.
Firewall
IP-Allowlist, Modell-Whitelist, Capability-Prüfung, Blocklist-Regex.
Multi-Provider
OpenAI, Anthropic, Google Gemini. Einheitliches API, Failover zwischen den Anbietern.
Für Agent-Systeme
Dein Agent, unsere Leitplanken
OpenAI-kompatibel, damit jeder Agent sofort läuft — mit Streaming, Tool-Calling und einem nativen Anthropic-Endpunkt.
Echtes Streaming
Server-Sent-Events 1:1 vom Provider, terminiert mit [DONE]. Tokens erscheinen, während sie entstehen — ideal für Chat-UIs und Agent-Loops.
Tool-Calling
tools, tool_choice und role:"tool" laufen unverändert durch. Der Agent ruft deine Funktionen, das Gateway bewacht Budget und Firewall.
Nativer Anthropic-Endpunkt
POST /v1/messages im Messages-Format — Claude Code und das Anthropic-SDK laufen mit ANTHROPIC_BASE_URL direkt über das Gateway.
Agent-Loop mit Tool-Aufruf
tools = [{"type": "function", "function": {
"name": "get_stock",
"description": "Aktueller Lagerbestand für eine SKU.",
"parameters": {"type": "object", "properties": {"sku": {"type": "string"}}, "required": ["sku"]},
}}]
messages = [{"role": "user", "content": "Ist SKU-4711 noch verfügbar?"}]
first = client.chat.completions.create(model="gpt-4o-mini", messages=messages, tools=tools)
call = first.choices[0].message.tool_calls[0]
result = get_stock(call.function.name, **json.loads(call.function.arguments))
messages.append(first.choices[0].message)
messages.append({"role": "tool", "tool_call_id": call.id, "content": json.dumps(result)})
final = client.chat.completions.create(model="gpt-4o-mini", messages=messages)
print(final.choices[0].message.content)
Grenzen: n > 1 wird nicht unterstützt; der native Anthropic-Endpunkt hat kein Provider-Failover.
Für Agenturen
LLM-Kosten pro Kunde abrechnen
Kosten pro Kunde abrechnen
Ein Gateway, beliebig viele Mandanten — jeder mit eigenem Key, eigenem Budget und eigenem Audit-Trail. Der Verbrauch läuft getrennt nach Projekt und Kunde auf, sodass aus dem Protokoll die Position auf der Kundenrechnung wird statt einer Sammelrechnung, die niemand aufteilen kann.
Hartes Budget-Limit vor dem Aufruf
Das Budget-Limit greift, bevor der Aufruf hinausgeht — nicht bei der Abrechnung danach. Race-sichere Budgets je Tag, Woche und Monat und eine Prepaid-Wallet stoppen einen Agenten in der Endlosschleife, solange er noch nichts gekostet hat.
pk_-Auth & Audit
Proxy-Keys statt Provider-Keys im Code. Jeder Call in einer HMAC-verketteten Hash-Chain.
AI-Calls absichern
Starte in wenigen Minuten. Keine Kreditkarte nötig. Free 0 €, Plus 8 €/Monat, Pro 15 €/Monat — alle Preise inkl. Umsatzsteuer, monatlich kündbar. Je Aufruf ab 1,1 Cent, gerechnet wie in der Beispielrechnung. Betrieb in Deutschland.