prmptopoly

Schütze deine AI-Keys
vor Kostenexplosion und Missbrauch

Das LLM-Gateway für alle Provider — ein AI-Gateway mit hartem Budget-Limit vor jedem Aufruf, Abrechnung je Mandant und lückenlosem Audit. OpenAI-kompatibel, betrieben in Deutschland, in Minuten eingerichtet.

Betrieb & Datenschutz

LLM-Gateway aus Deutschland: Kostenkontrolle mit Budget-Limit, Audit-Trail und Mandanten-Trennung

PROMPTOPOLY wird in Deutschland betrieben — Server in Deutschland, Entwicklung in Deutschland. Das Gateway ist für den DSGVO-Alltag gebaut: Response-Payloads werden nach sieben Tagen automatisch gelöscht, die Löschfristen sind fest, und der Audit-Trail macht jede Antwort nachvollziehbar. Ehrlich gesagt gehört zur DSGVO immer auch dein eigener Prozess — das Gateway liefert die technische Seite dafür.

Das harte Budget-Limit gilt vor jedem Aufruf: Tages-, Wochen- und Monatsdeckel, race-sicher reserviert. Die Kostenkontrolle sitzt damit vor der Rechnung, nicht danach — ein Agent in der Endlosschleife stoppt, bevor er Geld kostet. LLM-Kostenkontrolle heißt hier: nicht monatlich zur Kenntnis nehmen, sondern vor jedem Call entscheiden. Das ist auch der Unterschied, der im DSGVO- oder Kundenaudit zählt: nachweisen können, was passiert ist.

Jeder Mandant läuft über eigene Keys mit eigener Trennung: eigenes Budget, eigener Audit-Trail, eigene Verbuchung. Die Mandanten-Trennung wird so zur Grundlage deiner Kundenabrechnung — aus dem Protokoll wird die Position auf der Rechnung. Kostenkontrolle, die du je Kunde ausweisen kannst, statt einer Sammelposition für alle.

Integration

Tausche nur die Base-URL aus

// Vorher: Direkt zu OpenAI const openai = new OpenAI({ apiKey: 'sk-...' }); // Nachher: Über PROMPTOPOLY Proxy const openai = new OpenAI({ apiKey: 'pk_xxxxxxxxxxxxxxxxxxxx', baseURL: 'https://promptopoly.com/api/v1/proxy/v1' });

Keine Code-Änderungen nötig. Alle OpenAI-kompatiblen SDKs funktionieren sofort.

Sicherheit

Harte Sperren VOR der Weiterleitung

1

Authentifizierung

Jeder Request wird per X-Proxy-Key authentifiziert. Inaktive oder abgelaufene Keys werden sofort abgelehnt.

2

Firewall

IP-Allowlist, Modell-Whitelist und Blocklist-Regex prüfen den Request. Verbotene Calls blockieren vor Budget-Reservierung.

3

Budget & Wallet

Race-sicheres Budget-Limit und Prepaid-Wallet-Debit. Kein Call verlässt das Gateway ohne ausreichend Guthaben.

4

Provider-Call

Verschlüsselte Credentials werden entschlüsselt, der Provider-Call ausgeführt und die Antwort zurückgegeben.

5

Audit & Abrechnung

Jeder Call wird in einer Hash-Chain protokolliert. Marge und Kosten werden transparent abgerechnet.

Features

Leistungsumfang

Harte Limits

Tages-, Wochen- oder Monatsbudgets. Race-sichere Reservierung verhindert Kostenexplosionen.

KeyVault

AES-256-GCM Verschlüsselung. Klartext nur transient im RAM. Key-Rotation inklusive.

Marge & Abrechnung

Prozentual, fix oder pro 1k Tokens. Prepaid oder Postpaid. Transparent in Cent — mit echten Zahlen gerechnet auf der Beispielrechnung in den Preisen.

Audit-Trail

HMAC-verkettete Hash-Chain. Export als CSV/JSON. Feste Löschfristen.

Firewall

IP-Allowlist, Modell-Whitelist, Capability-Prüfung, Blocklist-Regex.

Multi-Provider

OpenAI, Anthropic, Google Gemini. Einheitliches API, Failover zwischen den Anbietern.

Für Agent-Systeme

Dein Agent, unsere Leitplanken

OpenAI-kompatibel, damit jeder Agent sofort läuft — mit Streaming, Tool-Calling und einem nativen Anthropic-Endpunkt.

Echtes Streaming

Server-Sent-Events 1:1 vom Provider, terminiert mit [DONE]. Tokens erscheinen, während sie entstehen — ideal für Chat-UIs und Agent-Loops.

Tool-Calling

tools, tool_choice und role:"tool" laufen unverändert durch. Der Agent ruft deine Funktionen, das Gateway bewacht Budget und Firewall.

Nativer Anthropic-Endpunkt

POST /v1/messages im Messages-Format — Claude Code und das Anthropic-SDK laufen mit ANTHROPIC_BASE_URL direkt über das Gateway.

Agent-Loop mit Tool-Aufruf

tools = [{"type": "function", "function": { "name": "get_stock", "description": "Aktueller Lagerbestand für eine SKU.", "parameters": {"type": "object", "properties": {"sku": {"type": "string"}}, "required": ["sku"]}, }}] messages = [{"role": "user", "content": "Ist SKU-4711 noch verfügbar?"}] first = client.chat.completions.create(model="gpt-4o-mini", messages=messages, tools=tools) call = first.choices[0].message.tool_calls[0] result = get_stock(call.function.name, **json.loads(call.function.arguments)) messages.append(first.choices[0].message) messages.append({"role": "tool", "tool_call_id": call.id, "content": json.dumps(result)}) final = client.chat.completions.create(model="gpt-4o-mini", messages=messages) print(final.choices[0].message.content)

Grenzen: n > 1 wird nicht unterstützt; der native Anthropic-Endpunkt hat kein Provider-Failover.

Für Agenturen

LLM-Kosten pro Kunde abrechnen

Kosten pro Kunde abrechnen

Ein Gateway, beliebig viele Mandanten — jeder mit eigenem Key, eigenem Budget und eigenem Audit-Trail. Der Verbrauch läuft getrennt nach Projekt und Kunde auf, sodass aus dem Protokoll die Position auf der Kundenrechnung wird statt einer Sammelrechnung, die niemand aufteilen kann.

Hartes Budget-Limit vor dem Aufruf

Das Budget-Limit greift, bevor der Aufruf hinausgeht — nicht bei der Abrechnung danach. Race-sichere Budgets je Tag, Woche und Monat und eine Prepaid-Wallet stoppen einen Agenten in der Endlosschleife, solange er noch nichts gekostet hat.

pk_-Auth & Audit

Proxy-Keys statt Provider-Keys im Code. Jeder Call in einer HMAC-verketteten Hash-Chain.

AI-Calls absichern

Starte in wenigen Minuten. Keine Kreditkarte nötig. Free 0 €, Plus 8 €/Monat, Pro 15 €/Monat — alle Preise inkl. Umsatzsteuer, monatlich kündbar. Je Aufruf ab 1,1 Cent, gerechnet wie in der Beispielrechnung. Betrieb in Deutschland.

Kostenlos starten Preise ansehen