Blog/guides·28. Aug. 2026·5 Min.·vom eroq-Team
Unzensierte Alternative zur OpenAI-API – gleiche Form, ohne Mauer
Deine OpenAI-Integration läuft, bis der Filter zuschlägt. eroq behält das Anfrageformat und tauscht die Richtlinie – unzensierter Chat, Bild und Stimme.
Jedes Charakter- oder Story-Produkt landet irgendwann beim selben Commit: Die OpenAI-Integration funktioniert wunderbar, das Produkt wächst, und dann beginnen die Ablehnungen – mitten in der Szene, unvorhersehbar, genau bei der Fiktion, für die sich deine Nutzer angemeldet haben (die Horror-Kampagne, der missglückte Raubzug, der Bösewicht, der wirklich bedrohlich ist). Der Filter ist kein Bug; er ist OpenAIs Richtlinie, die genau so funktioniert wie gedacht. Es ist nur nicht deine Richtlinie.
Die Lösung erfordert keinen Rewrite. Sie erfordert eine API, die die Form behalten und die Regeln geändert hat.
Drei Strings
eroq folgt der Request-Konvention von OpenAI überall dort, wo es eine gibt – chat/completions, images/generations, audio/speech. Eine bestehende Integration zu migrieren ist fast immer buchstäblich das hier:
- baseURL: "https://api.openai.com/v1"
+ baseURL: "https://eroq.ai/v1"
- apiKey: process.env.OPENAI_API_KEY
+ apiKey: process.env.EROQ_API_KEY
- model: "gpt-4o-mini"
+ model: "eroq-rp-mini"
Messages-Array, gestreamte SSE-Chunks, usage-Block, Fehler-Envelope – die Formen, mit denen dein Code schon umgehen kann. Die Doku liefert sogar jede Seite als rohes Markdown für deinen Copilot, und der Quickstart dauert wirklich fünf Minuten.
Was sich tatsächlich ändert
Auf die Richtlinie kannst du dich verlassen. Düstere, gewalttätige und provokante Fiktion wird in der Rolle gerendert – Horror, Krimi, Krieg, Satire –, und die Grenze ist eine schriftliche Richtlinie, vier Absätze lang (nur Fiktion; nichts mit Minderjährigen, keine realen, identifizierbaren Personen ohne Einwilligung, nichts Illegales), durchgesetzt auf Kontoebene statt durch einen Filter, der mitten in der Szene entscheidet. Du kannst unsere Richtlinie in deinen eigenen Bedingungen zitieren; versuch mal, die Laune eines Filters zu zitieren.
Die Preise werden pauschal. OpenAI rechnet nach Tokens ab; Charakter-Produkte haben die eifrigsten Vielschreiber der Branche. Bei eroq kostet eine Completion 1 oder 3 Credits, unabhängig von der Länge, Bilder kosten 10, und fehlgeschlagene Generierungen werden automatisch erstattet. Dein furchteinflößendster Power-User wird zu einer Multiplikation, nicht zu einer Varianz.
Die Modelle sind Spezialisten. RP+ und RP mini sind keine Allzweck-Assistenten mit abgeschalteten Leitplanken – sie sind auf Rollenspiel abgestimmt: Sie halten die Persona auch in langen Verläufen, dämpfen Wiederholungen bei hohen Sampling-Temperaturen, haben ein context-Feld für Charakterbögen und einen Texting-Modus für DM-Produkte.
Der Stack geht über Chat hinaus. Bildgenerierung mit unzensierten Modellen, asynchrones Video mit Motion One als unzensierter Engine, Stimme in beide Richtungen – und der eroq Store: Objektspeicher und ein CDN, direkt in die Generierung eingebaut, unter derselben schriftlichen Richtlinie wie die Modelle.
Privatsphäre wird zum Schalter. Schick private: true an die Bild- und Video-Endpunkte (oder schalte im Studio den Privatmodus ein), und eroq behält weder eine Datei noch einen Bibliothekseintrag, und das Nutzungsprotokoll zeigt Sternchen, wo der Prompt stünde. eroqs eigene Modelle speichern upstream nichts; die Video-Engines von Drittanbietern sowie Flash Image / Flux Image können Prompts bei ihrem Anbieter protokollieren. Außerhalb des Privatmodus werden Prompts für Abrechnung und Missbrauchsbekämpfung im Protokoll aufbewahrt – und deine Kreationen bleiben privat, bis du sie veröffentlichst.
Was sich ehrlicherweise nicht ändert
Allgemeine Intelligenz ist nicht der Tausch: Behalte OpenAI (oder eine andere Mainstream-API) für Zusammenfassungen, Embeddings und Tool-Calling – viele Kunden nutzen beides, je nach Aufgabe geroutet. eroq übernimmt den Platz, an dem der Filter das Problem war, nicht jeden Platz.
Die Migrations-Checkliste
- Schlüssel besorgen – 50 Gratis-Credits, keine Karte nötig.
- Tausch die drei Strings hinter einem Feature-Flag aus; lass zuerst deine am häufigsten abgelehnten Prompts laufen – das ist der Test, der zählt.
- Verbinde die 402-Behandlung mit deinem Auflade-Flow (pauschale Prepaid-Credits, „Budget aufgebraucht“ ist also ein Produkt-Event, keine Überraschung auf der Rechnung).
- Verschieb Persona- und System-Blöcke ins
context-Feld, wenn du so weit bist – sauberere Transkripte, gleiches Verhalten.
Häufige Fragen
Kann ich das OpenAI-SDK mit eroq verwenden?
Für die Schnittstellen, für die es eine OpenAI-Konvention gibt, ja – richte den Client mit deinem eroq-Schlüssel auf https://eroq.ai/v1. chat/completions nimmt dasselbe messages-Array und streamt dieselbe SSE-Chunk-Form, images/generations und audio/speech folgen demselben Muster, und der usage-Block und der Fehler-Envelope sind die, mit denen dein Code schon umgeht.
Welches eroq-Modell ersetzt ein allgemeines Chat-Modell?
RP mini für 1 Credit pro Completion für Volumen, RP+ für 3 für die Turns, die eine Szene tragen. Beide sind Rollenspiel-Spezialisten statt Allzweck-Assistenten – sie halten eine Persona auch in langen Verläufen und antworten im gewählten Register, aber deine Unit-Tests schreiben sie nicht.
Unterstützt eroq Embeddings, Tool-Calling oder Function Calls?
Nein. Es gibt keine Embeddings und keine Tool-Calling-Schnittstelle – eroq deckt Chat, Bilder, Video, Sprache, Transkription, Speicher und die Studio-Ressourcen drumherum ab. Das ist ein Platztausch, kein Komplettersatz: Behalte eine Mainstream-API für Retrieval, Agenten und strukturierte Tool-Nutzung und leite die Content-Arbeit hierher.
Was passiert, wenn eine Anfrage gegen die Richtlinie verstößt?
Bei den Bild- und Video-Endpunkten liefert sie einen eindeutigen Fehler content_blocked, ohne Berechnung, auf den du wie auf jeden anderen Code reagieren kannst. Im Chat sind RP+ und RP mini eroqs eigene Engines ohne darübergelegten Filter, dunkle Szenen werden also gerendert, statt hängen zu bleiben. So oder so sind die Grenzen schriftlich festgehalten und absolut (nur Fiktion; nichts mit Minderjährigen, keine realen, identifizierbaren Personen ohne Einwilligung, nichts Illegales), werden auf Kontoebene durchgesetzt und lassen sich in deinen eigenen Nutzungsbedingungen zitieren.
Brauche ich separate Schlüssel für Chat, Bilder und Video?
Nein. Ein Schlüssel erreicht jede Modalität und zieht von einem einzigen Workspace-Guthaben ab, es gibt also keinen Einrichtungsschritt pro Dienst und keine zweite Rechnung, die du abgleichen musst. Schlüssel tragen die Rolle des Mitglieds, das sie erstellt hat – so hält ein Workspace einen Produktionsschlüssel und den Testschlüssel eines Teammitglieds unter verschiedenen Obergrenzen.
Wie funktionieren Rate Limits?
Pro Minute, und ab dem Plan Creator aufwärts vervielfacht statt durch ein separates Kontingent ersetzt – Hobby erhöht deine Credits und die Cliplänge, lässt die Obergrenze pro Minute aber unverändert. Über der Grenze bekommst du einen 429 mit rate_limit_exceeded und einem Retry-After-Header, der sagt, wie viele Sekunden du warten sollst, sodass ein Client sich nach dem Header richten kann, statt zu raten. Die Rate-Limit-Referenz enthält die aktuellen Zahlen.
Der ganze Witz ist, dass Schritt 2 einen Nachmittag dauert und die Ablehnungs-Alerts in deinem Error-Tracker noch am selben Tag verstummen.
Mach das mit den Modellen hinter diesem Artikel – starte mit 50 Gratis-Credits oder sieh dir alle Engines und ihre Preise an.