Snelstartgids voor Sora 2-pipelines
Genereer ongecensureerde tekst voor je Sora 2-videopipelines met onze OpenAI-compatibele API. Deze snelstartgids behandelt authenticatie, basisverzoeken, streaming en tool calling om je tekstengine direct aan de gang te krijgen.
Authenticatie en Base URL
Onze API gebruikt standaard OpenAI-compatible authenticatie. Je hebt een API-sleutel nodig vanuit je dashboard en de base URL https://api.sora2apis.com/v1. Voeg je sleutel toe in de Authorization header als Bearer token. Deze setup werkt met elke SDK die OpenAI-compatibiliteit ondersteunt.
Meld je aan voor een account om je sleutel te krijgen. Nieuwe accounts ontvangen $0,50 aan gratis proeftegoed voor 7 dagen, zonder creditcard. Voor betaald gebruik beginnen top-ups bij $10. De sleutel wordt direct gegenereerd na het aanmelden en kan op elk moment worden geregeneerd.
curl https://api.sora2apis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Chat Completions Endpoint
Het kernendpoint is POST /v1/chat/completions. Het accepteert een model veld ingesteld op uncensored, een open-weight model dat is afgestemd om te antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik. Het is geen GPT, Claude of een model van een andere leverancier. Het model heeft een contextvenster van 100.000 tokens voor zowel prompt als completion.
Verstuur je tekstinput via de messages array. De API retourneert tekstoutput die klaar is voor je video-generatiepipeline. Er zijn geen embeddings, audio- of video-generatiemogelijkheden in dit endpoint. Het is strikt tekst-in, tekst-uit.
from openai import OpenAI
client = OpenAI(base_url="https://api.sora2apis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Streaming responses (SSE)
Voor real-time tekstgeneratie stel je stream: true in je verzoek in. De API retourneert Server-Sent Events (SSE) waardoor je tokens kunt verwerken terwijl ze worden gegenereerd. Dit is handig voor lange scripts of bijschriften waarbij je voortgang wilt tonen of data incrementeel wilt doorgeven.
Elk SSE-gebeurtenis bevat een gedeeltelijke delta van de respons. Aggregateer deze deltas om de volledige tekst te reconstrueren. De streaming respons volgt de standaard OpenAI SSE-indeling, wat compatibiliteit met de meeste moderne SDK's garandeert. Dit is ideaal voor dynamische tekstgeneratie in je Sora 2-workflow.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Tool and Function Calling
De API ondersteunt tool en function calling, waardoor je aangepaste functies kunt definiëren die het model kan gebruiken. Dit is waardevol voor gestructureerde data-extractie of geautomatiseerde besluitvorming binnen je tekstpipeline. Definieer je tools in de tools array en geef aan hoe het model moet reageren.
Het model retourneert tool calls wanneer dit gepast is, die je vervolgens kunt uitvoeren en terug kunt voeren in het gesprek. Dit maakt complexe workflows mogelijk waarbij de tekstengine kan communiceren met externe systemen of data precies kan formatteren voor je video-generatiebehoeften. Het is een krachtige functie voor geavanceerde Sora 2-pipelines.
Rate Limits and Usage
Je bent beperkt tot 300 verzoeken per minuut per sleutel. De maximale grootte van de request body is 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-fout. Zorg dat je applicatie retries op de juiste manier afhandelt. Elk account krijgt één API-sleutel, die op elk moment kan worden geregeneerd, waardoor de oude sleutel ongeldig wordt.
Prijzen zijn $0,25 per 1M input tokens en $1,00 per 1M output tokens. Credits zijn prepaid en vervallen nooit. Als je credit opraakt, ontvang je een 402-fout. Ongeldige sleutels resulteren in een 401-fout. Top-ups beginnen bij $10, met bonussen voor hogere bedragen.
Model Configuration
De model ID is altijd uncensored. Het is een open-weight model dat draait op onze eigen GPU-servers, afgestemd op wettelijk volwassen content zonder weigeringen. Het is geen GPT, Claude, Gemini, Grok of DeepSeek. Het model genereert geen audio, afbeeldingen of video. Het is strikt bedoeld voor tekstgeneratie.
Je kunt standaardparameters aanpassen zoals temperature en max_tokens om de output te regelen. Het contextvenster is 100.000 tokens. Deze flexibiliteit stelt je in staat de tekstoutput af te stemmen op je specifieke Sora 2-video-generatiebehoeften. Het model is ontworpen als een betrouwbare tekstengine voor je pipeline.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.sora2apis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.sora2apis.com/v1 |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-modus | response_format: {"type": "json_object"} |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Verzoekgrootte | tot 8 MB |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat is de grootte van het contextvenster?
Het contextvenster is 100.000 tokens, inclusief zowel de prompt als de completion. Dit maakt generatie van lange teksten mogelijk, geschikt voor scripts en gedetailleerde bijschriften.
Hoe ga ik om met rate limits?
Je bent beperkt tot 300 verzoeken per minuut per sleutel. Als je dit overschrijdt, ontvang je een 429-fout. Implementeer exponentiële backoff in je applicatie om herhaalde pogingen soepel af te handelen.
Is de inhoud echt ongecensureerd?
Het model weigert geen wettelijke volwassen, fictieve, security-research- of controversiële onderwerpen. Seksuele inhoud met minderjarigen wordt echter altijd geblokkeerd. Het is ontworpen voor creatieve vrijheid binnen wettelijke kaders.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.
API-sleutel aanvragen