Guida rapida per le pipeline Sora 2
Genera testo senza censura per le tue pipeline video Sora 2 utilizzando la nostra API compatibile con OpenAI. Questa guida rapida copre l'autenticazione, le richieste di base, lo streaming e la chiamata di funzioni per avviare immediatamente il tuo motore di testo.
Autenticazione e Base URL
La nostra API utilizza l'autenticazione standard compatibile con OpenAI. Avrai bisogno di una chiave API dal tuo dashboard e del Base URL https://api.sora2apis.com/v1. Trasmetti la tua chiave nell'intestazione Authorization come token Bearer. Questa configurazione funziona con qualsiasi SDK che supporta la compatibilità OpenAI.
Registrati per ottenere una chiave. I nuovi account ricevono $0,50 di credito di prova gratuito per 7 giorni, senza carta di credito. Per l'uso a pagamento, le ricariche partono da $10. La chiave viene generata immediatamente dopo la registrazione e può essere rigenerata in qualsiasi momento.
curl https://api.sora2apis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Endpoint Chat Completions
L'endpoint principale è POST /v1/chat/completions. Accetta un campo model impostato su uncensored, che è un modello a pesi aperti ottimizzato per rispondere senza rifiuti di contenuti per l'uso adulto legale. Non è GPT, Claude o il modello di qualsiasi altro fornitore. Il modello ha una finestra di contesto da 100.000 token sia per il prompt che per il completamento.
Invia il tuo input di testo tramite l'array messages. L'API restituisce un output di testo pronto per la tua pipeline di generazione video. Non ci sono funzionalità di embedding, audio o generazione video in questo endpoint. È strettamente testo in, testo out.
from openai import OpenAI
client = OpenAI(base_url="https://api.sora2apis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Risposte in streaming (SSE)
Per la generazione di testo in tempo reale, imposta stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) che ti consentono di elaborare i token man mano che vengono generati. Questo è utile per script o didascalie lunghi dove desideri visualizzare i progressi o alimentare i dati in modo incrementale.
Ogni evento SSE contiene un delta parziale della risposta. Aggrega questi delta per ricostruire il testo completo. La risposta in streaming segue il formato standard SSE di OpenAI, garantendo la compatibilità con la maggior parte degli SDK moderni. Questo è ideale per la generazione di contenuti dinamici nel tuo flusso di lavoro Sora 2.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Chiamata di strumenti e funzioni
L'API supporta la chiamata di strumenti e funzioni, consentendoti di definire funzioni personalizzate che il tuo modello può utilizzare. Questo è prezioso per l'estrazione di dati strutturati o il processo decisionale automatizzato all'interno della tua pipeline di testo. Definisci i tuoi strumenti nell'array tools e specifica come il modello dovrebbe rispondere.
Il modello restituirà chiamate di strumenti quando appropriato, che potrai poi eseguire e reintrodurre nella conversazione. Questo consente flussi di lavoro complessi in cui il motore di testo può interagire con sistemi esterni o formattare i dati con precisione per le tue esigenze di generazione video. È una funzione potente per le pipeline Sora 2 avanzate.
Limiti di richiesta e utilizzo
Sei limitato a 300 richieste al minuto per chiave. La dimensione massima del corpo della richiesta è di 8 MB. Se superi il limite di richieste, riceverai un errore 429. Assicurati che la tua applicazione gestisca i ritentativi in modo appropriato. Ogni account ha una sola chiave API, che può essere rigenerata in qualsiasi momento, revocando la chiave precedente.
Il prezzo è di $0,25 per 1M di token in input e $1,00 per 1M di token in output. I crediti sono prepagati e non scadono mai. Se rimani senza credito, riceverai un errore 402. Le chiavi non valide generano un errore 401. Le ricariche partono da $10, con bonus per importi maggiori.
Configurazione del modello
L'ID del modello è sempre uncensored. È un modello a pesi aperti eseguito sui nostri server GPU, ottimizzato per contenuti adulti legali senza rifiuti. Non è GPT, Claude, Gemini, Grok o DeepSeek. Il modello non genera audio, immagini o video. È destinato esclusivamente alla generazione di testo.
Puoi regolare parametri standard come temperature e max_tokens per controllare l'output. La finestra di contesto è di 100.000 token. Questa flessibilità ti consente di ottimizzare l'output di testo per le tue specifiche esigenze di generazione video Sora 2. Il modello è progettato per essere un motore di testo affidabile per la tua pipeline.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.sora2apis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.sora2apis.com/v1 |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Finestra di contesto | 100.000 token (input + output) |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modalità JSON | response_format: {"type": "json_object"} |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 100.000 token, che includono sia il prompt che il completamento. Questo consente la generazione di contenuti lunghi adatta per script e didascalie dettagliate.
Come gestire i limiti di richieste?
Sei limitato a 300 richieste al minuto per chiave. Se superi questo limite, riceverai un errore 429. Implementa un backoff esponenziale nella tua applicazione per gestire i tentativi in modo graduale.
I contenuti sono davvero senza censura?
Il modello non rifiuta argomenti legali per adulti, di finzione, di ricerca sulla sicurezza o controversi. Tuttavia, i contenuti sessuali che coinvolgono minori sono sempre bloccati. È progettato per la libertà creativa entro i limiti legali.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica il Base URL. È tutta qui la configurazione.
Ottieni la chiave API