Szybki start dla potoków Sora 2
Generuj tekst bez cenzury dla swoich potoków wideo Sora 2 za pomocą naszego API kompatybilnego z OpenAI. Ten szybki start obejmuje uwierzytelnianie, podstawowe zapytania, strumieniowanie i wywoływanie funkcji, aby uruchomić silnik tekstowy natychmiast.
Uwierzytelnianie i Base URL
Nasze API używa standardowego uwierzytelniania kompatybilnego z OpenAI. Będziesz potrzebował klucza API ze swojego panelu oraz Base URL https://api.sora2apis.com/v1. Przekaz swój klucz w nagłówku Authorization jako token Bearer. Ta konfiguracja działa z każdym SDK obsługującym kompatybilność z OpenAI.
Zarejestruj się, aby uzyskać swój klucz. Nowe konta otrzymują $0.50 w darmowym kredycie próbnym na 7 dni, bez karty kredytowej. W przypadku płatnego użycia doładowania zaczynają się od $10. Klucz jest generowany natychmiast po rejestracji i może być wygenerowany ponownie w dowolnym momencie.
curl https://api.sora2apis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Endpoint Chat Completions
Podstawowy endpoint to POST /v1/chat/completions. Akceptuje pole model ustawione na uncensored, co jest modelem o otwartych wagach dostrojonym do odpowiadania bez odmów treści dla prawnego użytku dorosłego. Nie jest to GPT, Claude ani żaden inny model dostawcy. Model ma okno kontekstu 100 000 tokenów zarówno dla promptu, jak i uzupełnienia.
Wyślij swój tekst wejściowy przez tablicę messages. API zwraca tekst wyjściowy gotowy do Twojego potoku generowania wideo. Nie ma możliwości embeddingów, audio ani generowania wideo w tym endpointcie. Jest to ściśle tekst-wejście, tekst-wyjście.
from openai import OpenAI
client = OpenAI(base_url="https://api.sora2apis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Odpowiedzi strumieniowe (SSE)
W przypadku generowania tekstu w czasie rzeczywistym ustaw stream: true w swoim zapytaniu. API zwraca zdarzenia wysłane przez serwer (SSE), umożliwiając przetwarzanie tokenów w miarę ich generowania. Jest to przydatne przy długich scenariuszach lub opisach, gdzie chcesz wyświetlać postęp lub przekazywać dane przyrostowo.
Każde zdarzenie SSE zawiera częściową deltę odpowiedzi. Zaggregate te delty, aby odtworzyć pełny tekst. Odpowiedź strumieniowa odpowiada standardowemu formatowi SSE OpenAI, zapewniając kompatybilność z większością nowoczesnych SDK. Jest to idealne do generowania dynamicznej treści w Twoim przepływie pracy Sora 2.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Wywoływanie narzędzi i funkcji
API obsługuje wywoływanie narzędzi i funkcji, pozwalając Ci zdefiniować własne funkcje do użycia przez model. Jest to cenne dla ekstrakcji danych strukturalnych lub automatycznego podejmowania decyzji w Twoim potoku tekstowym. Zdefiniuj swoje narzędzia w tablicy tools i określ, jak model powinien odpowiedzieć.
Model zwróci wywołania narzędzi, gdy będzie to odpowiednie, które możesz następnie wykonać i przekazać z powrotem do rozmowy. Umożliwia to złożone przepływy pracy, w których silnik tekstowy może interagować z systemami zewnętrznymi lub formatować dane precyzyjnie dla Twoich potrzeb generowania wideo. To potężna funkcja dla zaawansowanych potoków Sora 2.
Limity zapytań i użycie
Limit wynosi 300 zapytań na minutę na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Upewnij się, że Twoja aplikacja odpowiednio obsługuje ponowne próby. Każde konto otrzymuje jeden klucz API, który może być wygenerowany ponownie w dowolnym momencie, co unieważnia stary klucz.
Cennik to $0.25 za 1M tokenów wejściowych i $1.00 za 1M tokenów wyjściowych. Kredyty są przedpłacone i nigdy nie wygasają. Jeśli zabraknie kredytu, otrzymasz błąd 402. Nieprawidłowe klucze powodują błąd 401. Doładowania zaczynają się od $10, z bonusami za większe kwoty.
Konfiguracja modelu
Identyfikator modelu to zawsze uncensored. Jest to model o otwartych wagach działający na naszych własnych serwerach GPU, dostrojony do treści dla dorosłych bez odmów. Nie jest to GPT, Claude, Gemini, Grok ani DeepSeek. Model nie generuje audio, obrazów ani wideo. Jest ściśle przeznaczony do generowania tekstu.
Możesz dostosować standardowe parametry, takie jak temperature i max_tokens, aby kontrolować wyjście. Okno kontekstu wynosi 100 000 tokenów. Ta elastyczność pozwala Ci dopracować wyjście tekstowe dla swoich konkretnych potrzeb generowania wideo Sora 2. Model jest zaprojektowany jako niezawodny silnik tekstowy dla Twojego potoku.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.sora2apis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.sora2apis.com/v1 |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Tryb JSON | response_format: {"type": "json_object"} |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jaki jest rozmiar okna kontekstu?
Okno kontekstu wynosi 100 000 tokenów, co obejmuje zarówno prompt, jak i completion. Pozwala to na generowanie treści długich, odpowiednich dla scenariuszy i szczegółowych opisów.
Jak obsługuje się limity zapytań?
Limit wynosi 300 zapytań na minutę na klucz. Jeśli go przekroczysz, otrzymasz błąd 429. Zaimplementuj wykładnicze opóźnienie ponownych prób w swojej aplikacji, aby obsłużyć je w sposób elegancki.
Czy treść jest naprawdę bez cenzury?
Model nie odrzuca legalnych treści dla dorosłych, fikcyjnych, badawczych lub kontrowersyjnych. Jednak treść seksualna z udziałem małoletnich jest zawsze blokowana. Jest przeznaczony do kreatywnej swobody w granicach prawa.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień Base URL. To cała konfiguracja.
Pobierz klucz API