Guida rapida per i flussi di lavoro Acestep
Integra l'API testuale senza censura nel tuo flusso di lavoro multimodale con questa guida rapida. Genera script, didascalie ed output di prompt engineering utilizzando l'interfaccia compatibile con OpenAI standard.
Prerequisiti: ottieni la tua chiave API
Prima di inviare richieste, devi disporre di una chiave API valida. Visita la pagina Ottieni chiave API su acestep.cc. Puoi registrarti utilizzando Continua con Google oppure creando un account con email e password. Non è richiesto il numero di telefono. Una volta registrato, la tua chiave API viene visualizzata immediatamente. Copia questa chiave; la utilizzerai per autenticare tutte le richieste successive. Se non hai credito, dovrai ricaricarlo. Accettiamo solo pagamenti in criptovalute (USDT su TRC20 o USDC su Base) per importi tra $10 e $500. I nuovi account ricevono $0,50 di credito di prova valido per 7 giorni, senza bisogno di inserire una carta. Conserva la chiave in modo sicuro, poiché autentica il tuo utilizzo rispetto ai limiti di richieste e al consumo di token.Installazione
L'API utilizza il protocollo standard compatibile con OpenAI. Puoi interagire con essa utilizzando gli SDK ufficiali di OpenAI per il tuo linguaggio preferito o qualsiasi client HTTP. Per Python, installa il pacchettoopenai. Per Node.js, installa openai. Assicurati di utilizzare una versione recente dell'SDK che supporti gli URL base personalizzati. L'URL base per il nostro servizio è https://api.acestep.cc/v1. Ciò ti consente di riutilizzare il codice delle pipeline esistenti che si aspetta endpoint OpenAI, semplicemente modificando l'URL base e la chiave API. L'ID del modello che devi specificare nelle tue richieste è uncensored. Questo modello è un LLM a pesi aperti ottimizzato per minimizzare i rifiuti su argomenti legali, di fantasia o controversi, rendendolo ideale per pipeline creative dove i filtri sui contenuti potrebbero altrimenti bloccare output creativi validi.
Richiesta di base: genera testo
Invia una richiesta POST a/v1/chat/completions con il tuo prompt di sistema e i messaggi dell'utente. Il modello restituirà il testo generato. Assicurati di impostare il parametro model su uncensored. Puoi controllare la creatività con temperature e top_p. La finestra di contesto supporta fino a 100.000 token in totale (prompt + completamento). Il massimo output per richiesta è di 32.000 token, o 2.048 se non specifichi max_tokens. Gli errori e i rifiuti non consumano credito, ma la generazione di token con successo sì. Usa questo endpoint per generare script, didascalie o elaborare dati testuali prima di passarli ad altre API di generazione come la generazione di audio o immagini.
Risposte in streaming
Per aggiornamenti in tempo reale, impostastream: true nella tua richiesta. L'endpoint restituisce Server-Sent Events (SSE). Ogni segmento contiene testo parziale. I dettagli sull'utilizzo dei token vengono forniti nell'ultimo segmento dello streaming. Questo è utile per le applicazioni che mostrano il testo man mano che viene generato, migliorando la latenza percepita per gli utenti. Assicurati che il tuo client gestisca correttamente gli SSE. Lo streaming ti consente di elaborare i token man mano che arrivano, il che è vantaggioso per la generazione di contenuti lunghi nella tua pipeline. Ricorda che lo streaming non modifica i prezzi o i limiti di token; vieni comunque addebitato per il totale dei token generati.
Chiamata di funzioni
L'API supporta la chiamata di funzioni, consentendo al modello di generare dati strutturati in base agli strumenti definiti da te. Definisci le tue funzioni nel parametrotools. Imposta tool_choice su auto o su un nome di funzione specifico. Il modello risponderà con un oggetto di chiamata di funzione se appropriato. Questo è prezioso per estrarre dati strutturati dal testo o preparare input per chiamate API a valle. Puoi anche forzare l'output JSON impostando response_format su {"type": "json_object"}. Questo garantisce che il modello restituisca JSON valido, fondamentale per un'integrazione affidabile nella tua pipeline automatizzata. Usa queste funzionalità per migliorare l'affidabilità dei passaggi di elaborazione del testo.
Prezzi e limiti
Il prezzo è $0,25 per 1M di token in input e $1,00 per 1M di token in output. Il credito è prepagato e non scade mai. Gli errori sono gratuiti. I limiti di richieste sono 300 richieste al minuto per chiave e 8 richieste concorrenti contemporanee per chiave. La dimensione massima del corpo della richiesta è 8 MB. Se superi il limite di richieste, ricevi un errore 429. Un errore 401 indica una chiave non valida o scaduta. Un errore 402 significa che hai credito insufficiente. Non vengono emessi rimborsi per il credito; le controversie vengono gestite tramite la pagina Supporto. È consentita una chiave attiva per account; la generazione di una nuova chiave sostituisce quella vecchia. Tieni presenti questi limiti quando progetti la logica di retry della tua pipeline.
cURL
curl https://api.acestep.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.acestep.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.acestep.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.acestep.cc/v1 |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Modalità JSON | response_format: {"type": "json_object"} |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Bonus | +5% da $50, +10% da $100 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Il modello senza censura blocca tutti i contenuti sessuali?
No, il modello è ottimizzato per minimizzare i rifiuti per argomenti legali, di fantasia e controversi. Tuttavia, si applica sempre un limite rigido ai contenuti: le richieste contenenti contenuti sessuali che coinvolgono minori vengono rifiutate. Questo è l'unico blocco rigoroso imposto dal modello.
Posso usare questa API per la generazione di immagini o video?
No. Questa è un'API di chat-completions solo testo. Non genera immagini, audio o video. È progettata per alimentare i passaggi di generazione di testo nella tua pipeline, come la scrittura di prompt per generatori di immagini o script per strumenti video. Per quelle modalità, dovresti utilizzare le rispettive API.
Come ricarico il mio credito?
Le ricariche sono accettate solo tramite criptovalute: USDT sulla rete TRC20 o USDC sulla rete Base. Puoi ricaricare qualsiasi importo intero da $10 a $500. I crediti vengono addebitati in base all'utilizzo reale dei token e non serve nessuna carta o PayPal. È disponibile anche un credito di prova per i nuovi account.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.