Wu Xianzhi APICasi d'uso
API AI illimitata: sei modi d'uso, dal ruolo all'Agent backend
Valore: nessun rifiuto per contenuti adulti, finzione e temi controversi. Casi: RP e compagnia, webnovel, NPC, test moderazione, analisi, backend Agent. Costi: input $0.25/1M token, output $1.00. Solo per adulti (18+).
Aggiornato il
Punti chiave
- Solo per adulti e usi legali. Contenuti sessuali con minori (di qualsiasi età) sono sempre bloccati con 403, anche se finti.
- Tutti i sei casi dipendono da system prompt specifici: più sono chiari personaggio, tono, lunghezza e limiti, più l'output è stabile
- Costi stimati: chat compagnia ~$0.001/turno, webnovel ~$0.0055/paragrafo, NPC gioco ~$0.00032/frase.
- I costi reali dipendono dall'usage nella risposta; limitare max_tokens è il modo più diretto per controllare i costi
Premessa: solo per utenti adulti e usi legali
API per adulti (18+). Nessun rifiuto per contenuti adulti e controversi. Contenuti sessuali con minori (di qualsiasi età) sono sempre bloccati con 403 content_blocked. Verifica età e moderazione a carico del prodotto.
Di seguito analizziamo i sei casi d'uso, indicando cosa serve davvero, fornendo un system prompt modificabile e calcolando i costi. Prezzi: input $0,25/milione di token, output $1,00/milione di token, credito prepagato, nessun canone mensile. I conteggi dei token sono valori tipici assunti per le stime; i consumi reali dipendono dall'usage nella risposta. Le stime servono solo a valutare l'ordine di grandezza. Vedi Esempi di codice per la sintassi.
Un consiglio generale: in ogni caso, scrivi system prompt specifici. Il modello senza censura non rifiuta, ma non indovina le tue intenzioni: più sono chiari personaggio, tono, lunghezza e limiti, più l'output è stabile.
App di compagnia da ruolo (solo per adulti)
È la categoria più richiesta per il "no refusal". Utenti parlano a lungo con un personaggio fisso, spesso con temi adulti. Tecnica: 1) sistema stabile: metti personaggio e lore nel system prompt, sempre incluso. 2) contesto coerente: gestisci tu la cronologia e tagliala. La finestra di contesto è 100.000 token. 3) risposte brevi: per la chat, imposta max_tokens a ~300. Rispetta il ritmo e controlla i costi.
A livello prodotto serve l'accesso per adulti e strumenti di segnalazione e blocco. I contenuti minori vengono bloccati dall'endpoint; la tua app dovrebbe interrompere attivamente tali derive, senza affidarsi solo al backend.
你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。Stima costi: Input 3.000 token (personaggio + cronologia recente), output 250 token. Input: 3.000 × $0,25 / 1M = $0,00075; Output: 250 × $1,00 / 1M = $0,00025. Totale per turno: ~$0,001. 1.000 turni = $1,00. Se un utente fa 50 turni/giorno, costo giornaliero ~$0,05. Con $0,50 di credito di prova gratuito puoi testare il prototipo.
Scrittura web novel e romanzi
Gli autori usano il modello per continuare, espandere, cambiare stile o superare i blocchi creativi. Per generi erotici, dark o crime serve che il modello scriva personaggi realistici senza improvvisare morale nei punti chiave. Prepara: lore, schede personaggio, outline del capitolo e riassunto del capitolo precedente. Inseriscili nel system o nel primo user message per evitare derive.
Per la scrittura lunga, tieni presente il limite di output: il massimo per singola richiesta è max_tokens 32.000. In pratica, si consiglia di dividere un capitolo in più richieste da 1.500-3.000 parole ciascuna, aggiornando progressivamente il sommario, piuttosto che richiedere l'intero capitolo in una volta. Questo garantisce un controllo migliore sulla qualità ed evita di dover ricominciare tutto da capo in caso di errori. Con lo streaming, l'autore può leggere il testo mentre viene generato e interrompere la generazione in qualsiasi momento.
你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。Stima costi: Input 6.000 token (lore, outline, riassunto), output 4.000 token (~3.000 parole, stimato >1 token/parola). Input $0,0015, output $0,004. Totale per paragrafo: ~$0,0055. 100 paragrafi = $0,55. Un romanzo di un milione di parole (3.000 parole/paragrafo) richiede ~330 richieste, totale < $2.
NPC di gioco e generazione trama
Le conversazioni NPC hanno due caratteristiche: volume alto, singola riga breve. Servono personalità marcate e rispetto della lore. Nei giochi erotici, dark o con volgarità, un modello che rifiuta rompe l'immersione. Il modello senza censura mantiene lo stile senza interruzioni.
Implementazione: metti "conoscenze NPC" e "stato attuale" nel system prompt, le azioni del giocatore in user. Imposta max_tokens a 100-150. Per eventi (porta, trade, fight), usa function calling per azioni strutturate, non testo. Vedi codice per i dettagli. Ogni chiave ha un rate limit di 300 richieste/min. Per giochi online ad alta concorrenza, usa coda e cache sul server e gestisci il 429 con backoff.
你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。Stima costi: Input 800 token, output 120 token. Input $0,0002, output $0,00012. Totale per riga: ~$0,00032. 10.000 righe = $3,20. Per un gioco con decine di NPC, costi di sviluppo e test sono nell'ordine di pochi dollari.
Moderazione e red-teaming: genera i tuoi dati di test
I team che si occupano della moderazione dei contenuti affrontano un problema inevitabile: per testare modelli o regole di moderazione servono molti campioni "non conformi", ma i campioni reali sono difficili da reperire e scriverli manualmente è troppo lento. I modelli che rifiutano le risposte non sono d'aiuto, perché rifiutano persino di generare campioni di test. Con questa API puoi generare in batch corpus di test per il tuo sistema di moderazione per categoria, ad esempio varianti di insulti, spam, truffe e contenuti borderline, per valutare il recall, regolare le soglie ed eseguire test di regressione.
Il red-teaming è simile: genera input utente difficili per il tuo prodotto e verifica se le tue difese reggono. Limiti: usa i dati solo nel tuo ambiente di test, non per molestare o truffare utenti reali. I contenuti sessuali minori non vengono mai generati, restituisce 403.
Ingegneria: fai output JSON con etichetta di categoria e intensità. Genera ~20 campioni per richiesta, poi deduplica localmente. Usa prompt diversi per coprire più casi.
你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。Stima costi: Input 500 token, output 2.000 token (20 campioni). Input $0,000125, output $0,002. Totale per richiesta: ~$0,0021. Per 10.000 campioni servono 500 richieste, totale ~$1,06.
Analisi di argomenti sensibili per la ricerca
Ricercatori in scienze sociali, giornalismo, diritto e politica gestiscono materiali controversi: discorsi estremi, crimini, violenza storica, dibattiti politici. I modelli generici tendono a rifiutare o dare risposte generiche. Serve un modello che analizzi e confronti i fatti senza imporre giudizi di valore.
Caratteristica: input lungo, output breve. Inserisci documenti e ottieni un riassunto strutturato o annotato. Specifica nel prompt il framework di analisi (dimensioni, citazioni, distinzione fatti/opinioni). La finestra di contesto di 100.000 token basta per report lunghi. Ricorda: l'analisi non è avallo; il ricercatore deve verificare i fatti e i dati.
你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。Stima costi: Input 20.000 token, output 1.500 token. Input $0,005, output $0,0015. Totale per documento: ~$0,0065. 200 documenti = $1,30. Costi più alti per input lungo, ma il prezzo unitario è basso, quindi il batch è conveniente.
Backend Agent: evita interruzioni per rifiuto
Le app Agent (ricerca, dati, task multi-step) temono che il modello rifiuti al passo 5, bloccando tutto. Servono stabilità e function calling. Supportiamo tools e tool_choice in formato OpenAI. Quindi qualsiasi framework Agent con base_url personalizzabile si integra subito.
Consigli per gli Agent: 1) Limita le iterazioni con un max step per evitare loop infiniti. 2) Validazione parametri tool: non fidarti ciecamente dell'output. 3) Retry su 429/503, alert su 402 (saldo esaurito blocca task lunghi). 4) Un solo modello per pianificazione, esecuzione e sintesi, differenziando i ruoli con system prompt diversi.
你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。Stima costi: Supponi 6 turni/task, input 8.000 token (storico+tools), output 400 token. Input: 48.000 token ≈ $0,012. Output: 2.400 token ≈ $0,0024. Totale task: ~$0,0144. 1.000 task ≈ $14,40. Il costo Agent viene dallo storico ripetuto. Taglia i risultati degli strumenti prima di rimetterli nel contesto. Vedi prezzi.
Domande frequenti
Le app di compagnia richiedono verifica dell'età?
Solo per adulti. I prodotti finali devono verificare l'età. Contenuti sessuali con minori (di qualsiasi età) sono sempre bloccati con 403, anche se finti.
È legale generare dati di test per la moderazione?
Utilizzarli per valutare il tuo sistema di moderazione o per uso interno è generalmente una pratica ingegneristica corretta. Non utilizzare i contenuti generati per molestie, frodi o altre attività illecite; l'utilizzo deve essere conforme alla legge.
Un gran numero di dialoghi NPC nei giochi attiverà il limite di richieste?
300 richieste al minuto per chiave. In caso di elevato parallel requests, si consiglia di implementare code e cache delle conversazioni comuni sul server, di gestire il codice 429 con backoff esponenziale e, se necessario, di modulare il ritmo delle richieste.
Cosa succede se il saldo non è sufficiente a metà di un'attività Agent?
La richiesta restituisce 402 con codice errore no_credit e l'attività viene interrotta. Si consiglia di verificare il saldo prima di avviare attività lunghe e di gestire il 402 nel codice salvando lo stato e invitando l'utente a ricaricare.
Compila il modulo per ottenere la chiave API
Crea un account, copia la chiave API e modifica il Base URL. La configurazione è così semplice.
Ottieni la chiave API