NL ▾
API-sleutel ophalen

Wu Xianzhi APIToepassingen

Onbeperkte AI API-toepassingen: zes manieren, van rollenspel tot Agent-backend

De waarde van onze onbeperkte AI API is dat legale volwassen inhoud, fictie en controversiële onderwerpen niet meer worden geweigerd. We bespreken zes veelgebruikte use cases: roleplay, webnovels, game NPC's, contentmoderatie, onderzoek en Agent-backend. We geven aan wat nodig is, een system prompt voorbeeld en kosten per miljoen tokens: $0,25 voor input, $1,00 voor output. Alleen voor 18+, legaal gebruik.

Bijgewerkt op

Belangrijkste punten

  1. Alleen voor volwassen gebruikers en legaal gebruik; seksuele inhoud met minderjarigen wordt altijd geblokkeerd en retourneert 403, of het nu fictief is of niet
  2. Alle zes de categorieën zijn afhankelijk van specifieke system prompts; hoe duidelijker de persona, toon, lengte en taboes zijn gedefinieerd, hoe stabieler de output is
  3. Kostenschattingen zijn gebaseerd op aangenomen typische tokenaantallen: gezapsgesprek ongeveer $0,001 per beurt, webroman ongeveer $0,0055 per segment, game-NPC ongeveer $0,00032 per zin
  4. De werkelijke kosten zijn gebaseerd op usage in de response; het instellen van max_tokens is de meest directe manier om de kosten te beheersen

Eerst de voorwaarde: alleen volwassen gebruikers en legaal gebruik

Deze API is voor volwassenen (18+) en voor legaal gebruik. Legale volwassen inhoud, fictie en controversiële onderwerpen worden niet geweigerd, maar seksuele inhoud met minderjarigen wordt altijd geblokkeerd met 403 content_blocked, ongeacht fictie of roleplay. Als je een eindgebruikersproduct bouwt, moet je zelf zorgen voor leeftijdsverificatie, meldingen en accountbeheer; dat is jouw verantwoordelijkheid, niet die van de API.

We bespreken zes veelgebruikte use cases: wat je nodig hebt, een direct bruikbare system prompt en de kosten. Prijzen: input $0,25 / miljoen tokens, output $1,00 / miljoen tokens. Prepaid, geen maandelijkse kosten. Alle tokenaantallen zijn geschatte typische waarden. Je werkelijke verbruik staat in usage. Zie codevoorbeelden voor de implementatie.

Algemeen advies: maak je system prompt specifiek. Het ongecensureerde model weigert niet, maar raadt ook niet aan wat je wilt. Hoe specifieker je rol, toon, lengte en grenzen maakt, hoe stabieler de output.

Rollenspel en gezelschapsapplicaties (alleen volwassen gebruikers)

Dit is de meest voorkomende behoefte aan "geen weigering". Gebruikers hebben een lange dialoog met een vast persona, mogelijk met volwassen thema's. Belangrijk: houd het persona stabiel door het in system messages te plaatsen; behoud context door zelf geschiedenis te beheren en te knippen (de API is stateless, het contextvenster is 100.000 tokens); houd antwoorden kort. Stel max_tokens in op ongeveer 300 om de kosten te beheersen.

Op productniveau moet er een toelatingsmechanisme voor volwassenen zijn, met mogelijkheden voor rapportage en blokkade. Inhoud met minderjarigen wordt op endpoint-niveau geblokkeerd; je app moet dit soort richtingen ook actief beëindigen in het gesprek, in plaats van te vertrouwen op de endpoint als achtervang.

你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。

Kostenindicatie: Input 3.000 tokens ($0,00075), output 250 tokens ($0,00025). Per ronde ~$0,001. 1.000 ronden ~$1,00. Bij 50 ronden per dag ~$0,05. Met $0,50 testtegoed test je je prototype volledig.

Webromans en romancreatie

Webromanschrijvers gebruiken het API het meest voor het voortzetten, uitbreiden, van stijl veranderen en het oplossen van schrijfstijfheid. Voor volwassen, donkere of misdaadromans hebben schrijvers een model nodig dat personages realistisch kan schrijven, in plaats van dat het plotseling leert op het cruciale moment. Je moet voorbereiden: wereldopvatting, personageprofielen, het huidige hoofdstukplan en een samenvatting van het vorige hoofdstuk. Plaats deze in de system of de eerste user message, zodat het model niet afwijkt.

Let op de outputlimiet: max max_tokens is 32.000. Verdeel hoofdstukken in segmenten van 1.500-3.000 woorden. Update de samenvatting na elk segment voor betere kwaliteit. Bij streaming zie je de tekst live en kun je stoppen bij onvrede.

你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。

Kostenschatting:Stel dat elk verzoek 6.000 input tokens (persona, outline, samenvatting) en 4.000 output tokens (ongeveer 3.000 karakters) vereist. Input kost $0,0015, output $0,004, totaal per segment ongeveer $0,0055. 100 segmenten kost ongeveer $0,55. Een roman van een miljoen karakters (3.000 karakters per segment) vereist ongeveer 330 verzoeken voor minder dan $2.

Game-NPC's en plotgeneratie

NPC-gesprekken in games hebben twee kenmerken: veel volume en korte individuele berichten. De eis is dat de persoonlijkheid duidelijk is en dat de NPC zich houdt aan de plotinstellingen, zoals wat de NPC wel en niet weet. In volwassen, donkere of grof taalgebruik gebruikende games zal een model dat weigert de NPC uit de rol halen op cruciale momenten, wat de ervaring verstoort. De waarde van het ongecensureerde model hier is dat de stijl niet wordt onderbroken.

Zet NPC-kennis en taakstatus in de system prompt, spelerinput in user messages. Stel max_tokens in op 100-150. Gebruik function calling voor gestructureerde acties (bijv. vechten, handelen). Let op: 300 verzoeken/minuut per sleutel. Gebruik queues en backoff bij 429-fouten voor hoge concurrency.

你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。

Kostenschatting: Input 800 tokens ($0,0002), output 120 tokens ($0,00012). Per gesprek ~$0,00032. 10.000 NPC-regels ~$3,20. Ontwikkel- en testkosten voor spellen met tientallen NPCs zijn vaak slechts enkele dollars.

Contentmoderatie en red teaming: je eigen testdata genereren

Moderatieteams hebben veel 'violation' samples nodig, maar echte zijn zeldzaam en handmatig maken duurt lang. Modellen die vaak weigeren helpen niet. Genereer met deze API testcorpora voorje eigen moderatiesysteem: beledigingen, spam, fraudes, NSFW-varianten. Gebruik ze voor recall-tests en drempelinstellingen.

De aanpak voor red teaming is vergelijkbaar: construeer voor je eigen chatproduct batchgewijs verschillende veeleisende gebruikersinputs en controleer of je verdediging wordt doorbroken. Benadruk hier de grenzen: gegenereerde data is alleen voor je eigen testomgeving; gebruik het niet om echte mensen te lasteren of op te lichten. Seksuele inhoud met minderjarigen wordt ongeacht het doel niet gegenereerd; de endpoint retourneert direct 403.

Voor engineering is het aan te raden het model JSON te laten uitvoeren, met categorie- en intensiteitslabels per sample. Genereer ongeveer 20 samples per request en deduplicatie lokaal uitvoeren. Wissel tijdens het genereren van meerdere promptgroepen af om de dekking te waarborgen.

你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。

Kostenschatting: Input 500 tokens ($0,000125), output 2.000 tokens ($0,002). Per verzoek ~$0,0021. 10.000 samples vereisen 500 verzoeken, totaal ~$1,06.

Onderzoek naar gevoelige onderwerpen

Onderzoekers in de sociale wetenschappen, journalistiek, recht en openbaar beleid moeten vaak omgaan met controversiële materialen: extreem taalgebruik, misdaadzaken, historische gewelddadige gebeurtenissen en controversiële politieke en sociale kwesties. Algemene modellen weigeren of vermijden dit materiaal vaak, of geven eentonige antwoorden als 'er zijn argumenten aan beide kanten'. Onderzoeksscenario's hebben modellen nodig die eerlijk samenvatten, vergelijken en ordenen, in plaats van waardeoordelen voor de onderzoeker te doen.

Lang input, korte output: structureer een document of tekst tot een samenvatting of annotatie. Geef in de prompt de analysekaders op (dimensies, citaten, feiten vs. meningen). Het contextvenster van 100.000 tokens is groot genoeg voor lange rapporten. Resultaten zijn geen garantie; onderzoekers moeten feiten en data zelf verifiëren.

你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。

Kostenindicatie: Input 20.000 tokens ($0,005), output 1.500 tokens ($0,0015). Per document ~$0,0065. 200 documenten ~$1,30. Bij lange inputs verschuiven de kosten naar de inputzijde, maar door de lage inputprijs blijft bulk processing voordelig.

Agent-backend: voorkom dat geautomatiseerde workflows worden onderbroken door weigering

Agent-applicaties (automatisch onderzoek, data-organisatie, multi-step taakuitvoering) falen vaak als de model een stap weigert. Ze vereisen stabiliteit en function calling. We ondersteunen OpenAI-formaat tools en tool_choice. Elke framework met een aangepaste base_url kan direct aansluiten.

Belangrijke overwegingen voor Agents: 1. Beperk het aantal iteraties om een dead loop (oneindige lus) van toolaanroepen te voorkomen. 2. Valideer toolparameters; vertrouw de model output niet blind. 3. Retry op 429/503, alert op 402 (saldo leeg). 4. Gebruik één model met verschillende system prompts voor planning, uitvoering en samenvatting.

你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。

Kostenindicatie: Gemiddeld 6 rounds per taak. Input 48.000 tokens (~$0,012), output 2.400 tokens (~$0,0024). Per taak ~$0,0144. 1.000 taken ~$14,40. Agent-kosten komen vooral door de history die elke ronde wordt verstuurd. Houd toolresultaten compact om te besparen. Zie prijzen voor meer details.

Veelgestelde vragen

Moeten gezelschapsapps leeftijdverificatie doen?

Deze endpoint is alleen voor volwassen gebruikers; producten voor eindgebruikers moeten zelf leeftijdverificatie doen. Seksuele inhoud met minderjarigen wordt altijd geblokkeerd met 403, of het nu fictief is of niet.

Is het genereren van testdata voor moderatie legaal?

Gebruik voor je eigen moderatiesysteem of in je eigen omgeving is meestal een juiste engineering practice. Gebruik de gegenereerde inhoud niet voor laster, fraude of andere illegale doeleinden; het gebruik moet legaal zijn.

Zal een groot aantal NPC-gesprekken in een spel rate limits triggeren?

300 verzoeken per minuut per API-sleutel. Bij hoge concurrency is het aan te raden om aan de serverkant te wachten en veelvoorkomende gesprekken te cachen. Pas exponentiële back-off toe bij 429-fouten en split de verzoekfrequentie indien nodig.

Wat gebeurt er als de saldo niet meer toereikend is tijdens een Agent-taak?

Het verzoek retourneert 402 met foutcode no_credit, waardoor de taak wordt onderbroken. Controleer voor lange taken het saldo vooraf en vang 402 af in je code om de voortgang op te slaan en de gebruiker te vragen om op te waarderen.

Vul het formulier in om je API-sleutel te ontvangen

Maak een account aan, kopieer je API-sleutel en pas de Base URL aan. Zo eenvoudig is de configuratie.

API-sleutel ophalen