Wu Xianzhi APICas d'usage
API AI sans limites : six usages, du jeu de rôle au backend Agent
La valeur de l'API AI sans limites réside dans le fait que les contenus adultes légaux, les créations fictives et les sujets controversés ne sont plus refusés. Nous présentons six cas d'usage courants : compagnon de jeu de rôle, création de webnovels, PNJ de jeu, tests de modération, analyse de recherche et backend Agent. Pour chaque cas, nous indiquons les besoins, fournissons un exemple de prompt system et estimons le coût à $0,25 par million de tokens d'entrée et $1,00 par million de tokens de sortie. Ce produit est réservé aux utilisateurs de plus de 18 ans et à un usage légal.
Mis à jour le
Points clés
- Réservé aux adultes et aux usages légaux ; le contenu sexuel impliquant des mineurs est toujours bloqué (403), qu'il soit fictif ou non
- Les six cas d'usage dépendent de prompts system précis ; plus le personnage, le ton, la longueur et les limites sont clairs, plus les sorties sont stables
- L'estimation des coûts repose sur des nombres de tokens typiques supposés : environ $0,001 par tour de conversation, $0,0055 par segment de webnovel, $0,00032 par ligne de dialogue NPC
- Le coût réel dépend du champ usage dans la réponse ; limiter max_tokens est le moyen le plus direct de maîtriser les coûts
Prérequis : réservé aux adultes et aux usages légaux
Cet API s'adresse aux utilisateurs majeurs de 18 ans et plus et est réservé à un usage légal. Les contenus adultes légaux, la fiction et les sujets controversés ne sont pas bloqués, mais les contenus sexuels impliquant des mineurs, qu'ils soient fictifs ou non, et même en jeu de rôle, sont systématiquement bloqués avec une réponse 403 content_blocked. Si vous concevez un produit destiné aux utilisateurs finaux, vous devez mettre en place la vérification de l'âge, le signalement de contenu et la gestion des comptes dans votre application ; cette responsabilité incombe au produit, l'API ne peut pas s'en charger à votre place.
Voici les six cas d'usage courants : besoins réels, system prompt modifiable et coûts réels. Prix : $0,25 / M tokens en entrée, $1,00 / M tokens en sortie. Prépayé, sans abonnement. Les token counts sont des estimations typiques. Votre consommation réelle figure dans usage. Voir code example.
Conseil général : quel que soit le cas d'usage, le prompt system doit être précis. Le modèle sans censure ne vous refusera pas, mais il ne devinera pas vos intentions. Plus le personnage, le ton, la longueur et les limites sont clairs, plus les sorties sont stables.
Applications de type compagnon de jeu de rôle (réservées aux adultes)
C'est la catégorie qui répond le plus à la demande de « ne pas refuser ». Les utilisateurs dialoguent longtemps avec un personnage fixe ; le contenu peut inclure des descriptions émotionnelles et intimes pour adultes. Les trois points techniques clés sont : la stabilité du personnage, donc on place le persona et l'univers dans le message system pour qu'il soit présent à chaque tour ; la cohérence du contexte, ce qui nécessite de gérer soi-même l'historique et de le tronquer, car l'interface est sans état et la fenêtre de contexte est de 100 000 tokens ; des réponses courtes, car dans un chat, les messages font généralement quelques dizaines à quelques centaines de caractères. Réglez max_tokens à environ 300 pour coller au rythme de la conversation et maîtriser les coûts.
Au niveau produit, l'accès doit être réservé aux adultes, avec des mécanismes de signalement et de bannissement. Le contenu impliquant des mineurs est bloqué au niveau de l'API ; votre application doit aussi anticiper et couper ces dérivés en conversation, sans dépendre uniquement de l'API pour la sécurité.
你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。Estimation des coûts : Supposons 3 000 tokens d'entrée (personnage + historique récent) et 250 tokens de sortie par tour. Coût entrée : 3 000 × $0,25 / 1 000 000 = $0,00075. Coût sortie : 250 × $1,00 / 1 000 000 = $0,00025. Total par tour : ~$0,001. Pour 1 000 tours : ~$1,00. Pour un utilisateur faisant 50 tours par jour : ~$0,05/jour. Avec un crédit d'essai de $0,50, vous pouvez tester l'intégralité du prototype de votre produit.
Création de webnovels et de romans
Les auteurs de webnovels utilisent principalement l'API pour la suite, l'expansion, le changement de style et l'inspiration en cas de blocage. Pour les romans adultes, sombres ou policiers, les auteurs ont besoin que le modèle rende les personnages réalistes et ne change pas brusquement de ton au moment crucial. Préparez : le cadre de l'univers, les fiches personnages, le plan du chapitre actuel et le résumé du chapitre précédent. Intégrez-les dans le message system ou le premier message user pour éviter que le modèle ne dérive.
Pour l'écriture longue, attention à la limite de sortie : le maximum par appel est de max_tokens 32 000. En pratique, il est conseillé de diviser un chapitre en plusieurs appels, avec 1 500 à 3 000 tokens par segment. Mettez à jour le résumé de manière glissante après chaque segment, plutôt que de demander le chapitre entier d'un coup. Cela rend la qualité plus contrôlable et évite de tout recommencer en cas d'erreur en cours de route. Si vous activez le streaming, l'auteur peut lire au fur et à mesure et interrompre la génération à tout moment s'il n'est pas satisfait.
你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。Estimation des coûts : Supposons 6 000 tokens d'entrée (cadre, plan, résumé) et 4 000 tokens de sortie (environ 3 000 mots, ratio variable). Coût entrée : $0,0015. Coût sortie : $0,004. Total par segment : ~$0,0055. Pour 100 segments : ~$0,55. Pour un roman d'un million de mots (segments de 3 000 mots, soit ~330 requêtes) : moins de $2 au total.
PNJ de jeu et génération d'histoires
Les dialogues NPC ont deux caractéristiques : volume élevé et brièveté. Ils doivent avoir une personnalité marquée et respecter le cadre narratif (ce que le NPC sait ou ignore). Dans les jeux adultes, sombres ou avec vulgarité, un modèle qui refuse des réponses ferait sortir le NPC de son rôle au moment critique, dégradant l'expérience. La valeur du modèle sans limites ici est de préserver la cohérence du style sans interruption.
Pour l'implémentation, il est conseillé de placer « l'étendue des connaissances de ce PNJ » et « l'état actuel de la mission » dans le prompt system, et les messages du joueur dans le message user. Réglez max_tokens à 100 ou 150. Si le jeu nécessite de déclencher des événements (ouvrir une porte, effectuer un échange, combattre), utilisez l'appel de fonctions pour que le modèle renvoie une action structurée plutôt que de l'analyser dans le texte. Le processus complet des appels de fonctions est détaillé dans la page des exemples de code. Notez que chaque clé API est limitée à 300 requêtes par minute. Pour les jeux multijoueurs à fort trafic, ajoutez une file d'attente et un cache côté serveur, et implémentez une politique de backoff sur les erreurs 429.
你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。Estimation des coûts : Supposons 800 tokens d'entrée et 120 tokens de sortie par dialogue. Coût entrée : $0,0002. Coût sortie : $0,00012. Total par échange : ~$0,00032. Pour 10 000 lignes de dialogue : ~$3,20. Pour un jeu avec plusieurs dizaines de PNJ, les coûts de développement et de test restent de l'ordre de quelques dollars.
Modération et tests red team : générez vos propres données de test
Les équipes en charge de la modération de contenu font face à un problème incontournable : pour tester un modèle ou des règles de modération, il faut beaucoup d'échantillons « non conformes », mais les échantillons réels sont difficiles à obtenir et leur rédaction manuelle est trop lente. Les modèles qui refusent de répondre ne peuvent pas aider, car ils refusent même de générer des échantillons de test. Avec cette API, vous pouvez générer en masse par catégorie des corpus de test pour votre système de modération, par exemple des variantes d'insultes, de spam, d'arnaques ou d'expressions suggestives, afin d'évaluer le taux de rappel, d'ajuster les seuils et de réaliser des tests de régression.
L'approche red team est similaire : générez des entrées utilisateur difficiles pour vérifier si vos défenses sont franchissables. Limite importante : les données générées servent uniquement à votre environnement de test. Ne les utilisez pas pour harceler ou tromper des personnes réelles. Le contenu sexuel impliquant des mineurs n'est jamais généré, quel que soit l'usage ; l'API renvoie directement un 403.
Conseil d'ingénierie : demandez au modèle de sortir du JSON avec des étiquettes de catégorie et d'intensité. Générez environ 20 échantillons par requête et dédupliquez-les localement. Variez les prompts pour assurer une bonne couverture.
你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。Estimation des coûts : Supposons 500 tokens d'entrée et 2 000 tokens de sortie (20 échantillons). Coût entrée : $0,000125. Coût sortie : $0,002. Total par requête : ~$0,0021. Pour 10 000 échantillons (500 requêtes) : ~$1,06 au total.
Analyse de sujets sensibles pour la recherche
Recherche (sciences, droit, politique) : le modèle doit analyser des sujets controversés sans refus systématique ni réponse générique. Il doit comparer et synthétiser objectivement.
Ces tâches ont des entrées longues et des sorties courtes : insérez un document ou un lot de textes pour obtenir un résumé ou des annotations structurés. Précisez le cadre d'analyse (dimensions à extraire, citations nécessaires, distinction faits/opinions). La fenêtre de contexte de 100 000 tokens permet d'ingérer de longs rapports. L'analyse n'est pas une caution : le chercheur doit vérifier les résultats, surtout pour les faits et les données.
你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。Estimation des coûts : Supposons 20 000 tokens d'entrée et 1 500 tokens de sortie par document. Coût entrée : $0,005. Coût sortie : $0,0015. Total par document : ~$0,0065. Pour 200 documents : ~$1,30. Plus l'entrée est longue, plus le coût se concentre sur l'entrée, mais le prix unitaire faible rend le traitement par lots rentable.
Backend Agent : fluidifiez les workflows automatisés sans interruption
Agents : la stabilité est cruciale. Supporte les formats OpenAI tools et tool_choice. Compatible avec les frameworks supportant un base_url personnalisé.
Voici quelques points à considérer lors de la conception d’un agent. Premièrement, limitez le nombre de tours et définissez un nombre maximum d’étapes pour éviter que le modèle ne tombe dans une boucle infinie d’appels d’outils. Deuxièmement, validez les paramètres des outils à chaque étape et ne faites pas confiance aveuglément à la sortie du modèle. Troisièmement, implémentez une logique de réessai pour les erreurs 429 et 503, et configurez une alerte pour les erreurs 402, car l’épuisement du solde en cours de tâche longue entraînera son échec. Quatrièmement, il n’y a qu’un seul modèle qui assure la planification, l’exécution et la synthèse ; il suffit d’utiliser des prompts système différents pour distinguer les rôles.
你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。Estimation des coûts : Supposons 6 tours par tâche, 8 000 tokens d'entrée (historique + résultats d'outils) et 400 tokens de sortie par tour. Total entrée : 48 000 tokens (~$0,012). Total sortie : 2 400 tokens (~$0,0024). Coût par tâche : ~$0,0144. Pour 1 000 tâches : ~$14,40. Le coût principal vient de l'historique répété à chaque tour. Simplifiez les résultats des outils avant de les réinjecter dans le contexte pour réduire les coûts. Voir la page tarifs pour plus de détails.
Questions fréquentes
Les applications de type compagnon doivent-elles vérifier l'âge ?
Cet endpoint est réservé aux adultes ; les produits destinés aux utilisateurs finaux doivent gérer eux-mêmes la vérification de l'âge. Le contenu sexuel impliquant des mineurs est toujours bloqué (403), qu'il soit fictif ou non.
La génération de données de test pour les modérations est-elle légale ?
L'utiliser pour évaluer votre propre système de modération ou l'utiliser dans votre propre environnement est généralement une pratique d'ingénierie acceptable. Veillez à ne pas utiliser le contenu généré pour le harcèlement, la fraude ou d'autres usages illicites ; l'utilisation doit être légale.
Le grand nombre de dialogues de PNJ dans un jeu déclenchera-t-il une limite de débit ?
300 requêtes/min/clé. En forte concurrence, mettez en file d'attente et mettez en cache les réponses fréquentes. Appliquez un backoff exponentiel sur les 429 et découpez les requêtes si nécessaire.
Que se passe-t-il si le solde n'est plus suffisant au milieu d'une tâche Agent ?
La requête renvoie un code 402 avec l'erreur no_credit, et la tâche est interrompue. Pour les tâches longues, il est conseillé de vérifier le solde avant le début et de capturer l'erreur 402 dans le code pour sauvegarder la progression et inviter l'utilisateur à recharger son crédit.
Il suffit de remplir le formulaire pour obtenir votre clé API
Créez un compte, copiez votre clé API et modifiez la Base URL. La configuration est aussi simple que cela.
Obtenir votre clé API