Wu Xianzhi APICenários de uso
API de IA ilimitada: 6 usos, de RP a backend de Agentes
O valor da API está em não ter rejeição para conteúdo adulto legal, ficção e temas controversos. Abordamos seis cenários: RP/companhia, criação de web novels, NPCs de jogos, testes de moderação, pesquisa e backend de Agentes. Cada um inclui requisitos, exemplo de system prompt e custo estimado ($0,25/1M input, $1,00/1M output). Apenas para maiores de 18 anos e uso legal.
Atualizado em
Pontos principais
- Apenas para adultos e uso legal; conteúdo sexual envolvendo menores é sempre bloqueado (403), seja fictício ou não
- Todos os seis cenários dependem de system prompts específicos; quanto mais claras a persona, tom, comprimento e limites, mais estável é a saída
- Estimativa baseada em tokens típicos: chat de companhia ~$0,001/rodada, web novel ~$0,0055/parágrafo, NPC de jogo ~$0,00032/frase
- O custo real está no campo usage da resposta; limitar max_tokens é a forma mais direta de controlar custos
Requisito: apenas para adultos e uso legal
Esta API destina-se a usuários adultos com 18 anos ou mais e também é usada apenas para fins legais. Conteúdo adulto legal, ficção e tópicos controversos não serão bloqueados, mas conteúdo sexual envolvendo menores será sempre bloqueado e retornará 403 content_blocked. Se você cria um produto voltado para o usuário final, é necessário implementar a verificação de idade, a notificação de conteúdo e o gerenciamento de contas no seu próprio aplicativo; essa responsabilidade é do produto, e a API não a realiza por você.
Abaixo, detalhamos seis cenários comuns, indicando o que cada um realmente precisa, um prompt de sistema pronto para adaptação e o custo calculado com base nos preços. O preço é de $0,25 por milhão de tokens de entrada e $1,00 por milhão de tokens de saída, com crédito pré-pago e sem mensalidade. Todos os valores de tokens são valores típicos que assumi para a estimativa. Seu consumo real deve ser verificado no campo usage da resposta; as estimativas servem apenas para avaliar a ordem de grandeza. Veja o exemplo de código em código de exemplo.
Dica geral: escreva system prompts específicos. O modelo sem censura não rejeita, mas não adivinha; quanto mais claras a persona, tom, comprimento e limites, mais estável é a saída.
Aplicações de RP e companhia (apenas adultos)
Este é o cenário mais crítico para "não rejeição". Usuários conversam longamente com uma persona fixa, podendo haver conteúdo adulto. Tecnicamente: 1) Persona estável: inclua persona e lore no system prompt a cada rodada. 2) Contexto contínuo: gerencie e corte o histórico, pois o endpoint é stateless e a janela de contexto é de 100.000 tokens. 3) Respostas curtas: defina max_tokens em ~300 para alinhar ao ritmo de chat e controlar custos.
No produto, exija verificação de idade e tenha mecanismos de denúncia e banimento. O endpoint bloqueia conteúdo envolvendo menores; seu app deve interromper conversas nesse rumo, não depender apenas do endpoint.
你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。Estimativa de custo: Supondo 3.000 tokens de entrada por rodada (personagem mais histórico recente) e 250 tokens de saída. Entrada: 3.000 × $0,25 / milhão = $0,00075; Saída: 250 × $1,00 / milhão = $0,00025. Uma rodada custa cerca de $0,001. Mil rodadas custam cerca de $1,00. Se um usuário conversar 50 vezes por dia, o custo diário é de aproximadamente $0,05. Nessa ordem de grandeza, você pode testar completamente o protótipo do seu produto com $0,50 de crédito de teste grátis.
Criação de web novels e ficção
Autores usam para continuar, expandir, mudar estilo e inspiração. Prepare o mundo, personagens e resumos. Insira-os no system ou primeiro prompt para manter a coerência e evitar desvios na narrativa.
Atenção ao limite de saída na escrita longa: o máximo por chamada é max_tokens 32.000, mas recomenda-se dividir o capítulo em várias chamadas, com 1.500 a 3.000 caracteres por trecho. Atualize o resumo de forma acumulativa em vez de solicitar o capítulo inteiro de uma vez. Isso torna a qualidade mais controlável e evita ter que refazer tudo se houver um erro no meio. Se você ativar o streaming, o autor pode acompanhar a geração e interromper a qualquer momento se não gostar.
你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。Estimativa de custo: Supondo 6.000 tokens de entrada por chamada (configuração, esboço e resumo do texto anterior) e 4.000 tokens de saída (aproximadamente 3.000 caracteres; a proporção entre caracteres e tokens varia conforme o texto, aqui estimamos grosseiramente que cada caractere exija um pouco mais de 1 token). Entrada: $0,0015; Saída: $0,004. Um trecho custa cerca de $0,0055. Escrever 100 trechos custa cerca de $0,55. Um romance de um milhão de caracteres, com trechos de 3.000 caracteres, requer mais de 330 chamadas, totalizando menos de $2.
NPCs de jogos e geração de roteiro
NPCs têm duas características: volume alto e frases curtas. Exigem personalidade forte e respeito ao lore. Modelos que rejeitam podem quebrar a imersão em momentos críticos. O modelo sem censura mantém o estilo sem interrupções.
Implementação: inclua "alcance de conhecimento do NPC" e "estado atual da missão" no system prompt. Coloque a fala do jogador no user. Defina max_tokens entre 100 e 150. Para eventos (abrir porta, negociar, lutar), use function calling para retornar ações estruturadas. Veja o fluxo completo em exemplos de código. Limite: 300 requisições/minuto por chave. Use filas e cache no servidor para jogos multiplayer e faça backoff para 429.
你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。Estimativa de custo: Entrada 800 tokens ($0,0002), saída 120 tokens ($0,00012). Total ~$0,00032 por turno. 10.000 linhas de NPC custam ~$3,20. Desenvolvimento barato.
Moderação e testes de red team: gere seus próprios dados
Equipes de moderação de conteúdo enfrentam um problema inevitável: para testar modelos ou regras de moderação, são necessários muitos exemplos de "violação", mas os exemplos reais são difíceis de obter e a criação manual é lenta. Modelos que bloqueiam respostas não ajudam, pois eles próprios recusam gerar os exemplos de teste. Com esta API, você pode gerar em lote, por categoria, o corpus de teste para o seu próprio sistema de moderação, incluindo variações de xingamentos, spam, golpes e expressões sugestivas, para avaliar a taxa de recuperação, ajustar limiares e realizar testes de regressão.
Red teaming: gere entradas difíceis para testar as defesas do seu produto. Limite: use apenas no seu ambiente de teste, não para assédio ou fraude. Conteúdo sexual envolvendo menores não é gerado (retorna 403).
Engenharia: peça saída em JSON com tags de categoria e intensidade. Gere ~20 amostras por requisição e remova duplicatas localmente. Varie os prompts para garantir cobertura.
你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。Estimativa de custo: Entrada 500 tokens ($0,000125), saída 2.000 tokens ($0,002). Total ~$0,0021 por pedido. 10.000 amostras custam ~$1,06.
Análise de tópicos sensíveis para pesquisa
Pesquisadores de ciências sociais, jornalismo, direito e políticas públicas lidam com materiais controversos: extremismos, crimes, violência histórica, debates políticos. Modelos gerais tendem a rejeitar ou dar respostas genéricas. A pesquisa exige que o modelo resuma, compare e organize fatos sem impor juízo de valor.
Característica: input longo, output curto. Insira documentos/textos e peça resumo ou anotações estruturadas. Especifique no prompt: dimensões de análise, citações, distinção entre fato e opinião. A janela de contexto de 100.000 tokens comporta relatórios longos. O output não é endosso; o pesquisador deve verificar fatos e dados.
你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。Estimativa de custo: Entrada 20.000 tokens ($0,005), saída 1.500 tokens ($0,0015). Total ~$0,0065 por documento. Analisar 200 docs custa ~$1,30.
Backend de Agentes: evite interrupções por rejeição
Apps Agent precisam de estabilidade. Suporta OpenAI tools e tool_choice. Qualquer framework Agent com base_url customizável pode se conectar diretamente.
Dicas de design: 1) Limite iterações para evitar loops infinitos de ferramentas. 2) Valide parâmetros de ferramentas, não confie cegamente na saída. 3) Retente para 429/503; alerte para 402 (saldo esgotado interrompe tarefas longas). 4) Use um único modelo para planejamento, execução e resumo, diferenciando papéis via system prompt.
你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。Estimativa de custo: Supondo uma tarefa com média de 6 rodadas, com 8.000 tokens de entrada por rodada (histórico mais resultados de ferramentas) e 400 tokens de saída. Entrada total: 48.000 tokens, cerca de $0,012; Saída total: 2.400 tokens, cerca de $0,0024. Uma tarefa custa cerca de $0,0144. Mil tarefas custam cerca de $14,40. O custo principal de um Agente vem do envio repetido do histórico em cada rodada. A maneira mais direta de economizar é simplificar os resultados das ferramentas antes de incluí-los na janela de contexto. Para mais detalhes de preços, consulte a página de preços.
Perguntas frequentes
Aplicações de companhia exigem verificação de idade?
Este endpoint é apenas para usuários adultos; produtos finais devem fazer a verificação. Conteúdo sexual envolvendo menores é sempre bloqueado (403), seja fictício ou não.
A geração de dados de teste para moderação é legal?
Usar para avaliar seu próprio sistema de moderação ou usar no seu próprio ambiente é uma prática de engenharia geralmente adequada. Não use o conteúdo gerado para assédio, fraude ou outros fins ilegais; o uso deve ser legal.
Muitos diálogos de NPCs no jogo vão acionar o limite de requisições?
Cada chave de API permite 300 requisições por minuto. Quando a concorrência for alta, recomendamos fazer fila e armazenar em cache diálogos comuns no lado do servidor, aplicar backoff exponencial ao receber 429 e, se necessário, desacelerar o ritmo das requisições.
O que acontece se o saldo acabar no meio de uma tarefa de Agent?
A requisição retorna 402 com o código de erro no_credit e a tarefa é interrompida. Para tarefas longas, recomendamos verificar o saldo antes de iniciar, capturar o 402 no código para salvar o progresso e notificar o usuário para recarregar.
Basta preencher o formulário para obter a chave de API
Crie uma conta, copie a chave de API e altere o Base URL. A configuração é simples assim.
Obter chave de API