Wu Xianzhi APICasos de uso
API de IA sin límites: seis usos, desde roleplay hasta backend de Agentes
El valor de la API de IA sin restricciones está en que el contenido adulto legal, la creación de ficción y los temas controvertidos ya no son rechazados por el modelo. Este artículo se centra en seis escenarios comunes: compañía de roleplay, creación de novelas web, NPCs de juegos, pruebas de moderación de contenido, análisis de investigación y backend de Agent. Para cada uno se explica qué se necesita, se proporciona un ejemplo de prompt de sistema y se estima el costo a $0.25 por millón de tokens de entrada y $1.00 por salida. Este producto está dirigido exclusivamente a usuarios adultos mayores de 18 años y solo para uso legal.
Actualizado el
Puntos clave
- Solo para usuarios adultos y uso legal; el contenido sexual que involucre a menores se bloquea siempre y devuelve 403, sea ficticio o no
- Los seis escenarios dependen de system prompts específicos; cuanto más claros sean el personaje, el tono, la longitud y las zonas prohibidas, más estable será la salida
- La estimación de costos se basa en cantidades típicas de tokens asumidas: ~$0.001 por ronda de compañía, ~$0.0055 por segmento de novela, ~$0.00032 por línea de NPC
- El costo real depende del usage en la respuesta; limitar max_tokens es la forma más directa de controlar gastos
Primero: solo para usuarios adultos y uso legal
Esta API está dirigida a usuarios adultos mayores de 18 años y solo para uso legal. El contenido adulto legal, la creación de ficción y los temas controvertidos no serán rechazados, pero el contenido sexual que involucre a menores se interceptará y devolverá 403 content_blocked, sea ficticio o de roleplay. Si creas un producto para usuarios finales, debes gestionar la verificación de edad, las denuncias de contenido y la gestión de cuentas en tu propia aplicación; esa responsabilidad es tuya y el endpoint no lo hace por ti.
A continuación se presentan seis casos de uso comunes, detallando qué necesita cada uno, un prompt de sistema listo para adaptar y el costo calculado con los precios. El precio es de $0.25 por millón de tokens de entrada y $1.00 por salida, con crédito prepago y sin cuotas mensuales. Todas las cantidades de token son valores típicos asumidos para la estimación; tu consumo real se indica en el campo usage de la respuesta. La estimación sirve solo para evaluar el orden de magnitud. Para la sintaxis de llamada, consulta ejemplos de código.
Otro consejo general: en cualquier escenario, el system prompt debe ser específico. El modelo sin censura no te rechazará, pero tampoco adivinará lo que quieres; cuanto más claros sean el personaje, el tono, la longitud y las zonas prohibidas, más estable será la salida.
Aplicaciones de roleplay y compañía (solo adultos)
Este es el caso más concentrado en la necesidad de «no rechazo». Un usuario conversa largo tiempo con un personaje fijo, posiblemente con contenido adulto e íntimo. Lo técnico más importante: 1) Estabilidad del personaje: pon el personaje y el mundo en el mensaje system y envíalo en cada ronda. 2) Coherencia del contexto: mantén y recorta el historial tú mismo; el endpoint es sin estado y la ventana de contexto es de 100,000 tokens. 3) Respuestas cortas: en chat, limita max_tokens a ~300 para ajustar el ritmo y controlar costos.
A nivel de producto, exige acceso para adultos y conserva mecanismos de denuncia y bloqueo. El contenido que involucre a menores se bloquea en el endpoint; tu aplicación debe terminar esa dirección en la conversación, no depender del endpoint como red de seguridad.
你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。Estimación de costos: Asumimos 3,000 tokens de entrada (personaje + historial reciente) y 250 de salida. Entrada: 3,000 × $0.25 / 1M = $0.00075. Salida: 250 × $1.00 / 1M = $0.00025. Total por ronda: ~$0.001. 1,000 rondas ≈ $1.00. Si un usuario chatea 50 rondas/día, el costo diario es ~$0.05. Con $0.50 de crédito de prueba puedes probar el prototipo completo.
Creación de novelas y literatura web
Los autores de novelas web suelen usar la API para continuar, expandir, cambiar el estilo y obtener inspiración cuando se quedan atascados. Para novelas de temática adulta, oscura o de crimen, los escritores necesitan que el modelo represente a los personajes de forma realista, sin que cambie abruptamente a un tono moralista en los momentos clave. Debes preparar: la configuración del mundo, las fichas de personajes, el resumen del capítulo actual y el resumen del capítulo anterior. Introdúcelos en el prompt de sistema o en el primer mensaje de usuario para evitar que el modelo se desvíe.
En la escritura extensa, ten cuidado con el límite de salida: el máximo max_tokens por vez es 32,000, pero se recomienda dividir un capítulo en varias peticiones de 1,500 a 3,000 palabras, actualizando el resumen de forma continua (rolling update) y no pidiendo el capítulo entero de una vez. Esto hace la calidad más controlable y evita tener que rehacer todo si hay un error. Con streaming, el autor puede ver mientras se genera e interrumpir si no le gusta.
你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。Estimación de costos: Asumimos 6,000 tokens de entrada (configuración, esquema y resumen) y 4,000 de salida (~3,000 palabras, estimación gruesa de >1 token/palabra). Entrada $0.0015, salida $0.004. Por segmento: ~$0.0055. 100 segmentos ≈ $0.55. Una novela de un millón de palabras (~330 segmentos de 3,000 palabras) cuesta menos de $2 en total.
NPCs de juegos y generación de tramas
Las conversaciones de NPCs en juegos tienen dos características: gran volumen y mensajes muy cortos. Se requiere un carácter definido y la capacidad de respetar la configuración de la trama (qué sabe y qué no sabe el NPC). En juegos de temática adulta, oscuros o con lenguaje soez, si se usa un modelo que rechaza contenido, el NPC saldrá del personaje en momentos clave, lo que arruina la experiencia. El valor de un modelo sin censura aquí es que el estilo no se interrumpe.
En la implementación, se recomienda incluir el "rango de conocimiento de este NPC" y el "estado actual de la tarea" en el prompt system, y poner los mensajes del jugador en user. Limita max_tokens a 100-150. Si el juego necesita eventos como abrir puertas, comerciar o luchar, usa llamadas a funciones para que el modelo devuelva acciones estructuradas en lugar de analizar texto. El flujo completo está en la página de ejemplos de código. Ten en cuenta que cada clave tiene un límite de 300 peticiones por minuto; para juegos multijugador con alta concurrencia, añade colas y caché en el servidor y maneja el 429 con retroceso.
你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。Estimación de costos: Asumimos 800 tokens de entrada y 120 de salida por diálogo. Entrada $0.0002, salida $0.00012. Por interacción: ~$0.00032. 10,000 líneas de NPC ≈ $3.20. Para un juego con decenas de NPCs, el coste de desarrollo y pruebas suele ser del orden de unos pocos dólares.
Moderación y pruebas de red team: genera tus propios datos de prueba
Los equipos de moderación de contenido enfrentan un problema inevitable: para probar modelos o reglas de moderación, necesitan grandes cantidades de muestras «no conformes», pero las muestras reales son difíciles de obtener y crearlas manualmente es muy lento. Los modelos que se niegan a responder no ayudan, porque se niegan incluso a generar muestras de prueba. Con esta API, puedes generar en lote corpus de prueba para tu propio sistema de moderación por categoría, como variaciones de insultos, spam, estafas y contenido sugerente, para evaluar la tasa de recuperación, ajustar umbrales y realizar pruebas de regresión.
El enfoque de red teaming es similar: para tu producto de chat, genera en lote entradas de usuario difíciles para verificar si tus defensas pueden ser superadas. Hay que destacar un límite: los datos generados solo se usan en tu entorno de prueba, no los uses para molestar o defraudar a personas reales; el contenido sexual que involucre a menores no se generará bajo ningún concepto, y la API devolverá 403.
Desde el punto de vista de ingeniería, se recomienda que el modelo genere JSON, con cada muestra acompañada de etiquetas de categoría e intensidad. Genera unas 20 muestras por petición y luego dedúcalas localmente. Para garantizar la cobertura, prueba con varios prompts diferentes durante la generación.
你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。Estimación de costos: Suponiendo 500 tokens de entrada y 2,000 de salida por petición (20 muestras). Entrada $0.000125, salida $0.002, total por petición ~$0.0021. Generar 10,000 muestras requiere 500 peticiones, total ~$1.06.
Análisis de temas sensibles para investigación
Investigadores de ciencias sociales, periodismo, derecho y políticas públicas a menudo manejan materiales controvertidos: discursos extremos, crímenes, violencia histórica, temas políticos y sociales polémicos. Los modelos generales suelen rechazar, evadir o dar respuestas genéricas del tipo «ambos bandos tienen razón». En investigación se necesita que el modelo resuma, compare y organice datos de forma veraz, sin imponer juicios de valor al investigador.
Estas tareas se caracterizan por entradas largas y salidas cortas: ingresa un documento o lote de textos y obtén un resumen o anotación estructurada. Especifica en el prompt el marco de análisis (qué dimensiones extraer, si citar fragmentos, distinguir hechos de opiniones). La ventana de contexto de 100,000 tokens permite cargar informes muy largos. Recuerda: analizar no es respaldar; el investigador debe verificar los resultados, especialmente en hechos y datos.
你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。Estimación de costos: Asumimos 20,000 tokens de entrada y 1,500 de salida por documento. Entrada $0.005, salida $0.0015. Por documento: ~$0.0065. Analizar 200 documentos ≈ $1.30. A mayor entrada, el costo se inclina hacia la entrada, pero el precio unitario es bajo, por lo que el procesamiento por lotes sigue siendo rentable.
Backend de Agent: evita que los flujos de automatización se interrumpan por rechazos
Las aplicaciones de Agent, como investigación automatizada, organización de datos y ejecución de tareas en múltiples pasos, temen que el flujo llegue al quinto paso y el modelo rechace, interrumpiendo toda la cadena. Estas aplicaciones necesitan estabilidad, predictibilidad y soporte para llamadas a funciones. Aquí se soportan tools y tool_choice en formato OpenAI, por lo que los frameworks de Agent principales que admiten base_url personalizada pueden conectarse directamente.
Al diseñar un Agente, ten en cuenta lo siguiente: primero, limita el número de iteraciones y establece un número máximo de pasos para evitar bucles infinitos de llamadas a herramientas. Segundo, valida los parámetros de las herramientas en cada paso; no confíes ciegamente en la salida del modelo. Tercero, implementa reintentos para 429 y 503, y alertas para 402, ya que el agotamiento del saldo durante una tarea larga la hará fallar. Cuarto, si solo hay un modelo, la planificación, la ejecución y el resumen los realiza el mismo modelo; solo necesitas diferenciar los roles con diferentes prompts de sistema.
你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。Estimación de costos: Suponiendo una tarea promedio de 6 rondas, con 8,000 tokens de entrada (historial procesado con resultados de herramientas) y 400 de salida por ronda. Entrada total 48,000 tokens (~$0.012); salida total 2,400 tokens (~$0.0024); una tarea cuesta ~$0.0144. Mil tareas cuestan ~$14.40. El costo de Agent proviene principalmente del historial reenviado en cada ronda; simplificar los resultados de herramientas antes de volver a insertarlos en la ventana de contexto es la forma más directa de ahorrar. Para más detalles de precios, consulta la página de precios.
Preguntas frecuentes
¿Deben las aplicaciones de compañía verificar la edad?
Este endpoint solo está dirigido a usuarios adultos; los productos finales deben realizar su propia verificación de edad. El contenido sexual que involucre a menores siempre se bloquea, devolviendo 403, sea ficticio o no.
¿Es legal generar datos de prueba para auditoría?
Usar los datos generados para evaluar tu propio sistema de auditoría o para uso interno es una práctica de ingeniería habitual. No uses el contenido generado para acoso, fraude u otros fines ilegales; el uso debe ser legal.
¿Se activará el límite de peticiones con muchos diálogos de NPCs en un juego?
300 peticiones por minuto por clave. Cuando la concurrencia sea alta, se recomienda hacer cola y cachear los diálogos más frecuentes en el servidor, aplicar retroceso exponencial al recibir 429 y, si es necesario, distribuir el ritmo de las peticiones.
¿Qué ocurre si se agota el saldo a mitad de una tarea de Agent?
La petición devuelve 402 con el código de error no_credit y la tarea se interrumpe. Para tareas largas, se recomienda verificar el saldo antes de iniciar y capturar el 402 en el código para guardar el progreso y notificar al usuario que recargue.
Solo necesitas completar el formulario para obtener la clave de API
Crea una cuenta, copia la clave de API y modifica la Base URL. La configuración es así de sencilla.
Obtener clave de API