Grok API 无审查:如何使用 Grok SDK 调用无审查模型
Grok API 的无审查方法允许开发者将标准的 OpenAI 兼容客户端替换为调用无过滤大型语言模型,从而避免主要提供商常见的内容拒绝。通过使用标准的 REST API 使用单一专用的无审查模型,你可以直接控制响应行为,而无需处理模型路由或供应商特定 SDK 的复杂性。
更新于
要点
- 我们的 API 使用标准的 OpenAI chat-completions 格式,而非 Grok 专用协议,确保广泛的客户端兼容性。
- 该模型对合法的成人和争议性话题无审查,仅对涉及未成年人的性内容有硬性限制。
- 定价透明:输入 token 每 100 万 0.25 美元,输出 token 每 100 万 1.00 美元,仅支持加密货币充值。
- 无订阅或月费;你只需为实际的 token 使用付费,预付额度永不过期。
什么是 Grok API 无审查?
当开发者讨论 grok api uncensored 概念时,他们通常希望找到一种绕过标准商业模型对合法但敏感主题应用内容过滤的方法。在此语境下,“无审查”意味着底层大型语言模型经过调整,可以在不拒绝争议性、成人或创意提示词的情况下进行回答,只要它们不违法。这不仅仅是移除几个关键词;它涉及针对原始输出生成优化的模型架构和训练数据。
我们的服务正是如此:一个托管的 LLM,不会拒绝合法的成人、虚构或安全研究主题。它不是多个厂商的外壳。它是一个在自有服务器上运行的开放权重模型。与标准商业 API 的主要区别在于,它不会对边缘案例提示词进行礼貌的拒绝。然而,有一个始终适用的硬性内容限制:涉及未成年人的性内容将被严格拒绝。这确保了 API 可用于通用开发,同时为特定用例提供开发者所需的原始行为。
为什么在 Grok SDK 中使用无审查模型?
开发者通常使用标准 SDK 集成大型语言模型,因为它们可靠、文档齐全且得到广泛支持。使用无审查模型配合这些标准工具,允许你在保留现有基础设施的同时仅改变模型行为。主要优势在于一致性:你无需重写应用程序逻辑来处理不同的响应格式或错误代码。
通过使用标准的 OpenAI 兼容接口,你可以将此无审查模型插入任何期望 chat-completions 响应的客户端。这对于 A/B 测试特别有用,你可以在同一代码库中比较过滤与未过滤的输出。你不受限于单一厂商的生态系统。如果你正在构建聊天机器人、内容生成器或研究工具,无审查模型通过移除为避免触发器而专门措辞提示词的需求,降低了提示词工程的摩擦。该模型旨在直接回答,使其成为对语气和拒绝率至关重要的用户体验应用的理想选择。
与 Grok 兼容客户端的兼容性
常见的混淆点在于“Grok 兼容”与“OpenAI 兼容”之间的区别。我们的 API 是 OpenAI 兼容的。这意味着它遵循与 OpenAI Chat API 相同的 REST 结构、JSON 请求正文和响应格式。大多数现代 LLM SDK(包括用于 Grok 或其他提供商的 SDK)都是基于此 OpenAI 标准构建的。因此,你只需更改基础 URL 和 API 密钥,即可使用完全相同的 Python 或 Node.js 客户端调用我们的无审查 API。
这种方法避免了可能需要引入不必要复杂性的供应商特定 SDK。您不需要特殊的 "Grok SDK" 来使用我们的模型。任何可以连接到 OpenAI 接口的客户端都可以连接到我们的接口。这包括用于 Python 的流行库 openai 或 @anthropic-ai/sdk(当配置为 OpenAI 接口时)以及各种 Node.js 包装器。我们服务的基础 URL 为 https://api.uncensoredchat.cc/v1。您在请求中传递模型 ID uncensored。这种标准化确保您的代码具有可移植性且面向未来,无论您选择哪个提供商来托管您的模型。
无审查响应的配置
为了获得无审查模型的最佳效果,你应该配置请求以鼓励直接且富有创意的输出。temperature、top_p 和 stop 等标准参数的工作方式与 OpenAI API 完全相同。较高的 temperature 值(例如 0.7–1.0)会增加响应的随机性和创造性,这通常是无审查用例所期望的,因为你希望获得新颖或不可预测的答案。
你还可以使用 frequency_penalty 和 presence_penalty 来减少重复并鼓励模型在单个响应中探索不同的主题。函数调用(工具)和 JSON 模式(response_format: json_object)完全受支持。这意味着你可以像使用任何其他模型一样,使用无审查模型进行结构化数据提取或工具执行。该模型不会因内容过滤器而拒绝输出 JSON 或执行工具,从而实现强大的管道集成。你可以设置 seed 以获得可重现的结果,这对于调试和测试集成非常有用。这些标准参数让你可以对模型行为进行细粒度控制,而无需专有设置。
Token 限制与上下文窗口
理解 token 限制对于管理成本和性能至关重要。我们的无审查模型支持 100,000 token 的上下文窗口,包括提示词和补全。这比许多标准模型大得多,允许你在单个请求中处理长文档或维护广泛的对话历史。
每次请求的最大输出为 32,000 个 token。如果你未指定 max_tokens 参数,模型将默认使用 2,048 个 token。此限制针对整个请求,因此你需要考虑输入提示词的大小。例如,如果你发送一个 10,000 token 的提示词,你可以获得最多 54,000 token 的输出,但不超过 32,000 的硬性限制。这种灵活性非常适合总结长文本、生成代码或撰写详细文章等任务。token 计数是透明的,你可以通过 API 响应头或流式输出监控使用情况,确保在预算范围内并避免意外截断。
使用 Grok SDK 进行流式数据传输
流式传输对于构建响应式用户界面至关重要,尤其是在处理大型响应时。我们的 API 支持服务器发送事件(SSE)进行流式传输。启用流式传输后,模型会按生成顺序返回 token,允许你实时显示输出。这对于延迟至关重要的聊天应用特别有用。
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredchat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)流式传输时,响应的最后一个块包含请求的总 token 使用情况。这允许你跟踪成本和监控使用情况,而无需进行单独的 API 调用。流式传输格式与 OpenAI 流式传输格式完全相同,因此任何处理 OpenAI 流式传输的 SDK 都可以与我们的无审查 API 配合使用。你只需更新基础 URL 即可轻松将其集成到现有的流式逻辑中。这确保无论使用过滤还是无审查模型,你的用户体验都保持流畅和一致。
与 Grok 相比的成本效益
LLM API 的定价因提供商和模型大小而异。我们的无审查 API 提供透明的预付额度模式,无月费。成本为每 100 万输入 token 0.25 美元,每 100 万输出 token 1.00 美元。此定价简单明了,适用于所有请求,包括流式传输和非流式传输。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredchat.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);与一些根据模型层级或速度收费的提供商不同,我们根据实际的 token 使用量收费。错误和拒绝是免费的,因此你只需为模型生成的内容付费。预付额度永不过期,你可以使用加密货币充值。这种模式对于具有可变使用模式的开发者来说通常更具成本效益。你无需预测每月的用量或为闲置容量付费。没有订阅费意味着你可以从小规模开始并根据需要扩展,这对于希望精确控制成本的个人开发者和初创公司来说非常理想。
开始使用 Uncensored Chat
开始使用我们的无审查 API 非常简单。你可以使用 Google 账户注册,或通过提供电子邮件和密码注册。不需要电话号码。创建账户后,你将立即获得 API 密钥。此密钥用于对 API 请求进行身份验证。
curl https://api.uncensoredchat.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'你可以通过将 SDK 指向我们的基础 URL 开始发出请求:https://api.uncensoredchat.cc/v1。在请求中使用模型 ID uncensored。你可以使用 USDT (TRC20) 或 USDC (Base) 充值,金额为 10 至 500 美元之间。新账户将获得 0.50 美元的试用额度,有效期为 7 天,无需信用卡。这允许你在承诺更大的充值之前彻底测试 API。API 支持每分钟 300 次请求和每个密钥 8 次并发请求,这足以满足大多数开发和生产工作负载。
问答
无审查模型与 Grok 相同吗?
不,我们的模型是在自有服务器上运行的开放权重模型,与 Grok、GPT 或其他厂商的模型不同。它兼容 Grok SDK 格式(即 OpenAI 兼容格式),但本身并非 Grok 模型。
我可以使用官方的 Grok Python SDK 吗?
可以,前提是 SDK 兼容 OpenAI。你可以使用标准的 OpenAI Python SDK 或任何支持 OpenAI 接口格式的外壳。只需将基础 URL 改为我们的地址,并将模型 ID 设置为 "uncensored" 即可。
如果模型拒绝提示词会怎样?
拒绝很少见,但如果内容涉及未成年人的性内容且违反硬性限制,则会发生。其他拒绝通常基于模型的训练或特定上下文。如果是错误导致的拒绝,提示词不会产生费用;但如果模型生成了响应,则会计费 token。
我如何为 API 付费?
我们仅接受加密货币:TRC20 网络上的 USDT 或 Base 网络上的 USDC。你可以充值 10 至 500 美元之间的任意整数金额。额度永不过期,且充值较大金额可获得奖励。
只差一张表单,即可获得密钥
创建账户,复制密钥,更改基础 URL。这就是全部设置。