API Grok sem censura: como usar modelos sem censura com SDKs Grok
A abordagem de API Grok sem censura permite que desenvolvedores substituam clientes padrão compatíveis com OpenAI para chamar um modelo de linguagem grande sem filtros, evitando as recusas de conteúdo típicas dos principais provedores. Ao usar um único modelo sem censura, feito sob medida, via uma API REST padrão, você ganha controle direto sobre o comportamento da resposta sem a complexidade de roteamento de modelos ou SDKs específicos de fornecedores.
Atualizado
Pontos principais
- Nossa API usa o formato padrão de chat-completions do OpenAI, não um protocolo específico do Grok, garantindo ampla compatibilidade com clientes.
- O modelo é sem censura para tópicos adultos legais e controversos, com bloqueio rígido apenas para conteúdo sexual envolvendo menores.
- A precificação é transparente: $0,25 por 1 milhão de tokens de entrada e $1,00 por 1 milhão de tokens de saída, com recargas apenas em criptomoedas.
- Sem assinatura ou mensalidades; você paga apenas pelo uso real de tokens com crédito pré-pago que nunca expira.
O que significa API Grok sem censura?
Quando os desenvolvedores discutem o conceito de grok api uncensored, muitas vezes buscam uma maneira de contornar os filtros de conteúdo que modelos comerciais padrão aplicam a tópicos legais, mas sensíveis. Neste contexto, "sem censura" significa que o modelo de linguagem grande subjacente é ajustado para responder sem recusar prompts controversos, adultos ou criativos, desde que não sejam ilegais. Isso é distinto de simplesmente remover algumas palavras-chave; envolve uma arquitetura de modelo e dados de treinamento otimizados para geração de saída bruta.
Nosso serviço oferece exatamente isso: um LLM hospedado único que não recusa tópicos adultos legais, fictícios ou de pesquisa de segurança. Não é um wrapper em torno de vários fornecedores. É um único modelo de pesos abertos executado em nossos próprios servidores. A principal distinção em relação a uma API comercial padrão é a ausência de recusas educadas para prompts de casos extremos. No entanto, há um limite de conteúdo rígido que sempre se aplica: conteúdo sexual envolvendo menores é estritamente recusado. Isso garante que a API permaneça utilizável para desenvolvimento geral, enquanto entrega o comportamento bruto que os desenvolvedores buscam para casos de uso específicos.
Por que usar um modelo sem censura com SDKs Grok?
Os desenvolvedores frequentemente integram Modelos de Linguagem Grande usando SDKs padrão porque são confiáveis, bem documentados e amplamente suportados. Usar um modelo sem censura com essas ferramentas padrão permite que você mantenha sua infraestrutura existente, alterando apenas o comportamento do modelo. A principal vantagem é a consistência: você não precisa reescrever a lógica do seu aplicativo para lidar com diferentes formatos de resposta ou códigos de erro.
Ao usar um endpoint padrão compatível com OpenAI, você pode conectar este modelo sem censura a qualquer cliente que espere uma resposta de chat-completions. Isso é particularmente útil para testes A/B onde você deseja comparar saídas filtradas versus não filtradas da mesma base de código. Você não está limitado ao ecossistema de um único fornecedor. Se você está construindo um chatbot, um gerador de conteúdo ou uma ferramenta de pesquisa, um modelo sem censura reduz o atrito da engenharia de prompts, removendo a necessidade de formular perguntas especificamente para evitar gatilhos. O modelo é projetado para responder diretamente, tornando-o ideal para aplicativos onde o tom e as taxas de recusa são fatores críticos na experiência do usuário.
Compatibilidade com clientes compatíveis com Grok
Um ponto comum de confusão é a diferença entre "compatível com Grok" e "compatível com OpenAI". Nossa API é compatível com OpenAI. Isso significa que segue a mesma estrutura REST, os corpos de solicitação JSON e os formatos de resposta da API de Chat da OpenAI. A maioria dos SDKs modernos de LLM, incluindo os usados para Grok ou outros provedores, é construída sobre esse padrão OpenAI. Portanto, você pode usar exatamente os mesmos clientes Python ou Node.js para chamar nossa API sem censura, bastando alterar a URL base e a chave de API.
Essa abordagem evita a necessidade de SDKs específicos de fornecedores que podem introduzir complexidade desnecessária. Você não precisa de um "SDK Grok" especial para usar nosso modelo. Qualquer cliente que possa se conectar a um endpoint OpenAI pode se conectar ao nosso. Isso inclui bibliotecas populares como openai para Python ou @anthropic-ai/sdk (quando configurado para endpoints OpenAI) e vários wrappers Node.js. A URL base para nosso serviço é https://api.uncensoredchat.cc/v1. Você passa o ID do modelo uncensored em suas solicitações. Essa padronização garante que seu código permaneça portátil e à prova de futuro, independentemente de qual provedor você escolher para hospedar seu modelo.
Configuração para respostas sem censura
Para obter os melhores resultados de um modelo sem censura, você deve configurar suas solicitações para incentivar saídas diretas e criativas. Os parâmetros padrão como temperature, top_p e stop funcionam exatamente como na API OpenAI. Um valor de temperatura mais alto (por exemplo, 0,7–1,0) aumentará a aleatoriedade e a criatividade das respostas, o que é frequentemente desejável para casos de uso sem censura onde você deseja respostas novas ou menos previsíveis.
Você também pode usar frequency_penalty e presence_penalty para reduzir a repetição e incentivar o modelo a explorar tópicos diferentes dentro de uma única resposta. Chamada de funções (ferramentas) e modo JSON (response_format: json_object) são totalmente suportados. Isso significa que você pode usar o modelo sem censura para extração de dados estruturados ou execução de ferramentas assim como faria com qualquer outro modelo. O modelo não recusa a saída de JSON ou a execução de ferramentas com base em filtros de conteúdo, permitindo integração robusta de pipeline. Você pode definir um seed para resultados reproduzíveis, o que é útil para depuração e teste da sua integração. Esses parâmetros padrão dão a você controle fino sobre o comportamento do modelo sem precisar de configurações proprietárias.
Limites de tokens e janela de contexto
Entender os limites de tokens é crucial para gerenciar custos e desempenho. Nosso modelo sem censura suporta uma janela de contexto de 100.000 tokens, que inclui tanto o prompt quanto a conclusão. Isso é significativamente maior que muitos modelos padrão, permitindo que você processe documentos longos ou mantenha históricos de conversas extensos em uma única solicitação.
A saída máxima por solicitação é de 32.000 tokens. Se você não especificar o parâmetro max_tokens, o modelo usará 2.048 tokens como padrão. Este limite se aplica à solicitação inteira, então você deve considerar o tamanho dos seus prompts de entrada. Por exemplo, se você enviar um prompt de 10.000 tokens, poderá receber até 54.000 tokens de saída, até o limite rígido de 32.000. Essa flexibilidade é ideal para tarefas como resumir textos longos, gerar código ou escrever artigos detalhados. A contagem de tokens é transparente e você pode monitorar o uso por meio dos cabeçalhos de resposta da API ou dos dados de streaming, garantindo que você permaneça dentro do seu orçamento e evite truncamento inesperado.
Transmissão de dados com SDKs Grok
O streaming é essencial para construir interfaces de usuário responsivas, especialmente ao lidar com respostas grandes. Nossa API suporta Server-Sent Events (SSE) para streaming. Quando você habilita o streaming, o modelo retorna tokens conforme são gerados, permitindo que você exiba a saída em tempo real. Isso é particularmente útil para aplicativos de chat onde a latência é importante.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredchat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Ao transmitir, o último fragmento da resposta contém o uso total de tokens para a solicitação. Isso permite que você rastreie custos e monitore o uso sem fazer uma chamada de API separada. O formato de streaming é idêntico ao formato de streaming do OpenAI, então qualquer SDK que lide com streaming OpenAI funcionará com nossa API sem censura. Você pode integrar isso facilmente à sua lógica de streaming existente atualizando a URL base. Isso garante que a experiência do usuário permaneça suave e consistente, independentemente de você estar usando um modelo filtrado ou sem censura.
Eficiência de custos em comparação com o Grok
A precificação de APIs LLM pode variar amplamente dependendo do provedor e do tamanho do modelo. Nossa API sem censura oferece um modelo transparente de crédito pré-pago sem mensalidades. O custo é de $0,25 por 1 milhão de tokens de entrada e $1,00 por 1 milhão de tokens de saída. Essa precificação é direta e se aplica a todas as solicitações, incluindo streaming e não streaming.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredchat.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Ao contrário de alguns provedores que cobram com base em tiers de modelo ou velocidade, cobramos com base no uso real de tokens. Erros e recusas são gratuitos, então você paga apenas pelo que o modelo gera. O crédito pré-pago nunca expira e você pode recarregar com criptomoedas. Este modelo é frequentemente mais econômico para desenvolvedores com padrões de uso variáveis. Você não precisa prever seu volume mensal ou pagar por capacidade ociosa. A falta de taxas de assinatura significa que você pode começar pequeno e escalar conforme necessário, tornando-o ideal para startups e desenvolvedores individuais que desejam controlar seus custos com precisão.
Começando com Uncensored Chat
Começar com nossa API sem censura é direto. Você pode se cadastrar usando sua conta do Google ou fornecendo um e-mail e senha. Nenhum número de telefone é necessário. Uma vez que você cria uma conta, receberá uma chave de API imediatamente. Esta chave é usada para autenticar suas solicitações à API.
curl https://api.uncensoredchat.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Você pode começar a fazer solicitações apontando seu SDK para nossa URL base: https://api.uncensoredchat.cc/v1. Use o ID do modelo uncensored em suas solicitações. Você pode recarregar seu crédito usando USDT (TRC20) ou USDC (Base) com valores entre $10 e $500. Novas contas recebem $0,50 em crédito de teste válido por 7 dias, sem necessidade de cartão. Isso permite que você teste a API completamente antes de se comprometer com uma recarga maior. A API suporta até 300 solicitações por minuto e 8 solicitações simultâneas por chave, o que é suficiente para a maioria das cargas de trabalho de desenvolvimento e produção.
Perguntas e respostas
O modelo sem censura é igual ao Grok?
Não, nosso modelo é um modelo de pesos abertos executado em nossos próprios servidores, distinto de Grok, GPT ou qualquer outro modelo de fornecedor. É compatível com o formato do SDK do Grok (que é compatível com OpenAI), mas não é um modelo Grok em si.
Posso usar o SDK Python oficial do Grok?
Sim, se o SDK for compatível com OpenAI. Você pode usar o SDK Python padrão do OpenAI ou qualquer wrapper que suporte o formato de endpoint do OpenAI. Basta alterar a URL base para a nossa e definir o ID do modelo como "uncensored".
O que acontece se o modelo recusar um prompt?
As recusas são raras, mas podem ocorrer se o conteúdo violar o limite rígido de conteúdo sexual envolvendo menores. Outras recusas geralmente se baseiam no treinamento do modelo ou em contexto específico. Prompts recusados não geram cobrança se forem erros, mas se o modelo gerar uma resposta, os tokens são contados.
Como pagar pela API?
Aceitamos apenas criptomoedas: USDT na rede TRC20 ou USDC na rede Base. Você pode recarregar com qualquer valor inteiro entre $10 e $500. O crédito nunca expira e você pode obter um bônus ao recarregar valores maiores.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.