Grok API không kiểm duyệt: Cách sử dụng mô hình không kiểm duyệt với SDK Grok
Phương pháp Grok API không kiểm duyệt cho phép nhà phát triển chuyển đổi các khách hàng tương thích với OpenAI tiêu chuẩn để gọi một mô hình ngôn ngữ lớn không lọc, tránh việc từ chối nội dung thường thấy ở các nhà cung cấp lớn. Bằng cách sử dụng một mô hình không kiểm duyệt được xây dựng riêng biệt thông qua REST API tiêu chuẩn, bạn có quyền kiểm soát trực tiếp hành vi phản hồi mà không cần phức tạp hóa việc định tuyến mô hình hoặc sử dụng SDK đặc thù của nhà cung cấp.
Cập nhật
Điểm chính
- API của chúng tôi sử dụng định dạng chat-completions tiêu chuẩn của OpenAI, không phải giao thức đặc thù của Grok, đảm bảo tương thích rộng rãi với các khách hàng.
- Mô hình không kiểm duyệt đối với các chủ đề người trưởng thành hợp pháp và gây tranh cãi, chỉ chặn cứng nội dung tình dục liên quan đến trẻ vị thành niên.
- Giá cả minh bạch ở mức $0.25 cho mỗi 1 triệu token đầu vào và $1.00 cho mỗi 1 triệu token đầu ra, với các khoản nạp tiền chỉ bằng tiền điện tử.
- Không có phí đăng ký hoặc phí hàng tháng; bạn chỉ trả tiền cho việc sử dụng token thực tế bằng tín dụng trả trước không bao giờ hết hạn.
Grok API không kiểm duyệt có nghĩa là gì?
Khi lập trình viên thảo luận về khái niệm grok api uncensored, họ thường tìm cách bỏ qua bộ lọc nội dung mà các mô hình thương mại chuẩn áp dụng cho các chủ đề hợp pháp nhưng nhạy cảm. Trong ngữ cảnh này, "không kiểm duyệt" nghĩa là mô hình ngôn ngữ lớn nền tảng được tinh chỉnh để trả lời mà không từ chối các prompt gây tranh cãi, người lớn hoặc sáng tạo, miễn là chúng không vi phạm pháp luật. Điều này khác với việc chỉ loại bỏ một vài từ khóa; nó liên quan đến kiến trúc mô hình và dữ liệu huấn luyện được tối ưu hóa để tạo đầu ra thô.
Dịch vụ của chúng tôi cung cấp chính xác điều này: một LLM được lưu trữ duy nhất không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc nghiên cứu bảo mật. Nó không phải là một wrapper bao quanh nhiều nhà cung cấp. Đó là một mô hình trọng số mở chạy trên máy chủ của riêng chúng tôi. Sự khác biệt chính so với API thương mại tiêu chuẩn là sự vắng mặt của các lời từ chối lịch sự đối với các prompt trường hợp biên. Tuy nhiên, có một giới hạn nội dung cứng luôn được áp dụng: nội dung tình dục liên quan đến trẻ vị thành niên sẽ bị từ chối nghiêm ngặt. Điều này đảm bảo API vẫn có thể sử dụng được cho phát triển chung trong khi cung cấp hành vi thô mà các nhà phát triển tìm kiếm cho các trường hợp sử dụng cụ thể.
Tại sao nên sử dụng mô hình không kiểm duyệt với SDK Grok?
Các nhà phát triển thường tích hợp các Mô hình Ngôn ngữ Lớn bằng cách sử dụng các SDK tiêu chuẩn vì chúng đáng tin cậy, được tài liệu hóa tốt và được hỗ trợ rộng rãi. Việc sử dụng một mô hình không kiểm duyệt với các công cụ tiêu chuẩn này cho phép bạn giữ lại cơ sở hạ tầng hiện có trong khi chỉ thay đổi hành vi của mô hình. Lợi thế chính là tính nhất quán: bạn không cần phải viết lại logic ứng dụng của mình để xử lý các định dạng phản hồi hoặc mã lỗi khác nhau.
Bằng cách sử dụng một endpoint tương thích với OpenAI tiêu chuẩn, bạn có thể cắm mô hình không kiểm duyệt này vào bất kỳ khách hàng nào mong đợi phản hồi chat-completions. Điều này đặc biệt hữu ích cho việc thử nghiệm A/B nơi bạn muốn so sánh đầu ra có lọc và không lọc từ cùng một cơ sở mã. Bạn không bị giới hạn trong hệ sinh thái của một nhà cung cấp duy nhất. Nếu bạn đang xây dựng một chatbot, trình tạo nội dung hoặc công cụ nghiên cứu, một mô hình không kiểm duyệt sẽ giảm bớt sự phức tạp trong việc kỹ thuật prompt bằng cách loại bỏ nhu cầu phải diễn đạt câu hỏi cụ thể để tránh các kích hoạt. Mô hình được thiết kế để trả lời trực tiếp, khiến nó lý tưởng cho các ứng dụng nơi giọng điệu và tỷ lệ từ chối là các yếu tố quan trọng trong trải nghiệm người dùng.
Tương thích với các khách hàng tương thích Grok
Một điểm gây nhầm lẫn phổ biến là sự khác biệt giữa "tương thích Grok" và "tương thích OpenAI". API của chúng tôi tương thích với OpenAI. Điều này có nghĩa là nó tuân theo cùng cấu trúc REST, thân yêu cầu JSON và định dạng phản hồi như API Chat của OpenAI. Hầu hết các SDK LLM hiện đại, bao gồm cả những SDK được sử dụng cho Grok hoặc các nhà cung cấp khác, đều được xây dựng trên tiêu chuẩn OpenAI này. Do đó, bạn có thể sử dụng chính xác cùng các khách hàng Python hoặc Node.js để gọi API không kiểm duyệt của chúng tôi bằng cách chỉ thay đổi base URL và khóa API.
Phương pháp này tránh nhu cầu sử dụng các SDK đặc thù của nhà cung cấp có thể giới thiệu sự phức tạp không cần thiết. Bạn không cần một "SDK Grok" đặc biệt để sử dụng mô hình của chúng tôi. Bất kỳ khách hàng nào có thể kết nối với một endpoint OpenAI đều có thể kết nối với endpoint của chúng tôi. Điều này bao gồm các thư viện phổ biến như openai cho Python hoặc @anthropic-ai/sdk (khi được cấu hình cho các endpoint OpenAI) và nhiều wrapper Node.js khác. Base URL cho dịch vụ của chúng tôi là https://api.uncensoredchat.cc/v1. Bạn truyền ID mô hình uncensored trong các yêu cầu của mình. Sự chuẩn hóa này đảm bảo mã của bạn vẫn di động và tương lai-proof, bất kể nhà cung cấp nào bạn chọn để lưu trữ mô hình của mình.
Cấu hình cho các phản hồi không kiểm duyệt
Để có kết quả tốt nhất từ một mô hình không kiểm duyệt, bạn nên cấu hình các yêu cầu của mình để khuyến khích các đầu ra trực tiếp và sáng tạo. Các tham số tiêu chuẩn như temperature, top_p và stop hoạt động chính xác như chúng hoạt động trong API OpenAI. Giá trị temperature cao hơn (ví dụ: 0,7–1,0) sẽ tăng tính ngẫu nhiên và sáng tạo của các phản hồi, điều này thường mong muốn cho các trường hợp sử dụng không kiểm duyệt nơi bạn muốn các câu trả lời mới lạ hoặc ít dự đoán hơn.
Bạn cũng có thể sử dụng frequency_penalty và presence_penalty để giảm sự lặp lại và khuyến khích mô hình khám phá các chủ đề khác nhau trong một phản hồi duy nhất. Gọi hàm (công cụ) và chế độ JSON (response_format: json_object) được hỗ trợ đầy đủ. Điều này có nghĩa là bạn có thể sử dụng mô hình không kiểm duyệt cho việc trích xuất dữ liệu có cấu trúc hoặc thực thi công cụ giống như bạn vẫn làm với bất kỳ mô hình nào khác. Mô hình không từ chối xuất JSON hoặc thực thi công cụ dựa trên bộ lọc nội dung, cho phép tích hợp pipeline mạnh mẽ. Bạn có thể đặt một seed cho các kết quả có thể tái lập, điều này hữu ích cho việc gỡ lỗi và kiểm tra tích hợp của bạn. Các tham số tiêu chuẩn này cho phép bạn kiểm soát chi tiết hành vi của mô hình mà không cần các cài đặt độc quyền.
Giới hạn Token và Cửa sổ Ngữ cảnh
Hiểu rõ giới hạn token rất quan trọng để quản lý chi phí và hiệu suất. Mô hình không kiểm duyệt của chúng tôi hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và phần hoàn thành. Điều này lớn hơn đáng kể so với nhiều mô hình tiêu chuẩn, cho phép bạn xử lý các tài liệu dài hoặc duy trì lịch sử hội thoại rộng rãi trong một yêu cầu duy nhất.
Lượng output tối đa cho mỗi yêu cầu là 32.000 token. Nếu bạn không chỉ định tham số max_tokens, mô hình sẽ mặc định là 2.048 token. Giới hạn này áp dụng cho toàn bộ yêu cầu, vì vậy bạn phải tính đến kích thước của các prompt đầu vào của bạn. Ví dụ, nếu bạn gửi một prompt 10.000 token, bạn có thể nhận được tối đa 54.000 token output, không vượt quá giới hạn cứng là 32.000. Sự linh hoạt này rất lý tưởng cho các tác vụ như tóm tắt văn bản dài, tạo code hoặc viết bài chi tiết. Việc đếm token minh bạch, và bạn có thể theo dõi mức sử dụng thông qua các tiêu đề phản hồi API hoặc dữ liệu truyền phát (streaming), đảm bảo bạn luôn nằm trong ngân sách và tránh tình trạng cắt ngang không mong muốn.
Truyền phát Dữ liệu với SDK Grok
Truyền phát rất quan trọng để xây dựng giao diện người dùng đáp ứng, đặc biệt khi xử lý các phản hồi lớn. API của chúng tôi hỗ trợ Sự kiện Gửi qua Máy chủ (SSE) để truyền phát. Khi bạn bật truyền phát, mô hình trả về các token khi chúng được tạo, cho phép bạn hiển thị đầu ra theo thời gian thực. Điều này đặc biệt hữu ích cho các ứng dụng trò chuyện nơi độ trễ quan trọng.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredchat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Khi truyền phát, chunk cuối cùng của phản hồi chứa tổng mức sử dụng token cho yêu cầu. Điều này cho phép bạn theo dõi chi phí và giám sát việc sử dụng mà không cần thực hiện một cuộc gọi API riêng biệt. Định dạng truyền phát giống hệt với định dạng truyền phát OpenAI, vì vậy bất kỳ SDK nào xử lý truyền phát OpenAI đều sẽ hoạt động với API không kiểm duyệt của chúng tôi. Bạn có thể dễ dàng tích hợp điều này vào logic truyền phát hiện có của mình bằng cách cập nhật base URL. Điều này đảm bảo trải nghiệm người dùng của bạn vẫn mượt mà và nhất quán, bất kể bạn có đang sử dụng mô hình có lọc hay không kiểm duyệt.
Hiệu quả Chi phí so với Grok
Giá cả cho các API LLM có thể thay đổi rất nhiều tùy thuộc vào nhà cung cấp và kích thước mô hình. API không kiểm duyệt của chúng tôi cung cấp một mô hình tín dụng trả trước minh bạch không có phí hàng tháng. Chi phí là $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Giá cả này rõ ràng và áp dụng cho tất cả các yêu cầu, bao gồm cả truyền phát và không truyền phát.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredchat.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Khác với một số nhà cung cấp tính phí dựa trên các tầng mô hình hoặc tốc độ, chúng tôi tính phí dựa trên việc sử dụng token thực tế. Lỗi và từ chối đều miễn phí, vì vậy bạn chỉ trả tiền cho những gì mô hình tạo ra. Tín dụng trả trước không bao giờ hết hạn và bạn có thể nạp tiền bằng tiền điện tử. Mô hình này thường hiệu quả chi phí hơn cho các nhà phát triển có mô hình sử dụng biến đổi. Bạn không cần phải dự đoán khối lượng hàng tháng của mình hoặc trả tiền cho dung lượng nhàn rỗi. Việc thiếu phí đăng ký có nghĩa là bạn có thể bắt đầu nhỏ và mở rộng khi cần, khiến nó lý tưởng cho các công ty khởi nghiệp và nhà phát triển cá nhân muốn kiểm soát chi phí của mình một cách chính xác.
Bắt đầu với Uncensored Chat
Bắt đầu với API không kiểm duyệt của chúng tôi rất đơn giản. Bạn có thể đăng ký bằng tài khoản Google của mình hoặc bằng cách cung cấp email và mật khẩu. Không cần số điện thoại. Một khi bạn tạo tài khoản, bạn sẽ nhận được một khóa API ngay lập tức. Khóa này được sử dụng để xác thực các yêu cầu của bạn với API.
curl https://api.uncensoredchat.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Bạn có thể bắt đầu thực hiện các yêu cầu bằng cách trỏ SDK của bạn vào base URL của chúng tôi: https://api.uncensoredchat.cc/v1. Sử dụng ID mô hình uncensored trong các yêu cầu của bạn. Bạn có thể nạp tiền tín dụng của mình bằng USDT (TRC20) hoặc USDC (Base) với số tiền từ $10 đến $500. Tài khoản mới nhận được $0,50 tín dụng dùng thử miễn phí có giá trị trong 7 ngày, không cần thẻ. Điều này cho phép bạn kiểm tra API kỹ lưỡng trước khi cam kết nạp tiền lớn hơn. API hỗ trợ tối đa 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa, điều này đủ cho hầu hết các khối lượng công việc phát triển và sản xuất.
Hỏi đáp
Mô hình không kiểm duyệt có giống với Grok không?
Không, mô hình của chúng tôi là một mô hình trọng số mở chạy trên máy chủ của riêng chúng tôi, khác biệt với Grok, GPT hoặc bất kỳ mô hình của nhà cung cấp nào khác. Nó tương thích với định dạng SDK Grok (vốn tương thích với OpenAI) nhưng không phải là mô hình Grok.
Tôi có thể sử dụng SDK Python chính thức của Grok không?
Có, nếu SDK tương thích với OpenAI. Bạn có thể sử dụng SDK Python OpenAI tiêu chuẩn hoặc bất kỳ wrapper nào hỗ trợ định dạng endpoint OpenAI. Bạn chỉ cần thay đổi base URL thành của chúng tôi và đặt ID mô hình thành "uncensored".
Điều gì xảy ra nếu mô hình từ chối một prompt?
Việc từ chối là hiếm nhưng có thể xảy ra nếu nội dung vi phạm giới hạn cứng về nội dung tình dục liên quan đến trẻ vị thành niên. Các lần từ chối khác thường dựa trên quá trình huấn luyện của mô hình hoặc ngữ cảnh cụ thể. Các prompt bị từ chối sẽ không bị tính phí nếu đó là lỗi, nhưng nếu mô hình tạo ra phản hồi, token sẽ được tính.
Tôi thanh toán cho API như thế nào?
Chúng tôi chỉ chấp nhận tiền điện tử: USDT trên mạng TRC20 hoặc USDC trên mạng Base. Bạn có thể nạp tiền với bất kỳ số nguyên nào từ $10 đến $500. Tín dụng không bao giờ hết hạn và bạn có thể nhận thêm tiền bằng cách nạp số lượng lớn hơn.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ thiết lập.