VI ▾
apertus.topAPI LLM không kiểm duyệt, trả theo token

Yêu cầu đầu tiên trong năm phút

Bắt đầu với API LLM không kiểm duyệt Apertus trong vài phút. Hướng dẫn nhanh này bao gồm xác thực, yêu cầu cơ bản và truyền phát (streaming) sử dụng giao diện tương thích OpenAI.

URL gốc & Xác thực

Truy cập API bằng URL gốc chuyên dụng https://api.apertus.top/v1. Dịch vụ tương thích OpenAI, nghĩa là bạn có thể sử dụng các SDK tiêu chuẩn bằng cách cập nhật base_url và cung cấp khóa API của bạn. Đăng ký trên trang Lấy khóa API bằng Google hoặc địa chỉ email. Khóa của bạn sẽ hiển thị ngay lập tức khi tạo. Mỗi tài khoản chỉ giữ một khóa hoạt động; việc tạo khóa mới sẽ thay thế khóa trước đó. Không có gói đăng ký hàng tháng hoặc ngày hết hạn khóa. Tín dụng trả trước không bao giờ hết hạn và số tiền chưa sử dụng vẫn khả dụng cho các yêu cầu trong tương lai. Lỗi và từ chối không tiêu tốn tín dụng của bạn.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn thành văn bản đơn giản để kiểm tra kết nối và tính phí. Sử dụng ID mô hình uncensored để truy cập mô hình trọng số mở duy nhất. Mô hình này được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp. URL cơ sở là https://api.apertus.top/v1. Giá cả minh bạch: $0.25 cho mỗi 1 triệu token đầu vào và $1.00 cho mỗi 1 triệu token đầu ra. Bạn chỉ trả tiền cho những gì bạn sử dụng.

curl https://api.apertus.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Phản hồi trả về văn bản đã tạo. Nếu tín dụng của bạn không đủ, bạn sẽ nhận được lỗi thanh toán. Lỗi trong quá trình xử lý không tính phí vào tài khoản của bạn. Bạn có thể nạp tiền bằng USDT (TRC20) hoặc USDC (Base) qua bảng điều khiển.

Tích hợp Python SDK

Sử dụng Python SDK chính thức của OpenAI hoặc bất kỳ máy khách tương thích nào. Đặt base_url thành https://api.apertus.top/v1 và cung cấp khóa API của bạn. Điều này cho phép bạn tận dụng các cơ sở mã hiện có được thiết kế cho OpenAI. Endpoint /v1/chat/completions xử lý tất cả việc tạo văn bản. ID mô hình là uncensored. Các tham số như temperature, top_p và stop được hỗ trợ. Phản hồi truyền phát (streaming) bao gồm chi tiết sử dụng token trong phần dữ liệu cuối cùng. Gọi hàm và chế độ JSON cũng có sẵn cho đầu ra có cấu trúc.

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tích hợp Node SDK

Khởi tạo máy khách với URL gốc Apertus. Lớp OpenAI chấp nhận các tham số cấu hình tiêu chuẩn. Chuyển khóa API của bạn và đặt URL gốc thành https://api.apertus.top/v1. Điều này đảm bảo tương thích với các ứng dụng Node.js hiện có. ID mô hình uncensored là bắt buộc cho tất cả các yêu cầu. Bạn có thể kiểm soát độ dài đầu ra bằng max_tokens. Đầu ra tối đa mặc định là 2.048 token nếu không được chỉ định, với giới hạn cứng là 32.000 token mỗi yêu cầu.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát (streaming)

Bật truyền phát (streaming) bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện gửi bởi máy chủ (SSE). Mỗi phần dữ liệu chứa văn bản từng phần. Phần dữ liệu cuối cùng bao gồm thống kê sử dụng token đầy đủ cho yêu cầu. Điều này cho phép bạn hiển thị kết quả theo thời gian thực trong khi theo dõi chi phí. Truyền phát (streaming) hoạt động với tất cả các tham số, bao gồm gọi hàm. Đảm bảo máy khách của bạn xử lý các sự kiện SSE đúng cách. Cửa sổ ngữ cảnh hỗ trợ tối đa 100.000 token cho prompt và phần hoàn thành kết hợp.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn, Lỗi & Ngữ cảnh

API áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và cho phép 8 yêu cầu đồng thời. Kích thước yêu cầu tối đa là 8 MB. Nếu khóa xác thực không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu tín dụng trả trước của bạn đã cạn kiệt, bạn sẽ nhận được lỗi 402 cho biết số tiền không đủ. Giới hạn tốc độ được áp dụng dựa trên hạn ngạch mỗi phút. Cửa sổ ngữ cảnh là 100.000 token tổng cộng. Đầu ra tối đa mỗi yêu cầu là 32.000 token. Các yêu cầu vượt quá giới hạn này được xử lý bởi hành vi tiêu chuẩn của mô hình. Không có phần trăm SLA nào được đảm bảo. Quyền riêng tư được duy trì; các prompt không được sử dụng để huấn luyện.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.top/v1
ID mô hìnhuncensored
Xác thựcAuthorization: Bearer YOUR_KEY
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Thưởng+5% từ $50, +10% từ $100
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Khóa API của tôi có hết hạn không?

Không, khóa API của bạn không bao giờ hết hạn. Không có gói đăng ký hàng tháng hoặc phí định kỳ nào liên quan đến tài khoản của bạn. Bạn có thể sử dụng khóa này vô thời hạn cho đến khi bạn chọn thu hồi nó.

Điều gì xảy ra nếu tôi vượt quá giới hạn tốc độ?

API giới hạn bạn ở 300 yêu cầu mỗi phút trên mỗi khóa. Nếu bạn vượt quá giới hạn này, các yêu cầu tiếp theo có thể bị chậm hoặc từ chối. Bạn cũng có thể thực hiện 8 yêu cầu đồng thời cùng một lúc. Hãy theo dõi mức sử dụng để duy trì trong các giới hạn này.

Đoạn văn bản có bị cắt ngắn nếu vượt quá 32.000 token không?

Mô hình hỗ trợ đầu ra tối đa 32.000 token mỗi yêu cầu. Nếu văn bản tạo ra vượt quá giới hạn này, phản hồi sẽ bị cắt ngắn bởi mô hình. Bạn có thể điều chỉnh tham số <code>max_tokens</code> để kiểm soát độ dài đầu ra trong giới hạn này.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL gốc. Đó là toàn bộ quá trình thiết lập.

Lấy khóa APIĐọc tài liệu