Tổng Quan

Mô Hình

TokSpan cung cấp quyền truy cập vào hơn 200 mô hình từ hơn 50 nhà cung cấp thông qua một endpoint duy nhất tương thích OpenAI. Duyệt theo danh mục hoặc tìm kiếm mô hình cụ thể.

Danh Mục Mô Hình

Mô Hình Ngôn Ngữ Lớn

Mô hình tạo văn bản tiên tiến nhất cho trò chuyện, suy luận, tạo mã và sáng tạo nội dung.

Mô HìnhNhà Cung CấpNgữ CảnhPhù Hợp Nhất Cho
GPT-4oOpenAI128KĐa năng, đa phương thức
GPT-4.1OpenAI1MNgữ cảnh dài, lập trình
Claude Opus 4.8Anthropic200KSuy luận phức tạp, phân tích
Claude Sonnet 4.6Anthropic200KCân bằng tốc độ & chất lượng
Gemini 2.5 ProGoogle1MNgữ cảnh dài, nghiên cứu
DeepSeek V3DeepSeek128KChi phí hiệu quả, lập trình
Llama 4Meta128KThay thế mã nguồn mở
Mistral Large 3Mistral128KAI châu Âu, đa ngôn ngữ

Thị Giác & Đa Phương Thức

Mô hình hiểu được hình ảnh, ảnh chụp màn hình và tài liệu cùng với văn bản.

Mô HìnhNhà Cung CấpĐầu Vào
GPT-4o VisionOpenAIVăn Bản + Hình Ảnh
Claude 4 VisionAnthropicVăn Bản + Hình Ảnh + PDF
Gemini 2.5 VisionGoogleVăn Bản + Hình Ảnh + Video
Qwen-VLAlibabaVăn Bản + Hình Ảnh

Embeddings & Xếp Hạng Lại

Vector embeddings cho tìm kiếm ngữ nghĩa, RAG, phân cụm và phát hiện tương đồng.

Mô HìnhNhà Cung CấpSố Chiều
text-embedding-3-largeOpenAI3072 / 256-1024
text-embedding-3-smallOpenAI1536 / 512
Cohere Embed v3Cohere1024
Voyage AIVoyage1024 / 2048
BGE-M3BAAI1024

Giọng Nói & Âm Thanh

Mô hình text-to-speech và speech-to-text cho ứng dụng giọng nói.

Mô HìnhNhà Cung CấpLoại
GPT-4o TTSOpenAIChuyển văn bản thành giọng nói
WhisperOpenAIChuyển giọng nói thành văn bản
ElevenLabsElevenLabsChuyển văn bản thành giọng nói

Chuyển Đổi Mô Hình

Để sử dụng bất kỳ mô hình nào, chỉ cần truyền ID của nó vào trường model trong yêu cầu API của bạn:

python
# Switch from GPT-4o to Claude Opus — same code, one param change
response = client.chat.completions.create(
    model="claude-opus-4-8",  # ← Just change this
    messages=[{"role": "user", "content": "Write a haiku about coding."}],
)

Duyệt danh mục mô hình đầy đủ với giá trực tiếp tại api.tokspan.com/pricing.

Kiểm Soát Nỗ Lực Suy Luận

Đối với mô hình suy luận (GPT-5, Claude Opus, DeepSeek R1, Qwen3), bạn có thể kiểm soát độ sâu suy luận bằng cách thêm hậu tố vào tên mô hình:

Hậu TốTác DụngVí Dụ
-highĐộ sâu suy luận tối đa — chất lượng tốt nhất, chậm hơngpt-5-high
-mediumSuy luận cân bằng (mặc định cho hầu hết mô hình)gpt-5-medium
-lowNhanh, suy luận tối thiểu — tốt nhất cho tác vụ đơn giảngpt-5-low
-thinkingTrả về token suy luận trong phản hồiclaude-opus-4-8-thinking

Nếu không cung cấp hậu tố, mức suy luận mặc định của mô hình sẽ được sử dụng. Điều này cho phép bạn đánh đổi tốc độ và chi phí với chất lượng câu trả lời theo từng yêu cầu mà không cần thay đổi mã tích hợp.

Chuyển Đổi Định Dạng Chéo

TokSpan tự động chuyển đổi giữa các định dạng API khác nhau ở phía sau. Bạn luôn gửi yêu cầu theo định dạng OpenAI Chat Completions — TokSpan xử lý việc chuyển đổi sang định dạng gốc của nhà cung cấp ngược dòng:

  • OpenAI → Claude Messages API — System prompt, hội thoại nhiều lượt và định nghĩa công cụ được ánh xạ lại tự động
  • OpenAI → Gemini API — Phần nội dung, cài đặt an toàn và cấu hình tạo được chuyển đổi minh bạch
  • Claude → định dạng OpenAI — Phản hồi gốc của Claude được chuẩn hóa về cấu trúc phản hồi Chat Completions tiêu chuẩn

Điều này có nghĩa là bạn có thể sử dụng OpenAI Python/Node SDK, LangChain hoặc bất kỳ thư viện tương thích OpenAI nào để gọi bất kỳ mô hình nào — bất kể định dạng API gốc của nó.