Tổng Quan
Mô Hình
TokSpan cung cấp quyền truy cập vào hơn 200 mô hình từ hơn 50 nhà cung cấp thông qua một endpoint duy nhất tương thích OpenAI. Duyệt theo danh mục hoặc tìm kiếm mô hình cụ thể.
Danh Mục Mô Hình
Mô Hình Ngôn Ngữ Lớn
Mô hình tạo văn bản tiên tiến nhất cho trò chuyện, suy luận, tạo mã và sáng tạo nội dung.
| Mô Hình | Nhà Cung Cấp | Ngữ Cảnh | Phù Hợp Nhất Cho |
|---|---|---|---|
| GPT-4o | OpenAI | 128K | Đa năng, đa phương thức |
| GPT-4.1 | OpenAI | 1M | Ngữ cảnh dài, lập trình |
| Claude Opus 4.8 | Anthropic | 200K | Suy luận phức tạp, phân tích |
| Claude Sonnet 4.6 | Anthropic | 200K | Cân bằng tốc độ & chất lượng |
| Gemini 2.5 Pro | 1M | Ngữ cảnh dài, nghiên cứu | |
| DeepSeek V3 | DeepSeek | 128K | Chi phí hiệu quả, lập trình |
| Llama 4 | Meta | 128K | Thay thế mã nguồn mở |
| Mistral Large 3 | Mistral | 128K | AI châu Âu, đa ngôn ngữ |
Thị Giác & Đa Phương Thức
Mô hình hiểu được hình ảnh, ảnh chụp màn hình và tài liệu cùng với văn bản.
| Mô Hình | Nhà Cung Cấp | Đầu Vào |
|---|---|---|
| GPT-4o Vision | OpenAI | Văn Bản + Hình Ảnh |
| Claude 4 Vision | Anthropic | Văn Bản + Hình Ảnh + PDF |
| Gemini 2.5 Vision | Văn Bản + Hình Ảnh + Video | |
| Qwen-VL | Alibaba | Văn Bản + Hình Ảnh |
Embeddings & Xếp Hạng Lại
Vector embeddings cho tìm kiếm ngữ nghĩa, RAG, phân cụm và phát hiện tương đồng.
| Mô Hình | Nhà Cung Cấp | Số Chiều |
|---|---|---|
| text-embedding-3-large | OpenAI | 3072 / 256-1024 |
| text-embedding-3-small | OpenAI | 1536 / 512 |
| Cohere Embed v3 | Cohere | 1024 |
| Voyage AI | Voyage | 1024 / 2048 |
| BGE-M3 | BAAI | 1024 |
Giọng Nói & Âm Thanh
Mô hình text-to-speech và speech-to-text cho ứng dụng giọng nói.
| Mô Hình | Nhà Cung Cấp | Loại |
|---|---|---|
| GPT-4o TTS | OpenAI | Chuyển văn bản thành giọng nói |
| Whisper | OpenAI | Chuyển giọng nói thành văn bản |
| ElevenLabs | ElevenLabs | Chuyển văn bản thành giọng nói |
Chuyển Đổi Mô Hình
Để sử dụng bất kỳ mô hình nào, chỉ cần truyền ID của nó vào trường model trong yêu cầu API của bạn:
# Switch from GPT-4o to Claude Opus — same code, one param change
response = client.chat.completions.create(
model="claude-opus-4-8", # ← Just change this
messages=[{"role": "user", "content": "Write a haiku about coding."}],
)Duyệt danh mục mô hình đầy đủ với giá trực tiếp tại api.tokspan.com/pricing.
Kiểm Soát Nỗ Lực Suy Luận
Đối với mô hình suy luận (GPT-5, Claude Opus, DeepSeek R1, Qwen3), bạn có thể kiểm soát độ sâu suy luận bằng cách thêm hậu tố vào tên mô hình:
| Hậu Tố | Tác Dụng | Ví Dụ |
|---|---|---|
-high | Độ sâu suy luận tối đa — chất lượng tốt nhất, chậm hơn | gpt-5-high |
-medium | Suy luận cân bằng (mặc định cho hầu hết mô hình) | gpt-5-medium |
-low | Nhanh, suy luận tối thiểu — tốt nhất cho tác vụ đơn giản | gpt-5-low |
-thinking | Trả về token suy luận trong phản hồi | claude-opus-4-8-thinking |
Nếu không cung cấp hậu tố, mức suy luận mặc định của mô hình sẽ được sử dụng. Điều này cho phép bạn đánh đổi tốc độ và chi phí với chất lượng câu trả lời theo từng yêu cầu mà không cần thay đổi mã tích hợp.
Chuyển Đổi Định Dạng Chéo
TokSpan tự động chuyển đổi giữa các định dạng API khác nhau ở phía sau. Bạn luôn gửi yêu cầu theo định dạng OpenAI Chat Completions — TokSpan xử lý việc chuyển đổi sang định dạng gốc của nhà cung cấp ngược dòng:
- OpenAI → Claude Messages API — System prompt, hội thoại nhiều lượt và định nghĩa công cụ được ánh xạ lại tự động
- OpenAI → Gemini API — Phần nội dung, cài đặt an toàn và cấu hình tạo được chuyển đổi minh bạch
- Claude → định dạng OpenAI — Phản hồi gốc của Claude được chuẩn hóa về cấu trúc phản hồi Chat Completions tiêu chuẩn
Điều này có nghĩa là bạn có thể sử dụng OpenAI Python/Node SDK, LangChain hoặc bất kỳ thư viện tương thích OpenAI nào để gọi bất kỳ mô hình nào — bất kể định dạng API gốc của nó.