Обзор
Модели
TokSpan предоставляет доступ к 200+ моделям от 50+ провайдеров через единую конечную точку, совместимую с OpenAI. Просматривайте по категориям или ищите конкретные модели.
Категории моделей
Большие языковые модели
Современные модели генерации текста для чата, рассуждений, генерации кода и создания контента.
| Модель | Провайдер | Контекст | Лучше всего для |
|---|---|---|---|
| GPT-4o | OpenAI | 128K | Общего назначения, мультимодальная |
| GPT-4.1 | OpenAI | 1M | Длинный контекст, программирование |
| Claude Opus 4.8 | Anthropic | 200K | Сложные рассуждения, анализ |
| Claude Sonnet 4.6 | Anthropic | 200K | Сбалансированная скорость и качество |
| Gemini 2.5 Pro | 1M | Длинный контекст, исследования | |
| DeepSeek V3 | DeepSeek | 128K | Экономичная, программирование |
| Llama 4 | Meta | 128K | Открытая альтернатива |
| Mistral Large 3 | Mistral | 128K | Европейский AI, мультиязычная |
Vision и мультимодальные
Модели, понимающие изображения, скриншоты и документы наряду с текстом.
| Модель | Провайдер | Вход |
|---|---|---|
| GPT-4o Vision | OpenAI | Текст + изображение |
| Claude 4 Vision | Anthropic | Текст + изображение + PDF |
| Gemini 2.5 Vision | Текст + изображение + видео | |
| Qwen-VL | Alibaba | Текст + изображение |
Embeddings и реранкинг
Векторные представления для семантического поиска, RAG, кластеризации и обнаружения сходства.
| Модель | Провайдер | Размерность |
|---|---|---|
| text-embedding-3-large | OpenAI | 3072 / 256-1024 |
| text-embedding-3-small | OpenAI | 1536 / 512 |
| Cohere Embed v3 | Cohere | 1024 |
| Voyage AI | Voyage | 1024 / 2048 |
| BGE-M3 | BAAI | 1024 |
Речь и аудио
Модели text-to-speech и speech-to-text для голосовых приложений.
| Модель | Провайдер | Тип |
|---|---|---|
| GPT-4o TTS | OpenAI | Преобразование текста в речь |
| Whisper | OpenAI | Преобразование речи в текст |
| ElevenLabs | ElevenLabs | Преобразование текста в речь |
Переключение моделей
Чтобы использовать любую модель, просто передайте её идентификатор в поле model вашего API-запроса:
# Switch from GPT-4o to Claude Opus — same code, one param change
response = client.chat.completions.create(
model="claude-opus-4-8", # ← Just change this
messages=[{"role": "user", "content": "Write a haiku about coding."}],
)Просмотрите полный каталог моделей с актуальными ценами на api.tokspan.com/pricing.
Управление глубиной рассуждения
Для рассуждающих моделей (GPT-5, Claude Opus, DeepSeek R1, Qwen3) вы можете управлять глубиной рассуждения, добавляя суффикс к названию модели:
| Суффикс | Эффект | Пример |
|---|---|---|
-high | Максимальная глубина — наилучшее качество, медленнее | gpt-5-high |
-medium | Сбалансированное (по умолчанию для большинства моделей) | gpt-5-medium |
-low | Быстрое, минимальное — лучше всего для простых задач | gpt-5-low |
-thinking | Возвращает токены рассуждения в ответе | claude-opus-4-8-thinking |
Если суффикс не указан, используется уровень рассуждения модели по умолчанию. Это позволяет находить компромисс между скоростью, стоимостью и качеством ответа для каждого запроса без изменения кода интеграции.
Кросс-форматная конвертация
TokSpan автоматически конвертирует между различными форматами API за кулисами. Вы всегда отправляете запросы в формате OpenAI Chat Completions — TokSpan выполняет трансляцию в нативный формат upstream-провайдера:
- OpenAI → Claude Messages API — Системные промпты, многошаговые диалоги и определения инструментов автоматически преобразуются
- OpenAI → Gemini API — Части контента, настройки безопасности и конфигурация генерации транслируются прозрачно
- Claude → формат OpenAI — Нативные ответы Claude нормализуются до стандартной структуры ответа Chat Completions
Это означает, что вы можете использовать OpenAI Python/Node SDK, LangChain или любую библиотеку, совместимую с OpenAI, для вызова любой модели — независимо от её нативного формата API.