Обзор

Модели

TokSpan предоставляет доступ к 200+ моделям от 50+ провайдеров через единую конечную точку, совместимую с OpenAI. Просматривайте по категориям или ищите конкретные модели.

Категории моделей

Большие языковые модели

Современные модели генерации текста для чата, рассуждений, генерации кода и создания контента.

МодельПровайдерКонтекстЛучше всего для
GPT-4oOpenAI128KОбщего назначения, мультимодальная
GPT-4.1OpenAI1MДлинный контекст, программирование
Claude Opus 4.8Anthropic200KСложные рассуждения, анализ
Claude Sonnet 4.6Anthropic200KСбалансированная скорость и качество
Gemini 2.5 ProGoogle1MДлинный контекст, исследования
DeepSeek V3DeepSeek128KЭкономичная, программирование
Llama 4Meta128KОткрытая альтернатива
Mistral Large 3Mistral128KЕвропейский AI, мультиязычная

Vision и мультимодальные

Модели, понимающие изображения, скриншоты и документы наряду с текстом.

МодельПровайдерВход
GPT-4o VisionOpenAIТекст + изображение
Claude 4 VisionAnthropicТекст + изображение + PDF
Gemini 2.5 VisionGoogleТекст + изображение + видео
Qwen-VLAlibabaТекст + изображение

Embeddings и реранкинг

Векторные представления для семантического поиска, RAG, кластеризации и обнаружения сходства.

МодельПровайдерРазмерность
text-embedding-3-largeOpenAI3072 / 256-1024
text-embedding-3-smallOpenAI1536 / 512
Cohere Embed v3Cohere1024
Voyage AIVoyage1024 / 2048
BGE-M3BAAI1024

Речь и аудио

Модели text-to-speech и speech-to-text для голосовых приложений.

МодельПровайдерТип
GPT-4o TTSOpenAIПреобразование текста в речь
WhisperOpenAIПреобразование речи в текст
ElevenLabsElevenLabsПреобразование текста в речь

Переключение моделей

Чтобы использовать любую модель, просто передайте её идентификатор в поле model вашего API-запроса:

python
# Switch from GPT-4o to Claude Opus — same code, one param change
response = client.chat.completions.create(
    model="claude-opus-4-8",  # ← Just change this
    messages=[{"role": "user", "content": "Write a haiku about coding."}],
)

Просмотрите полный каталог моделей с актуальными ценами на api.tokspan.com/pricing.

Управление глубиной рассуждения

Для рассуждающих моделей (GPT-5, Claude Opus, DeepSeek R1, Qwen3) вы можете управлять глубиной рассуждения, добавляя суффикс к названию модели:

СуффиксЭффектПример
-highМаксимальная глубина — наилучшее качество, медленнееgpt-5-high
-mediumСбалансированное (по умолчанию для большинства моделей)gpt-5-medium
-lowБыстрое, минимальное — лучше всего для простых задачgpt-5-low
-thinkingВозвращает токены рассуждения в ответеclaude-opus-4-8-thinking

Если суффикс не указан, используется уровень рассуждения модели по умолчанию. Это позволяет находить компромисс между скоростью, стоимостью и качеством ответа для каждого запроса без изменения кода интеграции.

Кросс-форматная конвертация

TokSpan автоматически конвертирует между различными форматами API за кулисами. Вы всегда отправляете запросы в формате OpenAI Chat Completions — TokSpan выполняет трансляцию в нативный формат upstream-провайдера:

  • OpenAI → Claude Messages API — Системные промпты, многошаговые диалоги и определения инструментов автоматически преобразуются
  • OpenAI → Gemini API — Части контента, настройки безопасности и конфигурация генерации транслируются прозрачно
  • Claude → формат OpenAI — Нативные ответы Claude нормализуются до стандартной структуры ответа Chat Completions

Это означает, что вы можете использовать OpenAI Python/Node SDK, LangChain или любую библиотеку, совместимую с OpenAI, для вызова любой модели — независимо от её нативного формата API.