Visión General

Modelos

TokSpan brinda acceso a más de 200 modelos de más de 50 proveedores a través de un único endpoint compatible con OpenAI. Explora por categoría o busca modelos específicos.

Categorías de modelos

Modelos de lenguaje de gran escala

Modelos de generación de texto de última generación para chat, razonamiento, generación de código y creación de contenido.

ModeloProveedorContextoIdeal para
GPT-4oOpenAI128KPropósito general, multimodal
GPT-4.1OpenAI1MContexto largo, programación
Claude Opus 4.8Anthropic200KRazonamiento complejo, análisis
Claude Sonnet 4.6Anthropic200KEquilibrio velocidad/calidad
Gemini 2.5 ProGoogle1MContexto largo, investigación
DeepSeek V3DeepSeek128KCosto eficiente, programación
Llama 4Meta128KAlternativa de código abierto
Mistral Large 3Mistral128KIA europea, multilingüe

Visión y multimodal

Modelos que comprenden imágenes, capturas de pantalla y documentos junto con texto.

ModeloProveedorEntrada
GPT-4o VisionOpenAITexto + Imagen
Claude 4 VisionAnthropicTexto + Imagen + PDF
Gemini 2.5 VisionGoogleTexto + Imagen + Video
Qwen-VLAlibabaTexto + Imagen

Embeddings y reranking

Vectores de embedding para búsqueda semántica, RAG, clustering y detección de similitud.

ModeloProveedorDimensiones
text-embedding-3-largeOpenAI3072 / 256-1024
text-embedding-3-smallOpenAI1536 / 512
Cohere Embed v3Cohere1024
Voyage AIVoyage1024 / 2048
BGE-M3BAAI1024

Voz y audio

Modelos de texto a voz y voz a texto para aplicaciones de voz.

ModeloProveedorTipo
GPT-4o TTSOpenAITexto a voz
WhisperOpenAIVoz a texto
ElevenLabsElevenLabsTexto a voz

Cambio de modelos

Para usar cualquier modelo, simplemente pase su ID en el campo model de su solicitud API:

python
# Switch from GPT-4o to Claude Opus — same code, one param change
response = client.chat.completions.create(
    model="claude-opus-4-8",  # ← Just change this
    messages=[{"role": "user", "content": "Write a haiku about coding."}],
)

Explore el catálogo completo de modelos con precios en vivo en api.tokspan.com/pricing.

Control de esfuerzo de razonamiento

Para modelos de razonamiento (GPT-5, Claude Opus, DeepSeek R1, Qwen3), puede controlar la profundidad del razonamiento agregando un sufijo al nombre del modelo:

SufijoEfectoEjemplo
-highMáxima profundidad de razonamiento: mejor calidad, más lentogpt-5-high
-mediumRazonamiento equilibrado (predeterminado para la mayoría de los modelos)gpt-5-medium
-lowRápido, razonamiento mínimo: ideal para tareas simplesgpt-5-low
-thinkingDevuelve tokens de razonamiento en la respuestaclaude-opus-4-8-thinking

Si no se proporciona un sufijo, se usa el nivel de razonamiento predeterminado del modelo. Esto le permite equilibrar velocidad y costo frente a la calidad de respuesta por solicitud, sin modificar su código de integración.

Conversión entre formatos

TokSpan convierte automáticamente entre diferentes formatos de API de forma transparente. Usted siempre envía solicitudes en el formato OpenAI Chat Completions: TokSpan se encarga de la traducción al formato nativo del proveedor upstream:

  • OpenAI → Claude Messages API: los prompts de sistema, la conversación de múltiples turnos y las definiciones de herramientas se reasignan automáticamente
  • OpenAI → Gemini API: las partes de contenido, la configuración de seguridad y los parámetros de generación se traducen de forma transparente
  • Claude → formato OpenAI: las respuestas nativas de Claude se normalizan a la estructura estándar de respuesta de Chat Completions

Esto significa que puede usar el SDK de OpenAI para Python/Node, LangChain o cualquier biblioteca compatible con OpenAI para llamar a cualquier modelo, independientemente de su formato de API nativo.