Visión General
Modelos
TokSpan brinda acceso a más de 200 modelos de más de 50 proveedores a través de un único endpoint compatible con OpenAI. Explora por categoría o busca modelos específicos.
Categorías de modelos
Modelos de lenguaje de gran escala
Modelos de generación de texto de última generación para chat, razonamiento, generación de código y creación de contenido.
| Modelo | Proveedor | Contexto | Ideal para |
|---|---|---|---|
| GPT-4o | OpenAI | 128K | Propósito general, multimodal |
| GPT-4.1 | OpenAI | 1M | Contexto largo, programación |
| Claude Opus 4.8 | Anthropic | 200K | Razonamiento complejo, análisis |
| Claude Sonnet 4.6 | Anthropic | 200K | Equilibrio velocidad/calidad |
| Gemini 2.5 Pro | 1M | Contexto largo, investigación | |
| DeepSeek V3 | DeepSeek | 128K | Costo eficiente, programación |
| Llama 4 | Meta | 128K | Alternativa de código abierto |
| Mistral Large 3 | Mistral | 128K | IA europea, multilingüe |
Visión y multimodal
Modelos que comprenden imágenes, capturas de pantalla y documentos junto con texto.
| Modelo | Proveedor | Entrada |
|---|---|---|
| GPT-4o Vision | OpenAI | Texto + Imagen |
| Claude 4 Vision | Anthropic | Texto + Imagen + PDF |
| Gemini 2.5 Vision | Texto + Imagen + Video | |
| Qwen-VL | Alibaba | Texto + Imagen |
Embeddings y reranking
Vectores de embedding para búsqueda semántica, RAG, clustering y detección de similitud.
| Modelo | Proveedor | Dimensiones |
|---|---|---|
| text-embedding-3-large | OpenAI | 3072 / 256-1024 |
| text-embedding-3-small | OpenAI | 1536 / 512 |
| Cohere Embed v3 | Cohere | 1024 |
| Voyage AI | Voyage | 1024 / 2048 |
| BGE-M3 | BAAI | 1024 |
Voz y audio
Modelos de texto a voz y voz a texto para aplicaciones de voz.
| Modelo | Proveedor | Tipo |
|---|---|---|
| GPT-4o TTS | OpenAI | Texto a voz |
| Whisper | OpenAI | Voz a texto |
| ElevenLabs | ElevenLabs | Texto a voz |
Cambio de modelos
Para usar cualquier modelo, simplemente pase su ID en el campo model de su solicitud API:
# Switch from GPT-4o to Claude Opus — same code, one param change
response = client.chat.completions.create(
model="claude-opus-4-8", # ← Just change this
messages=[{"role": "user", "content": "Write a haiku about coding."}],
)Explore el catálogo completo de modelos con precios en vivo en api.tokspan.com/pricing.
Control de esfuerzo de razonamiento
Para modelos de razonamiento (GPT-5, Claude Opus, DeepSeek R1, Qwen3), puede controlar la profundidad del razonamiento agregando un sufijo al nombre del modelo:
| Sufijo | Efecto | Ejemplo |
|---|---|---|
-high | Máxima profundidad de razonamiento: mejor calidad, más lento | gpt-5-high |
-medium | Razonamiento equilibrado (predeterminado para la mayoría de los modelos) | gpt-5-medium |
-low | Rápido, razonamiento mínimo: ideal para tareas simples | gpt-5-low |
-thinking | Devuelve tokens de razonamiento en la respuesta | claude-opus-4-8-thinking |
Si no se proporciona un sufijo, se usa el nivel de razonamiento predeterminado del modelo. Esto le permite equilibrar velocidad y costo frente a la calidad de respuesta por solicitud, sin modificar su código de integración.
Conversión entre formatos
TokSpan convierte automáticamente entre diferentes formatos de API de forma transparente. Usted siempre envía solicitudes en el formato OpenAI Chat Completions: TokSpan se encarga de la traducción al formato nativo del proveedor upstream:
- OpenAI → Claude Messages API: los prompts de sistema, la conversación de múltiples turnos y las definiciones de herramientas se reasignan automáticamente
- OpenAI → Gemini API: las partes de contenido, la configuración de seguridad y los parámetros de generación se traducen de forma transparente
- Claude → formato OpenAI: las respuestas nativas de Claude se normalizan a la estructura estándar de respuesta de Chat Completions
Esto significa que puede usar el SDK de OpenAI para Python/Node, LangChain o cualquier biblioteca compatible con OpenAI para llamar a cualquier modelo, independientemente de su formato de API nativo.