GPT-6.1 Sol vs Claude Sonnet 5.5: mismo precio $2/$10, lanzados un día después, sin benchmark compartido

GPT-6.1 Sol vs Claude Sonnet 5.5: mismo precio de $2/$10, lanzados con un día de diferencia, sin benchmark compartido. Especificaciones, afirmaciones de los proveedores y cómo probar ambos por ti mismo.

Medy Evrard

30 September 2026

GPT-6.1 Sol vs Claude Sonnet 5.5: mismo precio $2/$10, lanzados un día después, sin benchmark compartido

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

GPT-6.1 Sol y Claude Sonnet 5.5 tienen un precio de 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida, y se lanzaron con un día de diferencia: Sonnet 5.5 el 28 de septiembre de 2026 y GPT-6.1 Sol el 29 de septiembre. Ningún proveedor ha comparado uno con el otro. OpenAI comparó GPT-6.1 Sol con Claude Opus 5.5 y Fable 5.1, y Anthropic comparó Sonnet 5.5 con GPT-6 Sol, el Sol anterior. La forma honesta de elegir es ejecutar ambos en sus propias tareas y comparar el costo por tarea, no el precio por token.

A continuación: especificaciones y precios uno al lado del otro, lo que cada proveedor afirma y contra qué modelo, las cifras de terceros (todas sobre GPT-6 Sol, no 6.1) y un método para ejecutar la comparación usted mismo en Apidog. Para cada modelo individualmente, consulte qué es GPT-6.1 Sol y qué es Claude Sonnet 5.5.

GPT-6.1 Sol vs Claude Sonnet 5.5: especificaciones y precios

Fuentes: página de precios de OpenAI, descripción general de Sonnet 5.5 y precios de Anthropic, además de la página del modelo GPT-6.1 Sol enlazada a continuación.

GPT-6.1 Sol Claude Sonnet 5.5
ID del Modelo gpt-6.1-sol claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5)
Lanzado 29 de septiembre de 2026 28 de septiembre de 2026
Entrada / salida por 1M $2 / $10 $2 / $10
Lecturas de caché por 1M $0.10 $0.20
Escrituras de caché por 1M $2.50 $2.50 (5 minutos), $4 (1 hora)
Lote por 1M $1 / $5 $1 / $5
Prompts de más de 272K tokens de entrada $4 entrada, $0.20 en caché, $15 salida para toda la solicitud Sin prima en la ventana de 1M
Nivel más rápido Rápido a $4 / $20; Ultrafast "próximamente" Modo rápido no disponible
Ventana de contexto 1,050,000 (922,000 entrada máxima) 1M
Salida máxima 128,000 128K (300K en Lote con una cabecera beta)
Corte de conocimiento 30 de abril de 2026 Junio de 2026
Niveles de esfuerzo low, medium (predeterminado), high, xhigh, max; no none low, medium, high (predeterminado de API), xhigh, max; el pensamiento no se puede desactivar (configuración más baja: between_tools)
Forma de API Responses (con herramientas), Chat Completions (sin herramientas), Batch Messages, Batch
Otras plataformas OpenRouter (openai/gpt-6.1-sol) Bedrock, Google Cloud, Microsoft Foundry, Claude Platform en AWS
Acceso gratuito Ninguno. Plus, Pro, Business, Enterprise y Edu lo obtienen en ChatGPT Work y Codex (no Chat; Enterprise y Edu una vez que un administrador lo habilita, según la documentación de modelos); no hay nivel de API gratuito. Cualquiera puede chatear con él en Claude.ai; la API cobra por token.

Dos filas son las más importantes para el costo. Las lecturas de caché de GPT-6.1 Sol cuestan la mitad que las de Sonnet 5.5, por lo que reutilizar un prompt largo es más barato en OpenAI. Por encima de los 272K tokens de entrada, el equilibrio cambia: la página del modelo GPT-6.1 Sol cotiza la solicitud completa a 2x las tarifas de entrada y caché y 1.5x las de salida, mientras que Sonnet 5.5 se mantiene en $2 y $10. Un prompt de 400,000 tokens con una respuesta de 5,000 tokens cuesta aproximadamente $1.68 en GPT-6.1 Sol y $0.85 en Sonnet 5.5, sin caché.

Lo que cada proveedor afirma y contra qué modelo

OpenAI sobre GPT-6.1 Sol Anthropic sobre Claude Sonnet 5.5
Comparado con GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5, Claude Fable 5.1 Sonnet 5, Opus 5.5, GPT-6 Sol (GPT-5.6 Sol en dos gráficos)
Incluye el otro modelo No No (GPT-6.1 Sol aún no existía)
Titular "Inteligencia casi-Astra" a un quinto de los precios de tokens estándar de Astra 30%+ más rápido que Sonnet 5, hasta un 30% menos por tarea
Quién calculó los números OpenAI (resultados de la competencia de informes públicos, según su nota al pie) Anthropic, además de Cognition, Cursor, Artificial Analysis y Surge AI para benchmarks nombrados

La publicación de lanzamiento de GPT-6.1 Sol de OpenAI afirma estos resultados reportados por OpenAI en su texto:

La publicación de lanzamiento de Sonnet 5.5 de Anthropic incluye una columna de GPT-6 Sol:

El desglose de benchmarks de Sonnet 5.5 cubre el resto de la tabla de Anthropic.

Opus 5.5 aparece en ambos gráficos, y ambos proveedores informan AutomationBench y Terminal-Bench Science, por lo que es tentador unir los dos. Los números no coinciden. OpenAI informa AutomationBench 1.0.6 con un esfuerzo medio en su propio arnés, mientras que la tabla de resumen de la tarjeta del sistema de Anthropic ejecuta sus modelos Claude con un esfuerzo máximo (Sonnet 5.5 44.7, Opus 5.5 42.5; GPT-6 Sol 32.0). Anthropic le da a Sonnet 5.5 un 59.9% en Terminal-Bench Science, pero el texto de OpenAI no da una puntuación bruta para GPT-6.1 Sol. Y OpenAI probó el uso de la computadora en OSWorld 2.0 offline, Anthropic en OSWorld 2.1. La comparación de GPT-6 Sol vs Claude Opus 5.5 chocó con el mismo muro.

Lo que los terceros midieron (en GPT-6 Sol, no en 6.1)

Cada comparación de terceros en los resultados de búsqueda empareja Sonnet 5.5 con GPT-6 Sol. La más completa es Artificial Analysis, cuyo Intelligence Index v4.3.2 agrega 10 evaluaciones:

Esfuerzo Índice Sonnet 5.5 Costo por tarea Sonnet 5.5 Índice GPT-6 Sol Costo por tarea GPT-6 Sol
medio 41 $0.59 40 $0.25
alto 47 $1.08 43 $0.38
xalto 52 $2.74 44 $0.52
máximo 56 $7.60 48 $1.05

Con el esfuerzo máximo, la misma página mide Sonnet 5.5 en 138 tokens de salida por segundo y GPT-6 Sol en 76. Sonnet 5.5 obtiene una puntuación más alta y cuesta más por tarea en cada nivel de esfuerzo mostrado, a pesar de los precios de lista idénticos; el consumo de tokens es la diferencia. Sonnet 5.5 en alto (47, $1.08) se sitúa junto a GPT-6 Sol en máximo (48, $1.05).

Los datos del propio gráfico de Anthropic tienen doble filo. En AA-Briefcase, GPT-6 Sol cuesta menos por tarea en todos los niveles de esfuerzo ($0.34 frente a $1.64 en medio) mientras que Sonnet 5.5 obtiene una puntuación más alta. En FrontierCode, Sonnet 5.5 en alto alcanza el 49.4% por $0.42 por tarea, frente al 49.3% de GPT-6 Sol en máximo por $2.07.

Todo esto es el Sol más antiguo. OpenAI dice que GPT-6.1 Sol supera a GPT-6 Sol con el mismo o menor esfuerzo en varios benchmarks, por lo que se espera que su fila se mueva una vez que terceros lo prueben.

Dónde es probable que cada uno sea más fuerte, según el propio marco de los proveedores

GPT-6.1 Sol. OpenAI lo presenta para "codificación compleja, uso de computadora y trabajo profesional cuando se desea un rendimiento casi-Astra a un costo menor". Sus ganancias declaradas se refieren a la automatización de agentes, el uso de computadoras y las tareas científicas, además de menos errores de hecho con poco esfuerzo. En cuanto al precio, favorece las cargas de trabajo intensivas en caché de menos de 272K tokens de entrada, y es el único de los dos con un nivel de velocidad de pago (Fast).

Claude Sonnet 5.5. Anthropic lo presenta para tareas cotidianas bien definidas, corrección de errores y documentos, diapositivas y hojas de cálculo pulidos, y dice que Opus 5.5 "sigue siendo claramente más fuerte en trabajos complejos y abiertos" (ver Sonnet 5.5 vs Opus 5.5). Sus fortalezas reportadas son la codificación de agentes (70.6% en Terminal-Bench 4.0 en máximo, ejecutado por Anthropic), el trabajo de conocimiento y el uso de computadoras (80.1% parcial en OSWorld 2.1). En cuanto al precio, favorece los prompts de más de 272K tokens, y se ejecuta en Bedrock, Google Cloud y Microsoft Foundry.

Dos comportamientos sesgan una prueba ingenua. El esfuerzo predeterminado difiere (medium para GPT-6.1 Sol, high para Sonnet 5.5 en la API), así que compare configuraciones coincidentes. Y ninguno acepta perillas de muestreo: Sonnet 5.5 devuelve 400 en temperature, top_p o top_k no predeterminados, y la guía de GPT-6 de OpenAI dice que se debe reducir temperature y top_p cuando el esfuerzo no es none. Controle la varianza con ejecuciones repetidas.

Ejecuta la comparación tú mismo en Apidog

Elija de 20 a 50 tareas de su tráfico real con respuestas verificables, como un campo JSON o una etiqueta. Luego, en Apidog:

  1. Cree un entorno con OPENAI_API_KEY y ANTHROPIC_API_KEY como secretos, además de EFFORT.
  2. Guarde dos solicitudes que compartan una variable {{prompt}}. Las formas difieren (referencia de Responses, referencia de Messages); la comparación de formatos de API explica por qué:
POST https://api.openai.com/v1/responses
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json

{"model": "gpt-6.1-sol", "reasoning": {"effort": "{{EFFORT}}"},
 "max_output_tokens": 25000, "input": "{{prompt}}"}
POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json

{"model": "claude-sonnet-5-5", "max_tokens": 25000,
 "output_config": {"effort": "{{EFFORT}}"},
 "messages": [{"role": "user", "content": "{{prompt}}"}]}
  1. Agregue aserciones para cada forma, luego una sobre la respuesta misma contra una columna expected:
Comprobar Respuestas de OpenAI Mensajes de Anthropic
Terminó normalmente $.status es igual a completed $.stop_reason es igual a end_turn
Respuesta presente $.output[*].type contiene message $.content[*].type contiene text
Tokens de salida, incluyendo el razonamiento $.usage.output_tokens $.usage.output_tokens
Lecturas de caché $.usage.input_tokens_details.cached_tokens $.usage.cache_read_input_tokens
Escrituras de caché $.usage.input_tokens_details.cache_write_tokens $.usage.cache_creation_input_tokens
  1. Ponga precio a cada respuesta en un script de postprocesamiento. Los input_tokens de OpenAI incluyen tokens en caché y de escritura de caché, así que réstelos antes de aplicar la tarifa de $2 (almacenamiento en caché de prompts de OpenAI). Los input_tokens de Anthropic cuentan solo los tokens después del último punto de interrupción de caché (almacenamiento en caché de prompts de Anthropic). Aplique la regla de 272K en el lado de OpenAI.
  2. Ponga ambas solicitudes en un único escenario de prueba, mantenga los prompts en una sola línea, sin comillas dobles, en un CSV, y ejecútelo desde la CLI de Apidog en cada esfuerzo que le interese:
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
  -d prompts.csv --env-var "EFFORT=medium" -r cli,junit

Divida el gasto total por el número de tareas que pasaron: ese es su costo por tarea. Ejecute al menos medium y high en ambos, ya que el mismo nombre de esfuerzo no está calibrado de la misma manera en todos los proveedores. Para obtener detalles de la solicitud, consulte la guía de la API de GPT-6.1 Sol y cómo usar la API de Claude Sonnet 5.5.

Preguntas frecuentes

¿Es GPT-6.1 Sol más barato que Claude Sonnet 5.5? Mismo precio de lista, $2/$10 por 1M. Las lecturas de caché de GPT-6.1 Sol son más baratas; Sonnet 5.5 es más barato por encima de los 272K tokens de entrada. El costo real depende de los tokens utilizados por tarea.

¿Cuál es mejor en codificación? No existe un benchmark compartido. Anthropic informa que Sonnet 5.5 está por encima de GPT-6 Sol en FrontierCode; OpenAI informa que GPT-6.1 Sol supera la mejor puntuación DeepSWE de GPT-6 Sol en 6.4 pp. Pruebe en su propio repositorio.

¿Cuál es más rápido? Artificial Analysis midió Sonnet 5.5 en 138 tokens por segundo y GPT-6 Sol en 76, ambos con esfuerzo máximo. Todavía no hay un número de terceros para GPT-6.1 Sol.

¿Alguno de ellos es gratuito? GPT-6.1 Sol no tiene un nivel gratuito. Sonnet 5.5 está disponible en las aplicaciones de chat de Claude.ai, pero la API cobra por token. Consulte cómo usar Claude Sonnet 5.5 gratis.

Elija ejecutando ambos

Tome diez tareas de su backlog, ejecute ambos modelos en medium y high, y compare el costo por tarea aprobada. Descargue Apidog para mantener el par como un escenario que puede volver a ejecutar cuando Artificial Analysis publique los números de GPT-6.1 Sol o cualquiera de los proveedores lance una nueva instantánea.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs