GPT-6.1 Sol y Claude Sonnet 5.5 tienen un precio de 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida, y se lanzaron con un día de diferencia: Sonnet 5.5 el 28 de septiembre de 2026 y GPT-6.1 Sol el 29 de septiembre. Ningún proveedor ha comparado uno con el otro. OpenAI comparó GPT-6.1 Sol con Claude Opus 5.5 y Fable 5.1, y Anthropic comparó Sonnet 5.5 con GPT-6 Sol, el Sol anterior. La forma honesta de elegir es ejecutar ambos en sus propias tareas y comparar el costo por tarea, no el precio por token.
A continuación: especificaciones y precios uno al lado del otro, lo que cada proveedor afirma y contra qué modelo, las cifras de terceros (todas sobre GPT-6 Sol, no 6.1) y un método para ejecutar la comparación usted mismo en Apidog. Para cada modelo individualmente, consulte qué es GPT-6.1 Sol y qué es Claude Sonnet 5.5.
GPT-6.1 Sol vs Claude Sonnet 5.5: especificaciones y precios
Fuentes: página de precios de OpenAI, descripción general de Sonnet 5.5 y precios de Anthropic, además de la página del modelo GPT-6.1 Sol enlazada a continuación.
| GPT-6.1 Sol | Claude Sonnet 5.5 | |
|---|---|---|
| ID del Modelo | gpt-6.1-sol |
claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5) |
| Lanzado | 29 de septiembre de 2026 | 28 de septiembre de 2026 |
| Entrada / salida por 1M | $2 / $10 | $2 / $10 |
| Lecturas de caché por 1M | $0.10 | $0.20 |
| Escrituras de caché por 1M | $2.50 | $2.50 (5 minutos), $4 (1 hora) |
| Lote por 1M | $1 / $5 | $1 / $5 |
| Prompts de más de 272K tokens de entrada | $4 entrada, $0.20 en caché, $15 salida para toda la solicitud | Sin prima en la ventana de 1M |
| Nivel más rápido | Rápido a $4 / $20; Ultrafast "próximamente" | Modo rápido no disponible |
| Ventana de contexto | 1,050,000 (922,000 entrada máxima) | 1M |
| Salida máxima | 128,000 | 128K (300K en Lote con una cabecera beta) |
| Corte de conocimiento | 30 de abril de 2026 | Junio de 2026 |
| Niveles de esfuerzo | low, medium (predeterminado), high, xhigh, max; no none |
low, medium, high (predeterminado de API), xhigh, max; el pensamiento no se puede desactivar (configuración más baja: between_tools) |
| Forma de API | Responses (con herramientas), Chat Completions (sin herramientas), Batch | Messages, Batch |
| Otras plataformas | OpenRouter (openai/gpt-6.1-sol) |
Bedrock, Google Cloud, Microsoft Foundry, Claude Platform en AWS |
| Acceso gratuito | Ninguno. Plus, Pro, Business, Enterprise y Edu lo obtienen en ChatGPT Work y Codex (no Chat; Enterprise y Edu una vez que un administrador lo habilita, según la documentación de modelos); no hay nivel de API gratuito. | Cualquiera puede chatear con él en Claude.ai; la API cobra por token. |
Dos filas son las más importantes para el costo. Las lecturas de caché de GPT-6.1 Sol cuestan la mitad que las de Sonnet 5.5, por lo que reutilizar un prompt largo es más barato en OpenAI. Por encima de los 272K tokens de entrada, el equilibrio cambia: la página del modelo GPT-6.1 Sol cotiza la solicitud completa a 2x las tarifas de entrada y caché y 1.5x las de salida, mientras que Sonnet 5.5 se mantiene en $2 y $10. Un prompt de 400,000 tokens con una respuesta de 5,000 tokens cuesta aproximadamente $1.68 en GPT-6.1 Sol y $0.85 en Sonnet 5.5, sin caché.
Lo que cada proveedor afirma y contra qué modelo
| OpenAI sobre GPT-6.1 Sol | Anthropic sobre Claude Sonnet 5.5 | |
|---|---|---|
| Comparado con | GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5, Claude Fable 5.1 | Sonnet 5, Opus 5.5, GPT-6 Sol (GPT-5.6 Sol en dos gráficos) |
| Incluye el otro modelo | No | No (GPT-6.1 Sol aún no existía) |
| Titular | "Inteligencia casi-Astra" a un quinto de los precios de tokens estándar de Astra | 30%+ más rápido que Sonnet 5, hasta un 30% menos por tarea |
| Quién calculó los números | OpenAI (resultados de la competencia de informes públicos, según su nota al pie) | Anthropic, además de Cognition, Cursor, Artificial Analysis y Surge AI para benchmarks nombrados |
La publicación de lanzamiento de GPT-6.1 Sol de OpenAI afirma estos resultados reportados por OpenAI en su texto:
- AutomationBench 1.0.6, esfuerzo medio: +2.2 pp sobre Opus 5.5 a aproximadamente un tercio del costo, y +4.8 pp sobre GPT-6 Sol.
- Terminal-Bench Science 0.1, esfuerzo máximo: $5.47 por tarea, frente a $23.21 para Opus 5.5. GPT-6 Astra sigue obteniendo la puntuación más alta, con un 68.1%.
- OSWorld 2.0 offline, esfuerzo máximo: +7 pp sobre GPT-6 Sol por menos de la mitad del costo.
La publicación de lanzamiento de Sonnet 5.5 de Anthropic incluye una columna de GPT-6 Sol:
- FrontierCode 1.1, ejecutado por Cognition: Sonnet 5.5 obtiene un 52.1% en xhigh (46.2% en max) frente a un 49.3% para GPT-6 Sol. Con un esfuerzo alto, Anthropic dice que Sonnet 5.5 iguala la mejor puntuación de GPT-6 Sol por aproximadamente un quinto del costo.
- GDPval-AA v2.1 y AA-Briefcase v1.1, ejecutados por Artificial Analysis: 1844 frente a 1487, y 1811 frente a 1483.
El desglose de benchmarks de Sonnet 5.5 cubre el resto de la tabla de Anthropic.
Opus 5.5 aparece en ambos gráficos, y ambos proveedores informan AutomationBench y Terminal-Bench Science, por lo que es tentador unir los dos. Los números no coinciden. OpenAI informa AutomationBench 1.0.6 con un esfuerzo medio en su propio arnés, mientras que la tabla de resumen de la tarjeta del sistema de Anthropic ejecuta sus modelos Claude con un esfuerzo máximo (Sonnet 5.5 44.7, Opus 5.5 42.5; GPT-6 Sol 32.0). Anthropic le da a Sonnet 5.5 un 59.9% en Terminal-Bench Science, pero el texto de OpenAI no da una puntuación bruta para GPT-6.1 Sol. Y OpenAI probó el uso de la computadora en OSWorld 2.0 offline, Anthropic en OSWorld 2.1. La comparación de GPT-6 Sol vs Claude Opus 5.5 chocó con el mismo muro.
Lo que los terceros midieron (en GPT-6 Sol, no en 6.1)
Cada comparación de terceros en los resultados de búsqueda empareja Sonnet 5.5 con GPT-6 Sol. La más completa es Artificial Analysis, cuyo Intelligence Index v4.3.2 agrega 10 evaluaciones:
| Esfuerzo | Índice Sonnet 5.5 | Costo por tarea Sonnet 5.5 | Índice GPT-6 Sol | Costo por tarea GPT-6 Sol |
|---|---|---|---|---|
| medio | 41 | $0.59 | 40 | $0.25 |
| alto | 47 | $1.08 | 43 | $0.38 |
| xalto | 52 | $2.74 | 44 | $0.52 |
| máximo | 56 | $7.60 | 48 | $1.05 |
Con el esfuerzo máximo, la misma página mide Sonnet 5.5 en 138 tokens de salida por segundo y GPT-6 Sol en 76. Sonnet 5.5 obtiene una puntuación más alta y cuesta más por tarea en cada nivel de esfuerzo mostrado, a pesar de los precios de lista idénticos; el consumo de tokens es la diferencia. Sonnet 5.5 en alto (47, $1.08) se sitúa junto a GPT-6 Sol en máximo (48, $1.05).
Los datos del propio gráfico de Anthropic tienen doble filo. En AA-Briefcase, GPT-6 Sol cuesta menos por tarea en todos los niveles de esfuerzo ($0.34 frente a $1.64 en medio) mientras que Sonnet 5.5 obtiene una puntuación más alta. En FrontierCode, Sonnet 5.5 en alto alcanza el 49.4% por $0.42 por tarea, frente al 49.3% de GPT-6 Sol en máximo por $2.07.
Todo esto es el Sol más antiguo. OpenAI dice que GPT-6.1 Sol supera a GPT-6 Sol con el mismo o menor esfuerzo en varios benchmarks, por lo que se espera que su fila se mueva una vez que terceros lo prueben.
Dónde es probable que cada uno sea más fuerte, según el propio marco de los proveedores
GPT-6.1 Sol. OpenAI lo presenta para "codificación compleja, uso de computadora y trabajo profesional cuando se desea un rendimiento casi-Astra a un costo menor". Sus ganancias declaradas se refieren a la automatización de agentes, el uso de computadoras y las tareas científicas, además de menos errores de hecho con poco esfuerzo. En cuanto al precio, favorece las cargas de trabajo intensivas en caché de menos de 272K tokens de entrada, y es el único de los dos con un nivel de velocidad de pago (Fast).
Claude Sonnet 5.5. Anthropic lo presenta para tareas cotidianas bien definidas, corrección de errores y documentos, diapositivas y hojas de cálculo pulidos, y dice que Opus 5.5 "sigue siendo claramente más fuerte en trabajos complejos y abiertos" (ver Sonnet 5.5 vs Opus 5.5). Sus fortalezas reportadas son la codificación de agentes (70.6% en Terminal-Bench 4.0 en máximo, ejecutado por Anthropic), el trabajo de conocimiento y el uso de computadoras (80.1% parcial en OSWorld 2.1). En cuanto al precio, favorece los prompts de más de 272K tokens, y se ejecuta en Bedrock, Google Cloud y Microsoft Foundry.
Dos comportamientos sesgan una prueba ingenua. El esfuerzo predeterminado difiere (medium para GPT-6.1 Sol, high para Sonnet 5.5 en la API), así que compare configuraciones coincidentes. Y ninguno acepta perillas de muestreo: Sonnet 5.5 devuelve 400 en temperature, top_p o top_k no predeterminados, y la guía de GPT-6 de OpenAI dice que se debe reducir temperature y top_p cuando el esfuerzo no es none. Controle la varianza con ejecuciones repetidas.
Ejecuta la comparación tú mismo en Apidog
Elija de 20 a 50 tareas de su tráfico real con respuestas verificables, como un campo JSON o una etiqueta. Luego, en Apidog:
- Cree un entorno con
OPENAI_API_KEYyANTHROPIC_API_KEYcomo secretos, además deEFFORT. - Guarde dos solicitudes que compartan una variable
{{prompt}}. Las formas difieren (referencia de Responses, referencia de Messages); la comparación de formatos de API explica por qué:
POST https://api.openai.com/v1/responses
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json
{"model": "gpt-6.1-sol", "reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000, "input": "{{prompt}}"}
POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json
{"model": "claude-sonnet-5-5", "max_tokens": 25000,
"output_config": {"effort": "{{EFFORT}}"},
"messages": [{"role": "user", "content": "{{prompt}}"}]}
- Agregue aserciones para cada forma, luego una sobre la respuesta misma contra una columna
expected:
| Comprobar | Respuestas de OpenAI | Mensajes de Anthropic |
|---|---|---|
| Terminó normalmente | $.status es igual a completed |
$.stop_reason es igual a end_turn |
| Respuesta presente | $.output[*].type contiene message |
$.content[*].type contiene text |
| Tokens de salida, incluyendo el razonamiento | $.usage.output_tokens |
$.usage.output_tokens |
| Lecturas de caché | $.usage.input_tokens_details.cached_tokens |
$.usage.cache_read_input_tokens |
| Escrituras de caché | $.usage.input_tokens_details.cache_write_tokens |
$.usage.cache_creation_input_tokens |
- Ponga precio a cada respuesta en un script de postprocesamiento. Los
input_tokensde OpenAI incluyen tokens en caché y de escritura de caché, así que réstelos antes de aplicar la tarifa de $2 (almacenamiento en caché de prompts de OpenAI). Losinput_tokensde Anthropic cuentan solo los tokens después del último punto de interrupción de caché (almacenamiento en caché de prompts de Anthropic). Aplique la regla de 272K en el lado de OpenAI. - Ponga ambas solicitudes en un único escenario de prueba, mantenga los prompts en una sola línea, sin comillas dobles, en un CSV, y ejecútelo desde la CLI de Apidog en cada esfuerzo que le interese:
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
-d prompts.csv --env-var "EFFORT=medium" -r cli,junit
Divida el gasto total por el número de tareas que pasaron: ese es su costo por tarea. Ejecute al menos medium y high en ambos, ya que el mismo nombre de esfuerzo no está calibrado de la misma manera en todos los proveedores. Para obtener detalles de la solicitud, consulte la guía de la API de GPT-6.1 Sol y cómo usar la API de Claude Sonnet 5.5.
Preguntas frecuentes
¿Es GPT-6.1 Sol más barato que Claude Sonnet 5.5? Mismo precio de lista, $2/$10 por 1M. Las lecturas de caché de GPT-6.1 Sol son más baratas; Sonnet 5.5 es más barato por encima de los 272K tokens de entrada. El costo real depende de los tokens utilizados por tarea.
¿Cuál es mejor en codificación? No existe un benchmark compartido. Anthropic informa que Sonnet 5.5 está por encima de GPT-6 Sol en FrontierCode; OpenAI informa que GPT-6.1 Sol supera la mejor puntuación DeepSWE de GPT-6 Sol en 6.4 pp. Pruebe en su propio repositorio.
¿Cuál es más rápido? Artificial Analysis midió Sonnet 5.5 en 138 tokens por segundo y GPT-6 Sol en 76, ambos con esfuerzo máximo. Todavía no hay un número de terceros para GPT-6.1 Sol.
¿Alguno de ellos es gratuito? GPT-6.1 Sol no tiene un nivel gratuito. Sonnet 5.5 está disponible en las aplicaciones de chat de Claude.ai, pero la API cobra por token. Consulte cómo usar Claude Sonnet 5.5 gratis.
Elija ejecutando ambos
Tome diez tareas de su backlog, ejecute ambos modelos en medium y high, y compare el costo por tarea aprobada. Descargue Apidog para mantener el par como un escenario que puede volver a ejecutar cuando Artificial Analysis publique los números de GPT-6.1 Sol o cualquiera de los proveedores lance una nueva instantánea.
