Anthropic lanzó Claude Sonnet 5.5 el 28 de septiembre de 2026. El precio por token no se mueve: sigue en 2 dólares por millón de entrada y 10 por millón de salida, exactamente los de Claude Sonnet 5. El ahorro que anuncia la empresa —hasta un 30 % menos por tarea— viene de gastar menos tokens, y lo mide ella. Te toca si tu negocio tiene un asistente o una automatización sobre esa API: cambiar el identificador del modelo puede romperlo de cinco maneras distintas.
Las fuentes de este artículo son de Anthropic, están en inglés y la traducción es propia; el original va entre comillas cuando la literalidad importa. Al final está declarado cómo se ha leído cada una.
Qué ha lanzado Anthropic exactamente
El 28 de septiembre Anthropic publicó Claude Sonnet 5.5, que describe como «el segundo modelo de la familia Claude 5.5» y como «un complemento más rápido y más barato de Claude Opus 5.5». La misma fecha aparece en las notas de versión de la plataforma Claude y en las notas de versión de las aplicaciones de Claude.
Las cifras que da el anuncio, atribuidas a las pruebas de la propia Anthropic:
- Genera respuestas «más de un 30 % más rápido» que Claude Sonnet 5, lo que lo convierte en «nuestro modelo Sonnet más rápido hasta la fecha».
- Cuesta «hasta un 30 % menos por tarea que su predecesor», no porque baje la tarifa, sino porque «suele necesitar bastantes menos tokens para hacer el mismo trabajo».
- Es el primer modelo Sonnet que sale con salvaguardas de ciberseguridad como las de los modelos más capaces de la casa, porque sus capacidades en esa materia «son comparables a las de Opus 5». Las de biología siguen siendo las mismas que las de Sonnet 5.
Anthropic añade que Claude Haiku 5.5 se unirá a la familia «en las próximas semanas». Esa parte es un anuncio de intención, sin fecha.
Según la ficha oficial del modelo, consultada el 29 de septiembre, Claude Sonnet 5.5 tiene una ventana de contexto de 1 millón de tokens, un máximo de 128.000 tokens de salida y un precio de 2 dólares por millón de tokens de entrada y 10 por millón de salida. Está disponible en la API de Claude para todos los clientes, y también en Amazon Bedrock, Google Cloud y Microsoft Foundry.
Qué no cambia
Esta es la mitad que casi nadie cuenta y la que evita decisiones precipitadas.
El precio por token es idéntico. La página de novedades del modelo lo dice sin matices: Claude Sonnet 5.5 «tiene los mismos precios que Claude Sonnet 5, incluidas las tarifas de caché de prompts y de procesamiento por lotes». La lectura de caché sigue en 0,20 dólares por millón y el lote mantiene su 50 % de descuento.
El tokenizador es el mismo. El mismo texto produce el mismo recuento de tokens que en Sonnet 5. Es lo que permite comparar facturas entre los dos modelos sin corregir nada.
La ventana de contexto y el máximo de salida son los mismos. 1 millón y 128.000 tokens en los dos, según la ficha de cada modelo.
Claude Sonnet 5 no desaparece. En la página de retirada de modelos, consultada el 29 de septiembre, claude-sonnet-5 figura como «Active», con fecha tentativa de retirada «no antes del 30 de junio de 2027». Lo que sí ha cambiado es su etiqueta: su ficha lo presenta ahora como modelo legado, que en el vocabulario de Anthropic significa que «no recibirá más actualizaciones y podría quedar obsoleto en el futuro». La misma página promete avisar «con al menos 60 días de antelación» antes de retirar un modelo público.
Traducido: si tu asistente funciona bien sobre Sonnet 5, no hay ninguna urgencia esta semana. Hay margen de un año largo y aviso previo.
Un detalle que sí cambia y no es una rotura: el corte de conocimiento. Sonnet 5 lo tiene en enero de 2026 y Sonnet 5.5, en junio de 2026. Cinco meses más de mundo conocido, según las fichas de ambos modelos.
Los cinco cambios que rompen código
Anthropic los llama «breaking changes» y los enumera en la página de novedades. Afectan «a código que ya está funcionando sobre Claude Sonnet 5»: no fallan al instalar nada, fallan cuando alguien cambia el identificador del modelo y la primera petición sale con un error 400. Van en lenguaje llano, porque el punto no es que los arregles tú, sino que sepas preguntar.
- Apagar el razonamiento previo se pide de otra forma. Lo que antes era
thinking: {"type": "disabled"}ahora esthinking: {"type": "between_tools"}. La petición antigua devuelve un error 400 cuyo mensaje apunta al nombre nuevo. - Ya no se puede obligar al modelo a usar una herramienta. Los valores
anyytooldel parámetrotool_choicedevuelven error. El mensaje es literal: «tool_choice: type "tool" and "any" are not supported for this model». La alternativa que documenta Anthropic es dejarautoy apoyarse en el uso estricto de herramientas o en salidas estructuradas. - Los bloques de razonamiento quedan atados al modelo y a la conversación. Una conversación que pasa de Sonnet 5 a Sonnet 5.5 conserva su razonamiento; una que va de Sonnet 5.5 a cualquier otro modelo lo pierde a partir del cambio. Además, si el historial se edita —cambian las instrucciones, las herramientas o un mensaje anterior—, la petición puede devolver error 400 en cuentas creadas a partir del 31 de agosto de 2026. La recomendación de Anthropic es mantener la conversación en modo añadir, nunca editar.
- La herramienta antigua de uso del ordenador deja de aceptarse. En la API de Claude y en Google Cloud hay que pasar al conjunto
computer_toolset_20260801. En Amazon Bedrock la antigua sigue funcionando. - Cambian las parejas válidas de la herramienta de asesor. Con un ejecutor Sonnet 5.5, los asesores Claude Opus 4.8, Opus 4.7 y Sonnet 5 devuelven error.
De los cinco, los dos primeros son los que aparecen en integraciones corrientes de negocio. Los tres últimos solo salen si alguien ha montado agentes con control del ordenador o cadenas de modelos.
El sexto cambio: el que no da ningún error
Hay uno más, y es el que más nos preocupa de todos, porque no rompe nada de forma visible.
En Claude Sonnet 5.5, las notas que el modelo escribe entre llamada y llamada a una herramienta dejan de venir como texto normal y vienen como bloques de razonamiento. Con la configuración por defecto, el texto de esos bloques llega vacío. Anthropic lo describe así en la página de novedades: una aplicación que muestra esas notas a sus usuarios «se queda en silencio entre llamadas a herramientas, sin ningún error».
Si tu asistente de WhatsApp escribe cosas como «déjame que mire la agenda» mientras consulta el calendario, ese aviso desaparece. La petición sigue devolviendo 200, no salta ninguna alarma y el cliente se queda mirando una pantalla quieta hasta que llega la respuesta final. Se arregla configurando el campo display para que devuelva el texto, o apagando el razonamiento previo con between_tools.
Hay un séptimo detalle del mismo tipo: los niveles de esfuerzo están recalibrados. Anthropic pide expresamente «repetir el barrido de esfuerzo en lugar de arrastrar el ajuste» de Sonnet 5. El mismo valor ya no produce la misma cantidad de razonamiento, y el razonamiento son tokens de salida, que son los caros.
A quién afecta y a quién no
Si solo usas la aplicación de Claude, no tienes nada que hacer. El modelo llegó a las aplicaciones el mismo 28 de septiembre, según sus notas de versión, y el cambio es transparente.
Si tu negocio tiene un asistente, un bot o una automatización sobre la API, te afecta en cuanto alguien decida actualizar el modelo. No antes.
Si no sabes en cuál de los dos casos estás, la pregunta que lo resuelve es: ¿alguien escribió código para conectar Claude con tus herramientas, o todo ocurre dentro de una ventana de chat? Si es lo primero, sigue leyendo la lista de abajo.
Qué hacer esta semana
- No actualices el modelo porque sí. Sonnet 5 está activo y con un año largo por delante. La actualización se hace cuando alguien pueda probarla, no el día del anuncio.
- Busca dos palabras en el código de tu asistente:
tool_choiceydisabled. Son las dos que provocan un error 400 inmediato. Si no lo mantienes tú, es la pregunta exacta para quien lo mantenga. - Prueba el cambio fuera de producción antes de tocar el asistente que habla con clientes. Una conversación completa de principio a fin, con las herramientas que usa de verdad.
- Comprueba los mensajes intermedios. Si tu asistente avisa de que está consultando algo, mira que siga avisando después del cambio. Es el fallo que no da error.
- Mide tu propia factura antes de creerte el 30 %. Guarda el consumo de una semana con Sonnet 5 y compáralo con una semana de Sonnet 5.5 sobre tus conversaciones reales. El tokenizador es el mismo, así que la comparación es limpia.
- Repite el ajuste de esfuerzo. Si tu integración fija un nivel, vuelve a decidirlo en lugar de copiarlo.
Un ejemplo: la clínica que actualiza un viernes
Una clínica dental con citas por WhatsApp automatizadas. Su integración fuerza el uso de la herramienta de agenda con tool_choice puesto en tool, porque así se garantizaba que el modelo consultara el calendario en lugar de inventarse un hueco. Es una decisión razonable y bastante común.
Actualizan a Sonnet 5.5 un viernes por la tarde, atraídos por el titular del 30 %. Cada petición devuelve ahora un error 400. Si la automatización no distingue un error de la API de una respuesta correcta —y muchas no lo hacen—, los pacientes que escriben el sábado no reciben nada. El lunes nadie entiende por qué hay huecos libres.
El arreglo es de media hora: quitar el forzado, dejar tool_choice en automático y decir en las instrucciones cuándo toca mirar la agenda. El problema no es el arreglo, es el fin de semana.
El análisis de PotencIA
Tres lecturas nuestras, separadas del hecho.
La primera: ese 30 % no es un dato independiente. Es una medición del fabricante sobre sus propias pruebas, y el propio anuncio la acota con un «hasta» y con un «en nuestras pruebas». No decimos que sea falsa; decimos que no es tu factura. Lo que sí es verificable es lo otro: la tarifa por token no ha bajado ni un céntimo. Quien te venda esto como una bajada de precio está contando la mitad.
La segunda, y es nuestro criterio, no un dato: un lanzamiento de modelo es el peor momento para actualizar y el mejor momento para leer. La información útil de esta semana no es el modelo nuevo, es la lista de cinco roturas. Esa lista es un mapa gratis de los puntos frágiles de tu integración, sirvan o no para migrar. Si en tu código aparecen tres de los cinco, tu automatización está más acoplada a un modelo concreto de lo que creías, y eso es un problema el día que ese modelo se retire, no hoy.
La tercera enlaza con lo que contamos el 25 de septiembre. Entonces explicamos qué rechazos empieza a cobrar la API de Claude y señalamos que cyber no estaba entre las categorías facturadas porque el clasificador se equivocaba demasiado con ella. Claude Sonnet 5.5 es el primer Sonnet que nace con salvaguardas de ciberseguridad, así que esa categoría va a aparecer más. Seguimos donde estábamos: según la documentación de rechazos, un rechazo de categoría cyber anterior a cualquier salida no se factura, y el modelo de reserva del servidor lo reintenta en Sonnet 5. Pero el consejo de aquel artículo vale doble ahora: guarda la categoría de cada rechazo en tu registro, porque es lo único que te dirá si ese reparto cambia.
Y el criterio de fondo con el que montamos las automatizaciones de WhatsApp con IA de PotencIA no se mueve con cada lanzamiento: el modelo es una pieza intercambiable, y una integración que no se puede cambiar de modelo sin romperse está mal montada. Lo que no es intercambiable es lo otro —que quede registrado qué pasó con cada conversación al conectar el canal con el CRM por la API oficial—, y eso no lo arregla ningún modelo nuevo. El lanzamiento equivalente de la semana pasada, la bajada de precio de la API de OpenAI con GPT-6 Sol y Luna, contaba la otra cara: allí sí bajó la tarifa.
Cómo se ha verificado esto
Las cinco páginas se han abierto el 29 de septiembre de 2026 desde España. Todas responden con HTTP 200 a la lectura directa, sin rodeos ni desafíos de seguridad. Las páginas de documentación de Anthropic se han leído en su versión Markdown, que la plataforma sirve añadiendo .md a la dirección; el contenido es el mismo que el de la página web.
La fecha del 28 de septiembre de 2026 está afirmada tres veces de forma independiente: en el anuncio de Anthropic, junto al nombre del modelo; en las notas de versión de la plataforma, como encabezado de la entrada más reciente, por delante de la del 24 de septiembre sobre rechazos facturados; y en las notas de versión de las aplicaciones de Claude, cuyo dato de última modificación en el código de la página marca el 28 de septiembre de 2026 a las 18:20 UTC. No se ha usado ninguna marca de tiempo relativa del tipo «hace dos días».
Las cifras de velocidad y de coste por tarea proceden del anuncio y se presentan como lo que son: mediciones de Anthropic sobre sus propias pruebas. No hay ninguna medición nuestra ni de terceros que las confirme, y así queda dicho en el artículo. Los precios por millón de tokens, la ventana de contexto y el máximo de salida proceden de las fichas oficiales de Claude Sonnet 5.5 y Claude Sonnet 5. El estado «Active» de Sonnet 5, su fecha tentativa de retirada y el aviso de 60 días proceden de la página de retirada de modelos. No se ha hecho ningún cálculo propio en esta pieza: no había ninguna cuenta que hiciera falta.
Los ejemplos de la clínica dental y del asistente que se queda mudo están construidos para explicar el efecto de dos cambios concretos. No son incidentes de ningún cliente.
No se ha consultado ningún medio, agregador ni resumen de terceros. Tampoco ninguna herramienta de indexación ni de rendimiento en buscadores.
Fuentes consultadas
- Presentación de Claude Sonnet 5.5, Anthropic, fechada el 28 de septiembre de 2026 y consultada el 29 de septiembre: la descripción del modelo como segundo de la familia Claude 5.5, el 30 % más de velocidad, el «hasta un 30 % menos por tarea» con el matiz de que gasta menos tokens con la misma tarifa, las salvaguardas de ciberseguridad y biología, y el anuncio de Claude Haiku 5.5 sin fecha.
- Notas de versión de la plataforma Claude, entrada del 28 de septiembre de 2026, consultada el 29 de septiembre: lanzamiento en la API de Claude, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry, y resumen de las cinco roturas.
- Novedades de Claude Sonnet 5.5, consultada el 29 de septiembre: el detalle de cada una de las cinco roturas con sus mensajes de error, el cambio de forma de la respuesta entre llamadas a herramientas, la recalibración de los niveles de esfuerzo, la igualdad de precios con Sonnet 5 y la disponibilidad por plataforma.
- Ficha de Claude Sonnet 5.5 y ficha de Claude Sonnet 5, consultadas el 29 de septiembre: ventana de contexto, máximo de salida, precios de entrada, salida y caché, cortes de conocimiento de enero y junio de 2026, y la etiqueta de modelo legado de Sonnet 5.
- Retirada de modelos de Claude, consultada el 29 de septiembre: el estado «Active» de
claude-sonnet-5yclaude-sonnet-5-5, sus fechas tentativas de retirada del 30 de junio y del 28 de septiembre de 2027, la definición de modelo legado y el compromiso de avisar con 60 días. - Notas de versión de las aplicaciones de Claude, entrada del 28 de septiembre de 2026, consultada el 29 de septiembre: confirmación de que el modelo llegó el mismo día a las aplicaciones de Claude.
- Rechazos y modelo de reserva, documentación de Claude, consultada el 29 de septiembre: las categorías que se facturan antes de cualquier salida y el reintento en Sonnet 5 que hace el modelo de reserva del servidor para la categoría
cyber.
