OpenAI abrió el 8 de octubre de 2026 el modo Ultrafast de GPT-6.1 Sol a todos los usuarios de su API, y con una condición que ningún nivel rápido anterior tenía: se puede usar con residencia de datos en la Unión Europea. La contrapartida está en la tarifa, porque Ultrafast cuesta seis veces el precio estándar del mismo modelo. Te toca si tu negocio tiene un asistente, un bot de WhatsApp o un clasificador montado sobre esa API y alguien ha pedido que responda más rápido sin sacar los datos de Europa.
Las fuentes de este artículo son documentación pública de OpenAI, están en inglés y la traducción es propia; el original va entre comillas cuando la literalidad importa. Los cálculos que no vienen de ellas están marcados como nuestros. Al final queda declarado cómo se ha leído cada fuente.
Qué cambió exactamente el 8 de octubre
Una entrada en el registro de cambios de la API de OpenAI, fechada el 8 de octubre de 2026 y etiquetada como función sobre el modelo gpt-6.1-sol y el endpoint v1/responses:
Añadido el modo Ultrafast para GPT-6.1 Sol en la Responses API. Usagpt-6.1-solconservice_tier: "ultrafast"para reducir el tiempo entre los tokens de salida generados. Está disponible para todos los usuarios de la API, sujeto a límites de tasa, con procesamiento global y residencia de datos en Estados Unidos y la UE.
Son dos cosas en una frase. La primera, que Ultrafast deja de ser un nivel restringido para GPT-6.1 Sol. La segunda, y es la que de verdad cambia algo en España, es el final: residencia de datos en la UE.
Por qué la residencia de datos es la noticia y no la velocidad
Ultrafast no es nuevo. OpenAI lo había activado para GPT-6 Astra el 29 de septiembre de 2026, y aquella entrada del mismo registro de cambios terminaba justo al revés: «Está disponible para los clientes de la API, sujeto a límites de tasa, con procesamiento global y residencia de datos en Estados Unidos. La residencia de inferencia en la UE y en otras regiones no está soportada».
Nueve días después, la guía de datos de OpenAI lo deja por escrito en una sola línea: «El modo Ultrafast para GPT-6.1 Sol admite residencia de datos en Estados Unidos y la UE y procesamiento global. GPT-6 Astra Ultrafast admite solo residencia de datos en Estados Unidos y procesamiento global».
Esa misma guía concreta qué significa la UE aquí: la región es Europa, entendida como Espacio Económico Europeo más Suiza, y las peticiones se mandan al dominio eu.api.openai.com. Para el tráfico que va a ese dominio, OpenAI dice usar Cloudflare Regional Services «de modo que la terminación TLS y el descifrado HTTPS ocurran dentro de la región de procesamiento elegida».
Conviene leer también lo que la residencia de datos no cubre, porque está en el mismo documento: no se aplica a los datos de sistema, que la guía define como «datos de cuenta, metadatos y datos de uso que no contienen contenido del cliente», ni al contenido que salga de la región por la ubicación de un usuario final o de tu propia infraestructura.
Qué hace Ultrafast y qué no promete
La guía de modo Ultrafast lo define como «el nivel de servicio más rápido de la API de OpenAI» y añade una recomendación que es casi una advertencia: «Úsalo cuando la velocidad justifique el coste más alto».
Lo que conviene mirar con lupa es la formulación del registro de cambios: Ultrafast sirve «para reducir el tiempo entre los tokens de salida generados». No dice que reduzca la espera hasta el primer token, ni el tiempo de razonamiento del modelo. Es lectura nuestra, pero es la que se desprende del texto: Ultrafast acelera el ritmo al que sale la respuesta una vez empieza a salir. En ningún punto de esa guía ni de la ficha del modelo OpenAI publica una cifra de latencia en milisegundos con la que comparar.
Hay tres detalles operativos más en esa misma guía:
- OpenAI «recomienda encarecidamente» WebSockets, «especialmente para aplicaciones agénticas que hacen muchas llamadas a herramientas en rápida sucesión», porque «sin una conexión persistente, la sobrecarga de red puede reducir las ganancias de latencia».
- Ultrafast tiene límites de tasa propios, separados de los de los modos Standard y Fast.
- Para GPT-6.1 Sol, esos límites por minuto son de 1.000.000 de tokens en el nivel Build, 4.000.000 en Launch y 40.000.000 en Grow.
El nivel Build es el de entrada de pago. Según la guía de límites de tasa, se alcanza con 5 dólares en compras de crédito acumuladas y trae un límite de uso de 500 dólares al mes. Dicho de otro modo: el millón de tokens por minuto en Ultrafast está al alcance de cualquier negocio que ya pague la API, no hace falta un contrato grande. OpenAI simplificó esos niveles de cinco a tres —Build, Launch y Grow— el 6 de octubre de 2026, según el mismo registro de cambios.
Lo que cuesta
La página de precios de la API, en su pestaña Ultrafast, da estas tarifas por millón de tokens para gpt-6.1-sol en contexto corto, que es todo lo que no pase de 272.000 tokens de entrada:
- Entrada: 12,00 dólares.
- Entrada en caché: 0,60 dólares.
- Escritura en caché: 15,00 dólares.
- Salida: 60,00 dólares.
En contexto largo, por encima de esos 272.000 tokens, pasa a 24,00 dólares de entrada, 1,20 en caché, 30,00 de escritura en caché y 90,00 de salida.
Para situarlo, la ficha del modelo GPT-6.1 Sol da el precio estándar del mismo modelo: 2 dólares de entrada, 0,10 en caché, 2,50 de escritura en caché y 10 dólares de salida. Y resume la relación entre niveles en tres frases: «Los precios del modo Fast son 2x Standard», «Los precios del modo Ultrafast son 6x Standard» y «Los precios de Batch y Flex son un 50 % más bajos que Standard».
Hay un recargo que no aparece en la tabla y sí en la nota al pie de la página de precios: «Los endpoints de procesamiento regional (residencia de datos) se cobran con un recargo del 10 % para los modelos publicados a partir del 5 de marzo de 2026». GPT-6.1 Sol se publicó el 29 de septiembre de 2026, así que entra.
Y hay una puerta administrativa antes que todo eso. La guía de datos dice que hay que «contactar con nuestro equipo comercial para ver si eres elegible para usar los controles de residencia de datos», y añade que «para usar residencia de datos con cualquier región distinta de Estados Unidos, tienes que estar aprobado para los controles de monitorización de abuso y firmar una enmienda de Retención Modificada». La residencia en la UE no es una casilla en el panel: es una conversación con OpenAI.
Nuestro cálculo: un asistente de WhatsApp con 1.500 conversaciones al mes
Esto no viene de OpenAI. Es una cuenta nuestra con las tarifas de arriba, para que el «seis veces más» deje de ser un porcentaje y sea una factura.
Supuestos: 1.500 conversaciones al mes, 4.000 tokens de entrada por conversación entre instrucciones, contexto del cliente e historial, y 300 tokens de salida. Son 6 millones de tokens de entrada y 450.000 de salida al mes. Sin caché de prompt, para aislar el efecto del nivel de servicio.
- Standard, procesamiento global: 16,50 dólares al mes.
- Fast, procesamiento global: 33,00 dólares.
- Ultrafast, procesamiento global: 99,00 dólares.
- Fast con residencia en la UE, con el recargo del 10 %: 36,30 dólares.
- Ultrafast con residencia en la UE, con el recargo del 10 %: 108,90 dólares.
Entre la configuración más barata y la del titular hay 92,40 dólares al mes de diferencia, 6,6 veces más, para el mismo modelo y el mismo trabajo. Y la comparación importante no es la primera contra la última: es Fast en la UE contra Ultrafast en la UE, 36,30 frente a 108,90, porque las dos resuelven la misma pregunta de «quiero más velocidad sin salir de Europa».
Un matiz que juega a favor del que optimice: la caché de prompt se abarata en la misma proporción, de 0,10 a 0,60 dólares por millón. Si tu asistente repite el mismo bloque de instrucciones en cada conversación, buena parte de esos 6 millones de tokens de entrada puede entrar en caché y la cuenta cambia bastante. Lo que no cambia es la salida, que es donde Ultrafast muerde: 60 dólares por millón frente a 10.
Qué no cambia
- Los modos Standard, Fast, Flex y Batch de GPT-6.1 Sol mantienen sus precios y su disponibilidad. Esto es un nivel nuevo, no una subida.
- Fast ya admitía residencia de datos en la UE para GPT-6.1 Sol, GPT-6 Sol y GPT-6 Luna. Si tu problema era Europa y no la velocidad extrema, esa puerta ya estaba abierta.
- GPT-6 Astra en Ultrafast sigue sin residencia en la UE. El cambio del 8 de octubre es solo para Sol.
- El umbral de contexto largo sigue en 272.000 tokens de entrada, y por encima de él todas las tarifas suben.
- La residencia de datos sigue requiriendo aprobación previa de OpenAI y una enmienda contractual. No se activa sola.
Qué debería hacer una pyme ahora
- Comprueba si tu problema es de latencia de salida o de espera inicial. Si el cliente se queja de que «tarda en empezar a contestar», Ultrafast no ataca eso, y pagarías seis veces por algo que no es tu cuello de botella.
- Antes de tocar el nivel de servicio, mide. Un asistente de WhatsApp que responde en dos segundos no mejora la conversión por bajar a uno y medio; uno que tarda quince, sí.
- Si lo que te aprieta es el expediente de protección de datos y no el reloj, mira Fast con residencia en la UE antes que Ultrafast: cuesta el doble del estándar, no seis veces.
- Si vas a pedir residencia de datos en la UE, empieza por la parte lenta: la elegibilidad, la enmienda de Retención Modificada y el cambio de dominio a
eu.api.openai.com. La tarifa es lo fácil. - Mete el recargo del 10 % en el presupuesto desde el principio. Es pequeño en porcentaje y constante en el tiempo.
- Revisa la caché de prompt antes de subir de nivel. Reordenar las instrucciones para que el bloque fijo vaya primero suele dar más ahorro que cualquier cambio de modelo.
Nuestra lectura
En PotencIA llevamos semanas viendo el mismo patrón en los anuncios de precio de los grandes modelos: el titular es una cifra redonda y la decisión real está en una condición escrita en otra página. Pasó hace dos días con el escalón de los 100.000 tokens de Claude Haiku 5.5, donde el 90 % de ahorro dependía de lo largo que fuera el prompt. Pasa aquí con un 6x que, para quien quiera cumplir desde Europa, es en realidad un 6,6x más una negociación comercial.
Lo que nos parece genuinamente nuevo no es la velocidad, es el mapa. Hasta el 29 de septiembre, pedir el nivel más rápido de OpenAI significaba aceptar procesamiento fuera de la UE. Desde el 8 de octubre, para un modelo concreto, ya no. Eso cambia la conversación con un cliente que tiene un encargado de protección de datos: deja de ser «no se puede» y pasa a ser «se puede, cuesta esto y requiere firmar aquello». Es un cambio pequeño en la documentación y grande en una reunión.
Y conviene no leerlo como una tendencia garantizada. Que Sol llegue a la UE no dice nada sobre cuándo llegará Astra, y la documentación no promete fechas. El contraste con lo que Google admite sobre dónde se guardan los datos de Gemini Notebook es útil justamente por eso: cada proveedor va a su ritmo y por producto, no por compañía.
Para un negocio que usa estas APIs a través de un asistente ya montado, la decisión práctica rara vez es «qué modelo» y casi siempre «qué nivel de servicio y en qué región», que es la parte que no sale en los anuncios. Es el mismo tipo de letra pequeña que condiciona cuánto cuesta de verdad un CRM conversacional y qué datos personales acaba guardando de cada conversación.
Cómo se ha verificado esto
Todas las páginas de developers.openai.com citadas se leyeron el 9 de octubre de 2026 con curl y agente de usuario de navegador, pidiendo la versión Markdown que ese dominio sirve al añadir .md a la URL. Respondieron 200: el registro de cambios, la ficha de GPT-6.1 Sol, la página de precios, la guía de modo Ultrafast, la guía de datos y la guía de límites de tasa. Ese dominio no se traduce al español, así que las citas son traducción propia desde el inglés.
El listado de novedades de OpenAI se barrió con curl sobre openai.com/news/rss.xml, que responde 200. Las páginas individuales de openai.com/index/ devuelven 403 a curl; las que se abrieron para descartarlas se leyeron con Chrome en modo headless, comprobando en el volcado que no hubiera desafío de Cloudflare. Ninguna de ellas se cita aquí: eran casos de cliente del propio fabricante.
La portada es una captura propia de la página de precios con la pestaña Ultrafast seleccionada, tomada el 9 de octubre de 2026 con Chrome en modo headless a 900 por 600 y factor de escala 2. Muestra las dos filas de la tabla y la nota del recargo del 10 %, que son las cifras que sostiene este artículo.
Las tarifas se contrastaron por dos vías que coinciden: la tabla de la página de precios y las frases de la ficha del modelo que expresan cada nivel como múltiplo del estándar. Las cifras en euros no existen: OpenAI publica estos precios en dólares y aquí se citan en dólares.

