Fast mode es una configuración de alta velocidad para Claude Opus que prioriza la velocidad de generación de tokens sobre el coste. No es un modelo distinto ni una versión con menos capacidad de razonamiento: es el mismo Opus, con la misma calidad, hasta 2.5x más rápido. La contrapartida es un coste por token significativamente mayor.
Funciona sobre Opus 5 y Opus 4.8. No está disponible en Sonnet, Haiku ni el resto de modelos. En Opus 4.7 se retiró el 24 de julio de 2026, así que cambiar a ese modelo apaga fast mode automáticamente.
Nota personal: en las tareas medianas con las que lo he probado la diferencia de velocidad se nota. Lo que me hace pensármelo no es el precio en sí, es de dónde sale: fast mode se cobra siempre de tus usage credits, aunque te quede cuota del plan. No es gastar antes lo que ya pagas, es facturar aparte desde el primer token.
Es importante no confundir fast mode con el ajuste de effort level. Bajar el effort level sí reduce la calidad de razonamiento a cambio de velocidad. Fast mode no sacrifica nada en calidad, solo en coste.
Resultado:
> /fast
Fast mode ON
Un icono ↯ se queda junto al prompt mientras fast mode esté activo.
Setup
1. Activa fast mode
Escribe /fast y pulsa Tab para alternar entre encendido y apagado:
/fast
2. Desactiva cuando no lo necesites
El mismo comando lo desactiva. Al desactivarlo sigues en Opus: no vuelve al modelo anterior. Para cambiar de modelo, /model.
3. Activa por defecto (opcional)
Para tenerlo siempre activo, añade a tu configuración de usuario:
{
"fastMode": true
}
4. O justo lo contrario, que cada sesión arranque apagada
Útil si abres muchas sesiones a la vez y no quieres que fast mode se cuele en todas:
{
"fastModePerSessionOptIn": true
}
Tu preferencia se guarda igual, así que quitando el ajuste vuelve el comportamiento persistente.
Actívalo al principio, no a mitad de conversación
La primera vez que enciendes fast mode en una conversación pagas, a precio de fast mode y sin caché, el input de todo el contexto acumulado hasta ese momento. Cuanto más avanzada esté la conversación, más caro sale ese primer instante. El cargo se aplica una vez por conversación, así que apagarlo y volverlo a encender más tarde no lo repite.
Requisitos
Necesitas las tres cosas a la vez:
- Suscripción (Pro/Max/Team/Enterprise) o Console de Anthropic. No funciona en Amazon Bedrock, Google Cloud Agent Platform, Microsoft Foundry ni Claude Platform en AWS.
- Usage credits activados en tu cuenta, que es lo que permite facturar por encima de lo incluido en tu plan. En cuentas individuales se activa en los ajustes de facturación de la Console.
- En Team y Enterprise, habilitación del Owner. Viene desactivado por defecto para la organización, y si no está habilitado
/fastrespondeFast mode has been disabled by your organization.
Referencia
| Aspecto | Detalle |
|---|---|
| Comando | /fast (Tab para alternar) |
| Modelos | Opus 5 y Opus 4.8 |
| Velocidad | Hasta 2.5x más rápido en tokens de salida |
| Coste | $10 / $50 por MTok (input / output), plano en toda la ventana de 1M |
| Facturación | Siempre desde usage credits, aunque te quede cuota del plan |
| Rate limits | Separados de Opus estándar y compartidos entre los modelos soportados; al agotarse cae a velocidad normal y el icono ↯ se pone gris hasta que pasa el cooldown |
| Persistencia | Se mantiene entre sesiones, salvo fastModePerSessionOptIn: true |
| Dónde no funciona | Extensión de VS Code |
| Estado | Research preview: la función, el precio y la disponibilidad pueden cambiar |
Cuando usarlo
- Iteración rápida: cambios de código donde esperar 30 segundos importa.
- Debugging en vivo: sesiones interactivas donde cada segundo cuenta.
- Trabajo con deadline: cuando la velocidad justifica el coste extra.
Para tareas autónomas largas, batch processing o CI/CD, el modo estándar es más eficiente en coste.
Documentación oficial: Speed up responses with fast mode