Uso real · 11–24 ago 2026
Con 187 millones de tokens, SuperGrok a 30$ sigue siendo el chollo
Si quieres el mismo Grok 4.6, no pases a API: te saldría ~580$/mes. Si te vale un modelo más barato, Pi + DeepSeek V4 Flash ronda los 15$/mes. Luna de OpenAI, ~37$. Qwen Max no gana.
Quédate en SuperGrok. Es Grok 4.6 a un precio que la API no puede tocar. Estás al 73–95% del pool semanal: justo, no roto.
Plus a 100$ (más pool, mismo modelo) o Pi + DeepSeek Flash a ~15$ para las tandas sucias y Grok para lo que importe.
La frase corta: no cambies de plan para ahorrar en Grok 4.6. El ahorro de verdad solo existe si aceptas otro modelo. El único más barato que 30$ con tu volumen es DeepSeek Flash por API, montado en Pi.
Tu mix, que es lo que mata las APIs caras
En 13 días de Build: 187,5 millones de tokens. Si sigues igual, ~433M al mes. No es “un chat”. Es un agente que reenvía el repo.
- Input fresco (sin cache): 19,2M
- Cache hit: 166,9M · 90% del input
- Output (incluye reasoning): 1,5M
- Mediana de prompt: 204k tokens. El 94% del volumen va en turnos de 200k o más.
Ese 90% de cache es el dato. Quien cobre el cache barato gana. Quien cobre el prompt largo el doble (Grok API a partir de 200k) pierde feo.
Mismo volumen, distinto sitio
Los $/mes son tu mix de 13 días × 30/13. Los planes fijos no se multiplican: es lo que pagas, con tope.
| Opción | $/mes | Nota |
|---|---|---|
| SuperGrok (lo que pagas) | 30 | Grok 4.6. Pool semanal casi lleno. |
| Pi + DeepSeek V4 Flash | 15–29 | Off-peak 15$. Peak 29$. Lo único más barato. |
| Pi + GPT-5.6 Luna | 37 | El “GPT barato” que preguntabas. OpenAI, no flagship. |
| Pi + Qwen 3.8 27B (Chutes) | 43 | Output a 3$/M se come el ahorro. El 27B piensa caro. |
| Pi + DeepSeek V4 Pro | 45–89 | Más capaz que Flash. Sigue barato por el cache. |
| SuperGrok Plus | 100 | Más pool, mismo Grok 4.6. Si el 30$ te corta. |
| Claude Code Max 20× | 200 | Tope cada 5 h + semanal. Tu ritmo lo rompe. |
| Cursor Ultra | 200 | Pool ~400$ de API. Tu mix Grok ya son 580$. |
| Pi + Claude Sonnet 5 API | 200 | Sin techo de 5 h, pero 7× SuperGrok. |
| Pi + Qwen 3.8 Max | 206 | Flagship de Alibaba. No gana al plan de 30$. |
| Pi + GPT-5.6 Terra | 374 | OpenAI “medio”. Caro para este mix. |
| Grok 4.6 por API | 579 | 19× lo que pagas ahora. El acantilado de 200k te parte. |
| Pi + GPT-5.6 Sol / GPT-5.5 | 729–935 | Flagship OpenAI. Absurdo con 90% cache de agente. |
DeepSeek: peak 01:00–04:00 y 06:00–10:00 UTC, lun–vie (en Madrid, madrugada y mañana). Tú picas sobre todo tarde/noche, así que casi todo cae off-peak. Luna usa tarifa larga en el 94% del volumen. Grok API también: 149/295 turnos ≥200k, pero son el 94% de los tokens.
Por qué 30$ de SuperGrok machaca a la API de Grok
xAI cobra Grok 4.6 a 2/0,50/6 $ por millón si el prompt va por debajo de 200k. En 200k o más, todo el request pasa a 4/1/12. Tu mediana es 204k. El 94% de tus tokens pagan el doble.
Eso son 251$ en 13 días, 579$/mes. El plan de 30$ te está dando el mismo modelo a ~5 céntimos por dólar de API. Por eso “pasar a API para controlar el gasto” aquí es al revés.
DeepSeek Flash cobra el cache a 0,007$/M off-peak. Grok API, a 0,50–1,00$. Con 167M de cache, esa columna sola son ~1$ en DeepSeek y 83–159$ en Grok API.
Pi no es un plan
Pi es un arnés de terminal gratis (Earendil). Pagas el modelo: Claude/ChatGPT por /login, o una API key (DeepSeek, OpenAI, OpenRouter, lo que sea). El ahorro está en la key, no en Pi.
Montar Pi + DeepSeek V4 Flash es la única ruta que, en tokens, sale más barata que SuperGrok. El pero: no es Grok 4.6. Flash es el modelo rápido de DeepSeek. Pro (45–89$) se acerca más y sigue por debajo de Plus.
Luna es gpt-5.6-luna, el piso de OpenAI (0,20/0,02/1,20 $ por millón en corto; el doble en largo). Con tu mix: 37$/mes. Más caro que SuperGrok, más barato que Terra/Sol. Útil si quieres OpenAI en el agente, no si quieres ahorrar respecto a los 30$.
Qwen 3.8-Max oficial: 2/0,25/6. 206$/mes. El 27B en Chutes: 43$, pero el thinking se cobra como output a 3$/M y este modelo piensa por defecto. En un agente se hincha.
Lo que no haría
- Alquilar una 4090 para el 27B. En el estudio del 17 ago tenía sentido para jornadas de 32–64k. Tu mediana es 204k y hay turnos de 5M. Esa GPU no te aguanta el contexto.
- Claude Pro a 20$ o Max 5× a 100$. Te los comes en un día pesado. Max 20× a 200$ es el mismo orden que Sonnet por API, con ventanas de 5 h.
- Cursor Ultra a 200$. El pool extra son ~400$ de API. Tu equivalente Grok ya son 580$.
- Salirte de SuperGrok para pagar Grok 4.6 por API. 579$ vs 30$.
Si el pool semanal de 30$ te deja tirado un jueves, el siguiente paso de xAI es SuperGrok Plus a 100$. Heavy está por encima (la landing no publica el número; facturas raras de “Heavy anual” salen en el FAQ de xAI). No lo necesitas para ahorrar. Es más pool, no menos precio.
Fuentes, 24 ago 2026
- x.ai/pricing · SuperGrok 30$, Plus 100$
- docs.x.ai/developers/pricing · Grok 4.6 API y el acantilado de 200k
- DeepSeek pricing · V4 Flash/Pro, peak/off-peak desde el 16 ago
- OpenAI pricing · gpt-5.6-luna / terra / sol
- OpenRouter Qwen 3.8 27B · Chutes 0,40 / 3,00 / cache 0,04
- OpenRouter Qwen 3.8 Max · 2 / 6 / cache 0,25
- Claude pricing · Pro 20$, Max 5× 100$, Max 20× 200$
- Claude API · Sonnet 5 a 2/10 (intro, ahora estándar)
- Cursor pricing · Pro 20$, Pro+ 60$, Ultra 200$
- pi.dev · el arnés, no el modelo
Los 187,5M salen de los turn_completed de ~/.grok/sessions en este VPS. No incluye grok.com / Imagine / Voice ni julio. Subagentes: solape máximo ~0,7M. El número se mueve si sigues picando.