GLM 5.3 Flash vs DeepSeek V4 Flash: cuál te conviene según tu caso
Dos laboratorios acaban de poner IA casi de frontera a 35 veces menos que el precio premium
En las últimas semanas, DeepSeek y Z.ai lanzaron dos modelos que cuestan $0.14 por millón de tokens. Los modelos premium en esa misma banda de inteligencia empezaban alrededor de $5. Es una diferencia de 35 veces, y cambia lo que un equipo pequeño puede construir.
Uso ambos modelos en producción. No en una demo ni en un script de benchmarks: todos los días, en tareas reales. Y lo interesante no es el precio. Es lo distinto que es la forma en que cada uno lo gana.
El marcador: lo que dicen las pruebas independientes
Aquí importa la fuente. Los números de DeepSeek fueron medidos por terceros hace semanas. Z.ai publicó los suyos el día del lanzamiento (26 de agosto) y la confirmación independiente aún está pendiente.
El detalle: promesas vs recibos
Ambos son modelos mixture-of-experts de unos 300B de parámetros totales con menos de 20B activos por token. Ambos leen un millón de tokens de contexto. La diferencia está en la evidencia.
DeepSeek salió el 31 de julio y sus números principales (79.0 en SWE-bench Verified, 91.6 en LiveCodeBench, 82.7 en Terminal-Bench) fueron reproducidos por evaluadores independientes. El 57 de GLM 5.3 Flash es una afirmación del día de lanzamiento, hecha por la empresa que vende el modelo. Puede sostenerse. La comunidad lo probó en secreto durante semanas antes del lanzamiento bajo un nombre en clave, y los scores independientes están en camino. Hasta entonces, trata el 57 como "probablemente genial" y el 50 como "hecho medido".
Hay también una variable de costo escondida: la verbosidad. Los tokens de razonamiento de DeepSeek están medidos en 25-45% de la salida, lo que mantiene su tarifa barata realmente barata. Nadie ha medido aún la expansión de tokens de GLM, y un modelo parlanchín convierte una tarifa baja en una tarea cara.
Dónde gana cada modelo
- Rendimiento de código verificado. Los scores independientes existen y son fuertes.
- Costos predecibles. Mismo precio desde julio, verbosidad medida, ~$0.03 por tarea de benchmark.
- Agentes que funcionan. Re-entrenado específicamente para uso de herramientas en producción.
- Imágenes y video. El único de los dos con entrada multimodal nativa.
- El precio más bajo. Descuento de lanzamiento: $0.07 entrada / $0.22 salida por 1M. Temporal.
- Los mejores scores en papel. Mejor puntaje compuesto y de agentes ahora mismo.
La decisión en 30 segundos
¿Un chatbot o asistente de código? DeepSeek V4 Flash. Medido, estable, barato en cargas reales.
¿Procesar documentos con imágenes o capturas de pantalla? GLM 5.3 Flash. Visión nativa en el mismo rango de precio.
¿Un pipeline sensible al costo a gran volumen? DeepSeek. Su costo por tarea está probado; el de GLM sigue siendo una suposición.
¿No estás seguro? Ambos tienen pesos abiertos bajo MIT. Pruébalos en tus propias tareas antes de comprometer un dólar.
Qué significa esto para tu sitio web
Si estás agregando un chatbot con IA, un agente o automatización a tu sitio, la elección del modelo ya es una decisión de costo operativo, no de presupuesto inicial. Un bot de soporte que maneja 10,000 conversaciones al mes cuesta unos pocos dólares con estas tarifas. Ese mismo nivel de inteligencia costaba cientos el año pasado.
La guerra de precios no se detiene. Cubrimos lo que los recortes de agosto significan para tu sitio y cómo funciona el precio por tokens en la práctica en dos posts recientes.
Y si quieres saber qué le falta a tu sitio actual antes de agregarle IA, corre la auditoría gratuita: toma segundos y muestra exactamente qué arreglar primero.
¿Listo para crecer?
Recibe un análisis gratis de tu sitio web con IA. Sin compromiso.