Reseña de Grok 4.6: lo que dice la tabla de evaluación cuando lees las filas perdedoras

Alicia Kirana Utomo
Escrito por

Alicia Kirana Utomo

Katelin Teen
Revisado por

Katelin Teen

Última edición August 12, 2026

Verificado por expertos
Ilustración dibujada a mano con el logotipo de Grok y una tarjeta de puntuación con calificaciones de estrellas mixtas en distintas categorías

Resumen

Grok 4.6 es real. Obtiene 61 puntos en el Artificial Analysis Intelligence Index, empatando con GPT-5.6 Sol y quedando dos puntos por detrás de Claude Opus 5, mientras cobra $2/$6 por millón de tokens frente a los $5/$30 de Sol. En relación precio-inteligencia es la mejor oferta de la frontera ahora mismo, y no creo que sea ni de lejos disputable.

Pero la propia tabla de evaluación de xAI tiene diez filas, y el marketing solo lee las que gana. Grok 4.6 pierde en DeepSWE por 7,1 puntos y en Terminal-Bench v3.0 por 8,6 puntos, ambas frente a GPT-5.6 Sol. Donde realmente gana es en trabajo de conocimiento: el mejor de la tabla en GDPVal-AA, AA-Briefcase y la evaluación legal Harvey. Este es un modelo de trabajo de conocimiento que se anunció como un modelo de código.

La fila que nadie imprimió es la que más me importa. Artificial Analysis midió su tasa de no alucinación en 65,7%. Construyo agentes de IA en eesel, y he visto lo que hace ese tercio cuando llega a un cliente real. Una base de conocimiento que dice "damos soporte a todos los modelos" se convierte en una IA que le dice con total confianza a un conductor que damos soporte a su coche. Mejores benchmarks no arreglan eso. Un límite de recuperación y una puerta de confianza sí.

Elige tu carga de trabajo y luego lee el veredicto

Lo más útil que puedo darte no es otra tabla de benchmarks. Es la respuesta a "¿esto me aplica a mí?". El veredicto de Grok 4.6 cambia por completo según lo que estés construyendo.

Lo que realmente cambió desde Grok 4.5

xAI lanzó Grok 4.6 el 12 de agosto de 2026, unas cinco semanas después de Grok 4.5. Cinco semanas es un ritmo rápido, y se nota en lo que cambió y lo que no.

La historia del entrenamiento es inusualmente sincera. xAI dice que ejecutó una fase de entrenamiento suplementario más larga que la de 4.5, y luego usó el propio Grok 4.5 para regenerar las trayectorias de SFT a través de niveles de razonamiento y entornos de agentes, filtrando trazas malas con comprobaciones basadas en modelos. En otras palabras, el modelo anterior enseñó a este, y la etapa de RL se dirigió a tareas agénticas: optimización de kernels, desarrollo web, diseño asistido por ordenador.

La ficha técnica apenas se movió. Según la página del modelo grok-4.6, el contexto se mantiene en 500.000 tokens, el modelo acepta texto e imagen como entrada y produce texto, con llamadas a funciones, salidas estructuradas y razonamiento. Los límites de tasa son 150 solicitudes por segundo y 50M de tokens por minuto, en us-east-1 y us-west-2.

Lo que sí se movió fueron las puntuaciones. Artificial Analysis lo sitúa en 61 puntos en el Intelligence Index, 5 puntos más que Grok 4.5 y 23 más que Grok 4.3. Cinco puntos en cinco semanas es un salto generacional real, no un simple cambio de número de versión.

Leer bien la tabla de evaluación

Una ilustración de una persona examinando las dos filas cortas de una tarjeta de puntuación mientras tres filas más largas están encima
Una ilustración de una persona examinando las dos filas cortas de una tarjeta de puntuación mientras tres filas más largas están encima

A continuación está la propia tabla de xAI. La encuentro más reveladora que el post del blog que la envuelve. El negrita es el ganador de cada fila.

EvaluaciónGrok 4.6 HighGrok 4.5 HighGPT-5.6 Sol MaxFable 5 Max
AA Intelligence Index61566162
GDPVal-AA v21753152617281741
CursorBench v3.269,9%66,7%67,2%70,5%
DeepSWE v1.165,9%54%73%70%
FrontierCode v1.1 (Extended)61,3%56,6%60,6%63,6%
APEX-Agents57,5%47,1%56,7%59,2%
Terminal-Bench v3.026%15,7%34,6%34,1%
APEX-SWE56,4%53,6%58,8%
AA-Briefcase1577131315021574
Harvey LAB (Vals)15,8%12,9%2,5%11,3%

Cuatro cosas destacan.

Grok 4.6 gana en las filas de trabajo de conocimiento y pierde en las de ingeniería de software. Se lleva GDPVal-AA, AA-Briefcase y Harvey LAB de forma directa. Pierde en DeepSWE por 7,1 puntos y en Terminal-Bench por 8,6. Para un post de lanzamiento titulado en torno a la codificación agéntica, es una forma curiosa.

El número de Harvey es la celda más extraña de la tabla. Grok 4.6 obtiene 15,8% en el benchmark de análisis legal frente al 2,5% de GPT-5.6 Sol. Una brecha de 6 veces en un solo eval suele significar que el eval mide algo muy específico, o que un modelo se ajustó para ese tipo concreto de tarea. Yo no construiría un producto legal sobre una sola fila, pero vale la pena saberlo.

Terminal-Bench tiene dos números de versión activos y no coinciden en absoluto. La ficha de xAI reporta 26% en v3.0. Artificial Analysis reporta 88,4% en v2.1 y lo llama en línea con los modelos líderes. Ambos son ciertos. v3.0 es la revisión más difícil. Si ves una cifra de Terminal-Bench citada sin versión, no te está diciendo nada.

Los saltos de 4.5 a 4.6 son mayores justo donde viven los agentes. DeepSWE pasó de 54% a 65,9%. APEX-Agents de 47,1% a 57,5%. AA-Briefcase de 1313 a 1577. Sea lo que sea que hizo la etapa de RL agéntica, funcionó en las tareas que se ejecutan durante muchos pasos.

Una fila más de la tabla que no está en el gráfico de xAI. Artificial Analysis mide 𝜏³-Banking, un eval de atención al cliente multiturno con uso de herramientas, y Grok 4.6 obtiene 50,7%. Eso lo coloca entre los dos primeros junto a Qwen3.8 Max con 51,3%. Volveré a esa cifra, porque estar entre los dos primeros resulta significar menos de lo que parece.

Velocidad y coste, medidos en lugar de proclamados

Aquí es donde Grok 4.6 hace su argumento más fuerte, y en realidad no es un argumento de benchmark.

El precio de lista no cambia respecto a Grok 4.5: $2,00 por 1M de entrada, $0,50 en caché, $6,00 de salida, según la página de precios de xAI. Al superar los 200k tokens de prompt, todas las tarifas se duplican a $4,00 / $1,00 / $12,00. Mantener el precio estable a lo largo de una generación es inusual en la frontera, y Artificial Analysis lo dice explícitamente.

La comparación que importa es con modelos a dos puntos del índice. Claude Opus 5 cuesta $5/$25. GPT-5.6 Sol cuesta $5/$30. Grok 4.6 empata con Sol a una quinta parte de la tarifa de salida, y la tarifa de salida domina el coste en trabajo con mucho razonamiento.

Medido en lugar de listado, en la página de Grok 4.6 de OpenRouter, el panorama se mantiene:

MedidaxAI estándarxAI (ZDR)
Entrada efectiva pagada$0,7249/M$0,7812/M
Salida efectiva pagada$6,125/M$6,116/M
Tasa de aciertos de caché90,3%88,0%
Rendimiento (media 3 días)94 tok/s92 tok/s
Latencia (media 3 días)0,62s0,96s
Tasa de error en llamadas a herramientas0,08%0,02%
Tasa de error en salidas estructuradas4,00%0,00%

Dos de esas merecen una segunda mirada. El precio efectivo de entrada es $0,72, no $2, porque el tráfico real acierta en caché el 90% de las veces. Y la tasa de error de salidas estructuradas del 4,00% en el endpoint estándar frente al 0,00% en el endpoint ZDR es una diferencia operativa real, no un artefacto de redondeo. Si estás fijando esquemas JSON para llamadas a herramientas, prueba ambos.

Artificial Analysis situó la factura de todo el índice en $1.068,47 para evaluar Grok 4.6, lo que da $0,84 por tarea, lo mismo que Kimi K3 con una inteligencia ligeramente menor. Generó 72M de tokens haciéndolo, frente a una mediana de 71M, así que es un poco más verboso pero no de forma exagerada.

La única línea que se movió en contra de los compradores es la entrada en caché, y la comunidad lo detectó en cuestión de horas:

Hacker News

"Seems the cache read pricing almost doubled from $0.30 in Grok 4.5 to $0.50 in Grok 4.6. In my experience in heavy coding sessions most pricing is just cache read and cache write like 80% of my token bill."

Es una observación justa y la aritmética es correcta. Es un aumento del 67% en la partida que domina las sesiones largas de agentes. También sigue siendo una entrada en caché de $0,50 en un modelo que empata con GPT-5.6 Sol, así que yo lo llamaría un retroceso real dentro de un trato que sigue siendo excelente. Nuestra guía de precios de xAI tiene la escala completa.

Lo que dicen quienes realmente lo están probando

Los benchmarks son un dato de entrada. A continuación, cómo fue el primer día de uso real. Elegí informes con números en lugar de impresiones.

El dato más útil que encontré fue una comparación directa a través de la misma función en la misma base de código:

Hacker News

"Tested both DS v4 pro 0813 and Grok 4.6 (all from openrouter) on Codex cli. Worked on a same new feature development on my project. Deepseek 4 pro: Worked for 12m 02s, cost $0.12, has bug. Grok 4.6: Worked for 3m 18s, cost $1.41, no bug."

Eso es 3,6 veces más rápido y 11,75 veces más caro, con un resultado funcional frente a uno roto. Es una sola prueba de una persona, así que trátalo como una señal y no como un hallazgo, pero captura el trade-off real frente a un modelo barato de pesos abiertos como DeepSeek V4 Flash mejor que cualquier puntuación de índice.

El tema de la velocidad se repitió:

Hacker News

"I used to be a Claude user. Since trying Grok 4.5 and especially Grok 4.6, I don't want to go back to Claude any more (I have early access to 4.6). Grok is 3x+ faster than Claude and I can't tell the diff in engineering work quality. As an engineer, speed is important to me."

Y un ingeniero describió el cambio de flujo de trabajo con precisión, que es el tipo de detalle que me hace confiar en un informe:

Hacker News

"My go-to workflow was Sol for planning and Grok for building. But my in my first tests with Grok 4.6, I found it quite good and I'll start using it for both; assuming it's as good at is shows at benchmarks it's unbeatable at cost/time."

También hubo escepticismo, y en su mayoría giró en torno a si el índice mide lo correcto:

Hacker News

"I haven't tried so it's pure speculation based on benchmarks, but I'd assume Grok 4.6 is around Opus 4.8 in real world use, but clearly below Opus 5."

Es una suposición razonable. La paridad en el índice y la paridad en el uso real son afirmaciones distintas, y la respuesta honesta un día después del lanzamiento es que nadie tiene aún suficientes horas de uso. Lo que sí puedo decir es que el argumento del precio por unidad de inteligencia no depende de resolver ese debate.

La fila que el post de lanzamiento dejó fuera

Una ilustración de un agente de soporte mirando hacia dos burbujas de diálogo igualmente confiadas, una sólida y otra hueca con un signo de interrogación dentro
Una ilustración de un agente de soporte mirando hacia dos burbujas de diálogo igualmente confiadas, una sólida y otra hueca con un signo de interrogación dentro

La tabla de evaluación de xAI tiene diez filas y ninguna trata sobre equivocarse. Artificial Analysis mide precisamente eso, y esas son las cifras que yo pondría en lo más alto de la página si estuviera escribiendo el post de lanzamiento.

Precisión de AA-Omniscience: 48,2%. Tasa de no alucinación: 65,7%.

Lee la segunda con cuidado, porque es fácil malinterpretarla como "alucina el 34% de las veces". Es la tasa de evitar una alucinación entre las respuestas que no fueron correctas. Así que cuando Grok 4.6 no sabe algo, lo dice unas dos de cada tres veces, e inventa una respuesta la otra vez. El benchmark existe precisamente porque negarse a responder no debería penalizarse igual que estar confiadamente equivocado.

Para un agente de código, una respuesta equivocada la atrapa una prueba. Para un agente de cara al cliente, una respuesta equivocada se envía.

Construyo agentes de IA en eesel, y he visto este exacto patrón de fallo en producción más de una vez. Uno en el que pienso a menudo: un equipo europeo de telemática de vehículos que usa Zendesk, con unos 200 tickets al mes y creciendo hacia 2.000, descubrió que su agente confirmaba alegremente soporte para marcas de coche que no estaban en ninguna parte de su base de datos. La IA no había fallado. Su centro de ayuda decía "damos soporte a todos los modelos", y el modelo lo creyó. Su ingeniero resumió las primeras semanas como prueba y error, que es la descripción más honesta que he escuchado sobre desplegar un modelo en bruto.

Eso es una tasa de no alucinación del 65,7% encontrándose con una base de conocimiento escrita para humanos. Nada en el entrenamiento de Grok 4.6 lo arregla. Lo que lo arregla es acotar de dónde puede extraer información el modelo, y controlar qué se le permite enviar.

Entonces, ¿deberías poner Grok 4.6 detrás de una cola de soporte?

Pregunta justa. La respuesta honesta tiene dos partes, y apuntan en direcciones distintas.

Como motor, es una elección legítimamente buena. 50,7% en 𝜏³-Banking es top dos entre todo lo que ha probado Artificial Analysis, y 𝜏³-Banking es el benchmark público más cercano a lo que realmente hace un agente de soporte: multiturno, con uso de herramientas, de cara al cliente. Una tasa de error en llamadas a herramientas del 0,08% y 94 tok/s significan que no se atascará a mitad de conversación. A $2/$6, la economía unitaria de la automatización de tickets de soporte se ve bien.

Como producto, no lo es. Estar entre los dos primeros en atención al cliente significa que resuelve aproximadamente la mitad de esas conversaciones. La otra mitad es donde vive el trabajo real: saber cuándo parar, cuándo pasar a un humano, qué macro disparar, qué búsqueda de pedido ejecutar, y qué nunca prometer. Nada de eso es una capacidad del modelo. Es diseño de escalado, alcance de recuperación, y un umbral de puntuación de confianza que ajustaste con tu propio historial.

Digo esto como alguien cuyo equipo pierde negocios exactamente por este razonamiento. Varios clientes de eesel se han ido a construir directamente sobre una API de modelo de frontera, y es la alternativa competitiva más común que vemos de equipos técnicos. A veces funciona. Lo que normalmente los hace volver no es la calidad del modelo, es el segundo mes: nadie quiere hacerse cargo de las reglas de triaje de tickets, la deriva de la voz de marca, los permisos de la base de conocimiento, y una rotación de guardia para un chatbot.

Si estás eligiendo un modelo esta semana, Grok 4.6 pertenece a la lista corta junto a Claude Opus 5 y GPT-5.6. Si estás decidiendo cómo responder a los clientes, el modelo es la decisión menos interesante que tomarás.

¿Quieres un modelo de frontera en tu helpdesk sin el segundo mes?

La vista de informes de eesel AI mostrando el volumen de tareas, eventos disparadores por tipo, y el uso de aprobaciones por herramienta
La vista de informes de eesel AI mostrando el volumen de tareas, eventos disparadores por tipo, y el uso de aprobaciones por herramienta

Esta es la parte que una API en bruto no puede darte. Antes de que eesel responda un solo ticket en vivo, reproduce tu agente sobre tus propios tickets históricos y te muestra lo que habría dicho, con tus datos, con tu base de conocimiento y sus lagunas incluidas. Así, la pregunta del 65,7% deja de ser un benchmark y se convierte en un número que realmente mediste, en tu cola, antes de que un cliente lo viera jamás. Conecta un helpdesk, observa la simulación, y luego decide. Prueba eesel, gratis.

Veredicto

Cómpralo si estás ejecutando sesiones agénticas largas de trabajo de conocimiento, investigación, análisis o tareas cargadas de documentos, y el coste importa. Las mejores puntuaciones de la tabla en GDPVal-AA y AA-Briefcase a $2/$6, terminando tareas en la mitad de turnos que Claude Opus 5, es una combinación difícil de rebatir. Cómpralo también si la pura velocidad cambia tu flujo de trabajo. Varios ingenieros reportaron de forma independiente 3x, y uno midió 3m 18s frente a 12m 02s en la misma tarea.

Sáltalo si tu carga de trabajo es ingeniería de software autónoma u operaciones intensivas en terminal. DeepSWE 65,9% frente al 73% de Sol, y Terminal-Bench v3.0 en 26% frente a 34,6%, no son decisiones ajustadas, y son las propias cifras publicadas por xAI.

Ten cuidado si va a estar de cara al cliente. Es uno de los dos mejores modelos en el benchmark de atención al cliente, y aun así falla en la mitad de esas conversaciones, con una tasa de no alucinación del 65,7% por debajo. Eso no es un problema de Grok, todo modelo de frontera tiene su propia versión de esta fila. Es una razón por la que la capa de helpdesk importa más que la elección del modelo.

Mi valoración general: la mejor relación precio-inteligencia de la frontera a agosto de 2026, mal etiquetado como un lanzamiento de código cuando su verdadera fortaleza es el trabajo de conocimiento. Cinco puntos de ganancia en el índice en cinco semanas con precios estables es la historia, y el aumento en la tasa de caché es el asterisco.

Si quieres el conjunto de comparación más completo, empieza con alternativas a Grok 4.5 y lee después la reseña de Claude Opus 5.

Para la matemática de tokens por sí sola, la escala de precios de xAI profundiza más que esta reseña.

Preguntas frecuentes

¿Es bueno Grok 4.6? ¿A qué conclusión llega esta reseña de Grok 4.6?
Es un modelo de frontera real y ahora mismo la mejor relación precio-inteligencia en lo más alto de la tabla. Obtiene 61 puntos en el Artificial Analysis Intelligence Index, a la par de GPT-5.6 Sol, a $2/$6 frente a los $5/$30 de Sol. La advertencia en esta reseña de Grok 4.6 es que sus victorias se concentran en trabajo de conocimiento, no en ingeniería de software pura. Si estás eligiendo un modelo para poner detrás de una cola de soporte, la lógica de la preselección en nuestra guía de el mejor agente de IA para atención al cliente importa más que la puntuación del índice.
¿Cómo se compara Grok 4.6 con Grok 4.5?
Gana 5 puntos en el Intelligence Index, de 56 a 61, unas cinco semanas después de que se lanzara Grok 4.5. Los saltos más grandes están en las evaluaciones agénticas: DeepSWE pasa de 54% a 65,9%, APEX-Agents de 47,1% a 57,5%, y AA-Briefcase de 1313 a 1577. Los precios por token se mantienen idénticos. Para los números del modelo anterior, consulta nuestra reseña de Grok 4.5 y el desglose de precios de Grok 4.5.
¿Cuánto cuesta ejecutar Grok 4.6?
$2,00 por 1M de tokens de entrada, $0,50 en caché, y $6,00 de salida según la página de precios de xAI, que se duplica a $4/$1/$12 al superar los 200k tokens de prompt. Artificial Analysis gastó $1.068,47 evaluándolo en todo el índice, a $0,84 por tarea. La escala completa está en nuestra guía de precios de xAI, y para los equipos de soporte el número que realmente importa es el coste por resolución.
¿Alucina Grok 4.6?
Sí, y el post de lanzamiento no lo menciona. Artificial Analysis midió una precisión de AA-Omniscience del 48,2% y una tasa de no alucinación del 65,7%, lo que significa que aproximadamente un tercio de sus respuestas incorrectas son invenciones confiadas en lugar de admitir que no lo sabe. Esa es la razón por la que un modelo en bruto necesita un límite de recuperación. Nuestra guía para prevenir alucinaciones en soporte y el artículo sobre mantener honesto a un agente de soporte cubren ambos la solución.
¿Es bueno Grok 4.6 para atención al cliente?
Sobre el papel es uno de los dos mejores modelos probados en atención al cliente multiturno, con un 50,7% en 𝜏³-Banking. Pero léelo de nuevo: estar entre los dos primeros significa que sigue fallando en la mitad de esas conversaciones. Grok 4.6 es un motor razonable, pero no es un producto de soporte por sí solo, por lo que las reglas de escalado y una puerta de puntuación de confianza hacen más por la tasa de resolución que el cambio de modelo. Consulta IA para atención al cliente para el panorama completo.
¿Dónde puedo usar Grok 4.6?
Se lanzó simultáneamente en la API de xAI, Grok Build y Cursor, además de OpenRouter, Vercel y Cloudflare. Cursor y Grok Build ofrecieron el doble de uso incluido durante la semana de lanzamiento. Nuestras páginas de precios de Cursor y reseñas de Cursor cubren ese lado, y Grok Bot cubre el producto de agentes independiente de xAI.
¿Cuál es la ventana de contexto de Grok 4.6?
500.000 tokens, sin cambios respecto a Grok 4.5, según la página del modelo grok-4.6. La trampa es que todas las tarifas se duplican en cuanto una solicitud supera los 200k, así que la ventana de contexto realmente utilizable al precio de lista es de 200k. Los hilos de tickets largos rara vez se acercan a eso, pero una base de conocimiento completa metida en un prompt sí, lo cual es un argumento a favor de la recuperación frente a la fuerza bruta.
¿Qué alternativas debería comparar con Grok 4.6?
Claude Opus 5 lidera el índice con 63, Claude Fable 5 se sitúa en 62, y GPT-5.6 Sol empata con Grok en 61. Por debajo, Kimi K3 iguala su $0,84 por tarea, y Qwen3.8 Max lo superó en herramientas de atención al cliente. Empieza con alternativas a Grok 4.5 o la lista más amplia de alternativas a xAI.

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Ilustración dibujada a mano de tres personas comparando fichas de puntuación de modelos junto a una balanza que pesa el coste frente a una lista de verificación
Trending

Alternativas a Grok 4.6: 7 modelos comparados según la forma de la factura

Grok 4.6 cuesta 2 $/6 $, y duplica cada tarifa en cuanto una solicitud supera los 200k tokens. Comprobé lo que cobran realmente siete alternativas, y cuáles eliminan ese precipicio en lugar de simplemente moverlo.

Alicia Kirana UtomoAlicia Kirana UtomoAug 13, 2026
Ilustración de un compañero de IA en un portátil siendo revisado por dos colegas con una lista de verificación y una lupa, con el logo de Grok a la izquierda
Trending

Análisis de Grok Bot: qué funciona de verdad en la beta temprana

Grok Bot le da a cada compañero de IA un ordenador en la nube y credenciales reales. Revisé todas las páginas de la documentación y la primera semana de informes de usuarios para ver qué funciona de verdad.

Rama Adi NugrahaRama Adi NugrahaAug 13, 2026
Ilustración de dos personas revisando una pila de capas de coste, puestos arriba y consumo de tokens abajo, con el logo de Grok a la izquierda
Trending

Precios de Grok Bot 2026: el plan de 200 $ y el medidor sin límite

Grok Bot se vende a 200 $ al mes o 120 $ por puesto, pero el precio de venta es solo la cuota de entrada. La documentación dice que todavía no hay tope de gasto, y el medidor corre semanalmente.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 13, 2026
Precios de Grok 4.6 en 2026: cada tarifa y lo que los equipos pagan de verdad
Trending

Precios de Grok 4.6 en 2026: cada tarifa y lo que los equipos pagan de verdad

Grok 4.6 tiene un precio de lista de 2,00 $ de entrada y 6,00 $ de salida por millón de tokens. El precio efectivo de entrada medido por OpenRouter es de 0,74 $. Aquí está cada partida de la factura y por qué puerta conviene comprar.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 13, 2026
Ilustración de un compañero de IA trabajando en un escritorio junto a dos colegas, con iconos de herramientas arriba y el logo de Grok a la izquierda
Trending

Grok Bot explicado: qué hacen en realidad los compañeros de IA siempre activos de xAI

Grok Bot le da a cada compañero de IA su propio ordenador en la nube y lo conecta a tus herramientas reales. Así funciona, esto cuesta, y aquí se rompe el diseño.

Alicia Kirana UtomoAlicia Kirana UtomoAug 12, 2026
Ilustración lineal de un desarrollador y un agente de soporte hablando a través de ondas de voz, junto al logo de Grok
Trending

Precio de Grok Voice Think Fast 2.0: qué cuesta $0.08/min

Grok Voice Think Fast 2.0 cuesta $0.08 por minuto de audio, un 60% más que 1.0. El alias grok-voice-latest cambia a él hoy mismo, así que aquí va la matemática real por llamada.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Ilustración lineal de un desarrollador y un agente de soporte hablando a través de ondas de voz, junto al logo de Grok
Trending

Precios de Grok Voice Think Fast 2.0: qué cuesta $0.08/min

Grok Voice Think Fast 2.0 cuesta $0.08 por minuto de audio, un 60% más que 1.0. El alias grok-voice-latest cambia a él hoy, así que aquí está el cálculo real por llamada.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Ilustración de línea de un agente de soporte con auriculares junto al logo de Grok, con una forma de onda de voz en un globo de diálogo
Trending

Grok Voice Think Fast 2.0: qué cambió y cuánto cuesta

Grok Voice Think Fast 2.0 obtiene 82.9% en el índice speech-to-speech de Artificial Analysis y responde en 0.70s. También cuesta un 60% más por minuto, y el alias por defecto pasa a él el 5 de agosto.

Rama Adi NugrahaRama Adi NugrahaAug 4, 2026
Ilustración editorial con el logo de Grok, barras de benchmarks y una etiqueta de precio que representa un análisis de Grok 4.5
Trending

Análisis de Grok 4.5: benchmarks, precios y el veredicto

Grok 4.5 de xAI se lanzó el 8 de julio con un puesto #4 en el Intelligence Index y el mejor resultado de uso de herramientas agenticas de la tabla. Aquí está el análisis real, los benchmarks, los precios y quién debería usarlo realmente.

Rama Adi NugrahaRama Adi NugrahaJul 9, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis